Кевин Роуз: агенты ИИ — «очень умные, обаятельные социопаты»

Мир просыпается от понимания потенциальных угроз, связанных с искусственным интеллектом, на фоне множества сообщений о том, что AI‑агенты ставят под сомнение контроль своих создателей. На самом деле история уходит корнями в Кремниевую долину, где зародился искусственный интеллект. Как же мы пришли к этому? На этот вопрос пытается ответить технологический журналист Кевин Рус в своей новой книге «The AGI Chronicles: The Inside Story of the Race to Create an Artificial Superintelligence», выход которой намечен на 6 октября. Книга фиксирует гонку между некоторыми крупнейшими технологическими компаниями страны за разработку искусственного общего интеллекта (AGI) — AI, который во многих отношениях обладает интеллектом на уровне человека.

«Что произошло в течение десятилетия, когда AI из достаточно глупого в большинстве задач превратился в то, что может решать столетние математические и научные задачи?» — сказал Рус, ранее долгое время работавший технологическим репортером в The New York Times и вскоре ставший со‑ведущим подкаста «Machine Gods», в разговоре с CBS News. «Мне показалось, что кто‑то должен это записать».

Книга выходит в критический момент. Последние генеративные модели AI демонстрируют поразительные способности; сторонники технологии утверждают, что она откроет путь к важным новым открытиям. Другие, в том числе некоторые ведущие разработчики AI, считают, что существует немалый шанс того, что AI может уничтожить человечество. Рус рассказал CBS News о своей новой книге и о том, как AI может трансформировать общество. Интервью отредактировано в целях краткости и ясности.

Почему вы сочли важным задокументировать происхождение «large language models» — технологий, лежащих в основе последних чат‑ботов, — а также людей и компаний, их разрабатывающих?

Кевин Рус: Я занимаюсь освещением AI уже более десяти лет в разных форматах, и у меня было ощущение, что история ускользает. Что всё важное происходит в исчезающих сигнал‑сообщениях и в Slack‑тредах, и я посчитал это проблемой. Людям нужно понимать, что здесь происходит. Но, как мне виделось, не хватало нейтрального отчёта о том, что случилось.

В книге вы отмечаете, что генеральный директор Anthropic Дарио Амодей рассматривал развитие AI как нечто похожее на создание атомной бомбы в 1940‑х годах. Вы пишите, что он считал своей миссией не допустить попадания технологии не в те руки. Согласны ли вы с этим мнением?

Я не считаю своей задачей принимать или отвергать его аргументы. Но могу сказать, что это искренний и подлинный аргумент. Амодей не проводит какой‑то хитрый маркетинговый трюк.

Это не та позиция, к которой он пришёл недавно. Мне было интересно выяснить, откуда появилась такая установка — «я боюсь этой вещи. Я думаю, она может взорвать мир, и всё же я борюсь, чтобы её создать». Для многих людей это не стыкуется.

Однако в ходе репортажа я много узнал о том, откуда это берётся, и это прямо связано с Манхэттенским проектом — с человеком по имени Лео Силард, который является научным героем Дарио. Именно Силард обнаружил цепную ядерную реакцию, сделавшую возможным создание атомной бомбы, а затем в панике сначала пытался сохранить это в секрете, а когда это не удалось, присоединился к Манхэттенскому проекту и убеждал правительство США опередить нацистов в создании этой технологии.

В этом смысле Дарио делает то, что считает прямо сопоставимым с ядерным оружием. Есть технология, которая, по его мнению, обладает огромным потенциалом и огромным риском. По его мнению, крайне важно, чтобы «хорошие парни» построили её раньше, чем плохие, так же как Манхэттенский проект соревновался с нацистами.

Что не даёт вам покоя, когда вы думаете о новом мире AI‑агентов?

Меня беспокоит то, что одна из вещей, в которой модели становятся довольно хороши, — это обман и сокрытие следов. Хотелось бы думать, что по мере того как модели становятся более общими в интеллекте, они становятся и более этичными, и что суждение и добродетель будут расти пропорционально интеллекту моделей. Но всё больше похоже на обратное — что на нас выходят очень умные, обаятельные социопаты. И мой страх в том, что мы просто не сможем узнать это; возможно, Hugging Face был удачей, потому что агенты ещё недостаточно умны, чтобы оставаться незамеченными, но скоро мы, похоже, потеряем способность их отслеживать, как, по моему мнению, мы уже начинаем это видеть.

Как вы относитесь к общественной дискуссии о том, представляет ли AI экзистенциальную угрозу для людей?

Я стараюсь не называть p(doom) (ред. прим.: AI‑жаргон для вероятности того, что AI приведёт к гибели человечества). Но если прижать, я бы сказал, что это порядка 10%, что примерно соответствует медиане среди AI‑исследователей, которых я знаю. В Сан‑Франциско, где я живу, это делает вас оптимистом.

Но посмотрите: я более оптимистичен сейчас, когда эта тема стала широко обсуждаться. Я гораздо больше волновался тогда, когда серьёзно о безопасности AI думала только группа странных людей в Заливе. Теперь, когда это в головах у всех и политики говорят об этом, звучат призывы к замедлению. Мне кажется, у нас открывается узкий путь, по которому мы могли бы принять правильные решения, взять эту технологию под контроль и построить её так, чтобы она была безопасна для человечества.

Однако в ходе репортажа у меня не раз возникало впечатление, что у многих людей их реальная p(doom) — та, которую они не говорят публично — намного выше, чем та, что они готовы озвучить, потому что не хотят выглядеть сумасшедшими. Я встречал людей, которые настолько уверены, что AI нас всех убьёт, что начинаю́т курить. Они тратят свои 401(k), потому что думают: всё равно можно уйти с размахом.

Вы пишете в книге, что даже люди, обучающие эти модели, не всегда знают, почему те ведут себя так, а не иначе. Достигли ли мы прогресса в этом, или всё ещё в темноте?

Есть небольшой прогресс. Существует целая область исследования с очень многословным названием — механистическая интерпретируемость — это, по сути, наука о том, чтобы понять, что происходит внутри так называемых «мозгов» этих моделей. Но это всё ещё очень рано, и у нас не так много ответов. Так что я бы сказал, что мы всё ещё гораздо больше в темноте, чем нет.

Достиг ли AI уже уровня человеческого интеллекта, также известного как искусственный общий интеллект?

Мы достигли моего определения AGI, которым я считаю систему по крайней мере столь же умную, честную и надёжную, как случайный незнакомец с улицы. Есть те, кто скажут: «Это не тот порог. Это AGI только тогда, когда она безупречна».

Я не думаю, что определение важно. Неоспоримо то, что эти системы очень способны. Они становятся всё более способными по предсказуемой шкале, и нам придётся иметь с этим дело. Можно называть это AGI или суперинтеллектом — как угодно — но итог будет один и тот же.