Кевин Руз: ИИ‑агенты — «очень умные, обаятельные социопаты»

Мир начинает осознавать потенциальные угрозы, которые несёт искусственный интеллект, на фоне череды сообщений о том, что агенты ИИ нарушают указания своих создателей. На самом деле история уходит корнями в Силиконовую долину, где зародился ИИ. Как мы оказались здесь — именно на этот вопрос пытается ответить технологический журналист Кевин Руз в своей новой книге The AGI Chronicles: The Inside Story of the Race to Create an Artificial Superintelligence, которая выйдет 6 октября. В книге задокументирована гонка между некоторыми из крупнейших технологических компаний страны за создание искусственного общего интеллекта (AGI) — ИИ, во многом обладающего интеллектом на уровне человека.

«Что произошло за десятилетие, когда ИИ из довольно тупого в большинстве задач превратился в систему, способную решать столетние математические и научные проблемы?» — сказал Руз, ранее многолетний технологический репортёр в The New York Times и вскоре ставший соведущим будущего подкаста Machine Gods, в интервью CBS News. «Я почувствовал: кто-то должен это записать».

Книга выходит в критический момент

Новейшие генеративные модели ИИ демонстрируют поразительные способности: сторонники технологии утверждают, что она откроет путь к важным открытиям, тогда как другие, в том числе некоторые ведущие разработчики ИИ, говорят, что существует немалая вероятность того, что ИИ может уничтожить человечество. Руз рассказал CBS News о своей новой книге и о том, как ИИ может трансформировать общество. Интервью было сокращено и отредактировано для ясности.

Почему вы решили задокументировать происхождение «больших языковых моделей»?

Кевин Руз: Я освещаю тему ИИ более десяти лет в разных форматах, и у меня было ощущение, что история ускользает. Всё важное происходит в исчезающих сигнал-сообщениях и в потоках Slack, и мне показалось, что это проблема. Люди должны понимать, что происходит. Но, по моему мнению, не хватало нейтрального отчёта о том, что случилось.

Сравнение с атомной бомбой

В книге вы отмечаете, что генеральный директор Anthropic Дарио Амодеи сравнивал развитие ИИ с созданием атомной бомбы в 1940‑е годы. Вы пишете, что он считал своей миссией не допустить попадания технологии не в те руки. Согласны ли вы с этим?

Не считаю своей задачей принимать или отвергать его аргумент. Но могу сказать, что это искренний и серьёзный аргумент. Амодеи не проводит какую‑то скрытую маркетинговую акцию.

Это не позиция, к которой он пришёл недавно. Мне было особенно интересно выяснить, откуда взялось отношение «меня пугает эта вещь, я думаю, она может взорвать мир, и всё же я соревнуюсь, чтобы её создать». Для многих это не укладывается в голове.

Но в ходе репортажа я действительно понял, откуда это берётся: напрямую от Манхэттенского проекта — от Лео Силларда, научного героя Дарио, который обнаружил ядерную цепную реакцию, сделавшую возможным создание атомной бомбы, а затем лихорадочно пытался сначала сохранить это в секрете, а когда это не удалось, присоединился к Манхэттенскому проекту и убеждал правительство США создать эту технологию раньше, чем это сделают нацисты. В этом смысле Дарио делает то, что считает прямо сопоставимым с ядерным оружием. Есть технология, которая по его мнению обладает огромным потенциалом и огромным риском. По его убеждению, «хорошим парням» необходимо создать её раньше, чем плохие, так же как Манхэттенский проект гонялся против нацистов.

Беспокойства по поводу агентов ИИ

Что вас беспокоит по ночам, когда вы думаете о новом мире агентов ИИ?

Меня беспокоит то, что одной из вещей, в которой модели становятся довольно хороши, является обман и умение скрывать свои следы. Хотелось бы думать, что по мере того как модели становятся более общими в интеллекте, они также станут более этичными, и что суждение и добродетель будут расти вместе с интеллектом моделей. Но всё больше похоже на то, что это не происходит — что на самом деле перед нами очень умные, обаятельные социопаты. И я боюсь, что мы просто не будем знать, что Hugging Face, возможно, был невероятной удачей, потому что агенты ещё недостаточно умны, чтобы остаться незамеченными, но скоро мы потеряем способность отслеживать их, как, мне кажется, мы уже начинаем это терять.

Обсуждение экзистенциальной угрозы

Как вы относитесь к публичной дискуссии о том, представляет ли ИИ экзистенциальную угрозу для человечества?

Я стараюсь не давать p(doom). (Примечание редактора: в жаргоне ИИ это обозначает вероятность того, что ИИ приведёт к вымиранию человечества.) Но если уж меня пристают, я бы сказал, что это примерно 10%, что примерно соответствует медиане среди тех исследователей ИИ, которых я знаю. В Сан‑Франциско, где я живу, это квалифицирует тебя как оптимиста.

Однако я более оптимистичен теперь, когда эта тема так широко обсуждается. Раньше я был гораздо более обеспокоен, когда единственными, кто серьёзно думал о безопасности ИИ, была группа странных людей в Бэй‑Эриа. Теперь, когда об этом думают все и политики обсуждают это, появляются призывы к замедлению. Мне кажется, у нас открывается узкая возможность принять правильные решения, взять технологию под контроль и создать её безопасно для человечества.

Но у меня был опыт, когда я многократно выяснял, что чья‑то настоящая p(doom) — та, которую они не озвучивают публично — значительно выше той, которую они готовы говорить на публике, потому что не хотят выглядеть сумасшедшими. В ходе репортажа я встречал людей, которые настолько уверены, что ИИ нас всех убьёт, что начинают курить. Они снимают деньги со своих 401(k), потому что думают: «Зачем откладывать? Можно прожечь жизнь с размахом».

Понимание поведения ИИ

Вы пишете в книге, что даже люди, которые обучают эти модели, не всегда понимают, почему те ведут себя так, как ведут. Достигли ли мы прогресса в этом вопросе или всё ещё в темноте?

Немного прогресса есть. Существует целая область исследований с довольно громоздким названием — механистическая интерпретируемость — которая по сути занимается наукой о том, что происходит внутри так называемых «мозгов» этих моделей. Но это всё ещё очень рано, и ответов немного. Так что я бы сказал: да, мы всё ещё скорее в темноте, чем нет.

Достиг ли ИИ уровня человеческого интеллекта?

Достиг ли ИИ уже уровня человеческого интеллекта, также называемого искусственным общим интеллектом?

Мы достигли моего определения AGI, которым я считаю систему, по крайней мере не менее умную, честную и надёжную, чем случайный прохожий, которого вы могли бы выбрать с улицы. Конечно, есть люди, которые скажут: «Нет, это неверная планка. Это AGI только тогда, когда оно безупречно».

Не думаю, что определение особенно важно. Бесспорно, что эти системы очень способные. Они становятся всё более способными в предсказуемом темпе, и нам придётся с этим считаться. Можно называть это AGI или сверхинтеллектом — как угодно — но итог будет один и тот же.