Кевин Руз: агенты ИИ — «очень умные, обаятельные социопаты»

Мир просыпается от понимания потенциальных угроз, которые несет искусственный интеллект, на фоне потока сообщений о том, что агентные системы ИИ игнорируют своих создателей. На самом деле, однако, история тянется из Силиконовой долины, где зародился ИИ. Как же мы пришли к этому моменту? На этот вопрос пытается ответить технологический журналист Кевин Рус в своей новой книге «The AGI Chronicles: The Inside Story of the Race to Create an Artificial Superintelligence», которая выйдет 6 октября. Книга документирует гонку между некоторыми из крупнейших технологических компаний страны за разработку искусственного общего интеллекта (AGI) — ИИ, который по большинству показателей обладает интеллектом на уровне человека.

«Что произошло за то десятилетие, в ходе которого ИИ превратился из довольно глупого в большинстве задач в систему, способную решать вековые задачи по математике и науке?» — сказал Рус, бывший долгосрочный технологический репортер в The New York Times и будущий со-ведущий грядущего подкаста «Machine Gods», в интервью CBS News. «Мне казалось, что кто-то должен это записать».

Книга выходит в критический момент. Новейшие генеративные модели ИИ демонстрируют поразительные возможности, и их сторонники утверждают, что они откроют путь к важным новым открытиям. Другие, в том числе некоторые ведущие разработчики ИИ, говорят, что существует немалая вероятность того, что ИИ может уничтожить человечество. Рус рассказал CBS News о своей новой книге и о том, как ИИ может трансформировать общество. Интервью отредактировано в целях краткости и ясности.

Почему вы сочли важным документировать происхождение «больших языковых моделей» — технологии, лежащей в основе последних чат-ботов, — а также людей и компаний, которые её разрабатывают?

Кевин Рус: Я писал об ИИ более десяти лет в разных форматах, и у меня появилось ощущение, что история ускользает. Что все важное происходит в исчезающих сигнал-сообщениях и ветках в Slack, и я считал это проблемой. Людям нужно понимать, что здесь происходит. Но, как мне казалось, не хватало нейтральной хронологии событий.

В книге вы отмечаете, что генеральный директор Anthropic Дарио Амодеи видел развитие ИИ как что-то похожее на создание атомной бомбы в 1940-х годах. Вы пишите, что он считал своей миссией не допустить, чтобы технология попала в плохие руки. Согласны ли вы с этой позицией?

Я не думаю, что мне следует принимать или отвергать его аргумент. Но могу сказать, что это искренний и подлинный аргумент. Амодеи не устраивает какой-то скрытый маркетинговый трюк.

Это не позиция, к которой он пришел недавно. Мне было действительно интересно разобраться, откуда возникла установка «меня пугает эта вещь, я думаю, она может взорвать мир, и всё же я соревнуюсь, чтобы её создать». Для многих это не укладывается в голову.

Но в процессе репортажа я действительно понял, откуда это приходит: прямо от Манхэттенского проекта — от человека по имени Лео Силард, который был научным героем Дарио. Он открыл цепную ядерную реакцию, что сделало возможным создание атомной бомбы, а затем сначала пытался сохранить это в секрете, а когда это не удалось, присоединился к Манхэттенскому проекту и призывал правительство США создать эту технологию раньше, чем нацисты. В этом смысле Дарио делает то, что считает прямо сопоставимым с ядерным оружием. Есть технология, которая, по его мнению, обладает огромным потенциалом и огромным риском. По его убеждению, крайне важно, чтобы «хорошие парни» построили её раньше плохих, как Манхэттенский проект соревновался с нацистами.

Что не даёт вам спать по ночам, когда вы думаете о новом мире агентных ИИ?

Меня беспокоит то, что одна из вещей, в которых модели становятся довольно хороши, — это обман, умение прятаться, уметь замести следы. Хотелось бы думать, что по мере того как модели станут более общими в интеллекте, они также станут более этичными, и что с ростом интеллекта будут расти и суждение, и добродетель. Но всё больше похоже, что это не так — что на самом деле мы имеем дело с очень умными, обаятельными социопатами. И это мой страх: что мы просто не будем знать, что Hugging Face могло оказаться исключительным везением потому, что агенты пока что недостаточно умны, чтобы оставаться незамеченными, но вскоре мы утратим способность их отслеживать, как я уже, на мой взгляд, начинаю видеть.

Как вы относитесь к публичной дискуссии о том, представляет ли ИИ экзистенциальную угрозу для людей?

Я стараюсь не озвучивать p(doom) (Примечание редактора: термин в жаргоне ИИ, означающий вероятность того, что ИИ приведет к вымиранию человечества). Но если уж прижать, я бы сказал, что это около 10%, что примерно соответствует медиане среди знакомых мне исследователей ИИ. В Сан-Франциско, где я живу, это делает вас оптимистом.

Но я думаю, что я более оптимистичен сейчас, когда эта тема так широко обсуждается. Я был гораздо более обеспокоен, когда единственными, кто всерьёз думал об безопасности ИИ, были какие-то странные люди в районе залива. Теперь, когда об этом думает каждый и политики говорят об этом, звучат призывы к замедлению. Я думаю, что у нас действительно открывается узкая дорога, по которой мы могли бы принять правильные решения, взять эту технологию под контроль и построить её безопасно для человечества.

При этом у меня многократно был опыт, когда я выяснял, что чья-то реальная p(doom) — та, которую они не произносят публично — гораздо выше, чем та, которую они готовы признавать, потому что не хотят выглядеть сумасшедшими. В ходе репортажа я встречал людей, которые так уверены, что ИИ нас всех убьет, что начинают курить. Они выводят деньги из своих пенсионных накоплений, потому что говорят: раз уж всё равно, можно уйти с размахом.

Вы пишете в книге, что даже те, кто обучает эти модели, не всегда знают, почему они ведут себя так, как ведут. Мы продвинулись в этом или все еще в темноте?

Есть небольшие продвижения. Существует целая область исследований с довольно говорящим названием — механистическая интерпретируемость — которая по сути занимается наукой о том, что происходит внутри так называемых «мозгов» этих моделей. Но это всё еще очень рано, и у нас не так много ответов. Так что я бы сказал, что да, мы всё ещё скорее в темноте, чем нет.

Достиг ли ИИ уже уровня человеческого интеллекта, известного как искусственный общий интеллект?

Мы достигли моего определения AGI — системы, которая по крайней мере так же умна, честна и надежна, как случайный прохожий, которого вы могли бы встретить на улице. Есть люди, которые скажут: «Ну это не та планка. AGI — это только тогда, когда система безупречна».

Я не думаю, что определение имеет большое значение. Неоспоримо то, что эти системы очень способны. Они становятся всё более способными в предсказуемом темпе, и нам приходится считаться с этим. Можно называть это AGI или суперинтеллектом или как угодно, но суммарный эффект один и тот же.