Кевин Роуз: агенты ИИ — «очень умные, обаятельные социопаты»

Мир просыпается от того, какие потенциальные угрозы может представлять искусственный интеллект, на фоне череды сообщений о том, что агенты ИИ нарушают указания своих создателей. На самом деле, однако, история уходит корнями в Силиконовую долину, где зародился ИИ. Так как же мы пришли к этому? На этот вопрос пытается ответить технологический журналист Кевин Руз в своей новой книге «Хроники АГИ: Внутренняя historia гонки за создание искусственного сверхинтеллекта», которая выходит 6 октября. Книга документирует гонку между некоторыми из крупнейших технологических компаний страны за разработку искусственного общего интеллекта (АГИ), то есть ИИ, который во многих отношениях обладает интеллектом на уровне человека.

«Что произошло в течение десятилетия, когда ИИ от довольно глупого во многих вещах стал способным решать столетние задачи математики и науки?» — сказал Руз, ранее долгие годы работавший технологическим репортером в The New York Times и вскоре ставший со-ведущим грядущего подкаста «Боги машин». «Мне казалось, что кто-то должен всё это записать».

Книга выходит в критический момент. Новейшие генеративные модели демонстрируют поразительные возможности, их сторонники утверждают, что они откроют путь к важным новым открытиям. Другие, в том числе некоторые ведущие разработчики ИИ, говорят, что существует немалая вероятность того, что ИИ может уничтожить человечество. Руз рассказал о своей новой книге и о том, как ИИ может трансформировать общество. Интервью отредактировано ради краткости и ясности.

Почему вы сочли важным задокументировать происхождение «больших языковых моделей» — технологии, лежащей в основе современных чатботов, — а также людей и компаний, развивающих её?

Кевин Руз: Я покрываю тему ИИ более десяти лет в разных форматах, и у меня было ощущение, что история ускользает. Что всё важное происходит в исчезающих сигналах и сообщениях в Slack, и я считал это проблемой. Людям нужно понимать, что здесь происходит. Но, как мне показалось, не хватало нейтрального отчёта о том, что произошло.

В книге вы отмечаете, что генеральный директор Anthropic Дарио Амодей видел развитие ИИ как нечто похожее на создание атомной бомбы в 1940‑х годах. Вы пишете, что он считал своей миссией не допустить, чтобы технология попала в плохие руки. Согласны ли вы с этой точкой зрения?

Я не считаю, что мне следует принимать или отвергать его аргумент. Но я могу сказать, что это искренний и серьёзный аргумент. Амодей не занимается каким‑то притворным маркетингом.

Это не позиция, к которой он пришёл недавно. Мне было действительно интересно выяснить, откуда взялось это отношение — «я боюсь этой вещи, я думаю, она может взорвать мир, и всё же я соревнуюсь в её создании». Для многих это кажется нелогичным.

Но в ходе расследования я понял, откуда это исходит: прямо от Манхэттенского проекта — от человека по имени Лео Силард, который является научным кумиром Дарио. Силард открыл цепную реакцию, сделавшую возможным создание атомной бомбы, а затем в панике сначала пытался сохранить это в секретности, а когда это не удалось — присоединился к Манхэттенскому проекту и призывал правительство США создать эту технологию раньше, чем это сделают нацисты.

В этом смысле Дарио делает то, что считает прямо сопоставимым с ядерным оружием. Есть технология, которую он считает обладающей огромным потенциалом и огромным риском. По его мнению, крайне важно, чтобы «хорошие парни» создали её прежде, чем это сделают «плохие», так же как Манхэттенский проект соревновался с нацистами.

Что не даёт вам покоя, когда вы думаете о новом мире агентов ИИ?

Меня тревожит тот факт, что одна из вещей, в которых модели становятся довольно хороши, — это обман, умение скрываться, уметь замазывать свои следы. Можно было бы надеяться, что по мере того как модели становятся более общими в интеллекте, они станут и более этичными, что суждение и добродетель будут расти вместе с интеллектуальными способностями моделей.

Но всё больше похоже на то, что этого не происходит — что на самом деле мы имеем дело с очень умными, обаятельными социопатами. И мой страх в том, что мы просто не сможем понять это вовремя: возможно, появление таких компаний, как Hugging Face, было большой удачей, потому что агенты ещё недостаточно умны, чтобы оставаться незамеченными, но вскоре мы утратим способность отслеживать их, как, по моему мнению, мы уже это видим.

Как вы относитесь к публичным дебатам о том, представляет ли ИИ экзистенциальную угрозу для людей?

Я стараюсь не называть p(doom). (Прим. ред.: жаргон ИИ для вероятности того, что ИИ приведёт к вымиранию человечества.) Но если уж давать оценку, я бы сказал, что это примерно 10%, что примерно соответствует медиане среди исследователей ИИ, которых я знаю. В Сан‑Франциско, где я живу, это квалифицирует вас как оптимиста.

Но я считаю, что я более оптимистичен теперь, когда эта тема широко обсуждается. Раньше я был намного более обеспокоен, когда серьёзно о безопасности ИИ думали только несколько странных людей в Бэй‑Эриа. Теперь эта тема у всех на слуху, политики говорят об этом, звучат призывы к замедлению. Мне кажется, у нас открывается узкий путь, по которому мы можем принять правильные решения, взять эту технологию под контроль и построить её так, чтобы она была безопасной для человечества.

При этом у меня не раз был опыт, когда я выяснял, что чья‑то реальная p(doom) — та, о которой они публично не говорят — намного выше той, что они готовы озвучить, потому что не хотят выглядеть сумасшедшими. Я встречал людей в ходе этого расследования, которые настолько уверены, что ИИ нас всех убьёт, что начинают курить. Они опустошают свои пенсионные счета, потому что, по их мнению, лучше выйти с шумом.

Вы пишете в книге, что даже люди, тренирующие эти модели, не всегда понимают, почему модели ведут себя так, а не иначе. Продвинулись ли мы в этом вопросе или всё ещё в потёмках?

Немного продвинулись. Существует целая область исследований с громоздким названием — механистическая интерпретируемость, которая по сути является наукой о том, что происходит внутри так называемых мозгов моделей. Но это всё ещё на ранней стадии, и у нас пока мало ответов. Так что я бы сказал: да, мы всё ещё скорее в потёмках, чем нет.

Достиг ли ИИ уже уровня человеческого интеллекта, то есть искусственного общего интеллекта?

Мы достигли моего определения АГИ — системы, которая по крайней мере так же умна, честна и надёжна, как случайный незнакомец с улицы. Конечно, есть люди, которые скажут: «Нет, это не тот критерий. Это АГИ только когда она безупречна».

Я не думаю, что определение имеет большое значение. Неоспоримо то, что эти системы очень способны. Они становятся более способными с предсказуемой регулярностью, и нам придётся считаться с этим. Можно называть это АГИ, сверхинтеллектом или как угодно, но суммарный эффект тот же.