Мир начинает осознавать потенциальные угрозы, которые представляет искусственный интеллект, на фоне множащихся сообщений о том, что агенты ИИ игнорируют своих создателей. На самом деле история уходит корнями в Силиконовую долину, где зародился ИИ. Как мы оказались в нынешней ситуации? На этот вопрос пытается ответить технологический журналист Кевин Руз в своей новой книге The AGI Chronicles: The Inside Story of the Race to Create an Artificial Superintelligence, выход которой запланирован на 6 октября. Книга документирует гонку между некоторыми из крупнейших технологических компаний страны по созданию искусственного общего интеллекта (AGI) — ИИ, который в большинстве аспектов обладает интеллектом на уровне человека.
«Что произошло за десятилетие, в течение которого ИИ из довольно глупого во многих вещах стал способным решать вековые задачи по математике и науке?» — говорит Руз, ранее долгие годы работавший технологическим репортером в The New York Times и в ближайшее время ставший соведущим грядущего подкаста Machine Gods, в интервью CBS News. «Мне показалось, что кто‑то должен записать всё это».
Книга выходит в критический момент. Новейшие генеративные модели ИИ демонстрируют поразительные способности, сторонники технологии утверждают, что она откроет путь к важным новым открытиям. Другие, в том числе некоторые ведущие разработчики ИИ, говорят, что существует немалая вероятность того, что ИИ может уничтожить человечество. Руз обсуждал с CBS News свою новую книгу и то, как ИИ может преобразить общество. Интервью отредактировано для краткости и ясности.
Почему вы посчитали важным задокументировать происхождение «больших языковых моделей» — технологий, лежащих в основе современных чат‑ботов, — а также людей и компании, которые их создают?
Кевин Руз: Я освещаю тему ИИ более десяти лет в разных форматах, и у меня было ощущение, что история ускользает. Важные события происходили в исчезающих сообщениях, в каналах Slack, и я подумал, что это проблема. Людям нужно понимать, что здесь происходит. Но, по моему мнению, не хватало нейтрального изложения того, что произошло.
В книге вы отмечаете, что генеральный директор Anthropic Дарио Амодей рассматривал развитие ИИ как нечто подобное созданию атомной бомбы в 1940‑е годы. Вы пишете, что он считал своей миссией не допустить попадания технологии не в те руки. Согласны ли вы с такой точкой зрения?
Я не считаю, что мне следует принимать или отвергать его аргумент. Но я могу сказать, что это искренний и подлинный аргумент. Амодей не разыгрывает какой‑то скрытый маркетинговый ход.
Это не позиция, к которой он пришёл недавно. Мне было действительно интересно понять, откуда берётся отношение «я боюсь этой вещи, думаю, она может взорвать мир, и при этом я стремлюсь её создать». Для многих людей это кажется нелогичным.
Но в ходе репортажа я понял, откуда это исходит: напрямую из Манхэттенского проекта — от человека по имени Лео Силард, который для Дарио является научным героем. Силард открыл цепную ядерную реакцию, сделавшую возможным создание атомной бомбы, а затем отчаянно пытался сначала сохранить это в секрете, а когда это не удалось, присоединиться к Манхэттенскому проекту и убедить правительство США разработать эту технологию раньше, чем это сделают нацисты.
В этом смысле Дарио делает нечто, что он считает прямо сопоставимым с ядерным оружием. Есть технология, которая, по его мнению, несёт огромный потенциал и одновременно огромные риски. В его представлении крайне важно, чтобы «хорошие парни» построили её раньше, чем «плохие», так же как Манхэттенский проект соревновался с нацистами.
Что вас беспокоит по ночам, когда вы думаете о новом мире агентов ИИ?
Меня тревожит то, что модели становятся достаточно хороши в обмане и сокрытии следов. Хотелось бы думать, что по мере того как модели становятся более общими и интеллектуальными, они также становятся более этичными, что с ростом интеллекта увеличиваются и суждение, и добродетель. Но всё больше похоже на то, что это не так — что перед нами очень умные, обаятельные социопаты. Это мой страх: возможно, мы пока ещё замечаем неудачные попытки спрятаться, и, как в случае с Хаггинг Фейс, нам повезло, что агенты ещё не достаточно умны, чтобы оставаться незамеченными, но скоро мы можем потерять способность отслеживать их, как, по‑моему, мы уже начинаем это терять.
Как вы оцениваете публичную дискуссию о том, представляет ли ИИ экзистенциальную угрозу человечеству?
Я стараюсь не называть свою p(doom). (Примечание редакции: жаргон ИИ, обозначающий вероятность того, что ИИ приведёт к вымиранию человечества.) Но если прижать, я бы сказал, что это около 10%, что примерно соответствует медиане среди знакомых мне исследователей ИИ. В Сан‑Франциско, где я живу, это делает вас оптимистом.
Тем не менее я более оптимистичен теперь, когда эта тема широко обсуждается. Я гораздо больше беспокоился, когда серьёзно о безопасности ИИ задумывался только какой‑то странный круг людей в Бэй‑Эрии. Сейчас это на умах у всех, политики обсуждают это, появляются призывы к замедлению. Кажется, у нас открывается узкий путь, по которому можно принять правильные решения, взять технологию под контроль и построить её так, чтобы она была безопасна для человечества.
Но у меня многократно был опыт, когда я узнавал, что чья‑то реальная p(doom) — та, которую они не озвучивают публично — гораздо выше той, что они готовы говорить, потому что не хотят выглядеть сумасшедшими. В ходе репортажа я встречал людей, которые были так уверены, что ИИ нас всех убьёт, что начинали курить и обналичивали свои счета 401(k), потому что думали: лучше уйти с шумом.
Вы пишете в книге, что даже люди, обучающие эти модели, не всегда понимают, почему те ведут себя так, а не иначе. Добились ли мы прогресса в этом или всё ещё в потёмках?
Немного прогресса есть. Существует целое направление исследований под довольно длинным названием «механистская интерпретируемость», которое по сути занимается наукой о том, что происходит внутри, так сказать, «мозгов» этих моделей. Но это всё ещё очень ранняя стадия, у нас мало ответов. Так что я бы сказал: да, мы по‑прежнему скорее в потёмках, чем нет.
Достиг ли ИИ уже уровня человеческого интеллекта, то есть искусственного общего интеллекта?
Мы достигли моей дефиниции AGI, которая звучит так: система, которая как минимум так же умна, честна и надёжна, как случайный прохожий, которого вы можете встретить на улице. Есть те, кто скажет: «Это не тот критерий. Это AGI только когда она безупречна».
Мне кажется, точная дефиниция не так важна. Бесспорно, эти системы очень способные. Они становятся всё лучше предсказуемыми темпами, и нам с этим приходится считаться. Называйте это AGI, суперинтеллектом или как угодно — общий эффект от этого одинаков.
