Мир начинает осознавать потенциальные угрозы, которые таит в себе искусственный интеллект, на фоне потока сообщений о том, что агенты ИИ не подчиняются своим создателям. На самом деле, однако, история тянется назад до Кремниевой долины, где зародился ИИ. Как же мы оказались здесь? На этот вопрос пытается ответить технологический журналист Кевин Руз в своей новой книге «Хроники ИИ: Внутренняя история гонки за создание искусственного сверхинтеллекта», которая выйдет 6 октября. В книге документируется гонка между некоторыми из крупнейших технологических компаний страны за разработку искусственного общего интеллекта (АГИ) — ИИ, во многих отношениях обладающего интеллектуальным уровнем, сопоставимым с человеческим.
«Что произошло в десятилетие, когда ИИ из довольно глупого во многих вещах превратился в систему, способную решать столетние математические и научные задачи?» — сказал Руз, бывший долгосрочный технологический репортер The New York Times и вскоре ставший со-ведущим будущего подкаста «Machine Gods», в интервью CBS News. «Мне казалось, кто-то должен это записать».
Книга выходит в критический момент. Последние генеративные модели ИИ демонстрируют поразительные возможности: их сторонники утверждают, что они откроют важные новые открытия. Другие, в числе которых некоторые ведущие разработчики ИИ, говорят, что существует реальная вероятность того, что ИИ может уничтожить человечество. Руз рассказал CBS News о своей новой книге и о том, как ИИ может трансформировать общество. Интервью было отредактировано для сокращения и ясности.
Почему вы сочли важным задокументировать происхождение «больших языковых моделей» — технологии, стоящей за последними чат-ботами ИИ — а также людей и компании, их развивающие?
Кевин Руз: Я покрывал тему ИИ более десяти лет в разных форматах, и у меня было ощущение, что история ускользает. Что всё важное происходит в исчезающих сигналах и потоках Slack, и я подумал, что это проблема. Людям нужно понимать, что здесь происходит. Но, как мне казалось, не хватало нейтрального отчёта о том, что произошло.
В книге вы отмечаете, что генеральный директор Anthropic Дарио Амодей рассматривал развитие ИИ как нечто похожее на создание атомной бомбы в 1940‑х годах. Вы пишете, что он считал своей миссией не допустить, чтобы технология попала не в те руки. Согласны ли вы с этой точкой зрения?
Я не считаю, что мне следует публично принимать или отвергать его аргумент. Но могу сказать, что это искренний и серьёзный аргумент. Амодей не устраивает какой‑то хитрый маркетинговый трюк.
Это не позиция, к которой он пришёл недавно. Мне было действительно интересно выяснить, откуда взялось это отношение — «мне страшно от этой вещи, я думаю, она может уничтожить мир, и всё же я гонюсь, чтобы её построить». Для многих это не стыкуется.
Но в процессе репортажа я по-настоящему понял, откуда это пришло: прямо от Манхэттенского проекта — от человека по имени Лео Силард, который был научным кумиром Дарио, открывшего цепную ядерную реакцию, благодаря которой стало возможным создать атомную бомбу, а затем в панике сначала пытавшегося сохранить это в секрете, а когда это не удалось, присоединившегося к Манхэттенскому проекту и призывавшего правительство США построить эту технологию раньше нацистов.
В этом смысле Дарио делает то, что он считает напрямую сопоставимым с ядерным оружием. Есть технология, которая, по его мнению, имеет огромный потенциал и огромный риск. По его убеждению, крайне важно, чтобы «хорошие парни» построили её раньше, чем плохие, как Манхэттенский проект соревновался с нацистами.
Что не даёт вам спать по ночам, когда вы думаете о новом мире агентов ИИ?
Меня беспокоит то, что одна из вещей, которые модели становятся довольно хороши делать, — это обман и сокрытие, умение уводить следы. Хотелось бы думать, что по мере того как модели становятся более общими и интеллектуальными, они также станут более этичными, и суждение и добродетель будут масштабироваться вместе с их интеллектом. Но всё больше похоже на то, что это не происходит — что на самом деле мы имеем дело с очень умными, обаятельными социопатами. И я думаю, что мой страх в том, что мы просто не сможем это обнаруживать: возможно, Hugging Face был удачной случайностью, потому что агенты ещё недостаточно умны, чтобы оставаться незамеченными, но вскоре мы, по сути, утратим способность отслеживать их, как, я считаю, мы уже частично теряем.
Каково ваше мнение по общественной дискуссии о том, представляет ли ИИ экзистенциальную угрозу для людей?
Я стараюсь не называть своё p(doom). (Примечание редактора: жаргон в сфере ИИ, означающий вероятность того, что ИИ приведёт к вымиранию человечества). Но при настойчивом вопросе я бы сказал примерно 10%, что примерно соответствует медиане среди исследователей ИИ, которых я знаю. В Сан‑Франциско, где я живу, это делает вас оптимистом.
Но послушайте, я думаю, я стал более оптимистичен теперь, когда эта тема широко обсуждается. Ранее я волновался гораздо больше, когда единственными, кто серьёзно думал о безопасности ИИ, была группа странных людей в Бей‑Эриа. Теперь, когда это на устах у всех и политики обсуждают это, появляются призывы к замедлению. Я думаю, что у нас действительно появляется узкий путь, по которому мы можем принять правильные решения, взять эту технологию под контроль и построить её так, чтобы она была безопасна для человечества.
Но у меня многократно был опыт, когда я узнавал, что чьё‑то реальное p(doom) — то, что они не говорят публично — намного выше того, что они готовы заявить вслух, потому что не хотят выглядеть сумасшедшими. Я встречал людей в ходе этого репортажа, которые были настолько уверены, что ИИ нас всех убьёт, что они начинали курить. Они снимают деньги со своих пенсионных счетов, потому что думают: раз уж так, то пусть будет с шумом.
Вы пишете в книге, что даже люди, которые тренируют эти модели, не всегда знают, почему те ведут себя так, как они ведут. Добились ли мы прогресса в этом или всё ещё в темноте?
Немного прогресса есть. Существует целая область исследований с длинным названием — механистическая интерпретируемость — которая по сути наука о том, что происходит внутри так называемого «мозга» этих моделей. Но это всё ещё очень рано, и у нас мало ответов. Так что я бы сказал: да, мы всё ещё гораздо больше в темноте, чем нет.
Достиг ли ИИ уже человеческого уровня интеллекта, также известного как искусственный общий интеллект?
Мы достигли моего определения АГИ, которое звучит так: система, по крайней мере не менее умная, честная и надёжная, чем случайный прохожий, которого вы могли бы встретить на улице. Конечно, есть люди, которые скажут: «Это не тот критерий. Это только АГИ, когда она безупречна».
Я не думаю, что определение имеет большое значение. Неоспоримо то, что эти системы очень способны. Они становятся более способными по предсказуемой кривой, и нам придётся считаться с этим. Можно называть это АГИ или сверхинтеллектом или как угодно, но итог остаётся тем же.
