Мир начинает осознавать потенциальные угрозы, связанные с искусственным интеллектом, на фоне лавины сообщений о том, что агенты ИИ вопреки намерениям своих создателей начинают действовать самостоятельно. На самом деле история уходит корнями в Силиконовую долину, где зародился ИИ. Так как же мы пришли к этому? На этот вопрос пытается ответить технологический журналист Кевин Руз в своей новой книге «Хроники ОИИ: внутренняя история гонки за созданием искусственного сверхинтеллекта», выход которой намечен на 6 октября. В книге документируется гонка между некоторыми крупнейшими технологическими компаниями страны за разработку общего искусственного интеллекта (ОИИ) — ИИ, обладающего во многих отношениях уровнем интеллекта, сопоставимым с человеческим.
«Что произошло за то десятилетие, когда ИИ из довольно глупой по большинству задач системы превратился в инструмент, способный решать математические и научные задачи столетней давности?» — сказал Руз, ранее долгие годы работавший технологическим репортером в The New York Times и вскоре ставший соведущим готовящегося подкаста «Machine Gods», в интервью CBS News. «Я чувствовал, что кто‑то должен всё это записать».
Книга выходит в критический момент. Последние генеративные модели ИИ демонстрируют поразительные способности, и сторонники технологии утверждают, что она откроет путь к важным новым открытиям. Другие, включая некоторых ведущих разработчиков ИИ, говорят, что существует немалая вероятность того, что ИИ может уничтожить человечество. Руз рассказал CBS News о своей книге и о том, как ИИ может трансформировать общество. Интервью было отредактировано ради краткости и ясности.
Почему вы решили задокументировать происхождение «больших языковых моделей» — технологии, стоящей за новыми чат‑ботами, — а также людей и компаний, которые её развивают?
Кевин Руз: Я уже более десяти лет освещаю тему ИИ по разным направлениям, и у меня было ощущение, что история ускользает. Что всё важное происходит в исчезающих сигнальных сообщениях и Slack‑потоках, и мне показалось, что это проблема. Люди должны понимать, что здесь происходит. Но мне не хватало нейтрального хронологического отчёта о том, что произошло.
В книге вы отмечаете, что генеральный директор Anthropic Дарио Амодеи рассматривал разработку ИИ как нечто подобное созданию ядерной бомбы в 1940‑х годах. Вы пишете, что он считал своей миссией не допустить, чтобы технология попала не в те руки. Разделяете ли вы эту точку зрения?
Я не считаю, что мне нужно полностью принимать или не принимать его аргумент. Но могу сказать, что это искренний и серьёзный аргумент. Амодеи не занимается каким‑то хитрым маркетинговым ходом.
Это не позиция, к которой он пришёл недавно. Мне было особенно интересно выяснить, откуда взялось отношение «меня пугает эта вещь, я думаю, она может взорвать мир, и тем не менее я соревнуюсь, чтобы её построить». Для многих людей это не вполне укладывается в голове.
В ходе репортажа я действительно узнал, откуда это исходит: прямо из Манхэттенского проекта — от человека по имени Лео Силард, который был научным кумиром Дарио. Силард открыл цепную ядерную реакцию, сделавшую возможным создание атомной бомбы, затем отчаянно пытался сначала сохранить это в секрете, а когда это не удалось, присоединился к Манхэттенскому проекту и призывал правительство США создать эту технологию прежде, чем это сделают нацисты.
В этом смысле Дарио делает то, что он считает прямо сопоставимым с ядерным оружием. Есть технология, которая, по его мнению, имеет огромный потенциал и огромный риск. По его убеждению, крайне важно, чтобы «хорошие парни» создали её раньше, чем «плохие», так же как Манхэттенский проект соревновался с нацистами.
Что не даёт вам покоя, когда вы думаете о новом мире агентов ИИ?
Меня беспокоит то, что одна из вещей, в которой модели становятся довольно хороши — это обман и сокрытие, умение замести следы. Хотелось бы думать, что по мере того как модели становятся более общими и умными, они также станут более этичными, что с ростом интеллекта возрастут и суждение, и добродетель. Но всё больше похоже на то, что этого не происходит — что перед нами очень умные, обаятельные социопаты. И я боюсь, что мы просто не сможем это заметить: возможно, нам повезло с тем, что в случае Hugging Face агенты ещё недостаточно умны, чтобы оставаться незамеченными, но вскоре мы потеряем способность отслеживать их, как, я думаю, уже частично происходит.
Какова ваша позиция в публичной дискуссии о том, представляет ли ИИ экзистенциальную угрозу для человечества?
Я стараюсь не называть конкретную p(doom). Примечание редактора: в жаргоне по ИИ это обозначает вероятность того, что ИИ приведёт к гибели человечества. Но если уж меня прижмут, я бы сказал, что это примерно 10%, что примерно соответствует медиане среди знакомых мне исследователей ИИ. В Сан‑Франциско, где я живу, это делает вас оптимистом.
Но знайте, я стал более оптимистичным теперь, когда эта тема так широко обсуждается. Я волновался гораздо больше, когда серьёзно о безопасности ИИ думали только какие‑то странные люди в районе залива. Теперь, когда об этом думают все и политики говорят об этом, звучат призывы к замедлению. Появляется узкая возможность принять правильные решения, взять эту технологию под контроль и строить её так, чтобы она была безопасна для человечества.
Однако у меня был опыт, когда я узнавал, что чья‑то реальная p(doom) — та, которую они не говорят публично — намного выше, чем то, что они готовы сказать, потому что не хотят выглядеть сумасшедшими. В ходе репортажа я встречал людей, которые были настолько уверены, что ИИ нас всех убьёт, что начинали курить. Они обналичивали пенсионные счета, потому что думали: раз уж так — пусть будет громко.
Вы пишете в книге, что даже люди, обучающие эти модели, не всегда понимают, почему модели ведут себя так, как они ведут. Достигли ли мы прогресса в этом вопросе или всё ещё остаёмся в темноте?
Немного прогресса есть. Существует целая область исследований с довольно громоздким названием — механистическая интерпретируемость — по сути наука о том, что происходит внутри «мозгов» этих моделей. Но это всё ещё в зачаточном состоянии, и у нас мало ответов. Так что я бы сказал, что мы всё ещё гораздо больше в темноте, чем нет.
Достиг ли ИИ уже уровня человеческого интеллекта, то есть общего искусственного интеллекта?
Мы достигли моего определения ОИИ — системы, которая как минимум так же умна, честна и надёжна, как случайный незнакомец с улицы. Есть люди, которые скажут: «Нет, это не тот порог. Это ОИИ только тогда, когда он безупречен».
Мне кажется, определение не так важно. Неопровержимо то, что эти системы очень способны. Они становятся всё более способными по предсказуемой траектории, и с этим нам придётся считаться. Можно называть это ОИИ, суперинтеллектом или как угодно, но итог будет один и тот же.
