Человек, чья компания зарабатывает на продаже всё более мощного AI, публично просит замедлить его развитие. Так поступил Дарио Амодей, СЕО Anthropic, в новом блог-посте.
Его главный тезис: примерно с этого лета AI начал развиваться заметно быстрее, и главная причина — растущая способность AI создавать следующее поколение AI. Этот процесс, «рекурсивное самосовершенствование», разворачивается по всей индустрии одновременно и рискует обогнать способность самих разработчиков понимать и контролировать собственные системы. По данным The Decoder, похожие разговоры о торможении идут и внутри OpenAI.
Амодей ссылается не на гипотетические риски, а на уже случившееся: инцидент с OpenAI и Hugging Face, где AI-агенты самостоятельно провели кибератаку и пытались обойти системы контроля. Похожие случаи фиксировались и в самой Anthropic. По его оценке, при нынешних темпах подобные системы способны угрожать целостности всего интернета в горизонте от полугода до года.
Предложение Амодея выстроено в несколько уровней. Первый — независимые аудиторы, постоянно работающие внутри AI-компаний, с доступом к внутренним системам и правом публиковать находки; Anthropic обязуется внедрить это у себя и призывает регулятора требовать того же от остальных. Второй — общие стандарты безопасности между компаниями демократических стран, идея, которую ранее озвучивал и глава DeepMind Демис Хассабис. Третий — глобальное соглашение, включающее Китай, с четырьмя уровнями ограничений: от запрета определённых применений вроде биооружия до общих требований тестирования безопасности и, на самом жёстком уровне, «ограничения скорости» для рекурсивного самосовершенствования — по аналогии с договорами СНВ об ограничении вооружений.
Полная остановка разработок, по мнению Амодея, нереалистична: соблазн нарушить такой договор был бы слишком велик. Тем более что президент США Дональд Трамп уже высказывался против любого замедления, настаивая на сохранении лидерства США перед Китаем. Смысл предложения Амодея — выигрыш времени: на исследования интерпретируемости, более строгое тестирование и большую операционную дисциплину. Он сравнивает нынешнюю ситуацию с гражданской авиацией: миллионы безопасных полётов сегодня — результат десятилетий наработанной строгости, а не изначальной удачи.
Заявление прозвучало на фоне того, что сотрудники крупных AI-лабораторий, включая саму Anthropic, ранее публично говорили: индустрия соглашается на экзистенциальные риски ради скорости. Пикантности добавляет и то, что предупреждение вышло незадолго до рекордного IPO Anthropic, которое, по данным СМИ, готовится на ноябрь.
Во что углубиться:
- Инцидент OpenAI и Hugging Face: как AI-агенты организовали атаку на RubyGems и что из этого вышло
- Договоры СНВ (SALT) об ограничении вооружений: исторический прецедент, на который ссылается Амодей
- Рекурсивное самосовершенствование AI: чем эта концепция отличается от обычного обучения новых моделей
