Пока Amodei готовил взвешенный манифест о безопасности, изнутри компании прозвучало нечто менее сдержанное. Исследователь Джейкоб Коксон уволился из Anthropic, опубликовав в X сообщение: компания «мчится прямиком к самосовершенствующемуся суперинтеллекту и играет с нашими жизнями». Формулировка резкая даже для индустрии, где апокалиптические прогнозы давно стали частью риторики.
Люди уходят из компаний постоянно, по разным причинам, и сам уход здесь не главное. Важно другое: руководитель отдела alignment в Anthropic, Эван Хубингер, не стал опровергать слова коллеги, а подписался под ними в соцсетях. Это меняет вес высказывания. Хлопнул дверью не разочарованный экс-сотрудник, а человек, отвечающий за безопасность моделей внутри компании, — и публично согласился с диагнозом «мы играем с огнём».
Время для такого заявления выбрано будто специально неудачно — Anthropic готовится к IPO, и любые сомнения в собственной безопасности звучат прямо противоположно тому, что хочет услышать рынок перед размещением акций. Компания годами строила образ «ответственного» игрока на фоне более агрессивного OpenAI. Если собственные сотрудники не верят в устойчивость этой позиции, встаёт закономерный вопрос: насколько убедительны публичные обещания компании для будущих инвесторов и регуляторов.
Официальная реакция Anthropic на уход Коксона была сдержанной, без прямых опровержений его тезисов. Возможно, отчасти именно поэтому спустя пару дней появился развёрнутый пост Амодея с предложениями по замедлению — попытка перехватить нарратив и показать, что беспокойство слышат на самом верху.
Во что углубиться:
- Что такое AI alignment и почему этим направлением занимаются отдельные команды в лабораториях
- IPO Anthropic: условия выхода на биржу и ожидания инвесторов
- Похожие случаи ухода сотрудников из AI-компаний с публичными предупреждениями
