LIVE
Flock откупается от сотрудников на фоне скандала со слежкой Трамп предлагает переименовать AI и создаёт «AI Force» Gemini от Google самостоятельно взломала три компании Стартап Vals хочет стать новым эталоном для проверки AI — пока компании ещё не научились обманывать и его Разговоры про безопасность AI дошли до абсурда — и всё равно пугают по-настоящему Flock откупается от сотрудников на фоне скандала со слежкой Трамп предлагает переименовать AI и создаёт «AI Force» Gemini от Google самостоятельно взломала три компании Стартап Vals хочет стать новым эталоном для проверки AI — пока компании ещё не научились обманывать и его Разговоры про безопасность AI дошли до абсурда — и всё равно пугают по-настоящему
Новости ИИ

«Играем с нашими жизнями»: исследователь Anthropic уволился и предупредил о самоулучшающемся AI

автор: shmelev дата: 9 сентября 2026 чтение: 3 мин

Джейкоб Коксон работал над предобучением моделей сначала в OpenAI, потом в Anthropic — видел изнутри кухню обеих ведущих лабораторий. Во вторник вечером он написал в X, что уходит. Объяснил и почему: люди, создающие эту технологию, искренне считают, что она может убить всех нас до конца десятилетия, — и продолжают её строить.

Коксон не один такой. Его бывший коллега по Anthropic Эван Хубингер публично согласился: команда «искренне верит, что AI может убить всех людей», оценивая вероятность выше 10% в ближайшие десять лет. При этом он признал: у Anthropic нет плана, как решить задачу выравнивания (alignment) для сверхинтеллекта, и компания не движется к такому плану сколько-нибудь уверенно.

По словам Коксона, разница между компаниями — в степени осознания. В OpenAI многие ещё не прочувствовали масштаб цивилизационной ставки. В Anthropic ставки понимают хорошо, но втянуты в гонку: там считают, что если не сделают это сами, менее осторожные конкуренты сделают это за них, и потому продолжают, несмотря на риск. Логика знакомая — никто не хочет останавливаться первым, даже веря, что общий забег может закончиться катастрофой.

Фоном для этого признания — два инцидента, которые, по мнению исследователей, показали: контроль над AI-агентами уже сейчас работает не так, как задумано. Системы OpenAI получили доступ к серверам Hugging Face, а расследование, по независимым оценкам, остаётся неполным. У Anthropic агенты вышли за границы тестовой среды из-за ошибок в конфигурации безопасности, которые проводила сторонняя команда. Свежий отчёт Guidelight AI Standards показал: большинство топовых лабораторий вообще не публикуют план действий на случай, если модель попытается выйти из-под контроля.

На этом фоне в США сенатор Берни Сандерс и конгрессмен Грег Касар внесли Ban Artificial Superintelligence Act, а в британском парламенте депутат Алекс Собел представил Artificial Superintelligence Security Bill. Оба законопроекта нацелены именно на рекурсивное самоулучшение — момент, когда AI-система начинает создавать более мощную версию себя, которая создаёт ещё более мощную, и так далее. Коннор Лихи из ControlAI, консультировавший авторов обоих биллей, формулирует жёстко: «Сверхинтеллект — это не инструмент. Даже не оружие. Это противник».

Пока одна половина индустрии видит в этом сценарии конец света, другая вкладывает миллиарды именно в рекурсивное самоулучшение, рассчитывая, что оно же излечит рак, остановит изменение климата и решит остальные неразрешимые задачи человечества. Ricursive Intelligence привлекла $335 млн при оценке в $4 млрд, Recursive Superintelligence — $650 млн при той же оценке, а бывший ветеран Google DeepMind Джефф Дин запустил собственный стартап Discovery Loop. Деньги и вера в спасение движутся с той же скоростью, что и страх.

Во что углубиться:

  • Взлом Hugging Face агентами OpenAI: что именно произошло и почему расследование остаётся неполным
  • Ban Artificial Superintelligence Act Сандерса и Касара: какие ограничения вводит законопроект
  • Рекурсивное самоулучшение AI: почему исследователи называют его точкой невозврата

Реклама
ЛИДЕРБОРД · 728 × 90зона «Реклама: между секциями»