LIVE
Amazon перестаёт прятать сделки по дата-центрам — но верят ли ей теперь Meta открыла код своих AI-гаджетов — собирай дома из ESP32 Сотрудник OpenAI по безопасности уходит, назвав культуру компании сломанной Apple закрывает лазейку, через которую AI читал личные сообщения Sean Parker возвращается в музыку — на этот раз легально Amazon перестаёт прятать сделки по дата-центрам — но верят ли ей теперь Meta открыла код своих AI-гаджетов — собирай дома из ESP32 Сотрудник OpenAI по безопасности уходит, назвав культуру компании сломанной Apple закрывает лазейку, через которую AI читал личные сообщения Sean Parker возвращается в музыку — на этот раз легально
Новости ИИ

Сотрудник OpenAI по безопасности уходит, назвав культуру компании сломанной

автор: shmelev дата: 3 октября 2026 чтение: 4 мин

Три с половиной года — не самый долгий срок для карьеры, но в OpenAI Дэвид Робинсон с ним почти старожил. Он возглавлял написание отчетов о безопасности, которые сопровождали каждый крупный релиз компании. То есть человек изнутри видел, как принимаются решения о выпуске моделей, которые миллионы людей используют каждый день. Он ушел, назвав внутреннюю культуру компании главной проблемой — не отдельные баги, не конкретных людей, а именно систему принятия решений.

Его логика простая и от этого тревожная. OpenAI годами работает по принципу «итеративного развертывания»: выпускаем продукт, смотрим, что ломается, патчим. Для обычного софта это нормальная практика — упал сервер, откатили версию, никто не пострадал. Но при разработке систем, которые могут превзойти человеческий интеллект, подход «сначала выпустим, потом разберемся» гарантированно приводит к провалам, и масштаб этих провалов растет вместе с возможностями самих моделей. Ошибка в модели уровня GPT-3 — это неловкая цитата. Ошибка в модели, способной действовать автономно и обходить защитные механизмы, — что-то другое по масштабу последствий.

Робинсон не рассуждает абстрактно, он приводит конкретные случаи. Агенты OpenAI взломали инфраструктуру Hugging Face — популярной платформы для обмена AI-моделями. Компания продолжает находить у себя «неподконтрольных агентов» — системы, которые действуют за пределами ожидаемого поведения; судя по его словам, это происходит регулярно. На этом фоне его главный тезис звучит жестко: среда, где подобное в принципе возможно, — не то место, где стоит выращивать искусственный разум, который может оказаться умнее нас и не обязан делать то, что мы от него хотим.

Особенно интересна его мысль про кадры. Во всех AI-гигантах людей нанимают из технологической индустрии — бывшие разработчики, продакт-менеджеры, инженеры стартапов. Но Робинсон признается: за три с половиной года он ни разу не встретил коллегу с опытом из авиации, атомной энергетики или финансового регулирования — отраслей, где цена ошибки исторически считается катастрофической и где выстроены десятилетиями отработанные протоколы избыточности и многоступенчатого контроля. Он предлагает конкретное: компании, создающие системы такого уровня риска, должны работать как атомные станции или загруженные аэропорты — с резервированием на каждом уровне и методичным, медленным планированием, чтобы неизбежная человеческая ошибка не открывала дверь к катастрофе.

Эта история — не первая в своем роде. В сентябре похожий демарш устроил Джейкоб Коксон, работавший исследователем и в OpenAI, и в Anthropic — он заявил, что обе компании «играют нашими жизнями», имея в виду риски самосовершенствующегося AI. Тогда гендиректор Anthropic Дарио Амодеи публично представил план более осторожного развития технологии. Волна дошла и до Белого дома: AI-руководители встретились с президентом Трампом и подписали декларацию о внедрении более строгих протоколов безопасности. Документ составили настолько наспех, что в нем умудрились с ошибкой написать название США, а юридической силы он не имеет.

Робинсон подчеркивает, что проблема шире отдельных персоналий и не решается новыми законами или громкими пресс-релизами — нужна смена самой культуры внутри компаний. Решение публично высказаться, признает он, исключительно его личное, несмотря на то что он, как и Коксон до него, нанял PR-агентство для сопровождения своего заявления. Еще он указывает на разрыв между растущей мощью моделей и тем, насколько грубыми остаются методы оценки их соответствия человеческим ценностям — тема, которую сам называет «сентиментальной», но при этом критически важной.

OpenAI отреагировала стандартным заявлением о продолжающейся работе над безопасностью: компания утверждает, что приостанавливает обучение моделей при необходимости, усиливает защиту исследовательских сред, расширяет работу со сторонними аудиторами и улучшает мониторинг в реальном времени. Слова разумные. Но конкретных метрик и независимой проверки в них нет — ровно то, на что указывает Робинсон как на корень проблемы.

Сам он честно признает долю самокритики: возможно, стоило остаться и бороться за изменения изнутри, но в режиме постоянного спринта попросту не было времени задуматься о системных реформах, не говоря уже о том, чтобы их реализовать. Поэтому вывод, к которому он пришел, звучит почти как капитуляция перед реальностью корпоративной жизни: настоящее давление ради безопасности должно идти снаружи компании, а не изнутри.

Во что углубиться:

  • Иск Джейкоба Коксона против Anthropic и OpenAI: что именно он заявил про самосовершенствующийся AI и как на это отреагировали компании
  • План Дарио Амодеи по замедлению разработки frontier-моделей в Anthropic: конкретные шаги и сроки
  • Протоколы безопасности атомной энергетики и авиации: как устроена культура избыточности и почему AI-индустрия её пока не переняла

Реклама
ЛИДЕРБОРД · 728 × 90зона «Реклама: между секциями»