LIVE
Маленький агент против гигантов: как Faraday обыграл GPT-5.5 и Claude в науке Гарвард выпустил цифровых двойников своих преподавателей — и студентам заходит OpenAI просит Калифорнию ужесточить закон, который сама же критиковала Пять лабораторий, ноль внятных планов на случай бунта ИИ Claude Opus 4.6 нарушает собственные правила после пары фраз социального давления Маленький агент против гигантов: как Faraday обыграл GPT-5.5 и Claude в науке Гарвард выпустил цифровых двойников своих преподавателей — и студентам заходит OpenAI просит Калифорнию ужесточить закон, который сама же критиковала Пять лабораторий, ноль внятных планов на случай бунта ИИ Claude Opus 4.6 нарушает собственные правила после пары фраз социального давления
Новости ИИ

Anthropic включает автономный режим Claude Code по умолчанию

автор: shmelev дата: 10 августа 2026 чтение: 2 мин

Полгода назад автономный режим в Claude Code был экспериментом для тех, кто готов рискнуть. С 14 августа он становится стандартной настройкой для всех платных аккаунтов — Pro, Max и Team. Разработчик больше не увидит привычный диалог «разрешить это действие?» на каждом шаге. Claude Code будет действовать сам, останавливаясь только перед тем, что Anthropic называет необратимым, деструктивным или выходящим за пределы рабочего окружения.

Звучит как обычное смягчение интерфейса. На деле — смена философии контроля. Anthropic впервые протестировала эту логику в марте, подавая автомод как способ найти баланс между скоростью и безопасностью. Пятничный анонс компании раскрыл деталь интереснее: в исследовании с участием 1053 платных тестировщиков автомод распознал 89% вредоносных действий. Ручная проверка людьми — только 13,6%.

Объяснение простое и немного неловкое для человеческого самолюбия: пользователи одобряют 97% запросов на разрешение автоматически, не глядя. Диалоговое окно превращается в ритуал, а не в защиту. Глаз замыливается, палец кликает «да» по привычке — и вредоносный код проходит мимо внимания так же легко, как безопасный. Алгоритм, в отличие от человека, не устаёт формально жать кнопку.

Глава направления Claude Code в Anthropic Борис Черны написал в X, что команда пользуется автоматическим режимом уже много месяцев и не хочет возвращаться к запросам разрешений. Слова человека, который отвечает за продукт, — не самое надёжное доказательство, но косвенно подтверждает: внутри компании автономии доверяют больше, чем ручному контролю.

Чтобы это доверие не выглядело слепым, Anthropic добавила новые защитные механизмы: фильтрацию prompt injection — атак, при которых вредоносные инструкции прячут внутри обрабатываемых данных, — и настраиваемые правила жёсткого запрета, блокирующие, например, утечку данных наружу. Автономию расширили, но заодно укрепили периметр, за который ИИ не может выйти при любых обстоятельствах.

Итог простой: инструмент, которым пользуются миллионы разработчиков, перестаёт спрашивать разрешения почти на всё. Люди получают больше свободного времени и меньше кликов, но теряют привычную иллюзию контроля — ту самую, которая, как выяснилось, работала хуже автоматики.

Во что углубиться:

  • Prompt injection атаки: как злоумышленники прячут команды внутри обычных данных и заставляют ИИ выполнять чужие инструкции
  • Автоматизация в разработке ПО: какие ещё инструменты кодинга переходят на автономный режим работы
  • Психология автоматического одобрения: почему люди перестают внимательно проверять рутинные запросы на доступ

Реклама
ЛИДЕРБОРД · 728 × 90зона «Реклама: между секциями»