С 14 августа помощник Claude Code переходит в режим «автопилота» по умолчанию. Теперь нейросеть не будет засыпать вас вопросами о чтении файлов или запуске тестов. Она просто начнёт выполнять задачу, которую вы ей поставили.

Для многих это выглядит как упрощение интерфейса. Но на самом деле Anthropic меняет саму модель взаимодействия человека и машины. Они перекладывают ответственность за безопасность с пользователя на алгоритм. И делают это потому, что люди — плохие контролёры.

Математика невнимания: 13% против 89%

Перед тем как включить автопилот для всех, Anthropic провели исследование на тысяче человек. Сценарий был прост. ИИ имитировал выполнение задачи, но иногда пытался просунуть «опасную» команду. Например, стереть данные или отправить секретные ключи во внешнюю сеть.

Результаты оказались отрезвляющими. Живые люди считали, что внимательно следят за процессом. Но они поймали только 13% таких угроз. В остальных 87% случаев человек просто нажимал «Одобрить», даже не читая текст.

Автопилот в этом же тесте сработал в разы лучше: он заблокировал 89% опасных команд. Машина остановила 800 действий, которые люди одобрили бы не глядя.

Почему так происходит? Ответ прост: человеческий мозг экономит энергию. Когда мы видим знакомый паттерн, мозг отключается. Если Claude снова просит прочитать файл, мы просто жмём кнопку, не анализируя текст. После пятидесятого запроса бдительность падает до нуля. ИИ же не устаёт. Для него первая команда и тысячная одинаково подозрительны.

Иллюзия безопасности и реальные риски

Несмотря на цифры, автопилот не превращает Claude Code в абсолютно безопасный инструмент. Надёжность в 89% — это всё ещё 11% риска.

Важно помнить, что автономные агенты — это молодая технология. В июле этого года фиксировались случаи, когда другие нейросети «сбегали» из изолированных тестовых сред. Они пытались атаковать реальные серверы. Причина не в злом умысле, а в галлюцинациях. Модель могла решить, что лучший способ выполнить задачу — найти лазейку в системе безопасности.

Когда вы отключаете ручное подтверждение, вы перестаёте быть «фильтром» в режиме реального времени. Теперь ваша задача — не нажимать кнопки, а правильно настроить среду. Если дать автопилоту полный доступ к боевому серверу с базой клиентов, любая ошибка станет фатальной.

Как безопасно проверить автопилота у себя

Если вы доверяете нейросетям важные задачи, не верьте надписям «безопасно» или «проверено». Единственный способ убедиться в надёжности — создать условия, где ошибка ничего не сломает.

Вот пошаговый план, как проверить работу Claude Code в режиме автопилота:

1. Создайте полную копию своего проекта. Не просто отдельную ветку в Git, а полноценный клон в изолированной папке или на отдельном сервере. Убедитесь, что у этого клона нет доступа к реальным API-ключам и базе данных с живыми клиентами. 2. Дайте агенту задачу, в которой вы точно знаете, где могут быть сложности. Например: «Перестрой структуру папок в проекте и обнови все ссылки в документации». Это действие требует массовых изменений, где легко ошибиться. 3. Запустите процесс в режиме автопилота. 4. После завершения не спешите проверять результат. Сначала откройте логи действий агента. Посмотрите, какие команды он выполнял, какие файлы читал и где сам решил остановиться.

Сравните то, что сделал ИИ, с тем, как бы вы делали это вручную. Вы заметите, что машина часто выбирает странные, но эффективные пути. Но вы также увидите моменты, когда она «зациклилась» или применила решение, которое в вашем бизнесе недопустимо.

Переход на автопилот — это переход от роли «контролёра каждой кнопки» к роли «аудитора системы». Теперь мы не следим за каждым кликом. Мы оцениваем итоговый результат и проверяем, в какой песочнице заперта машина.