Anthropic расширяет возможности управления Claude Code, но не теряет контроль

Для разработчиков, использующих ИИ, нынешний подход к «программированию по ощущениям» часто предполагает либо тщательный мониторинг каждого действия, либо предоставление модели полной свободы действий. Компания Anthropic утверждает, что последнее обновление Claude устраняет эту дилемму, позволяя ИИ самостоятельно решать, какие действия безопасно выполнять — в определенных пределах.
Этот шаг отражает более широкую отраслевую тенденцию, при которой инструменты ИИ создаются таким образом, чтобы действовать без необходимости получения одобрения человека на каждом этапе. Ключевая задача заключается в том, чтобы найти баланс между скоростью и контролем: чрезмерные меры безопасности замедляют прогресс, в то время как их недостаток может привести к непредсказуемому и рискованному поведению. Новый «автоматический режим» Anthropic, который в настоящее время находится в стадии предварительного тестирования — то есть доступен для испытаний, но ещё не является готовым продуктом, — представляет собой новую попытку компании найти этот баланс.
Автоматический режим использует меры безопасности на базе ИИ для проверки каждого действия перед его выполнением, выявляя незапрошенное рискованное поведение и признаки «вставки подсказок» — метода атаки, при котором в обрабатываемый контент встраиваются вредоносные инструкции, заставляющие ИИ выполнять непреднамеренные действия. Действия, признанные безопасными, выполняются автоматически, а рискованные — блокируются.
По сути, это расширение существующей команды Claude Code «dangerously-skip-permissions», которая передает все принятие решений ИИ, но с дополнительным уровнем безопасности.
Эта функция основана на недавнем буме автономных инструментов для программирования от таких компаний, как GitHub и OpenAI, которые могут выполнять задачи от имени разработчиков. Однако она идет еще дальше, перекладывая решение о том, когда запрашивать разрешение у пользователя, на сам ИИ.
Anthropic не раскрыла конкретные критерии, которые использует её уровень безопасности для различения безопасных и рискованных действий — детали, которые разработчики, вероятно, захотят понять более чётко, прежде чем широко внедрять эту функцию. (TechCrunch связался с компанией для получения дополнительной информации по этому вопросу.)
Режим «Auto» появился вслед за запуском компанией Anthropic инструмента Claude Code Review — автоматического рецензента кода, который выявляет ошибки до того, как они попадают в кодовую базу, — а также Dispatch for Cowork, позволяющего пользователям назначать задачи агентам ИИ для выполнения работы от их имени.
Автоматический режим будет доступен пользователям Enterprise и API в ближайшие дни. Компания заявляет, что в настоящее время он работает исключительно с Claude Sonnet 4.6 и Opus 4.6, и рекомендует использовать новую функцию в «изолированных средах» — тестовых конфигурациях, отделенных от производственных систем, что позволяет минимизировать потенциальный ущерб в случае сбоя.
Связанная статья
Anthropic выпускает Opus 4.8 с новым инструментом для динамической организации рабочего процесса
В четверг компания Anthropic представила Opus 4.8 — новую версию своей флагманской общедоступной модели. Стоимость обновления осталась на прежнем уровне, и теперь оно доступно на всех платформах.Выпус
Sesame, стартап в сфере искусственного интеллекта, созданный основателями Oculus, дебютирует на iOS
В четверг стартап Sesame, занимающийся искусственным интеллектом и основанный создателями Oculus и другими бывшими членами команды Meta VR, представил публичную предварительную версию своих диалоговых
Frontier AI Labs отказывается раскрывать стратегии локализации неконтролируемых моделей
Последние исследования показывают, что лишь немногие ведущие лаборатории, занимающиеся ИИ, опубликовали или продемонстрировали планы реагирования на попытки выхода системы из-под контроля. План сдержи
Рекомендации по связанным специальным темам
Комментарии (0)

Для разработчиков, использующих ИИ, нынешний подход к «программированию по ощущениям» часто предполагает либо тщательный мониторинг каждого действия, либо предоставление модели полной свободы действий. Компания Anthropic утверждает, что последнее обновление Claude устраняет эту дилемму, позволяя ИИ самостоятельно решать, какие действия безопасно выполнять — в определенных пределах.
Этот шаг отражает более широкую отраслевую тенденцию, при которой инструменты ИИ создаются таким образом, чтобы действовать без необходимости получения одобрения человека на каждом этапе. Ключевая задача заключается в том, чтобы найти баланс между скоростью и контролем: чрезмерные меры безопасности замедляют прогресс, в то время как их недостаток может привести к непредсказуемому и рискованному поведению. Новый «автоматический режим» Anthropic, который в настоящее время находится в стадии предварительного тестирования — то есть доступен для испытаний, но ещё не является готовым продуктом, — представляет собой новую попытку компании найти этот баланс.
Автоматический режим использует меры безопасности на базе ИИ для проверки каждого действия перед его выполнением, выявляя незапрошенное рискованное поведение и признаки «вставки подсказок» — метода атаки, при котором в обрабатываемый контент встраиваются вредоносные инструкции, заставляющие ИИ выполнять непреднамеренные действия. Действия, признанные безопасными, выполняются автоматически, а рискованные — блокируются.
По сути, это расширение существующей команды Claude Code «dangerously-skip-permissions», которая передает все принятие решений ИИ, но с дополнительным уровнем безопасности.
Эта функция основана на недавнем буме автономных инструментов для программирования от таких компаний, как GitHub и OpenAI, которые могут выполнять задачи от имени разработчиков. Однако она идет еще дальше, перекладывая решение о том, когда запрашивать разрешение у пользователя, на сам ИИ.
Anthropic не раскрыла конкретные критерии, которые использует её уровень безопасности для различения безопасных и рискованных действий — детали, которые разработчики, вероятно, захотят понять более чётко, прежде чем широко внедрять эту функцию. (TechCrunch связался с компанией для получения дополнительной информации по этому вопросу.)
Режим «Auto» появился вслед за запуском компанией Anthropic инструмента Claude Code Review — автоматического рецензента кода, который выявляет ошибки до того, как они попадают в кодовую базу, — а также Dispatch for Cowork, позволяющего пользователям назначать задачи агентам ИИ для выполнения работы от их имени.
Автоматический режим будет доступен пользователям Enterprise и API в ближайшие дни. Компания заявляет, что в настоящее время он работает исключительно с Claude Sonnet 4.6 и Opus 4.6, и рекомендует использовать новую функцию в «изолированных средах» — тестовых конфигурациях, отделенных от производственных систем, что позволяет минимизировать потенциальный ущерб в случае сбоя.
Anthropic выпускает Opus 4.8 с новым инструментом для динамической организации рабочего процесса
В четверг компания Anthropic представила Opus 4.8 — новую версию своей флагманской общедоступной модели. Стоимость обновления осталась на прежнем уровне, и теперь оно доступно на всех платформах.Выпус
Sesame, стартап в сфере искусственного интеллекта, созданный основателями Oculus, дебютирует на iOS
В четверг стартап Sesame, занимающийся искусственным интеллектом и основанный создателями Oculus и другими бывшими членами команды Meta VR, представил публичную предварительную версию своих диалоговых
Frontier AI Labs отказывается раскрывать стратегии локализации неконтролируемых моделей
Последние исследования показывают, что лишь немногие ведущие лаборатории, занимающиеся ИИ, опубликовали или продемонстрировали планы реагирования на попытки выхода системы из-под контроля. План сдержи





Дом






