Anthropic расширяет возможности управления Claude Code, но не теряет контроль

Для разработчиков, использующих ИИ, нынешний подход к «программированию по ощущениям» часто предполагает либо тщательный мониторинг каждого действия, либо предоставление модели полной свободы действий. Компания Anthropic утверждает, что последнее обновление Claude устраняет эту дилемму, позволяя ИИ самостоятельно решать, какие действия безопасно выполнять — в определенных пределах.
Этот шаг отражает более широкую отраслевую тенденцию, при которой инструменты ИИ создаются таким образом, чтобы действовать без необходимости получения одобрения человека на каждом этапе. Ключевая задача заключается в том, чтобы найти баланс между скоростью и контролем: чрезмерные меры безопасности замедляют прогресс, в то время как их недостаток может привести к непредсказуемому и рискованному поведению. Новый «автоматический режим» Anthropic, который в настоящее время находится в стадии предварительного тестирования — то есть доступен для испытаний, но ещё не является готовым продуктом, — представляет собой новую попытку компании найти этот баланс.
Автоматический режим использует меры безопасности на базе ИИ для проверки каждого действия перед его выполнением, выявляя незапрошенное рискованное поведение и признаки «вставки подсказок» — метода атаки, при котором в обрабатываемый контент встраиваются вредоносные инструкции, заставляющие ИИ выполнять непреднамеренные действия. Действия, признанные безопасными, выполняются автоматически, а рискованные — блокируются.
По сути, это расширение существующей команды Claude Code «dangerously-skip-permissions», которая передает все принятие решений ИИ, но с дополнительным уровнем безопасности.
Эта функция основана на недавнем буме автономных инструментов для программирования от таких компаний, как GitHub и OpenAI, которые могут выполнять задачи от имени разработчиков. Однако она идет еще дальше, перекладывая решение о том, когда запрашивать разрешение у пользователя, на сам ИИ.
Anthropic не раскрыла конкретные критерии, которые использует её уровень безопасности для различения безопасных и рискованных действий — детали, которые разработчики, вероятно, захотят понять более чётко, прежде чем широко внедрять эту функцию. (TechCrunch связался с компанией для получения дополнительной информации по этому вопросу.)
Режим «Auto» появился вслед за запуском компанией Anthropic инструмента Claude Code Review — автоматического рецензента кода, который выявляет ошибки до того, как они попадают в кодовую базу, — а также Dispatch for Cowork, позволяющего пользователям назначать задачи агентам ИИ для выполнения работы от их имени.
Автоматический режим будет доступен пользователям Enterprise и API в ближайшие дни. Компания заявляет, что в настоящее время он работает исключительно с Claude Sonnet 4.6 и Opus 4.6, и рекомендует использовать новую функцию в «изолированных средах» — тестовых конфигурациях, отделенных от производственных систем, что позволяет минимизировать потенциальный ущерб в случае сбоя.
Связанная статья
Google тестирует агента Remy AI для Gemini по мере смещения фокуса на управление пользователями
Согласно Business Insider, Google тестирует Remy, нового ИИ-персонального агента для Gemini. Этот инструмент предназначен для выполнения задач от имени пользователей, упрощая как профессиональные рабочие процессы, так и повседневные рутины.В настоящ
Anthropic выходит на рынок юридических технологий ИИ по мере усиления конкуренции
Anthropic unveiled a suite of new chatbot capabilities on Tuesday, aimed at delivering automated support to legal practices. Эти инструменты были представлены во вторник и направлены на предоставление автоматизированной поддержки юридическим фирмам.
OpenAI сокращает разрыв с Anthropic среди бизнес-пользователей, показывают новые данные
Поскольку IPO компаний OpenAI и Anthropic всё ещё отдалены, а детализированные финансовые отчёты не опубликованы, нам приходится обращаться к альтернативным индикаторам для оценки их бизнес-показателей. Платформа корпоративных кредитных карт и управл
Рекомендации по связанным специальным темам
Комментарии (0)

Для разработчиков, использующих ИИ, нынешний подход к «программированию по ощущениям» часто предполагает либо тщательный мониторинг каждого действия, либо предоставление модели полной свободы действий. Компания Anthropic утверждает, что последнее обновление Claude устраняет эту дилемму, позволяя ИИ самостоятельно решать, какие действия безопасно выполнять — в определенных пределах.
Этот шаг отражает более широкую отраслевую тенденцию, при которой инструменты ИИ создаются таким образом, чтобы действовать без необходимости получения одобрения человека на каждом этапе. Ключевая задача заключается в том, чтобы найти баланс между скоростью и контролем: чрезмерные меры безопасности замедляют прогресс, в то время как их недостаток может привести к непредсказуемому и рискованному поведению. Новый «автоматический режим» Anthropic, который в настоящее время находится в стадии предварительного тестирования — то есть доступен для испытаний, но ещё не является готовым продуктом, — представляет собой новую попытку компании найти этот баланс.
Автоматический режим использует меры безопасности на базе ИИ для проверки каждого действия перед его выполнением, выявляя незапрошенное рискованное поведение и признаки «вставки подсказок» — метода атаки, при котором в обрабатываемый контент встраиваются вредоносные инструкции, заставляющие ИИ выполнять непреднамеренные действия. Действия, признанные безопасными, выполняются автоматически, а рискованные — блокируются.
По сути, это расширение существующей команды Claude Code «dangerously-skip-permissions», которая передает все принятие решений ИИ, но с дополнительным уровнем безопасности.
Эта функция основана на недавнем буме автономных инструментов для программирования от таких компаний, как GitHub и OpenAI, которые могут выполнять задачи от имени разработчиков. Однако она идет еще дальше, перекладывая решение о том, когда запрашивать разрешение у пользователя, на сам ИИ.
Anthropic не раскрыла конкретные критерии, которые использует её уровень безопасности для различения безопасных и рискованных действий — детали, которые разработчики, вероятно, захотят понять более чётко, прежде чем широко внедрять эту функцию. (TechCrunch связался с компанией для получения дополнительной информации по этому вопросу.)
Режим «Auto» появился вслед за запуском компанией Anthropic инструмента Claude Code Review — автоматического рецензента кода, который выявляет ошибки до того, как они попадают в кодовую базу, — а также Dispatch for Cowork, позволяющего пользователям назначать задачи агентам ИИ для выполнения работы от их имени.
Автоматический режим будет доступен пользователям Enterprise и API в ближайшие дни. Компания заявляет, что в настоящее время он работает исключительно с Claude Sonnet 4.6 и Opus 4.6, и рекомендует использовать новую функцию в «изолированных средах» — тестовых конфигурациях, отделенных от производственных систем, что позволяет минимизировать потенциальный ущерб в случае сбоя.
Anthropic выходит на рынок юридических технологий ИИ по мере усиления конкуренции
Anthropic unveiled a suite of new chatbot capabilities on Tuesday, aimed at delivering automated support to legal practices. Эти инструменты были представлены во вторник и направлены на предоставление автоматизированной поддержки юридическим фирмам.
OpenAI сокращает разрыв с Anthropic среди бизнес-пользователей, показывают новые данные
Поскольку IPO компаний OpenAI и Anthropic всё ещё отдалены, а детализированные финансовые отчёты не опубликованы, нам приходится обращаться к альтернативным индикаторам для оценки их бизнес-показателей. Платформа корпоративных кредитных карт и управл





Дом






