
Auto mode стає типовим режимом у Claude Code
З 14 серпня нові сесії Claude Code на планах Pro, Max і Team працюватимуть в автоматичному режимі. Anthropic твердить, що класифікатор безпечніший за користувача, який натискає «дозволити».
Що змінюється 14 серпня
Anthropic зробила auto mode типовим режимом у Claude Code. Від 14 серпня нові сесії на планах Pro, Max і Team запускатимуться в автоматичному режимі; ті, хто вже закріпив інший варіант, збережуть його, решта можуть побачити одноразове запитання про перехід. Класифікатор витрачає кілька додаткових токенів на кожен виклик інструмента, і компанія більше не стягує цю плату з користувачів цих планів.
У Claude Enterprise, Claude API, Claude Platform на AWS, Amazon Bedrock, Agent Platform від Google Cloud і Microsoft Foundry режим поки що вмикається вручну, щоб адміністратори встигли оцінити зміну. Протягом наступного місяця компанія разом із хмарними партнерами планує зробити його типовим; адміністратори Enterprise уже можуть увімкнути його через managed settings.
Як це працює і навіщо
Замість запитів на підтвердження auto mode пропускає кожен виклик через класифікатор, який блокує незворотні, руйнівні дії або дії поза межами середовища користувача. Коли дію заблоковано, Claude зазвичай знаходить безпечніший шлях або питає користувача; якщо прогресу немає — три блокування підряд або двадцять за сесію — система повертається до ручних підтверджень.
Аргумент простий: ручна перевірка стає звичкою. У Claude Code користувачі схвалюють 97% запитів на дозвіл, водночас відхиляючи 39% поданих планів.
Дані про безпеку
Anthropic посилається на внутрішній і сторонній ред-тимінг, оцінювання prompt injection, контрольоване дослідження з 1 053 оплачуваними тестувальниками та аналіз реальних сесій, заявляючи, що auto mode був не гіршим за ручну перевірку за всіма показниками. В одному тесті люди помічали явно небезпечну команду лише в 13,6% випадків (143 з 1 053), тоді як auto mode блокував 89% таких команд. Що довша сесія, то гірше працювали люди: близько 5% після 50 і більше попередніх запитів.
У двотижневому пілоті з британським стартапом Apollo Research посилений після синтетичних атак класифікатор ловив приблизно половину раніше пропущених атак, а частка пропусків знизилася з 12% до 7%. Окреме оцінювання Trajectory Labs перевірило 72 сценарії непрямого prompt injection по десять разів кожен: жодна з 720 спроб не спрацювала проти моделей Claude в auto mode, тоді як на Codex 5,83% спроб вдалися в режимі Auto-review і 19,03% у Full Access.
У продакшені
Anthropic каже, що auto mode уже типовий для внутрішнього використання Claude Code: класифікатор, зокрема, зупинив публікацію звіту на публічному сайті обміну кодом і масове завершення близько двох тисяч pod'ів, що знищило б навчальні завдання. Серед замовників режим використовують Adobe, Nuro, Gusto і Garner Health, а користувачі auto mode у командах надсилають приблизно на 25% більше pull request'ів.
SiTech — веброзробка з підтримкою AI
Створюємо швидкі та сучасні сайти й інтегруємо AI у бізнес-процеси. Маєте проєкт чи запитання? Із задоволенням допоможемо.