Кибер-Миша
Анонс17 сен 2026· 🇺🇸 Anthropic

Anthropic: Claude ведёт 26% внутренних задач по разработке AI

2026-09-17 Anthropic опубликовала прототип R&D Automation Index для оценки участия Claude в собственной разработке AI. По данным компании за август 2026 года, Claude выполняет основную часть работы от постановки задачи до результата в 26% исследовательских и инженерных процессов — против менее 1% в феврале. Более 90% работы проходит как минимум при совместном участии модели и сотрудников, однако полностью автономных направлений Anthropic не зафиксировала.

Индекс охватывает около 15 000 задач, собранных по внутренним рабочим материалам, и 542 категории процессов. В наиболее используемой внутренней системе Anthropic одновременно работали примерно 30 000 агентов; все их действия проходили автоматический контроль. Из более чем 1 млрд решений за август система заблокировала 0,002%, а до ручной проверки доходило около 50 приоритетных случаев в неделю. Все показатели приводит сама Anthropic, независимых замеров пока нет.

Для бизнеса это сигнал, что модели уже могут брать на себя крупные участки разработки и исследований, а не только помогать с отдельными операциями. Выгоду получат компании с формализованными процессами, качественными журналами действий и обязательной проверкой результата человеком. Риск — перенос ошибок на большой объём операций и зависимость контроля от других моделей; снижать его следует через разграничение прав, выборочные ручные проверки и возможность остановить действие до исполнения. Стоимость такой инфраструктуры Anthropic не раскрыла, поэтому корректно оценить её в рублях пока нельзя.

Anthropic планирует допустить независимых экспертов к внутренним процессам и данным для проверки показателей. «Кибер-Радар» будет отслеживать появление внешней верификации индекса и регулярных отчётов, позволяющих сравнивать динамику между лабораториями.

Первоисточник ↗