Кибер-Миша
Анонс17 сен 2026· 🇺🇸 Anthropic

Anthropic: Claude ведёт 26% внутренних задач по разработке AI

2026-09-17 Anthropic опубликовала систему измерения автоматизации собственной разработки AI. По данным компании, в августе 2026 года Claude выполнял основную часть работы от постановки задачи до готового результата в 26% внутренних задач при контроле человека; в феврале доля была ниже 1%. Более 90% работы проходило на уровне, где Claude как минимум сотрудничал с сотрудниками. Полностью автономных участков разработки Anthropic не зафиксировала.

Индекс построен примерно на 15 000 задачах, собранных из рабочих записей сотрудников за июль 2026 года. Claude распределял их по 378 конечным категориям и оценивал степень автоматизации, а вес категории зависел от затраченного сотрудниками времени. По данным вендора, оценки модели и людей совпали точно в 59% случаев и различались не более чем на один уровень в 97%; независимой проверки результатов пока нет. Anthropic также сообщила примерно о 30 000 одновременно работающих внутренних агентах и более чем 1 млрд проверенных решений за август.

Для бизнеса это сигнал, что модели уже могут брать на себя крупные части инженерных и исследовательских процессов, но показатель Anthropic нельзя напрямую переносить на обычные компании. Методика опирается на внутренние данные и использует Claude для оценки работы Claude, поэтому есть риск систематической ошибки; перед сокращением штата или пересмотром сроков следует провести собственный пилот с контролем качества и трудозатрат. Денежная стоимость такой автоматизации не раскрыта, поэтому достоверно пересчитать эффект в рубли пока невозможно.

Anthropic планирует допустить независимых внешних экспертов к внутренним процессам и данным. Мы будем отслеживать результаты такой проверки, повторные замеры индекса и появление сопоставимых показателей у других лабораторий.

Первоисточник ↗