Кибер-Миша
Анонс9 июл 2026· 🇺🇸 Anthropic

Anthropic представила Embody для оценки Claude и других моделей в робототехнике

2026-07-09 Anthropic представила Embody — набор испытаний для оценки того, как Claude и другие языковые модели управляют роботами. В исследование вошли задачи с маятниками, симуляторами четвероногих и человекоподобных роботов, манипулятором и реальным Unitree Go2. Лучший сводный результат в опубликованной таблице показала Mythos Preview — 0,389, однако это данные Anthropic, независимых замеров пока нет.

Embody проверяет несколько способов управления: прямые команды приводам, написание управляющего кода, обучение контроллера и работу через готовые политики движения. Результаты показывают, что модели в основном не справляются с непосредственным управлением суставами, но лучше выполняют навигацию и перемещение предметов через готовые контроллеры и вспомогательные средства. Anthropic обещает опубликовать код в репозитории safety-research/embody, однако на дату анонса он ещё не был доступен; лицензия и окончательные условия использования не указаны.

Для производителей роботов, интеграторов и промышленных лабораторий Embody может стать общей основой для сравнения моделей до запуска на реальном оборудовании. Это помогает отделить возможности самой модели от качества камер, контроллеров и программной обвязки. Коммерческой цены у набора нет, поэтому пересчитать стоимость в рубли пока невозможно; основной риск — принять результаты лабораторных испытаний за готовность к эксплуатации. Перед внедрением стоит повторить тесты на собственном оборудовании и отдельно проверить безопасность действий.

Далее важно отслеживать фактическую публикацию исходного кода, лицензию, воспроизводимость результатов и появление независимых испытаний. До этого Embody следует считать исследовательским анонсом, а не готовым отраслевым стандартом.

Первоисточник ↗