Aleph Alpha выпустила Kolibri — открытую модель на 78,1 млрд параметров
2026-10-03 немецкая Aleph Alpha выпустила Kolibri — двуязычную модель для работы с текстом и кодом на немецком и английском языках. Архитектура Mixture-of-Experts содержит 78,1 млрд параметров, из которых при обработке каждого токена задействуются 3,46 млрд. Максимальный контекст составляет 1 048 576 токенов, однако для эффективной эксплуатации разработчик рекомендует ограничиваться 262 144 токенами.
Веса доступны на Hugging Face по лицензии Apache 2.0, поэтому модель можно развернуть у себя и доработать под внутренние процессы. Для версии FP8 требуется около 78 ГБ памяти; заявленный минимум — две NVIDIA A100 80 GB либо одна H200, B200 или B300. Цена облачного доступа не опубликована, поэтому стоимость за 1M входных и выходных токенов, а также пересчёт в рубли пока недоступны. По данным вендора, Kolibri получила 96,9 балла на AIME 2025, 85,9 на LiveCodeBench v6 и 61,4 на BFCL v4; независимых замеров пока нет.
Модель ориентирована на организации, которым нужны немецкий язык, обработка больших документов и размещение в собственной инфраструктуре: государственные учреждения, промышленность и регулируемые отрасли. Практические сценарии включают поиск по внутренним материалам, подготовку документов, программирование и автоматизацию многоэтапных операций. Основной риск — заметные требования к оборудованию и неподтверждённые внешними тестами показатели; перед внедрением стоит провести проверку на корпоративных данных и рассчитать полную стоимость серверов и сопровождения.
Aleph Alpha указывает единый срез знаний по английскому и немецкому языкам на 2026-06-18. Дальше важно отслеживать независимые оценки качества на немецком языке, поддержку распространённых средств запуска и появление коммерческого API с публичными тарифами.