Falcon-H1 34B
ДоступнаСтаршая модель гибридной линейки Falcon-H1 от Technology Innovation Institute (Абу-Даби): в каждом блоке параллельно работают обычное внимание и Mamba-2 (SSM), причём соотношение головок двух типов настраивается. 34B параметров, контекст 256K, вывод до 16K токенов, срез знаний — 31 марта 2025 года. По данным вендора, инструкт-версия сопоставима с моделями класса 70B, а на длинных последовательностях даёт до 4x по входной и до 8x по выходной пропускной способности против Qwen2.5-32B; независимые сводные замеры в справочниках не зафиксированы. Нативно поддерживает 18 языков, включая русский. Линейка анонсирована в мае 2025 года, полный технический отчёт вышел в конце июля 2025-го; лицензия Falcon LLM License 2.0 на базе Apache 2.0.
Для бизнеса
За счёт SSM-части дешевле в инференсе на длинных контекстах, чем чистые трансформеры того же размера, и русский входит в число нативных языков. Лицензия пермиссивная, но со своими условиями TII — проверить текст перед коммерческим использованием.
Бенчмарки
Подтверждённых оценок пока нет. Мы не смешиваем заявления вендоров с независимыми замерами — методология.
История событий
31 июл 2025Релиз
Релиз Falcon-H1 34B и технический отчёт
Публикация полного технического отчёта по серии Falcon-H1; 34B — старшая модель линейки
Первоисточник ↗20 мая 2025Анонс
Анонс линейки Falcon-H1
TII представила гибридную серию attention + Mamba-2 от 0.5B до 34B с контекстом до 256K
Первоисточник ↗Цена API · за 1M токенов
Публичной цены API нет.
Спецификации
ЛицензияFalcon LLM License 2.0
ДоступОткрытые веса
АрхитектураГибрид (SSM)
Параметры34B
Контекст262K токенов
Макс. вывод16K токенов
Знания до31 мар 2025
МодальностиТекст, Код
Релиз31 июл 2025