Кибер-Миша

Alice AI LLM Flash

Доступна
🇷🇺 Яндекс (Alice AI / YandexGPT)·РоссияПроприетарная
Лёгкая и быстрая версия флагманской Alice AI LLM, открытая для бизнеса 28 мая 2026 года в Yandex AI Studio. Позиционируется под массовые повторяющиеся задачи: модерация пользовательского контента, классификация обращений в поддержку, диалоги с клиентами — по оценке Яндекса, это около 60% корпоративных запросов к его моделям. Стоит почти в пять раз дешевле флагманской Alice AI LLM (у которой тариф 0,5 ₽ вход / 2 ₽ выход за 1000 токенов); точные цены Flash вендор публикует в тарифах AI Studio, в открытых анонсах цифры не приводились. По данным вендора, обходит GPT-5.4 mini в 56% случаев, в диалоговых сценариях — в 73%. Технические параметры (размер, контекст) не раскрыты.
Для бизнеса

Это выбор для потоковых задач, где важна цена за штуку, а не глубина мысли: разобрать тысячи обращений, отмодерировать отзывы, вести простые диалоги. Экономика сходится именно на объёме — почти впятеро дешевле флагмана при достаточном качестве для рутины. Все козыри Яндекса на месте: рублёвый договор с российским юрлицом, дата-центры в РФ и соответствие 152-ФЗ, быстрый старт через тот же AI Studio, где живут остальные модели компании. Честно о слабостях: это осознанно «урезанная» модель — для аналитики, сложных документов и кода она не предназначена; вендор не раскрывает ни размер, ни контекст, а публичных цен в анонсах нет — считать бюджет придётся по калькулятору AI Studio. Китайские открытые модели того же класса при самостоятельном размещении могут выйти ещё дешевле, но потребуют своего железа и инженеров.

Бенчмарки
Win-rate против GPT-5.4 mini (внутренние замеры)56%данные вендора
Win-rate в диалоговых сценариях против GPT-5.4 mini73%данные вендора
История событий
28 мая 2026Релиз

Alice AI LLM Flash для бизнеса

Лёгкая модель семейства Alice AI открыта в Yandex AI Studio: почти в 5 раз дешевле флагмана, фокус на модерацию, классификацию и клиентские диалоги.

Первоисточник ↗
Цена API · за 1M токенов

Публичной цены API нет.

Спецификации
Лицензия
ДоступПроприетарная
АрхитектураНе раскрыта
Параметры
Контекст
Макс. вывод
Знания до
МодальностиТекст
Релиз28 мая 2026