audio.cpp 0.7 добавил поддержку 62 семейств аудиомоделей
2026-08-26 вышел audio.cpp 0.7 — обновление среды для локальной работы с моделями речи и звука. Число поддерживаемых семейств выросло с 49 до 62, а вариантов — с 70+ до 85+. В список вошли MiniMax Music 3, MagpieTTS, PersonaPlex, MeanVC2, AudioSR, ControlFoley, FireRedTTS3, FireRedAudio, MiDashengLM-Gen, Granite Speech 5.0 TurboCTC и MOSS-VoiceGenerator.
Главное прикладное изменение — Arena UI: один исходный запрос можно одновременно поставить в очередь для нескольких локальных моделей или вариантов GGUF, а затем сопоставить результаты, показатели и порядок выполнения. Среда охватывает синтез и распознавание речи, преобразование голоса, генерацию музыки и звуковых эффектов. Она работает на Windows, Linux и macOS, поддерживает NVIDIA, AMD, Apple Silicon и центральные процессоры; исходный код распространяется по лицензии MIT.
Для бизнеса релиз упрощает предварительный выбор аудиомодели без отдельных сценариев тестирования и передачи записей внешнему API. Само ПО бесплатно — 0 рублей, но итоговые расходы определяются оборудованием, электроэнергией и сопровождением; сопоставимой оценки полной стоимости владения разработчики не приводят. Основной риск — заявленные показатели скорости получены авторами проекта на отдельных конфигурациях, независимых замеров пока нет, поэтому перед внедрением следует проверить качество, задержку и потребление памяти на собственных данных.
Далее важно отслеживать стабильность новых интеграций, наличие готовых пакетов GGUF и результаты испытаний на распространённых видеокартах. Отдельной проверки требуют лицензии весов каждой модели: лицензия MIT для audio.cpp не распространяется автоматически на подключаемые модели.