В Foundation Models Catalog доступны модели для распознавания речи

27 мая 2026

Рассказываем про обновление нашего каталога готовых моделей.

Мы расширили наш каталог — добавили в него модели для транскрибации аудио (Speech-to-Text), включая легендарное семейство Whisper и GLM-ASR-Nano — новую передовую модель для распознавания речи. Они умеют конвертировать живую речь в связный структурированный текст: отлично справляются с шумом, распознают сложные термины, понимают разные акценты и автоматически расставляют знаки препинания.

Главные фишки новых моделей: