Whisper large-v3
Whisper large-v3 — это модель для распознавания речи, доступная под лицензией Apache 2.0, что разрешает коммерческое использование. Она распространяется через библиотеку transformers и размещена на Hugging Face. Модель содержит 1 543 490 560 параметров (около 1,54 миллиарда) и весит 8.63 ГБ.
| Сколько языков | 99 | источник из карточки модели |
|---|---|---|
| Языки | en, zh, de, es, ru, ko, fr, ja, pt, tr, pl, ca, nl, ar, sv, it, id, hi, fi, vi, he, uk, el, ms и ещё 75 | источник из карточки модели |
| Вес модели | 8.63 ГБ формат safetensors, файлов: 3 | источник из карточки модели |
| Параметров | 1 543 490 560 параметров | источник из карточки модели |
| Лицензия | apache-2.0 | источник из карточки модели |
| Коммерческое использование | да лицензия apache-2.0 | источник выведено из данных карточки |
| Задача | automatic-speech-recognition | источник из карточки модели |
| Библиотека | transformers | источник из карточки модели |
| Страница | https://huggingface.co/openai/whisper-large-v3 | источник из карточки модели |
Меняется со временем
Эти значения устаревают, поэтому показаны с датой снимка.
| Загрузок за месяц | 4359272 | снято 2026-08-28 |
|---|---|---|
| Отметок «нравится» | 6194 | снято 2026-08-28 |
| Последнее изменение | 2024-08-12 | снято 2026-08-28 |
Что это и кому подойдёт
Модель поддерживает 99 языков, включая английский, немецкий, французский, испанский, итальянский, китайский, японский, арабский, украинский, польский, чешский, португальский, голландский, турецкий, греческий, финский, шведский, норвежский, датский, венгерский, румынский, болгарский, сербский, хорватский, латышский, литовский, тайский, вьетнамский, хинди, бенгальский, непальский, амхарский, африкаанс, мальтийский и корейский. Это делает её подходящей для проектов, где требуется обработка речи на разных языках.
При выборе этой модели важно учитывать её размер: 8.63 ГБ, что может потребовать значительных вычислительных ресурсов для загрузки и выполнения. Модель предназначена для задачи автоматического распознавания речи (automatic-speech-recognition) и интегрируется через библиотеку transformers, что упрощает её использование в существующих пайплайнах обработки звука.
Текст написан по паспорту выше и переписывается, когда паспорт меняется. Снимок от 2026-08-29.
Оценки качества перевода здесь нет намеренно: сравнивать модели «кто лучше» честно можно только замером на общем наборе текстов, а своих замеров мы не делаем и чужие без ссылки на публикацию не приводим.