SeamlessM4T v2 Large
SeamlessM4T v2 Large — это модель для работы со звуком, которая поддерживает перевод по направлениям «многие → многие». Она доступна в библиотеке transformers и распространяется по лицензии cc-by-nc-4.0, что означает запрет на коммерческое использование. Модель содержит 2 309 249 669 параметров, что приблизительно равно 2,3 миллиарда, и занимает 8.6 ГБ в памяти.
| Направления перевода | многие → многие | источник выведено из данных карточки |
|---|---|---|
| Сколько языков | 96 | источник из карточки модели |
| Языки | af, am, ar, as, az, be, bn, bs, bg, ca, cs, zh, cy, da, de, el, en, et, fi, fr, or, om, ga, gl и ещё 72 | источник из карточки модели |
| Вес модели | 8.6 ГБ формат safetensors, файлов: 2 | источник из карточки модели |
| Параметров | 2 309 249 669 параметров | источник из карточки модели |
| Лицензия | cc-by-nc-4.0 | источник из карточки модели |
| Коммерческое использование | нет лицензия cc-by-nc-4.0 | источник выведено из данных карточки |
| Задача | automatic-speech-recognition | источник из карточки модели |
| Библиотека | transformers | источник из карточки модели |
| Страница | https://huggingface.co/facebook/seamless-m4t-v2-large | источник из карточки модели |
Меняется со временем
Эти значения устаревают, поэтому показаны с датой снимка.
| Загрузок за месяц | 319484 | снято 2026-08-28 |
|---|---|---|
| Отметок «нравится» | 1009 | снято 2026-08-28 |
| Последнее изменение | 2024-01-04 | снято 2026-08-28 |
Что это и кому подойдёт
Модель подходит для задач, связанных с обработкой речи, и может быть полезна в исследовательских или некоммерческих проектах, где требуется работа с несколькими языками. Среди поддерживаемых языков можно назвать английский, немецкий, французский, испанский, итальянский, китайский, японский, арабский, украинский, польский, чешский, португальский, голландский, турецкий, греческий, финский, шведский, норвежский, датский, венгерский, румынский, болгарский, сербский, хорватский, латышский, литовский, тайский, вьетнамский, хинди, бенгальский, непальский, амхарский, африкаанс, мальтийский, яванский и корейский. Всего модель охватывает 96 языков.
При выборе этой модели важно учитывать, что она не предназначена для коммерческой работы из-за лицензионных ограничений. Также следует обратить внимание на значительный размер модели — 8.6 ГБ, что может потребовать соответствующих вычислительных ресурсов. Модель размещена на платформе Hugging Face и имеет метку задачи automatic-speech-recognition, что указывает на её применение в области распознавания речи.
Текст написан по паспорту выше и переписывается, когда паспорт меняется. Снимок от 2026-08-29.
Оценки качества перевода здесь нет намеренно: сравнивать модели «кто лучше» честно можно только замером на общем наборе текстов, а своих замеров мы не делаем и чужие без ссылки на публикацию не приводим.