Tencent представила две новые модели машинного перевода: HY‑MT1.5-1.8B и HY‑MT1.5-7B. Если младшая модель моментально оказалась на первой строке в трендах Hugging Face, то старшая—это серьезный шаг к тому, чтобы стать новой опенсорс-SOTA в своей области.
-
HY‑MT1.5-1.8B оптимизирована для потребительского оборудования, занимает всего 1 ГБ памяти и показывает впечатляющую скорость: 0,18 с на генерацию 50 токенов. По словам разработчиков, она не только быстрая, но и по качеству превосходит многие популярные коммерческие API. Это достигается благодаря продвинутой дистилляции, где компактная модель учится, подражая более крупным и мощным аналогам.
-
HY‑MT1.5-7B — это мощный инструмент для облачных решений. Её производительность сравнима с 90-м процентилем закрытых сервисов, таких как Gemini 3.0 Pro, что открывает возможности для создания высококлассных сервисов на открытом коде.
Кроме сырой мощности, обе модели получили набор функций для продакшена:
-
33 языка и 5 диалектов. Поддержка включает не только основные языки мира, но и, например, кантонский и тамильский.
-
Настройка терминологии. Можно задать, как конкретный термин должен переводиться.
-
Контекстуальный перевод. Модель учитывает предыдущие реплики в диалоге или абзацы в документе для более связного и точного перевода.
-
Сохранение форматирования. Модель обучена работать с текстом с разметкой (например, тегами
) и сохранять его в выводе.

Tencent также подготовила квантизированные версии:
-
FP8-квантизация для наилучшего баланса скорости и качества.
-
INT4 (GPTQ) для суперкомпактного деплоя.
-
GGUF-формат для поклонников llama.cpp.
Это означает, что модель можно запустить практически на любом оборудовании — от сервера с GPU до современного ноутбука или даже одноплатника. Для квантизации Tencent использовал свой фреймворк AngelSlim.
Для удобства облачного развёртывания 7B-версии уже доступен Docker-образ.


Полезные ссылки:
Хотите быть в курсе важных новостей из мира ИИ? Подписывайтесь на наш Telegram-канал BotHub AI News.
Источник: 1, 2, 3.