Я давненько обещал рассказать про нормальную LLM для переводов. Ну так вот…
Что за зверь?
В начале 2026 года «корпорация добра» Google выкатила TranslateGemma — семейство открытых моделей на базе архитектуры Gemma 3, заточенных исключительно под машинный перевод на 55 языков. У них есть три весовые категории: 4B, 12B и 27B параметров. И, небольшой сюрприз, они умеют переводить текст даже со встроенных картинок без дополнительного обучения.
Давид против Голиафа
Самое занятное в этой истории — эффективность. Оказывается, модель-середнячок на 12 миллиардов параметров переводит точнее, чем прошлый базовый гигант на 27 миллиардов. Что это значит для нас? То, что нейронку с качеством уровня бигтеха теперь можно запустить локально. Демо-версия, о которой пишет, например, издание Slator, доказывает: тяжеловесный софт или бэкенд больше не нужны, всё крутится прямо в окне браузера.
Почему индустрия в восторге?
По многим причинам:
— Больше не нужно параноить, что NDA-документы или медицинские карты утекут на серверы корпораций. Ведь данные не покидают жесткий диск. — Никаких подписок на облако. Скачал — пользуешься. — Младшая 4B-модель комфортно чувствует себя на обычных смартфонах.
В общем, теперь независимость от облака выглядит так: git clone https://huggingface.co/google/translategemma-4b-it (if you know, you know)
Кажется, кто-то в Кремниевой долине решил, что приватность — это новая нефть. Ну, или просто захотел насолить конкурентам с их платными API. В любом случае, мы в огромном плюсе! 😎