Google обновили модель, которая влезет даже в ваш смартфон 📱 Gemma 3n — компактная мультимодальная модель, созданная для работы прямо на устройствах.
Версия E4B стала первой моделью в категории "до 10 млрд параметров", которая набрала больше 1300 на LMArena. Неплохо для малютки.
Что в ней интересного👇🏻
▫️Работает на вашем железе. Модели требуют всего 2-3 ГБ памяти. Это значит — никаких облаков, API-ключей и платных подписок. Можно пилить фичи, которые будут работать оффлайн и не будут сливать код пользователя на сторонние сервера. Приватность, все дела.
▫️Гибкая архитектура "Матрёшка" (MatFormer). Из одной большой модели (E4B) можно достать модель поменьше (E2B), которая будет работать в 2 раза быстрее. Или даже нарезать кастомный размер под свои нужды.
▫️Улучшения в программировании и логике. Заявляют, что прокачали модель в математике, рассуждениях и в написании кода.
▫️Готовые интеграции. Модель уже поддерживается в Hugging Face Transformers, llama.cpp, Ollama, MLX и куче других инструментов.
Я уже вижу, как это можно вкрутить в IDE для локального автокомплита или в какой-нибудь мобильный клиент для анализа скриншотов с кодом 😏 Где пощупать: 👉🏻 Модели на Hugging Face 👉🏻 Поиграться в Google AI Studio