Minimax - к шикарному text2video добавили средненькую LLM и шикарный голос (tts)...
Сегодня день постов про MiniMax: Китайская компания MiniMax на неделе представила три модели: MiniMax-Text-01, MiniMax-VL-01 и T2A-01-HD для работы с текстом, изображениями и речью.
MiniMax утверждает, что модель MiniMax-Text-01, состоящая из 456 миллиардов параметров, работает лучше, чем недавно представленная Google модель Gemini 2.0 Flash на таких тестах, как MMLU и SimpleQA, которые измеряют способность модели решать математические задачи и отвечать на вопросы, основанные на фактах.
В целом языковая модель приятная для обычных задач обобщения текста или лёгкой беседы на уровне остальных собратьев. Прикручена удобная авторизация и есть сохранение диалогов.
Но мне не зашла: 1. Все мои задачки провалила: рассуждения есть, но все время уходит от правильного ответа. Подтвердить, что модель хороша в математике не могу... 2. На предложение добавить записи в мой календарь бодро согласилась, но в конце диалога попросила меня добавить записи руками, так как у нее нет нужного api.
Если бы мне год назад рассказали бы об этой модели, я наверное был бы в большем восторге, но сегодня уровень поднялся до небес и обычная LLM вообще не вызывает каких то супер эмоций... Использовать ее или применять другие - дело вкуса...
А вот голосовая модель и видео - огонь, но об этом в следующих постах...
Напомню, что в России, без VPN бесплатно и на русском доступны следующие языковые модели: 1. Гигачат (веб и телеграм). 2. Яндекс Нейро. 3. Мистраль из Франции. 4. DeepSeek из Китая (+ AppStore) 5. Семейство моделей Qwen из Китая. 6. Облегченная модель Phi-4 от Microsoft.
Другие LLMки, включая разные версии ChatGPT, можно условно бесплатно найти на сайтах агрегаторах: you.com, DuckDuckGo или liner... Под VPN доступны ChatGPT, Gemini и скоро ожидаем Grok-3.