Поставил 3 модели на одну задачу — сравнил GLM 5.2, Minimax M3 и Kimi 2.7 🧪
Делаю бота. На сложном месте намеренно оставил ошибки комбинация из кружочков, наложений и текста, который должен вписываться в обводку. Задача простая по сути, но тяжёлая на стыке логики и визуала. Посмотрел, кто как справится результаты 👇
🟦 GLM 5.2 Работает медленно, но чётко — если идёшь по методике обвязок Hermes. Проблема в другом: она «слепая». Текст в обводку кружочка вставить не смогла, хотя задача описана максимально подробно. Для логики — топ. Для визуала — минус.
🟨 Minimax M3 Подразочаровал. Начал переделывать, ошибок много — даже по обвязкам. Но: на фронтенде справляется нормально, и для агентных задач тоже рабочий. Раньше сидел на нём ещё с версии 2.7.
🟩 Kimi 2.7 Сказал «перестрой логику полностью» — и она практически всё сделала без ошибок. Перестроила, логика работает. Текст пока тестирую — позже скажу, что вышло. Из трёх — для ботов мне зашла больше всего.
Итог:
GLM 5.2 — для логики по обвязкам, но визуал не её Minimax M3 — фронтенд и агенты, но на сложных переделках сыплет ошибками Kimi 2.7 — лучший баланс для ботов У меня подписка на GLM и Kimi, а Minimax — на Llama Cloud за $20. Вот такая история 😄 А вы на чём сейчас ботов пилите? Делитесь в комменты 👇