За месяц бесплатный ИИ сделал гиперскачок: китайцы накатывают монстров Kimi 2 — теперь еще и агент Бесплатно (!) можно дать сложную задачу — он сам порежет её на куски и будет выполнять. Поддерживает длиннющий контекст (до 256k токенов). Можно даже запускать в облаке через Ollama как агента. Для программистов и ресёрчеров — прямо «чёрный кофеёк, да прямо в вену».

Ollama — вышла в облака В свежей версии добавили запуск облачных моделей. Раньше был только локальный LLM, а теперь можно дергать мощь серваков. Ну и недавно также обновилась прога и появилась оболочка чата.

GLM 4.6 от z.ai Китайцы не спят: новая версия этой ИИ уже считается круче Kimi 2. Скорость, понимание, кодинг — невероятный топ.

Qwen3 от Alibaba По качеству рассуждений и кода держится рядом с Kimi K2 и DeepSeek. Но! Kimi выдаёт больше кода и с меньшим количеством ошибок. Тут — спор на уровне «у кого мотор громче», но факт: у Kimi пока меньше багов.

Бомба недели — Reflection Llama-3.1 70B Первая открытая нейронка, которая реально учится на своих ошибках в процессе работы. Думает по схеме: → → . Вшитые токены размышлений, а не «подсунутый промпт». На задачах математики и логики бьёт стоковый Llama-3.1 на +10% точности. Бесплатно лежит на HuggingFace, но железо пока нужно очень мощное: от 40GB GPU или 24GB с квантами. Минусы: на русском пока слабовата, выдача длиннее, ошибки и опечатки. На англ. норм. Полностью открытая, можно менять и дообучать. Вероятно подобные системы и станут прорывными в науке в ближайшее время.