«Думающая» Kimi K2 обошла GPT-5 в «Последнем экзамене человечества»
Moonshot AI выпустил модель Kimi K2 с открытым кодом, возможностью рассуждения и мощными агентными способностями.
Kimi K2 Thinking выполняет по 200–300 последовательных вызовов инструментов без вмешательства человека. Для решения сложных задач она рассуждает на протяжении сотен шагов. Окно контекста — 256 тысяч токенов.
Модель установила несколько рекордов в бенчмарках, оценивающих агентные задачи. В том числе, великом и ужасном Humanity’s Last Exam.
K2 Thinking уже есть на сайте https://www.kimi.com/ и в API. Режим агента добавят в ближайшее время.
В этом посте были ссылки, но мы их удалили по правилам Сетки