AI научили тратить заметно меньше токенов на размышления
Платформа для запуска AI-моделей Fireworks представила Ember-1 — дообученную версию Kimi K3. По внутренним тестам, она расходует примерно на 40% меньше токенов при сопоставимом качестве ответов. Модель учили сокращать лишние рассуждения и повторения, сохраняя полезную самопроверку.
В тестах на реальных задачах двух клиентов Ember-1 сократила расход токенов примерно на треть. Один из клиентов уже начал использовать её вместо исходной модели.
Результаты тестов близки, хотя не везде одинаковы: например, в SWE-bench Verified Ember-1 набрала 92.2% против 93.2% у Kimi K3 на максимальном уровне рассуждений.
Модель уже доступна через API Fireworks. Цена за токен осталась на уровне Kimi K3 — экономия достигается за счёт их меньшего количества. Пока это исследовательский релиз с доступом на две недели, дальше будут смотреть на спрос.