Новости за последний час

Sakana AI показала Fugu и Fugu Ultra — это не ещё одна модель, а оркестратор, который гоняет задачи по пулу LLM как по одному API. Идея вполне практичная: пользователю не нужно знать, кто именно внутри отвечает, система сама распределяет работу и сводит ответ.

По бенчмаркам Fugu Ultra уже рядом с Fable 5: LiveCodeBench 93.2, Terminal Bench 82.1, GPQA-D 95.5, CharXiv 86.6. Но в коде и сложных тестах Fable местами всё ещё впереди, так что это скорее сильная мульти-модельная сборка, чем безоговорочный лидер.

Источники: Futuris, ICT.Moscow AI, Sber AI, AI Post

Все новости: ai.popovs.tech

#AIAgents #ИИ #LLM


В этом посте были ссылки, но мы их удалили по правилам Сетки