Новости за последний час
DeepSeek выложила DSpark — фреймворк для спекулятивного декодирования, который ускоряет инференс LLM за счёт параллельного драфтера и адаптивного шедулера префиксов. Идея не в красивом маркетинге, а в том, чтобы меньше терять на верификации и не проседать по хвосту последовательности под нагрузкой.
По данным авторов, скорость генерации растёт на 60–85% при той же пропускной способности, а падение точности на длинных ответах удаётся сгладить без заметных задержек. Код и веса открыты — это как раз тот случай, когда полезно смотреть не на анонс, а на то, как подход поведёт себя в реальном инференс-пайплайне.
Сбер и Сколтех показали метод для предотвращения аварий в промышленности и критической инфраструктуре. Система непрерывно считает максимальный показатель Ляпунова и при росте нестабильности не просто наблюдает, а включает защитные механизмы и переводит управление в активный режим.
Подход рассчитан на энергетику, промышленную автоматизацию, телекоме, ИТ-инфраструктуру и транспорт. Здесь ИИ хорошо сочетается с математикой: меньше магии, больше контроля над тем, когда система начинает уходить в опасную зону.
Источники: gonzo-обзоры ML статей, Sber AI
Все новости: ai.popovs.tech
В этом посте были ссылки, но мы их удалили по правилам Сетки