🚀 Anthropic выпустила Sonnet 4.6
Anthropic представила обновлённую среднюю модель Claude Sonnet 4.6, которая по многим показателям сравнима с флагманом Opus 4.6.
Обновлённая модель стала дефолтной в claude.ai и Claude for Work. Она показала значительный рост в сложных задачах: на бенчмарке ARC-AGI-2 результат вырос с 13,6% до 58,3%. Sonnet 4.6 превзошла Opus 4.6 в офисных задачах (1633 против 1606 баллов Elo) и почти сравнялась в агентном программировании (79,6% vs 80,8%). В бета-режиме доступно контекстное окно до 1 млн токенов.
На OSWorld модель достигла 72,5%, что близко к человеку в задачах вроде заполнения форм и навигации по таблицам.