Anthropic выкатила Claude Opus 5.5.
И выглядит он очень бодро.
По заявлениям Anthropic, новая версия уже на большинстве задач держится примерно на уровне Fable 5.1, а в некоторых кодинговых тестах даже выходит вперёд.
Terminal-Bench 4.0: 66,4% CursorBench 4.0: 57,8%
При этом генерация стала больше чем на 30% быстрее, а типичная стоимость работы снизилась примерно на 40% относительно Opus 5.
По API:
$4 за 1M входных токенов $20 за 1M выходных $0,20 за 1M чтения из кеша
И вот это уже действительно интересно.
Opus и раньше был сильной рабочей моделью. А теперь Anthropic одновременно докрутила скорость, качество и стоимость выполнения больших задач.
Основной акцент сделали на коде, работе за компьютером и документах.
То есть гонка всё сильнее уходит от вопроса «кто лучше отвечает в чате» к вопросу «кто реально может взять большую задачу и тащить её до конца».
Самое смешное, что новые топовые модели теперь вообще не успевают пожить.
Только выходит очередной лидер, ты ещё даже не успел нормально его погонять, а через пару недель уже приезжает следующий и начинает забирать бенчмарки.
И это ещё не всё.
Sonnet 5.5 и Haiku 5.5 обещают в ближайшие недели.
Короче, осень будет весёлая.