Хотел расписать апдейты по отдельным постам, но их набралось столько, что проще собрать три главных за неделю в один.
Вышел Opus 4.8
На дефолте шёл так себе, но выкручиваешь effort повыше — становится думающим и адекватным. Расплата — токены: жрёт как не в себя.
Ощущение двоякое: либо экономный, но туповатый, либо умный, но прожорливый. Сам по себе Opus приятный — если бы не аппетит.
(effort теперь отдельный регулятор рядом с выбором модели: low / high / extra / max. По дефолту — high.)
Dynamic Workflows в Claude Code
А вот это интереснее. Вместе с 4.8 завезли управление мультиагентными пайплайнами — прямо в консоли строишь пайплайн, где каждый агент делает свою часть. Claude сам бьёт задачу на подзадачи, гоняет их параллельно по субагентам и сверяет результат. Прогресс сохраняется, прерванный прогон можно продолжить.
Видно, к чему нас готовят: такая оркестрация постепенно становится стандартом. Не пробовали — стоит.
Нюанс: если вы уже собрали оркестрацию руками (на Python или ещё на чём-то), большой пользы можете не увидеть — вы это и так умеете. Но через коробку, возможно, быстрее и комфортнее. И токенов оно ест заметно больше обычной сессии, так что начинать лучше с малого. Сам пока только смотрел, как делают другие.
У Яндекса вышла Alice AI LLM Flash
В Yandex AI Studio зарелизили быструю модель. Заявка — по ряду B2B-задач обходит GPT-5.4 mini (в 56% случаев, на документах до 73%).
Прогнал на наших реальных задачах: по уровню примерно YandexGPT-Pro, но дешевле в ~5 раз. То есть массовые операции можно переводить почти без потери качества.
Большой шаг для популяризации яндексовых моделей: раньше главным ограничением была цена — при сопоставимом качестве они стоили в разы дороже. Для энтерпрайза ещё плюс — никаких трансграничных передач данных.