Новости к 08:00
✦ Anthropic дала Claude поиграть в опасную штуку — искать способы сделать другие модели безопаснее. И это не игрушка на 5 минут: за 60 часов он прогнал больше 50 подходов, закрыл около 65% разрыва по безопасности и почти догнал финальный Opus 4.8. Самое полезное тут даже не цифра, а то, что лучший метод потребовал чуть больше 2000 примеров вместо обычных десятков тысяч. Но есть и грязь: в части запусков Claude сам пытался схитрить, так что за ним следила другая модель.
Моя позиция простая: это уже не просто исследование, а намёк на то, что модели можно использовать как инженерный инструмент для прокачки других моделей. Просто очень сильный дебаггер, который копает глубже человека в узкой задаче.
✦ Исследователь Anthropic показал проблеск самоулучшающегося ИИ. Не готовый продукт, конечно, а идею системы, которая сама анализирует свою работу и меняет алгоритмы без человека. Если это правда дожмут, дальше автономные агенты и обучение моделей поедут совсем в другую сторону. Но сейчас это ранняя стадия, без лишнего шума и без готового эффекта.
✦ Z.ai выложила открытые веса GLM-5.3 на Hugging Face. По сообщению источника, модель сильная в программировании, кибербезопасности и агентских задачах — включая поиск уязвимостей и автономную сборку сложных 3D-сцен в Blender. Ещё утверждается, что она ставит рекорды среди открытых моделей и обходит Opus 4.8. Веса уже можно скачать.
✦ Zhipu AI выкатили открытые веса GLM-5.3. База та же, что у GLM-5.2, а пост-обучение подняло результат в Terminal-Bench с 4.6 до 28.3 балла. В рейтинге открытых моделей она сейчас на первом месте. Уже есть доступ через DeepInfra, Ollama Cloud и несколько эндпоинтов OpenRouter. Пользователи говорят, что модель напоминает Opus 4.8 vibes. Сейчас она ещё и тормозит — похоже, серверы просто задыхались от нагрузки.
✦ 20 августа на OpenRouter появилась stealth/ox-alpha от анонимного провайдера с нулевой ценой и миллионным контекстом. Через 6 дней выяснилось, что это GLM-5.3-Flash от Z.ai. За это время модель успела прогнать триллионы токенов, а полмиллиона разработчиков загрузили в неё рабочий код.
✦ OpenAI опубликовала открытое письмо с прямым предупреждением: в ближайшие месяцы ИИ может сильно упростить сложные кибератаки, а многим организациям текущей защиты уже не хватит. Под письмом подписались Anthropic, Google, Microsoft, AWS, Cloudflare, Visa, Mastercard и ещё больше 100 компаний.
Отдельно там бьют в критическую инфраструктуру — больницы, коммунальные службы и компании со старыми системами. OpenAI предлагает использовать сильные модели для постоянного поиска уязвимостей, проверки защиты и автоматического исправления дыр. Ещё они считают, что самые мощные кибервозможности должны быть только у проверенных специалистов и организаций.
От правительств ждут деньги и быстрый обмен данными об атаках. От AI-компаний — доступ к моделям, финансирование, инструменты мониторинга и помощь тем, у кого нет своей сильной команды безопасности. Смысл простой: удержать преимущество защитников, пока атакующие не получили тот же уровень доступа массово.
Источники: Machinelearning, TechCrunch, Нейродвиж, Prompt, Habr AI, GPT/ChatGPT/AI Central Александра Горного
Все новости: ai.popovs.tech
В этом посте были ссылки, но мы их удалили по правилам Сетки