Вчера, 3 сентября OpenAI представила GPT-6 Astra.
Что изменилось.
1. Работа на компьютере
Astra может сама открывать сайты и программы, заполнять формы, обновлять данные в CRM, работать с календарём, искать информацию, устанавливать и тестировать софт.
Модель может выполнить задачу целиком: например, создать сайт, проверить его работу, найти ошибку и попытаться исправить.
2. Документы, таблицы и презентации
Astra должна точнее соблюдать шаблон, структуру, стиль и оформление, лучше отбирать нужную информацию и меньше добавлять лишнего.
3. Длинные задачи
Модель должна лучше удерживать исходную цель, даже если по ходу работы появляются новые условия и уточнения.
Если информации немного не хватает, Astra должна продолжить работу самостоятельно и задавать вопрос только тогда, когда без ответа действительно нельзя двигаться дальше.
4. Автоматизация
AutomationBench:
GPT-5.6 Sol — 18,1% GPT-6 Astra — 41,4% Claude Fable 5.1 — 31,4%
По многошаговой автоматизации Astra сейчас впереди.
Но в общем Artificial Analysis Intelligence Index Claude Fable 5.1 выше:
Claude Fable 5.1 — 65,7 GPT-6 Astra — 61,2
То есть лидер зависит от задачи.
5. Большой контекст
На тесте с контекстом примерно до миллиона токенов:
GPT-5.6 Sol — 73,8% GPT-6 Astra — 96,3%
Это особенно важно для больших проектов, длинных чатов, крупных документов и работы в Codex.
6. Кибербезопасность
OpenAI впервые присвоила модели уровень Critical.
Во время тестирования Astra обнаружила две ранее неизвестные уязвимости.
7. Управляемость
OpenAI проверяла, насколько часто модель выходит за рамки действий, разрешённых пользователем.
GPT-5.6 Sol — 48%. Astra — 0%.
Если это подтвердится в обычной работе, для меня это одно из самых важных изменений.
Чем больше задач мы передаём модели, тем важнее не только качество результата, но и способность точно соблюдать границы задачи.
Теперь жду Astra в ChatGPT, чтобы проверить всё это уже в реальной работе.