Вчера, 3 сентября OpenAI представила GPT-6 Astra.

Что изменилось.

1. Работа на компьютере

Astra может сама открывать сайты и программы, заполнять формы, обновлять данные в CRM, работать с календарём, искать информацию, устанавливать и тестировать софт.

Модель может выполнить задачу целиком: например, создать сайт, проверить его работу, найти ошибку и попытаться исправить.

2. Документы, таблицы и презентации

Astra должна точнее соблюдать шаблон, структуру, стиль и оформление, лучше отбирать нужную информацию и меньше добавлять лишнего.

3. Длинные задачи

Модель должна лучше удерживать исходную цель, даже если по ходу работы появляются новые условия и уточнения.

Если информации немного не хватает, Astra должна продолжить работу самостоятельно и задавать вопрос только тогда, когда без ответа действительно нельзя двигаться дальше.

4. Автоматизация

AutomationBench:

GPT-5.6 Sol — 18,1% GPT-6 Astra — 41,4% Claude Fable 5.1 — 31,4%

По многошаговой автоматизации Astra сейчас впереди.

Но в общем Artificial Analysis Intelligence Index Claude Fable 5.1 выше:

Claude Fable 5.1 — 65,7 GPT-6 Astra — 61,2

То есть лидер зависит от задачи.

5. Большой контекст

На тесте с контекстом примерно до миллиона токенов:

GPT-5.6 Sol — 73,8% GPT-6 Astra — 96,3%

Это особенно важно для больших проектов, длинных чатов, крупных документов и работы в Codex.

6. Кибербезопасность

OpenAI впервые присвоила модели уровень Critical.

Во время тестирования Astra обнаружила две ранее неизвестные уязвимости.

7. Управляемость

OpenAI проверяла, насколько часто модель выходит за рамки действий, разрешённых пользователем.

GPT-5.6 Sol — 48%. Astra — 0%.

Если это подтвердится в обычной работе, для меня это одно из самых важных изменений.

Чем больше задач мы передаём модели, тем важнее не только качество результата, но и способность точно соблюдать границы задачи.

Теперь жду Astra в ChatGPT, чтобы проверить всё это уже в реальной работе.