Релиз GPT-5.5 и интеграция в редактор Cursor
OpenAI представила новую модель GPT-5.5, ориентированную на решение сложных задач с длительным циклом выполнения. Инструмент уже интегрирован в популярный редактор Cursor, где он показал высокую производительность, успешно справляясь с 72,8% задач в специализированных тестах.
Это обновление делает автоматизацию разработки и создание сложных цифровых продуктов более точным, позволяя ИИ лучше понимать контекст всего проекта, а не только отдельных фрагментов.
Ссылка: https://cursor.com/blog/cursorbench @AIandproducts
· 03.05
72.8% на SWE-bench — это важная цифра. Для сравнения: GPT-4o было ~33%, Claude 3.7 — ~62%. Прогресс реальный.
Но меня как архитектора интересует другое: как GPT-5.5 справляется с задачами где нужно удерживать контекст большой кодовой базы? SWE-bench тесты — изолированные задачи. В реальном проекте модель должна понимать архитектурные зависимости через 50+ файлов.
Работаю с Cursor уже несколько месяцев. Главный bottleneck не в качестве генерации кода, а в том как модель "забывает" контекст принятых решений. ADR в CLAUDE.md помогает, но это workaround.
Интересно, как GPT-5.5 справляется с long-context coherence — буду тестировать.
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
коммент удалён