Как EVMbench от OpenAI тестирует агентов искусственного интеллекта

OpenAI представила бенчмарк для тестирования агентов ИИ на смарт-контрактах: компания-разработчик ChatGPT выпустила EVMbench , новый бенчмарк, разработанный совместно с Paradigm, который отслеживает, насколько эффективно агенты ИИ могут находить, исправлять и использовать уязвимости в смарт-контрактах. Их последняя модель, GPT-5.3-Codex, показала результат 72,2% в задачах по эксплуатации уязвимостей, что более чем вдвое превышает производительность GPT-5 всего за шесть месяцев. OpenAI также выделяет 10 миллионов долларов в виде API-кредитов для поддержки разработчиков и исследователей безопасности, использующих ИИ для защитного аудита кода.

Как EVMbench от OpenAI тестирует агентов искусственного интеллекта
OpenAI представила бенчмарк для тестирования агентов ИИ на смарт-контрактах: компания-разработчик ChatGPT выпустила EVMbench , новый ... | Сетка — социальная сеть от hh.ru