Программисты больше не нужны.
Вчера OpenAI выпустила еще две новые модели: o3-mini (для скорости) и o3-mini-high (якобы, для сложных логических задач)
Это оказалось очень кстати, потому что у меня был легкий приступ айтишного красноглазия: я решил обновить телеграм бота, который каждое утро показывает а рабочий чат метрики за прошлый день. Мы переехали на новую модель BI хранилища и теперь пришло время переключить все запросы.
Ну а поскольку программист я так себе, пришлось тестировать новую модель. И я, честно говоря, в легком шоке.
Она не только провела меня по всем этапам — помогла настроить виртуальное окружение для Python, поставить pip и все зависимости. Это в принципе и четверка могла. За несколько итераций o3-m/h поправила структуру запросов у psycopg2, переписала под новую версию библиотеки телеграма, перепилила асинхронность и отладила до начисто работающей версии. Я просто писал в чат выдачу терминала, когда скрипт падал и говорил — давай, исправь!
Интересно, можно ли прокинуть stdout через мой любимый Warp до OpenAI API, чтобы я вообще ничего не делал 😃
А теперь цифры, которые впечатляют: o3-mini-high набирает 82.74 балла на LiveBench (это такой тест для моделей). Для сравнения: ближайшие конкуренты даже близко не подобрались — o1 (69.69), Claude 3.5 Sonnet (67.13) и DeepSeek R1 (66.74).
Короче, это новый ориентир для coding-моделей. Без вариантов.
И да, даже если вы используете ChatGPT бесплатно, вы можете попробовать o3-mini (просто обновите аппку и выберите кнопку Reason или команду /reason).
Не отстаём от трендов. https://t.me/CEO_POV