Программисты больше не нужны.

Вчера OpenAI выпустила еще две новые модели: o3-mini (для скорости) и o3-mini-high (якобы, для сложных логических задач)

Это оказалось очень кстати, потому что у меня был легкий приступ айтишного красноглазия: я решил обновить телеграм бота, который каждое утро показывает а рабочий чат метрики за прошлый день. Мы переехали на новую модель BI хранилища и теперь пришло время переключить все запросы.

Ну а поскольку программист я так себе, пришлось тестировать новую модель. И я, честно говоря, в легком шоке.

Она не только провела меня по всем этапам — помогла настроить виртуальное окружение для Python, поставить pip и все зависимости. Это в принципе и четверка могла. За несколько итераций o3-m/h поправила структуру запросов у psycopg2, переписала под новую версию библиотеки телеграма, перепилила асинхронность и отладила до начисто работающей версии. Я просто писал в чат выдачу терминала, когда скрипт падал и говорил — давай, исправь!

Интересно, можно ли прокинуть stdout через мой любимый Warp до OpenAI API, чтобы я вообще ничего не делал 😃

А теперь цифры, которые впечатляют: o3-mini-high набирает 82.74 балла на LiveBench (это такой тест для моделей). Для сравнения: ближайшие конкуренты даже близко не подобрались — o1 (69.69), Claude 3.5 Sonnet (67.13) и DeepSeek R1 (66.74).

Короче, это новый ориентир для coding-моделей. Без вариантов.

И да, даже если вы используете ChatGPT бесплатно, вы можете попробовать o3-mini (просто обновите аппку и выберите кнопку Reason или команду /reason).

Не отстаём от трендов. https://t.me/CEO_POV

#AI #кодинг