В продолжение к посту выше:
мне нужно было поработать с проектом и изменить его архитектуру.
== Дал доступ к репозиторию для Codex и задал вопрос.
== Загрузил код репозитория в обычный Gemini.
В итоге обе нейросети сработали быстро, но Codex был невероятно лаконичен, а Gemini за два запроса выдал мне 16 страниц текста. При этом по качеству и точности ответа Gemini был значительно круче. Получается, что бенчмарки, которыми модели между собой меряются, не совсем соответствуют реальности — нужно тестировать самостоятельно и выбирать ту модель, которая больше нравится по ответам. Все эти рейтинги, увы, привирают.
В целом, мне не очень нравится код, который пишут GPT-o3/o4 и Codex — они сильно уступают по конечному результату и "заботе" о читаемости. Claude и Gemini по умолчанию пишут документацию, комментарии к коду и любят добавлять тесты.
В общем, Codex пока скорее разочаровывает. Посмотрим, как они будут развиваться дальше.
мой канал: https://t.me/oh_my_zen