Несколько дней использовал новый агент от OpenAI и пока что восторга не вызывает и в целом что агент, что его режим Deep Research в деле исследования RU-сегмента интернета вызывает больше вопросов, чем восторга.

Еще ранее заметил, что при глубоком исследовании к примеру рынка рекомендательных систем он перебирает кучу источников, в итоге находит 1-2 статьи на сомнительных сайтах на которые дает кучу ссылок в исследовании. А само исследование, несмотря на прямые требования о структуре, ответах на конкретные вопросы и прочих промптах состоит из воды на 95%, как Тони Роббинс. И полезной информации остаются крупицы из и так небольшого исследования. При этом у Gemini таких проблем нет, и более того, Deep Research отлично работает даже с бесплатным тарифом и строго следует гайдам.

Наблюдая за работой агента, кажется понимаю причину — из всего списка сайтов, что он пытается почитать 90% возвращают ему 50* или 40* ошибки, т.е. он даже не доходит до контента и начиная с логичных источников типа Хабра или компаний сваливается на 15+ места к сомнительным блогам типа Sostav, дневников маркетологов и прочему.

То ли он отщелкивается антиботом и настройками ИБ, то ли не может решить капчу, хотя во множестве каналов пишут про его способность обходить капчу Cloudflare.

В результате попросил его собрать презу-отчет, качество было примерно такое же, как год назад в каких-то модельках для през, практически нет дизайна и структурности, на каждый слайд пара фраз, всю инфу из презы можно легко запихнуть в 1 слайд.

В общем пока такое себе, ждем 5ую версию.

Несколько дней использовал новый агент от OpenAI и пока что восторга не вызывает и в целом что агент, что его режим Deep Research в деле исследования RU-сегмента интернета вызывает больше вопросов, че... | Сетка — социальная сеть от hh.ru