Как вам GPT 5?
Делюсь впечатлениями, пощупал как целевая аудитория обновления — ведь прокачали в первую очередь текстовую модель (написание осмысленного текста действительно улучшилось) и медицинский аспект. Со вторым, думаю, понятно: страховки в развитых странах дорогие. Предположу, что исходили из запроса пользователей, а это правильно, молодцы - на метриках сделали.
А вот по первому пункту могу сказать, что действительно стало лучше, но без серьезных революций. Я в основном использую нейросеть для дискавери и научных изысканий — в таких вопросах ожидал серьезного прироста.
Представили две модели - 5 и Thinking. Запросы автоматически анализируются и маршрутизируются в необходимую модель (с этим были траблы на старте - быстро поправили). С точки зрения использования и существующей путаницы (отсутствия какой-либо логики названий предыдущих моделей) — стало действительно по-царски. Обычная модель все также хорошо справляется с повседневными задачами, гуглит инфу и решает простые задачки. Отдельный жирный лайк за то что придушили (жаль не полностью) подхалимную 4о версию, которая своей неточностью в следовании инструкциям и дезинформации откровенно бесила, однако и 5.0 модель даже с простыми задачами справляется паршивенько. Но из плюсов: в тестах показало, что модель лучше всех держит контекст (по сайту контекст аренды Plus версия держит 32к).
Thinking модель интереснее — чувствуется что подросла мощность относительно о3, но и время ожидания возросло (возможно субъективно, думает реально долго). Говорят она еще стала сильно лучше в кодинге, но сам пока не добрался и сказать тут нечего. Могу отметить, что модель стала менее «послушной» и больше запросов выполняет не прям в точности как просишь, а скорее как считает «нужным». Ответы также стали очень сухими, больше похоже на о3 модель. 4.5 со своим глубоким исследованием выдает более живые и читабельные тексты.
Пощупал еще голосовой чат, но почему-то совсем сломали его — совсем не понравилось: у меня было порядка 10 попыток вести диалог, модель просто пересказывала заданную в настройках установку, потом вопрос и так по кругу. После того как установки профиля снес - ситуация не ушла и не смог никак это полечить почему-то. Простые задачки, суммация сказанного так и не вышла. Тут уж не знаю в чем проблема, первые модели (белые кружочки) справлялись лучше, жду фикса.
Смутило, что теперь нет возможности выбрать никакие предыдущие модели даже на подписке. Понятно, что обновление в первую очередь нужно было самой компании за счет кратного удешевления выполнения запросов, но отнимать возможность переключения вручную полностью - как по мне перебор. Стал активнее засматриваться в сторону Playground и Raycast решений. Радует, что и для пользователя цена ответов (для API) не выросла - у 5-й модели она такая же как у 4о, и при этом доступна продвинутая «размышляющая» модель.
Спустя недели после релиза - все еще сыро, ждем доработок. Дешевизна и увеличение запросов радует, но искусственные ограничения и сырость на данный момент не позволяют пользоваться полноценно.
· 19.08.2025
Я взял плюс чтоб полноценно опробовать без лимитов. В первый день был замечен неплохой скачок в ведении диалога. Без буллшита всякого и довольно точно. Потом они там что-то откатывали и теперь он будто +- как 4o.
А с профильными специализированными задачами так же +- на том же уровне. Чуть-чуть может лучше за счет расширенного пула токенов. Но результаты в целом на том же уровне.
Deep Research, фича которая предполагает максимальную точность и объем – все равно, что крутить рулетку.
Может выдаст все в полном объеме, а может пропустит всякое важное, или упустит контекст и додумает выводы. И если в теме разбираешься, чтобы валидировать результаты, то сидишь потом проверяешь за ботом. Все равно что гуглить вручную изначально.
И все это при выверенных промтах и небольших и максимально сфокусированных задачах, чтоб токены не разлетались на разные контексты, скипая часть информации в каждом из них.
Агентов не пробовал, но там лимит что-то вроде 20 запросов/мес. Хз что серьезное можно сделать с таким лимитом 🤷♂️.
А вот режим обучения при кратком тесте понравился. Там сам процесс взаимодействия выстроен эталонно для обучения. Вместо простых ответов, он задает вопросы стимулируя усваивать информацию. Но если углубиться, то точность этой информации, вероятно, будет хромать.
Заметил еще, что чат деградирует не так быстро, но это снова во многом вопрос ресурсов и расширенного пула токенов. Ну и галюнов, которые прям откровенно пиздят с умным видом как раньше, тоже не заметил. Хотя по мелочи бывает, конечно.
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
коммент удалён