У ChatGPT и Claude есть скрытый рычаг — сколько «думать» над ответом. По умолчанию стоит экономный режим.
У OpenAI это reasoning effort: низкий, средний, высокий. У Anthropic — extended thinking с бюджетом токенов. По умолчанию везде средний уровень. Хватает на обычный вопрос. Не хватает на разбор договора аренды или план выхода в новый город.
Включить расширенное мышление вручную — значит потратить в 3-10 раз больше токенов, чем обычно. Зато модель разбирается, а не вспоминает похожие тексты из интернета первым попавшимся способом.
Перед важным решением — конкуренты, договор, цены — стоит вручную поднимать планку и просить максимальный бюджет размышления. Перед мелким вопросом — не тратьте лимит, он не бесконечный: у Claude сессия на такие запросы обнуляется каждые пять часов.
И ещё момент: на открытых рейтингах вроде LMArena модели меряются по категориям отдельно, кодинг и тексты — разные лидеры. Выбирайте модель под задачу, а не самую разрекламированную.