Недавно Anthropic опубликовали исследование "The Hot Mess of AI", и там есть находка, которая переворачивает представление о работе ИИ. Чем дольше модель "думает" (extended thinking), тем более непредсказуемыми становятся её ошибки. Звучит контринтуитивно – мы привыкли, что больше времени на размышление улучшает результат. У ИИ всё наоборот: длительное рассуждение порождает хаос, а не логику
Авторы исследования используют точную метафору – модель не превращается в последовательного злодея, она становится "горячим месивом". Внутренние противоречия нарастают, когда токенов слишком много.
Практический вывод неожиданный: если ChatGPT или Claude выдают необычно длинный, детализированный ответ на простой вопрос – это не признак качества, а тревожный сигнал. Длина не равна надёжности. Возможно, модель как раз запуталась в собственных цепочках вывода.
Работая с ИИ последние годы, я замечаю этот паттерн регулярно – краткие ответы часто точнее развёрнутых. Но мы по инерции воспринимаем многословие как глубину анализа. Это заставляет задуматься: действительно ли больше "рассуждений" ИИ делает его умнее, или мы просто проецируем человеческую логику на нечеловеческие процессы?
· 17.02
Достаточно почитать, что происходит в Thinking - модель иногда напрямую и пишет, что пользователь задал корявый референс, или она слишком ушла в обсуждение каких-то пунктов
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
коммент удалён
· 17.02
Зависит от модели. Если это frontier можель, то будет
Если маленькая, то нет
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён
· 17.02
Ну да, я исключительно про большие. Маленькие слишком нишевые
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён