Сколько раз ИИ уверенно отвечал вам ерунду, а вы этого не заметили?
Мой способ с этим бороться: спрашивать через опенроутер 8 моделей сразу.
Называю эту конструкцию эластиком. Фиг знает, откуда оно пошло. Прицепилось ещё в январе, когда только начинал юзать опенклоу.
СНАЧАЛА ФАКТЫ, ПОТОМ МНЕНИЯ
Собираю свежие факты обычным поиском, тремя поисковиками сразу.
Один даёт готовый разбор со ссылками. Второй свежие страницы. Третий закрывает российские темы.
Эти факты подкладываю каждой модели, чтобы она рассуждала не по памяти двухлетней давности. Под капотом у меня не передовые модели, а поколения на 2–3 старше. Задача не глубина мышления, а вариативность гипотез.
ВОСЕМЬ РОДСТВЕННИКОВ ДАЮТ ОДНО МНЕНИЕ
Дальше вопрос уходит восьми нейросетям от разных разработчиков.
Разные разработчики принципиально. Модели одного производителя ошибаются одинаково: восемь родственников дадут одно мнение, умноженное на восемь.
Сейчас в панели: DeepSeek V4 Pro, Qwen3.7 Flash, Minimax M3, Gemini 3.1 Flash Lite, Mistral Large, Nex N2 Pro, Muse Glimmer 30B, Inkling Small от Thinking Machines.
Восемь разработчиков. Восемь разных школ.
Мозг всей конструкции: Claude Code на Opus 5. Он формулирует вопрос, раздаёт углы, собирает свод. Иногда подключаю Кодекс и Грок со своих подписок, но редко. Только когда вопрос дорогой.
ОДИНАКОВЫЙ ПРОМТ = БОЛЬШЕ ВЫДУМОК
Промт пишу под каждую модель отдельно. Свой угол, свой контекст, своя постановка.
Раздашь одинаковый — модели начинают додумывать чужую роль и уходят в выдумки. Галлюцинаций больше, а разброс мнений схлопывается.
Каждой ставлю свою задачу. Одна ищет слабые места. Вторая смотрит на деньги. Третья на техническую сторону.
Одна работает вслепую, без всякой роли. Чтобы я видел: не направил ли своими формулировками весь разбор.
И одной прямо поручаю опровергнуть то, к чему придут остальные.
ГОЛОС БЕЗ ЦИТАТЫ НЕ СЧИТАЕТСЯ
Я не считаю, кто что сказал.
Из ответов выписываются конкретные спорные утверждения. Каждая модель по каждому голосует: согласна, не согласна, не знаю.
Главное правило: голос засчитывается, только если модель приведёт дословную цитату из своего же первого ответа. Не пересказ. Не «я это имела в виду». Точную фразу.
Потом отдельная проверка смотрит: цитата правда подтверждает утверждение или её притянули.
Без этого получается имитация. Все кивают, а спроси откуда — источника нет.
Отсеивается две трети голосов.
ПРАЙС ВРАЛ ВТРОЕ
Продолжение в комментариях
· 22.08
А почему не хотите превратить ваш "эластик" в полноценный MCTS? После нескольких итераций система выбирает не гипотезу, за которую "проголосовало больше моделей", а ветку с лучшим сочетанием доказательности и устойчивости к проверкам. MCTS как раз строит дерево постепенно и использует оценки состояний, чтобы балансировать исследование новых ветвей и использование уже перспективных.
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
коммент удалён