Ноль провалов на Kimi K3 - плохой аргумент в её пользу

Мой рабочий стек - Kimi K3 от Moonshot AI. Откатов назад не было ни одного. Я почти собрал из этого пост-рекомендацию, а потом посмотрел на собственный список задач и понял, что рекомендовать нечего. Доступ беру через API напрямую и через OpenRouter. Три класса задач. Парсинг и сбор данных: цены и остатки конкурентов, отзывы из карточек, выгрузки по позициям. Анализ больших массивов: закинул историю позиций по 80 SKU целиком, получил сводку с выводами, резать на куски и склеивать результаты не пришлось - контекстное окно на миллион токенов держит. Код: скрипты автоматизации, интеграции по API, сценарии в n8n и Make. Ни одной задачи, где я сказал бы «верни как было» и ушёл обратно на Claude. Теперь посмотрите на этот список ещё раз. Данные, таблицы, код. Всё структурное. Русский текст, который увидит клиент, я модели не отдавал ни разу: ни описаний карточек, ни ответов на отзывы, ни писем в поддержку. Провалов нет по скучной причине. Я не заходил в зону, где они случаются. Мой результат описывает мою границу и ничего не говорит о том, как эта модель пишет по-русски. Данных по этому вопросу у меня нет, и признать это честнее, чем выдать отсутствие эксперимента за успешный эксперимент. Второе основание, на котором держался выбор, - «китайский опенсорс дешевле». Сверил 6 августа. K3: 3 доллара за миллион входящих токенов, 15 за исходящие. Claude Sonnet 5: те же 3 и 15, причём до 31 августа он идёт по вводной цене 2 и 10 и прямо сейчас выходит дешевле. Разница по бренду исчезла. Экономия живёт в трёх других местах. Первое - подбор модели под класс задачи. Kimi K2.7 Code стоит 0.95 и 4 доллара за миллион, втрое дешевле обоих флагманов, и для рутинного кода его хватает с запасом. Гонять флагман там, где справится младшая модель, дороже, чем ошибиться с поставщиком. Второе - кэш. Попадание у K3 обходится в 30 центов за миллион против 3 долларов на холодном запросе, разница десятикратная. Если у Вас скрипт с одинаковой шапкой промпта уходит на сервер 200 раз в день, это самый крупный рычаг в стеке, и к выбору поставщика он отношения не имеет. Третье - как считаются рассуждения. У K3 они включены всегда, отключить нельзя, и токены рассуждений идут как исходящие по 15 долларов. Длинная цепочка размышлений обходится дороже видимого ответа. Пакетной скидки для K3 тоже нет, хотя для младших моделей Moonshot она есть. Что с этим делать, если мысль «перевести всё на китайцев» уже поселилась. Возьмите 5 задач, которые в июле делали руками. Прогоните каждую через свою текущую модель и через вторую, положите результаты рядом. Вопрос для сравнения один: эту версию я отправил бы клиенту? Порог перевода тоже один - справилась не хуже. Граница, которую держу руками: любой русский текст, который увидит клиент, проходит через человека перед отправкой. Структурные задачи идут без меня. У кого собран гибридный стек - какая модель на каком классе задач и по какому признаку Вы её туда поставили? Отдельно интересен рабочий вариант для русского текста, у меня его нет. Пишите в комменты или в DM, соберём общую карту.

Ноль провалов на Kimi K3 - плохой аргумент в её пользу | Сетка — социальная сеть от hh.ru