Про цену токенов и подписок на AI
Многие переживают насчет возможного роста стоимости работы с нейросетями, но вероятность многократного подорожания на данный момент всё же минимальна.
Условный Qwen3.8-Flash-Next можно локально запустить в квантованном виде даже на мини-ПК уровня Ryzen AI Max+ 395 с 128 ГБ общей памяти. Такие машины стоят примерно $3000–5000 в зависимости от производителя и конфигурации.
Скорость, судя по опубликованным тестам, вполне приемлемая для реальной работы: заметно ниже, чем у быстрых облачных провайдеров, но пользоваться моделью для разработки, работы с текстом и других повседневных задач уже вполне комфортно. При этом по совокупности бенчмарков Qwen3.8-Flash-Next находится примерно в том же классе, что и GPT-5.6 Luna, а в некоторых тестах даже превосходит её.
Поэтому мне кажется, что ситуация с ценой вычислений для LLM не настолько драматична. Если модель такого уровня уже можно запускать локально на машине стоимостью в несколько тысяч долларов, то оснований ожидать какого-то неизбежного многократного роста стоимости работы с LLM я пока не вижу. Разумеется, если само железо внезапно не подорожает ещё раза в пять.