Как выбирать модель, чтобы не сжечь лимиты?
Вчера тестировал Fable, он за 5 промптов на режиме High выжрал 4х часовой лимит, сильного сдвига по эффективности я пока не ощутил на своих задачах. Про расходование лимитов есть мысль сделать фрейм, по которому исходя из сложности и типа запроса будет предлагаться модель.
Пока у меня только так работает: Простая задача, нет VPN -> Qwen или Deepseek Что-то важное и VPN есть -> почти всегда Claude.
Раньше использовал Perplexity в Comet, но бесплатная модель в последнее время знатно проседает.
А у вас есть свой принцип выбора модели по сложности, цене или удобству?