Лимиты в Codex и Cloud code
Если есть проблема с лимитами в работе с ИИ агентами - читайте пост до конца)
Как не упираться в лимиты, несколько советов:
- структурируйте свои промты, чаты, запросы. Самая частая ошибка - длинный, не структурированный промт. Такой промт жрет ваши токены в огромных количествах. Почему? Все просто - наш промт на русском языке обходится в среднем в 4 токена за слово. Ответ нейронки стоит в 5 раз дороже. На кривой промт нейронка выдаст длинный, дорогой ответ, а результата нужного не будет.
- используйте разные чаты. Прежде чем ответить на ваш запрос, нейронка читает предыдущую историю в чате. Чем больше сообщений в чате, тем дороже ответ. Вы не видите процесса, но все это обдумывание и анализ также кушает лимит. Также это позволит избежать "тупости" нейронки. Это называется деградацией контекста (context rot)
- для простых задач используйте более низкую модель, более низкий уровень "мозгов", если задача сложная, требует высокого уровня рассуждений, добавьте уровень для модели.
- просим нейронку отвечать коротко и по делу. Добавляем инструкции в настройках Персонализации.
- не плодим мусорные запросы типа: "Эй брат, ты не то сделал, переделывай"
- добавляйте скиллы для своего ИИ агента. Обучите скилу, или найдите уже готовый который подходит под ваши задачи.
Это малая часть, продолжение следует)