Vibecode report 1

Недавно OpenAI выкатили сразу кипу обновлений. Поэтому делюсь своими наблюдениями и идеями, краденными у других AI-энтузиастов.

1. Что делать, если ChatGPT просит подтвердить номер телефона, чтобы войти в аккаунт? На сайте можно запросить сообщение на иностранный номер: на сайт приходит код, и ты снова в своём личном кабинете. Я советую использовать экзотические номера. В первый раз я ввёл номер от США, и GPT сказал, что этот номер в базе общедоступных, поэтому сообщение на него отправлять не будет. Потом взял японский номер, и всё получилось.

2. Модели, лимиты и субагенты С каждым обновлением использование старых моделей становится невыгодным. Например, как бы мы ни жаловались на sol-5.6, он был умнее и дешевле по токенам, чем 5.5-xhigh. То же самое и с Astra GPT-6 по сравнению с солом. Ещё до выхода Astra я начал сталкиваться с тем, что на подписке Plus у меня очень быстро испаряются лимиты. Пятичасовые уходили примерно за час работы. Тогда я просил модель работать через субагентов, то есть просил составить план работы, разбить его между агентами; потом будут агенты, которые склеивают куски работы от отдельных агентов, и есть ещё revision-агенты, которые проводят тесты и проверяют, что всё работает. С выходом Astra многие стали жаловаться на то, что подписка сжигается очень быстро. Даже у меня, а если представим какое-то сложное SaaS-outreach агентство, где надо контролировать сотни вещей, — это вам не CRM пилить.

Так вот, оказывается, что Астра очень любит жонглировать субагентами и вместо того, чтобы выполнять задачи самостоятельно с полной отдачей, она делегирует задачи субагентам, которые как-то их решают. Вероятно, за счёт этого и поднимается скорость ответа; в то же время за счёт этого токены разлетаются как горячие пирожки. Астра съедала 5-часовой лимит примерно за полчаса. После того как я её попросил вообще не использовать субагентов и решать все задачи только самой, она стала кушать в разы меньше: я работаю на medium сразу в нескольких сессиях часами, а лимит никак не тратится. Также скорость практически не упала, а качество возросло. Из того, что я слышал от других: есть проблема того, что Астра рекурсивно ищет ошибки и не останавливается, пока всё не найдёт, и из-за этого она не останавливается и какую-то простую таску мусолит часами.

Можно попросить её не делать одно исправление, а смотреть все потенциальные исправления, все их делать сразу, а потом все их сразу тестировать и работать такими большими волнами. Тогда модель не будет во время тестов срываться и исправлять ошибку, а потом снова прогонять тесты, которые уже могут быть неактуальными.

Я попросил Астру рассказать мне про самые важные изменения, и вот что она мне выдала: Самые важные изменения:Без субагентов. Ассистент выполняет работу самостоятельно, включая проверку результата. • Сначала весь объём задачи. Перед исправлениями изучает связанные проблемы и составляет полный список необходимого до финиша. • Исправления широкими итерациями. Выполняет текущий список, затем запускает общую волну проверок. Собирает все найденные проблемы перед следующей партией исправлений. • Устранение причины с сохранением полезного. Исправление должно сохранять функции, данные, историю и связи между объектами. • Без бессмысленных повторных проверок. Пригодные результаты переиспользуются; повтор нужен при изменениях, ошибках или конкретной неопределённости. • Один источник общих правил. Подробные рекомендации по изображениям, веб-дизайну, текстам, Kimi/Qwen и серверам подключаются по теме задачи.

Нужно понимать, что, так как модели постоянно меняются, выходят обновления, то вся информация, о которой рассказывают другие и я, — это просто гипотезы, которые сработали и, вероятно, сработают у вас. Нейронка будет толдычить, что информация непроверенная и неподтверждённая, но кто там такой будет её проверять и подтверждать? Надо впитывать информацию от наших братьев и сестриц вайбдрочеров и применять её

Vibecode report 1 | Сетка — социальная сеть от hh.ru