Убиваю рутину AI-агентами | Growth & Automation (n8n, Python, LLM)
· 24.08Вопрос
как оцениваете сроки на проектах с llm внутри? обычную разработку прикинуть могу, а тут неделю сидишь, пока сценарий не начнёт стабильно отрабатывать. я умножаю на два - и всё равно промахиваюсь
7 комментов
· 24.08
Ну а если по существу: сейчас я на проекте с большим не очень хорошим легаси. Разобраться в одно лицо - много месяцев разбора связностей. Там только схем С4 порядка 10 пришлось делать, что бы хоть как-то показать связности...
В общем делаю так: - прилетает задача и я её кормлю ИИ - прошу найти места для правок, объяснить правки, проверить регрессии, сделать план реализации - по диагонали пробегаюсь в поисках галлюцинаций, дораьатываю - прошу оценить время доработок - затем переоценить с учётом работы с ИИ
На мой взгляд немного завышает показатели, но по сути близкую оценку даёт. Ошибка не более 20%, что считаю на уровне погрешности
0
ответить
коммент удалён
· 24.08
а вот момент с переоценкой именно на работу с ИИ - это интересно, я обычно просто закладываю буфер на промпт-инжиниринг как отдельный этап, а не пересчитываю саму оценку. и 20% погрешности на легаси - это реально неплохо, у меня обычно больше
0
ответить
ответ удалён
· 24.08
У меня основная боль промтов уходит в работу по оценке. Как правило это 2-4 часа: ( Но в живую я бы точно не быстрее делал, так что как будто баш на баш выходит.
0
ответить
ответ удалён
· 24.08
да, у меня тоже промты съедают больше времени, чем я закладываю на старте. и самое обидное - ты эти 2-4 часа не можешь заранее предсказать, потому что не знаешь, на какой итерации модель начнёт вести себя адекватно
0
ответить
ответ удалён
· 24.08
Говорю llm: оцени задачу. И она оценивает😂
0
ответить
коммент удалён
· 24.08
У меня коэффициент к общей разработке тоже не работает. Я разделяю оценку на две части: обычная реализация и стабилизация на фиксированном наборе сценариев. Для второй заранее задаю 5–10 критических сценариев, порог прохождения и лимит итераций. Тогда видно, где промах: в коде, постановке или поведении модели.
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
коммент удалён
· 24.08
да, разделение на "реализацию" и "стабилизацию" - это то, что мне не хватало. я обычно всё в один блок сваливаю и потом не понимаю, где именно утёк срок. а лимит итераций жёстко ставишь или двигаешь, если сценарий объективно сложный?
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён