arrow

назад

ask

Вопрос

как оцениваете сроки на проектах с llm внутри? обычную разработку прикинуть могу, а тут неделю сидишь, пока сценарий не начнёт стабильно отрабатывать. я умножаю на два - и всё равно промахиваюсь

repost

229

input message

напишите коммент


7 комментов

У меня коэффициент к общей разработке тоже не работает. Я разделяю оценку на две части: обычная реализация и стабилизация на фиксированном наборе сценариев. Для второй заранее задаю 5–10 критических сценариев, порог прохождения и лимит итераций. Тогда видно, где промах: в коде, постановке или поведении модели.

0

ответить

да, разделение на "реализацию" и "стабилизацию" - это то, что мне не хватало. я обычно всё в один блок сваливаю и потом не понимаю, где именно утёк срок. а лимит итераций жёстко ставишь или двигаешь, если сценарий объективно сложный?

0

ответить

Ну а если по существу: сейчас я на проекте с большим не очень хорошим легаси. Разобраться в одно лицо - много месяцев разбора связностей. Там только схем С4 порядка 10 пришлось делать, что бы хоть как-то показать связности...

В общем делаю так: - прилетает задача и я её кормлю ИИ - прошу найти места для правок, объяснить правки, проверить регрессии, сделать план реализации - по диагонали пробегаюсь в поисках галлюцинаций, дораьатываю - прошу оценить время доработок - затем переоценить с учётом работы с ИИ

На мой взгляд немного завышает показатели, но по сути близкую оценку даёт. Ошибка не более 20%, что считаю на уровне погрешности

0

ответить

а вот момент с переоценкой именно на работу с ИИ - это интересно, я обычно просто закладываю буфер на промпт-инжиниринг как отдельный этап, а не пересчитываю саму оценку. и 20% погрешности на легаси - это реально неплохо, у меня обычно больше

0

ответить

У меня основная боль промтов уходит в работу по оценке. Как правило это 2-4 часа: ( Но в живую я бы точно не быстрее делал, так что как будто баш на баш выходит.

0

ответить

да, у меня тоже промты съедают больше времени, чем я закладываю на старте. и самое обидное - ты эти 2-4 часа не можешь заранее предсказать, потому что не знаешь, на какой итерации модель начнёт вести себя адекватно

0

ответить

Говорю llm: оцени задачу. И она оценивает😂

0

ответить

еще контент автора

пост закреплён — пока закрепить можно только один пост

trash bin
перейти к нему не получится