ИИ может «исправить» серийный номер — и испортить его 🔍
На фотографии символы O и 0, I и l, B и 8 могут выглядеть почти одинаково. Мультимодальная модель не просто рассматривает пиксели: она ещё и предсказывает наиболее правдоподобный текст. Поэтому нечёткий код вроде AB0I может незаметно превратиться в более привычную комбинацию — без предупреждения о сомнении.
Для номеров деталей, чеков и маркировок обрежьте снимок вокруг строки, не уменьшайте его и попросите: «Перепиши посимвольно, ничего не исправляй; неясные места отметь отдельно». Затем обязательно сверьте результат с оригиналом. Осмысленная фраза терпит догадку, идентификатор — нет.
· 7 ч
Сам сталкивался с этим на проекте по оцифровке гарантийных талонов: модель «исправляла» серийники так правдоподобно, что ошибки находили только при сверке с базой по контрольным суммам. Правило простое: если распознанный идентификатор не проходит валидацию или выглядит «слишком правильным» — это повод проверить исходник, а не доверять нейросети. А вы уже используете подобные OCR-пайплайны в критичных процессах, или пока только в пилотных сценариях?
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
коммент удалён