Тестируем бесплатный OCR на Mac 👀
Я тут на днях решил проверить, насколько хорошо с распознаванием текста на сканах и PDF справляется встроенная система macOS.
Насколько точно она может обычный скан документа превратить в текст, который потом можно искать, переносить в таблицу, CRM или отдавать ИИ на анализ?
Для сравнения взял специализированную библиотеку docTR, которая занимает около 2,5 ГБ, и обычный офисный PDF без текстового слоя: фирменный бланк, с реквизитами, адресом и русским текстом.
Что получилось👇🏻 ➖ macOS Vision, быстрый режим — 1,19 сек и около 95% кириллицы. Ошибки единичные: «стр.ба» вместо «стр.6а»
➖ macOS Vision, точный режим — 0,75 сек и 0% кириллицы. На выходе «o6[?]eCTB0 c orpaHM4eHHOkl OTBeTCTBeHHOCTbK)»
➖ docTR — 3,64 сек плюс почти 20 секунд на загрузку моделей и тоже 0% кириллицы. «O6ueCTBO C orpahnyeHHOM OTBETCTBEHHOCTbIO».
Оказалось, что «точный» режим macOS просто не поддерживает русский язык, а «быстрый» поддерживает. По названию режима этого вообще не понять 😅
А самое печальное, что ни один из инструментов не выдал ошибку 🤪 Оба вернули результат как успешный: цифры, email и телефон на месте, длина текста правильная, 1774 знака, что тебе еще надо? 🤣
👉🏻 Если такое улетит в базу или в CRM пачкой сканов договоров — вы узнаете об этом сильно позже((
💡 Мой вердикт: встроенный OCR на Mac вполне можно брать в работу с русскоязычными документами, только если правильно выбрать режим и проверять качество на своих файлах.