Тестируем бесплатный OCR на Mac 👀

Я тут на днях решил проверить, насколько хорошо с распознаванием текста на сканах и PDF справляется встроенная система macOS.

Насколько точно она может обычный скан документа превратить в текст, который потом можно искать, переносить в таблицу, CRM или отдавать ИИ на анализ?

Для сравнения взял специализированную библиотеку docTR, которая занимает около 2,5 ГБ, и обычный офисный PDF без текстового слоя: фирменный бланк, с реквизитами, адресом и русским текстом.

Что получилось👇🏻 ➖ macOS Vision, быстрый режим — 1,19 сек и около 95% кириллицы. Ошибки единичные: «стр.ба» вместо «стр.6а»

macOS Vision, точный режим — 0,75 сек и 0% кириллицы. На выходе «o6[?]eCTB0 c orpaHM4eHHOkl OTBeTCTBeHHOCTbK)»

docTR — 3,64 сек плюс почти 20 секунд на загрузку моделей и тоже 0% кириллицы. «O6ueCTBO C orpahnyeHHOM OTBETCTBEHHOCTbIO».

Оказалось, что «точный» режим macOS просто не поддерживает русский язык, а «быстрый» поддерживает. По названию режима этого вообще не понять 😅

А самое печальное, что ни один из инструментов не выдал ошибку 🤪 Оба вернули результат как успешный: цифры, email и телефон на месте, длина текста правильная, 1774 знака, что тебе еще надо? 🤣

👉🏻 Если такое улетит в базу или в CRM пачкой сканов договоров — вы узнаете об этом сильно позже((

💡 Мой вердикт: встроенный OCR на Mac вполне можно брать в работу с русскоязычными документами, только если правильно выбрать режим и проверять качество на своих файлах.