Новая модель от Baidu для мгновенного распознавания многостраничных PDF

Компания Baidu выпустила бесплатный инструмент Unlimited-OCR, который избавляет от необходимости делить длинные документы на части для обработки. Модель способна распознать 100-страничный PDF-файл за один проход, сохраняя высокую точность даже для многоязычных контрактов и архивов.

Это решение работает локально на видеокартах среднего сегмента, что позволяет компаниям автоматизировать извлечение данных из документов без затрат на облачные сервисы и передачи конфиденциальной информации третьим лицам.

Ссылка: https://github.com/baidu/Unlimited-OCR @AIandproducts