Из VBA в Python: как я за 3 дня собрал парсер PDF без навыка
Привет, я Даниил. 👋 Недавно жена попросила помочь с рутиной: она каждый день разбирает десятки PDF документов (включая сканы), вытаскивая из них нужные данные. Это занимало часы.
Я решил помочь.
Сначала я «навайбкодил» макрос в VBA - работало, но криво. Тогда я понял: надо брать Python. И за 3 дня (из которых 2 дня ушли на отладку) у меня получилось:
1. освоить основы Python; 2. написать парсер, который работает с любыми PDF (даже сканы - OCR через Tesseract, который уже встроен в сборку, ничего устанавливать не нужно); 3. добавить поддержку OpenAI и DeepSeek; 4. реализовать работу через HTTPS-прокси (прокси можно включить в настройках); 5. сделать интерфейс на Tkinter; 6. собрать всё в Windows-приложение (.exe).
⚠️ Важный нюанс: всё это работает не «из коробки», а через API-ключи провайдеров OpenAI или DeepSeek. Ключи нужно покупать или регистрировать отдельно; для OpenAI часто нужен ещё и VPN или прокси. Но в программе есть встроенная поддержка HTTPS прокси, так что это решаемо. Сейчас программа - это десктопный помощник: загружаешь документы, пишешь промпт, указываешь поля через «|», и на выходе — чистый Excel с нужными данными. Без лишней рутины.
Что дальше? Хочу сделать из этого APK для Android через Buildozer и Kivy. Чтобы можно было парсить документы прямо с телефона.
Если у тебя есть опыт с Android сборкой Python-приложений - буду рад советам 🙌
Кстати, я сейчас в поиске работы как CMO / Head of Marketing. Если нужен нестандартный маркетолог с продуктовым мышлением и любовью к автоматизации — напиши.
И да, я готов поделиться прогой с теми, кто хочет потестить — используй свой API-ключ (OpenAI или DeepSeek) и, если нужно, настрой прокси. Пиши в личку.
Спасибо, что дочитали.
#опыт #кейс #автоматизация #python #ai #ии #маркетинг #ищуработу #резюме #нетворкинг