Ahojte,
posledné mesiace som si popri práci (Cloud DevOps) staval malé API, ktoré mi vyriešilo problém, na ktorý som narazil pri automatizácii účtovníctva: extrakciu štruktúrovaných dát z faktúr a bločkov.
Problém: väčšina hotových OCR/document-AI riešení (AWS Textract, Google Document AI a podobne) rozpozná text, ale nerozumie slovenským/českým špecifikám — nevie, že IČO, DIČ a IČ DPH sú tri rôzne veci s vlastnou checksum logikou, popletie si dátumy vo formáte DD.MM.YYYY, alebo si nevie poradiť s desatinnou čiarkou (1 234,50 mu ľahko vyjde ako 1234.5 alebo horšie). Skúšal som pár generických nástrojov a výsledky boli nepoužiteľné bez manuálnej kontroly každého riadku.
Riešenie: postavil som REST API (FastAPI + Claude Vision), ktoré:
- rozpozná a validuje IČO/DIČ/IČ DPH podľa reálneho mod-11 checksum algoritmu (a upozorní, ak sedí OCR chyba, nie fabrikuje dáta)
- správne číta SK/CZ dátumové a číselné formáty
- rozpozná lokálne pojmy priamo (Dodávateľ/Odberateľ, Variabilný symbol, Základ DPH…)
- vracia vždy jeden striktný JSON formát (Pydantic v2 schéma), vrátane confidence skóre a upozornenia, ak je dokument nečitateľný/rozmazaný
- podporuje PDF (aj viacstranové), PNG, JPEG — file upload alebo base64
Je to headless API, žiadne UI — cieľom bolo, aby sa dalo jednoducho zapojiť do existujúcich pipeline (import do účtovného softvéru, spracovanie výdavkových dokladov a pod.).
API je dostupné na RapidAPI aj Zyla API Hub s free tierom na vyskúšanie. ![]()