Sartzen den PDF bakoitza taldearen ordu bat da
Norbaitek ERP-an sartzen dituen hornitzaileen fakturak. Norbaitek datak eta baldintzak ateratzeko irakurtzen dituen kontratuak. Norbaitek eskaerekin alderatzen dituen albaranak. Norbaitek PIM-era igotzen dituen fitxa teknikoak. Zure taldea giza OCR egiten ari da.
Document IA PDF horiek automatikoki prozesatzen ditu — ikuspegi multimodalarekin, ez 90eko hamarkadako OCRrekin. Zure sistemetan konektatzen diren datu egituratuak ateratzen ditu. Dokumentu bakoitzeko 10 minutu behar zirenak, orain 10 segundotan egiten dira.
Nola eraiki genuen
1. Ohiko dokumentuen auditoria
Benetako laginak bidaltzen dizkiguzu: prozesatu nahi dituzun motako 20-50 dokumentu. Eremu kritikoak, edge cases eta formatu-aldaketak identifikatzen ditugu. Kodea ukitu aurretik, zer duzun eta zer atera nahi duzun ulertzen dugu.
2. Erauzketa-pipeline
Vision-first ereduak erabiltzen ditugu (Claude Vision, GPT-4 Vision) structured output-arekin. Ereduak dokumentua pertsona batek bezala ikusten du eta eskatu zenituzkeen eremuak dituen JSON bat itzultzen du. Ez du aldez aurreko OCR-rik behar, ez du txantiloi zurrunik behar.
3. Zure sistemarekin integrazioa
JSON zure ERP, CRM, datu-base, PIM edo behar duzun tokira joaten da. APIaren bidez edo n8n bidez. Tarteko pantailarik gabe, inork leku batetik bestera kopiatu beharrik gabe.
4. Giza baliozkotzea dagokion lekuan
Dokumentu kritikoak (faktura handiak, kontratu legalak) giza berrikuspenetik igarotzen dira itxi aurretik. Sistemak konfiantza-maila erakusten dizu eremu bakoitzeko: eredua BEZaren inguruan ziur ez badago, esaten dizu. Ez dizu bere zalantza ezkutatzen.
Ohiko dokumentu motak
- Hornitzaileen fakturak (edozein formatu, edozein hizkuntza).
- Kontratuak, data nagusiak, zenbatekoak eta klausulak erauziaz.
- Produktuen fitxa teknikoak (zehaztapenak, ratioak, ziurtagiriak).
- Albaranak eta entrega-oharrak, eskaerekiko gurutzaketa automatikoarekin.
- Curriculumak, HRrako gaitasunak erauziaz.
- Eskaneaturiko tiketak, ordainagirak, justifikanteak finantzarako.
Zer aldatzen da hau funtzionatzen denean
- Dokumentuen prozesatzea orduetatik minutuetara.
- Transkripzio-erroreak zerora jotzen dute.
- Zure administrazio-taldea benetako atazak egiteko libre geratzen da.
- Auditoriak eta compliance trazagarri bihurtzen dira: erauzketa bakoitza erregistratuta geratzen da.
Hau ez dugunean gomendatzen
- Zure dokumentuak bakoitza bakarra bada eta eredurik gabe badaude (serbiletetan eskuz idatzitako oharrak): modeloak ez du orokortzen ikasten.
- Zure bolumena oso txikia bada (<20 dokumentu/hilabete): setup-ak ez du konpentsatzen.
- Zure dokumentuek hirugarrenen aldetiko prozesamenduaren murrizketa legalak badituzte (data classification alta): baliteke legez kanpokoa izatea US-eko API bidez prozesatzea.
Pribatutasuna
Zure compliance-ak Claude/GPT-ra dokumentuak bidaltzea onartzen ez badu, vision on-prem ereduak erabiltzen ditugu (Qwen2.5-VL, InternVL3) zure azpiegituran edo gure Europako azpiegituran. Operatzeko garestiagoa da, baina datuak ez dira irteten.
Erabiltzen dugun stack-a
- Claude Vision (Claude 4.5) dokumentu orokorretarako.
- GPT-4.1 Vision kasu batzuetan alternatiba gisa.
- Qwen2.5-VL 72B on-prem compliance zorrotzerako.
- n8n + API de tu ERP/CRM integraziorako.
Diagnostiko saio batekin hasten gara
Setup osoa aurrekontatzen hasi aurretik, 90 minutuko saio bat egiten dugu. Elkarrekin aztertzen ditugu zure dokumentuen benetako bolumena, zure ohiko formatuak eta zure helmuga-sistema, eta gomendio zintzo batekin ateratzen gara: zerbitzu hau zure une honetarako egokia den, ala beste zerbaitatik hastea komeni den.
Saio hori ez dugu kobratzen. Interesatzen bazaizu, kontaguzu.