AI leest gegevens uit documenten en foto's en zet ze in je systeem. Geen overtikken meer. Gebouwd voor een vastgoedplatform, op nacalculatie.
Documentextractie met AI betekent dat een model de gegevens uit documenten en foto's leest (namen, bedragen, datums, adresgegevens, kenmerken) en ze als gevulde velden in je eigen systeem zet, met per veld de bron waar het op staat. EIGHTY8 bouwt dit rond jouw documentsoorten; overtikken hoort er daarna niet meer bij.
Bijna elk bedrijf heeft een plek waar de wereld op papier binnenkomt: contracten, aktes, facturen, domeinstaten, inspectierapporten, vrachtbrieven. En bijna elk bedrijf heeft iemand die die papieren van A naar B overtypt. Van de bijlage in de mail naar de velden in het eigen systeem. Niet omdat het moeilijk is, maar omdat het moet: het systeem kan niet rekenen, zoeken of herinneren op gegevens die er niet in staan.
Het overtypen is traag, maar het erge zit ergens anders. Wie de hele dag kopieert, scant zijn eigen werk niet meer. Een bedrag verkeerd gelezen, een veld overgeslagen omdat het op een volgende pagina stond. En bij documenten die per leverancier of per regio anders zijn ingericht, betekent elk nieuw format opnieuw uitzoeken waar welk gegeven staat.
Voor wie documenten en foto's moet omzetten in bruikbare gegevens (vastgoed, logistiek, juridisch werk, advies) is dat een vast, terugkerend verlies van uren. Niet bij de duurste specialist, maar bij degene die anders de klanten opvangt en het werk coördineert.
De workflow neemt het document (PDF, scan, foto, mailbijlage) en leest er de velden uit die jouw proces nodig heeft. Waar de tekst netjes gedigitaliseerd is, is dat leeswerk; waar het een foto of scheve scan is, gebeurt er eerst herkenning. Een model is hier nuttig omdat documenten in het echt nooit netjes zijn: elke aanbieder gebruikt zijn eigen indeling, en vaste sjablonen breken daarop.
Het resultaat is geen losse tekst maar gevulde velden in jouw systeem, en daar zit de eerlijkheid van het ontwerp: bij elk veld staat de bron. Welke regel, welke plek in het document. Zo kun je in één oogopslag controleren of het bedrag en de datum kloppen in plaats van het hele document opnieuw te lezen. Velden die het model niet met overtuiging kan lezen, laat hij bewust leeg; gokken staat niet in het ontwerp.
Wat een model níet doet: interpreteren wat de gegevens juridisch of zakelijk betekenen. Een afwijkende bepaling in een contract wordt gevonden en uitgelicht, maar de beslissing daarover is van een mens. Bij een vastgoedplatform waar we dit bouwden, betekent dat dat details uit documenten en foto's automatisch in de listing belanden en de specialist alleen nog beoordeelt in plaats van overtypt.
Extractie begint bij voorbeelden. De kaarten hieronder zijn wat we in de discovery van je meekrijgen en samen opbouwen.
Het werkt voor bedrijven die regelmatig dezelfde soort documenten ontvangen. Makelaars met aktes en foto's, transporteurs met documenten per zending, adviseurs met clientdossiers, insurers met schademeldingen. De winst groeit met het aantal documenten per week en met het aantal systemen waarin nu handmatig wordt overgetypt.
Het werkt niet voor eenmalige documentstromen zonder vaste velden, en niet als er ná het uitlezen sowieso altijd een menselijke beoordeling per document moet plaatsvinden die net zo lang duurt. Ook: als je documenten onder een strikte geheimhoudingsregeling vallen, bespreken we eerst waar ze verwerkt mogen worden. Dat is een voorwaarde, geen detail.
Een documentsoort met tien vaste velden is ander werk dan vijf formats met vrije tekst en foto's. Daarom offreren we per project, op basis van scope en complexiteit. Er is geen prijslijst en geen pakket. Je krijgt vooraf een heldere offerte met wat er gebouwd wordt en welke aannames we doen, en uitbreidingen met nieuwe documentsoorten gaan daarna op dezelfde voet.
Dat is precies waar een model boven klassieke sjablonen uitsteekt: een foto van een document, gemaakt met een toestel in de hand, wordt eerst herkend en daarna uitgelezen. Hoe betrouwbaar hangt af van de kwaliteit. Een scherpe foto leest beter dan een doorgelezen fax. Bij onvoldoende kwaliteit geeft het systeem dat eerlijk terug in plaats van te raden, en het veld gaat alsnog naar een mens. We testen dit in de discovery met jouw eigen slechtste documenten, niet met de mooiste.
Alles wat herkenbaar op het document staat: namen, adressen, bedragen, datums, kenmerken, nummers en vrije beschrijvingen die tot een keuze uit je eigen lijstjes terug te brengen zijn. Wat niet werkt is informatie die er níet op staat. Een afleiding, een som over meerdere documenten, een zakelijke conclusie. Dat soort stappen bouwen we eventueel als aparte regel na de extractie, zodat duidelijk blijft wat gelezen is en wat berekend.
Hij wordt niet weggegooid en niet half gevuld: het document gaat naar een mens met de melding wat er misging en welke velden eventueel al wel betrouwbaar gelezen zijn. Die vult het resterende deel in, en het document met zijn oplossing wordt een voorbeeld waar het model de volgende keer beter van wordt. Zo groeit de dekking met je echte stroom in plaats van met een laboproef, en blijft er geen document stil in een wachtrij hangen.
De omvang hangt af van het aantal documentsoorten, het aantal velden per soort en of er ook foto's en scans meegenomen worden. We beginnen in de discovery met jouw eigen voorbeelden, meten daarop wat haalbaar is en scopen het project vooraf. Afgerekend wordt op nacalculatie van wat er gebouwd is, met de aannames vooraf op papier. Zonder verplicht pakket eromheen.
EIGHTY8