Gegevensbescherming
We waarderen je vertrouwen en werken hard om je informatie veilig te houden.
Hoe Airparser je gegevens verwerkt met AI
Airparser zet documenten en e-mails om in de gestructureerde velden die je in een schema definieert, met behulp van een gecombineerde data-extractie-pipeline — voorverwerking, OCR, extractiemodellen (waaronder onze eigen modellen en verbeterde modellen gespecialiseerd in data-extractie), en nabewerking. We willen precies zijn over hoe die pipeline je gegevens beschermt, zodat je het niet zomaar op je woord hoeft te nemen.
Deze pagina vult onze algemene Beveiligingspagina aan met een nauwkeurigere, technischere blik specifiek op het AI-gedeelte van de pipeline.
Wat AI doet bij Airparser
Airparser is geen simpele wrapper om een chatmodel. Extractie combineert meerdere fasen — voorverwerking, OCR, modellen voor gestructureerde extractie, en nabewerking/validatie — en AI wordt binnen die pipeline ingezet waar het de meeste waarde toevoegt: het interpreteren van inhoud die varieert in lay-out of formaat en het toewijzen daarvan aan de velden van je schema. Er is geen generieke chatinterface en geen open-eindig prompten van je gegevens buiten de door jou geconfigureerde extractietaak.
Hoe een document stap voor stap wordt verwerkt
- Binnenkomst — een document komt binnen via upload, e-mail, API, of een integratie in je Airparser-postvak.
- Voorverwerking — het bestand wordt genormaliseerd, en bij gescande bestanden of afbeeldingen wordt OCR uitgevoerd om een tekstlaag te produceren.
- Gestructureerde extractie — het document wordt met je schema vergeleken met behulp van onze extractiemodellen en -logica: een mix van eigen modellen en verbeterde/gespecialiseerde modellen — voortbouwend op de aanbieders die vermeld staan op onze subverwerkers-pagina — specifiek afgestemd op data-extractie uit documenten.
- Nabewerking — de geëxtraheerde output wordt gevalideerd en genormaliseerd volgens de veldtypen van je schema voordat deze wordt afgerond.
- Levering — het resultaat wordt opgeslagen in je account en is beschikbaar via de app, de API, of je geconfigureerde export/webhook.
Waarom we OCR, AI en nabewerking combineren
Elke fase dekt een andere zwakte af. OCR alleen levert ruwe tekst, maar geen begrip van wat die tekst betekent of hoe die zich verhoudt tot je schema. AI-modellen zijn goed in het interpreteren van betekenis en het omgaan met documenten waarvan de lay-out of formulering varieert — iets waar vaste sjablonen slecht mee omgaan —, maar garanderen op zichzelf geen goed getypeerd, gevalideerd resultaat. Nabewerking dicht dat gat door typen, formaten en consistentie te controleren voordat gegevens je account bereiken. De combinatie van alle drie levert betrouwbaardere resultaten op dan vertrouwen op één enkele methode.
Embeddings en lange documenten
Embeddings zijn numerieke representaties van tekst waarmee een systeem kan bepalen welke delen van een document het meest relevant zijn voor een bepaald veld of een bepaalde vraag, zonder bij elke stap het hele document te hoeven verwerken.
We hebben deze techniek gebruikt om zeer lange documenten efficiënter te verwerken. Dit wordt momenteel selectief toegepast en blijft enigszins experimenteel in plaats van standaard onderdeel van elke extractie — we kunnen het gebruik ervan in de toekomst uitbreiden naarmate het volwassener wordt.
Onze extractiemodellen
Onze extractie-pipeline gebruikt een mix van eigen modellen en verbeterde, gespecialiseerde modellen die voortbouwen op de LLM-aanbieders die vermeld staan op onze subverwerkers-pagina — specifiek afgestemd op data-extractie uit documenten, niet op algemene chat.
Training en gegevensbewaring
- We trainen of finetunen nooit een model met jouw gegevens, en we verkopen je gegevens nooit. Dit is een blijvende toezegging, geen functie die afhankelijk is van je abonnement.
- Onze overeenkomsten met onze AI-subverwerkers verbieden hen om gegevens die zijn ingediend voor extractie te gebruiken om hun modellen te trainen.
Versleuteling en transport
Alle communicatie met onze AI-subverwerkers verloopt via versleutelde verbindingen (HTTPS/TLS 1.2+), dezelfde standaard die we toepassen op elk ander deel van onze infrastructuur.
Gegevensscheiding
De documenten, schema's en resultaten van elk Airparser-account zijn logisch gescheiden van elk ander account. Het verwerken van het document van de ene klant onthult of vermengt nooit de gegevens van een andere klant.
Wat onder jouw controle blijft
- Jij bent de Verwerkingsverantwoordelijke; Airparser en zijn AI-subverwerkers treden alleen op als Verwerker, volgens jouw instructies.
- Je kunt op elk moment elk document, schema, of je hele account verwijderen.
- Configureerbaar retentiebeleid stelt je in staat om verwerkte gegevens automatisch te verwijderen tussen 1 en 180 dagen.
Veelgestelde vragen
Is Airparser slechts een wrapper om een chatmodel?
Nee. Extractie verloopt via een pipeline — voorverwerking, OCR, modellen voor gestructureerde extractie, en nabewerking/validatie — met een mix van eigen modellen en verbeterde, gespecialiseerde modellen die voortbouwen op de aanbieders die vermeld staan op onze subverwerkers-pagina, specifiek afgestemd op data-extractie uit documenten en niet op algemene chat.
Wordt het ruwe bestand (bijv. een gescande PDF of afbeelding) verwerkt, of alleen de geëxtraheerde tekst?
Dat hangt af van het document en schema, maar documentinhoud — inclusief ruwe bestanden en afbeeldingen waar nodig — kan direct worden verwerkt door onze extractiemodellen. Die verwerking is versleuteld tijdens verzending en wordt nooit gebruikt voor training.
Gebruiken jullie embeddings of vectorzoeken?
We hebben embeddings selectief gebruikt om zeer lange documenten efficiënter te verwerken. Dit is momenteel beperkt/experimenteel en geen onderdeel van elke extractie.
Kunnen medewerkers van Airparser mijn documenten lezen?
Toegang tot klantgegevens is beperkt volgens het principe van minimale rechten, beperkt tot wat nodig is voor support of probleemoplossing, en wordt regelmatig gecontroleerd. Zie onze Beveiligingspagina voor meer details.
Worden mijn gegevens gebruikt om de modellen van Airparser of de AI-aanbieders te verbeteren?
Nee. We trainen niet met jouw gegevens, en onze contracten met onze AI-subverwerkers verbieden hen dit ook.
Wat gebeurt er met mijn gegevens als ik een document verwijder?
Ze worden onmiddellijk verwijderd uit actieve systemen, en uit back-ups en logs binnen de door jou geconfigureerde bewaartermijn (1-180 dagen).
Vragen?
Als je meer details nodig hebt voor je eigen beveiligings- of leveranciersbeoordeling, neem dan contact met ons op via [email protected].