Datenschutz

Wir schätzen Ihr Vertrauen und arbeiten hart daran, Ihre Informationen sicher zu halten.

Wie Airparser Ihre Daten mit KI verarbeitet

Airparser wandelt Dokumente und E-Mails in die strukturierten Felder um, die Sie in einem Schema definieren, und nutzt dafür eine kombinierte Datenextraktions-Pipeline — Vorverarbeitung, OCR, Extraktionsmodelle (einschließlich eigener Modelle und erweiterter, auf Datenextraktion spezialisierter Modelle) sowie Nachbearbeitung. Uns ist wichtig, genau zu erklären, wie diese Pipeline Ihre Daten schützt, damit Sie es nicht einfach glauben müssen.

Diese Seite ergänzt unsere allgemeine Sicherheitsseite um einen genaueren, technischeren Blick speziell auf den KI-Teil der Pipeline.

Was KI bei Airparser leistet

Airparser ist kein einfacher Wrapper um ein Chat-Modell. Die Extraktion kombiniert mehrere Stufen — Vorverarbeitung, OCR, Modelle zur strukturierten Extraktion und Nachbearbeitung/Validierung —, und KI wird innerhalb dieser Pipeline dort eingesetzt, wo sie den größten Mehrwert bringt: beim Interpretieren von Inhalten, die in Layout oder Format variieren, und beim Zuordnen zu den Feldern Ihres Schemas. Es gibt keine generische Chat-Oberfläche und kein offenes Prompting Ihrer Daten über die von Ihnen konfigurierte Extraktionsaufgabe hinaus.

Wie ein Dokument Schritt für Schritt verarbeitet wird

  • Eingang — ein Dokument geht per Upload, E-Mail, API oder eine Integration in Ihrem Airparser-Postfach ein.
  • Vorverarbeitung — die Datei wird normalisiert, und bei gescannten Dateien oder Bildern wird OCR ausgeführt, um eine Textebene zu erzeugen.
  • Strukturierte Extraktion — das Dokument wird mithilfe unserer Extraktionsmodelle und -logik mit Ihrem Schema abgeglichen: einer Mischung aus eigenen Modellen und erweiterten/spezialisierten Modellen — aufbauend auf den auf unserer Subunternehmer-Seite aufgeführten Anbietern —, die speziell auf die Datenextraktion aus Dokumenten abgestimmt sind.
  • Nachbearbeitung — die extrahierte Ausgabe wird anhand der Feldtypen Ihres Schemas validiert und normalisiert, bevor sie finalisiert wird.
  • Zustellung — das Ergebnis wird in Ihrem Konto gespeichert und ist über die App, die API oder Ihren konfigurierten Export/Webhook verfügbar.

Warum wir OCR, KI und Nachbearbeitung kombinieren

Jede Stufe deckt eine andere Schwäche ab. OCR allein liefert Rohtext, aber kein Verständnis dafür, was dieser Text bedeutet oder wie er Ihrem Schema zugeordnet wird. KI-Modelle sind gut darin, Bedeutung zu interpretieren und mit Dokumenten umzugehen, deren Layout oder Formulierung variiert — womit feste Vorlagen schlecht zurechtkommen —, garantieren aber allein kein sauber typisiertes, validiertes Ergebnis. Die Nachbearbeitung schließt diese Lücke, indem sie Typen, Formate und Konsistenz prüft, bevor die Daten in Ihr Konto gelangen. Die Kombination aller drei liefert zuverlässigere Ergebnisse als sich auf eine einzelne Methode zu verlassen.

Embeddings und lange Dokumente

Embeddings sind numerische Repräsentationen von Text, die es einem System ermöglichen zu erkennen, welche Teile eines Dokuments für ein bestimmtes Feld oder eine Abfrage am relevantesten sind, ohne bei jedem Schritt das gesamte Dokument verarbeiten zu müssen.

Wir haben diese Technik eingesetzt, um sehr lange Dokumente effizienter zu verarbeiten. Sie wird derzeit selektiv angewendet und bleibt eher experimentell als fester Bestandteil jeder Extraktion — wir könnten ihren Einsatz künftig ausweiten, sobald sie ausgereifter ist.

Unsere Extraktionsmodelle

Unsere Extraktions-Pipeline nutzt eine Mischung aus eigenen Modellen und erweiterten, spezialisierten Modellen, die auf den auf unserer Subunternehmer-Seite aufgeführten LLM-Anbietern aufbauen — speziell auf die Datenextraktion aus Dokumenten abgestimmt, nicht auf allgemeinen Chat.

Training und Datenspeicherung

  • Wir trainieren oder optimieren niemals ein Modell mit Ihren Daten, und wir verkaufen Ihre Daten niemals. Dies ist eine dauerhafte Zusage, kein tarifabhängiges Feature.
  • Unsere Vereinbarungen mit unseren KI-Subunternehmern untersagen ihnen, zur Extraktion übermittelte Daten zum Training ihrer Modelle zu verwenden.

Verschlüsselung und Übertragung

Die gesamte Kommunikation mit unseren KI-Subunternehmern erfolgt über verschlüsselte Verbindungen (HTTPS/TLS 1.2+) — demselben Standard, den wir auf jeden anderen Teil unserer Infrastruktur anwenden.

Datentrennung

Die Dokumente, Schemas und Ergebnisse jedes Airparser-Kontos sind logisch von jedem anderen Konto getrennt. Die Verarbeitung des Dokuments eines Kunden legt niemals die Daten eines anderen Kunden offen oder vermischt sie.

Was unter Ihrer Kontrolle bleibt

  • Sie sind der Verantwortliche; Airparser und seine KI-Subunternehmer handeln ausschließlich als Auftragsverarbeiter, nach Ihren Anweisungen.
  • Sie können jederzeit jedes Dokument, Schema oder Ihr gesamtes Konto löschen.
  • Konfigurierbare Aufbewahrungsrichtlinien ermöglichen es Ihnen, verarbeitete Daten automatisch zwischen 1 und 180 Tagen zu löschen.

Häufig gestellte Fragen

Ist Airparser nur ein Wrapper um ein Chat-Modell?

Nein. Die Extraktion läuft über eine Pipeline — Vorverarbeitung, OCR, Modelle zur strukturierten Extraktion und Nachbearbeitung/Validierung — unter Verwendung einer Mischung aus eigenen Modellen und erweiterten, spezialisierten Modellen, die auf den auf unserer Subunternehmer-Seite aufgeführten Anbietern aufbauen und speziell auf die Datenextraktion aus Dokumenten abgestimmt sind, nicht auf allgemeinen Chat.

Wird die Rohdatei (z. B. ein gescanntes PDF oder Bild) verarbeitet, oder nur der extrahierte Text?

Das hängt vom Dokument und Schema ab, aber Dokumentinhalte — einschließlich Rohdateien und Bildern, wo nötig — können direkt von unseren Extraktionsmodellen verarbeitet werden. Diese Verarbeitung ist bei der Übertragung verschlüsselt und wird niemals zum Training verwendet.

Verwenden Sie Embeddings oder Vektorsuche?

Wir haben Embeddings selektiv eingesetzt, um sehr lange Dokumente effizienter zu verarbeiten. Dies ist derzeit begrenzt/experimentell und kein fester Bestandteil jeder Extraktion.

Können Airparser-Mitarbeiter meine Dokumente lesen?

Der Zugriff auf Kundendaten ist nach dem Prinzip der minimalen Rechtevergabe beschränkt, auf das für Support oder Fehlerbehebung Notwendige begrenzt und wird regelmäßig geprüft. Details finden Sie auf unserer Sicherheitsseite.

Werden meine Daten verwendet, um die Modelle von Airparser oder den KI-Anbietern zu verbessern?

Nein. Wir trainieren nicht mit Ihren Daten, und auch unsere Verträge mit unseren KI-Subunternehmern untersagen ihnen dies.

Was passiert mit meinen Daten, wenn ich ein Dokument lösche?

Sie werden sofort aus aktiven Systemen entfernt und innerhalb des von Ihnen konfigurierten Aufbewahrungszeitraums (1-180 Tage) aus Backups und Protokollen.

Fragen?

Wenn Sie weitere Details für Ihre eigene Sicherheits- oder Lieferantenprüfung benötigen, kontaktieren Sie uns unter [email protected].