Ochrona danych

Cenimy Twoje zaufanie i ciężko pracujemy, aby zapewnić bezpieczeństwo Twoich informacji.

Jak Airparser przetwarza Twoje dane za pomocą AI

Airparser przekształca dokumenty i wiadomości e-mail w ustrukturyzowane pola zdefiniowane w schemacie, wykorzystując połączony proces ekstrakcji danych — wstępne przetwarzanie, OCR, modele ekstrakcji (w tym własne modele oraz ulepszone modele specjalizujące się w ekstrakcji danych) oraz przetwarzanie końcowe. Zależy nam na precyzyjnym wyjaśnieniu, jak ten proces chroni Twoje dane, abyś nie musiał(a) po prostu nam wierzyć na słowo.

Ta strona uzupełnia naszą ogólną stronę Bezpieczeństwo o bliższe, bardziej techniczne spojrzenie konkretnie na część procesu związaną z AI.

Co robi AI w Airparser

Airparser nie jest zwykłą nakładką na model czatu. Ekstrakcja łączy kilka etapów — wstępne przetwarzanie, OCR, modele ekstrakcji strukturalnej oraz przetwarzanie końcowe/walidację — a AI jest wykorzystywane w tym procesie tam, gdzie wnosi największą wartość: przy interpretowaniu treści różniących się układem lub formatem oraz przypisywaniu ich do pól Twojego schematu. Nie ma tu ogólnego interfejsu czatu ani otwartego promptowania Twoich danych poza skonfigurowanym zadaniem ekstrakcji.

Jak krok po kroku przetwarzany jest dokument

  • Wprowadzenie — dokument trafia poprzez przesłanie, e-mail, API lub integrację do Twojej skrzynki Airparser.
  • Wstępne przetwarzanie — plik jest normalizowany, a w przypadku zeskanowanych plików lub obrazów uruchamiane jest OCR w celu utworzenia warstwy tekstowej.
  • Ekstrakcja strukturalna — dokument jest dopasowywany do Twojego schematu za pomocą naszych modeli i logiki ekstrakcji: połączenia własnych modeli oraz ulepszonych/wyspecjalizowanych modeli — opartych na dostawcach wymienionych na naszej stronie podprzetwarzających — dostrojonych specjalnie do ekstrakcji danych z dokumentów.
  • Przetwarzanie końcowe — wyodrębnione dane są walidowane i normalizowane zgodnie z typami pól Twojego schematu przed sfinalizowaniem.
  • Dostarczenie — wynik jest zapisywany na Twoim koncie i dostępny przez aplikację, API lub skonfigurowany eksport/webhook.

Dlaczego łączymy OCR, AI i przetwarzanie końcowe

Każdy etap odpowiada za inną słabość. Samo OCR daje surowy tekst, ale nie rozumienie tego, co ten tekst oznacza ani jak odnosi się do Twojego schematu. Modele AI dobrze radzą sobie z interpretowaniem znaczenia i obsługą dokumentów o zmiennym układzie lub sformułowaniach — z czym sztywne szablony radzą sobie słabo —, ale same w sobie nie gwarantują dobrze typowanego, zwalidowanego wyniku. Przetwarzanie końcowe wypełnia tę lukę, sprawdzając typy, formaty i spójność, zanim dane trafią na Twoje konto. Połączenie tych trzech elementów daje bardziej niezawodne wyniki niż poleganie na jednej metodzie.

Embeddingi i długie dokumenty

Embeddingi to numeryczne reprezentacje tekstu, które pozwalają systemowi określić, które części dokumentu są najbardziej istotne dla danego pola lub zapytania, bez konieczności przetwarzania całego dokumentu przy każdym kroku.

Wykorzystaliśmy tę technikę, aby pomóc w wydajniejszym przetwarzaniu bardzo długich dokumentów. Obecnie jest ona stosowana selektywnie i pozostaje raczej eksperymentalna niż domyślną częścią każdej ekstrakcji — możemy rozszerzyć jej zastosowanie w przyszłości, w miarę jej dojrzewania.

Nasze modele ekstrakcji

Nasz proces ekstrakcji wykorzystuje połączenie własnych modeli oraz ulepszonych, wyspecjalizowanych modeli opartych na dostawcach LLM wymienionych na naszej stronie podprzetwarzających — dostrojonych specjalnie do ekstrakcji danych z dokumentów, a nie do ogólnego czatu.

Szkolenie modeli i przechowywanie danych

  • Nigdy nie trenujemy ani nie dostrajamy żadnego modelu na Twoich danych i nigdy nie sprzedajemy Twoich danych. To stałe zobowiązanie, a nie funkcja zależna od planu.
  • Nasze umowy z podprzetwarzającymi AI zabraniają im wykorzystywania danych przesłanych do ekstrakcji do trenowania ich modeli.

Szyfrowanie i transport

Cała komunikacja z naszymi podprzetwarzającymi AI odbywa się poprzez szyfrowane połączenia (HTTPS/TLS 1.2+) — ten sam standard stosujemy w każdej innej części naszej infrastruktury.

Rozdzielenie danych

Dokumenty, schematy i wyniki każdego konta Airparser są logicznie odizolowane od każdego innego konta. Przetwarzanie dokumentu jednego klienta nigdy nie ujawnia ani nie miesza danych innego klienta.

Co pozostaje pod Twoją kontrolą

  • Jesteś Administratorem danych; Airparser i jego podprzetwarzający AI działają wyłącznie jako Podmiot przetwarzający, zgodnie z Twoimi instrukcjami.
  • Możesz w dowolnym momencie usunąć dowolny dokument, schemat lub całe swoje konto.
  • Konfigurowalne zasady przechowywania pozwalają na automatyczne usuwanie przetworzonych danych w przedziale od 1 do 180 dni.

Najczęściej zadawane pytania

Czy Airparser to tylko nakładka na model czatu?

Nie. Ekstrakcja przebiega przez proces — wstępne przetwarzanie, OCR, modele ekstrakcji strukturalnej oraz przetwarzanie końcowe/walidację — wykorzystujący połączenie własnych modeli oraz ulepszonych, wyspecjalizowanych modeli opartych na dostawcach wymienionych na naszej stronie podprzetwarzających, dostrojonych specjalnie do ekstrakcji danych z dokumentów, a nie do ogólnego czatu.

Czy surowy plik (np. zeskanowany PDF lub obraz) jest przetwarzany, czy tylko wyodrębniony tekst?

Zależy to od dokumentu i schematu, ale treść dokumentu — w tym surowe pliki i obrazy, gdy jest to potrzebne — może być przetwarzana bezpośrednio przez nasze modele ekstrakcji. Takie przetwarzanie jest szyfrowane podczas przesyłania i nigdy nie jest wykorzystywane do trenowania.

Czy korzystacie z embeddingów lub wyszukiwania wektorowego?

Wykorzystaliśmy embeddingi selektywnie, aby pomóc w wydajniejszym przetwarzaniu bardzo długich dokumentów. Obecnie jest to rozwiązanie ograniczone/eksperymentalne, a nie element każdej ekstrakcji.

Czy pracownicy Airparser mogą czytać moje dokumenty?

Dostęp do danych klientów jest ograniczony zgodnie z zasadą minimalnych uprawnień, ograniczony do tego, co niezbędne do wsparcia lub rozwiązywania problemów, i jest regularnie audytowany. Zobacz naszą stronę Bezpieczeństwo, aby dowiedzieć się więcej.

Czy moje dane są wykorzystywane do ulepszania modeli Airparser lub dostawców AI?

Nie. Nie trenujemy na Twoich danych, a nasze umowy z podprzetwarzającymi AI również im tego zabraniają.

Co dzieje się z moimi danymi, jeśli usunę dokument?

Są one natychmiast usuwane z aktywnych systemów oraz z kopii zapasowych i dzienników w ramach skonfigurowanego przez Ciebie okresu przechowywania (1-180 dni).

Pytania?

Jeśli potrzebujesz więcej szczegółów do własnej weryfikacji bezpieczeństwa lub dostawców, skontaktuj się z nami pod adresem [email protected].