Nescio.AI

Sensible Daten mit KI maskieren, pseudonymisieren, anonymisieren

Nescio.AI erkennt personenbezogene und vertrauliche Informationen in unstrukturierten Dokumenten und entfernt sie mit wenigen Klicks. Das KI-Tool läuft komplett auf Ihrer eigenen Infrastruktur, ohne Abhängigkeiten von Cloud-Providern. So machen Sie Berichte, Akten, Tickets und Gutachten für Analysen, Sprachmodelle und KI-Agenten nutzbar, ohne dass die Daten Ihr Hoheitsgebiet verlassen.

  • Ein Großteil der Dokumente in Kanzleien, Behörden, Hochschulen und Finanzunternehmen enthält personenbezogene oder vertrauliche Informationen. DSGVO, EU AI Act, NIS2 und berufliche Geheimhaltungspflichten setzen der Weiterverwendung dieser Dokumente mit KI strenge Grenzen – gerade dort, wo die Technologie den größten Mehrwert brächte.
  • Dokumente werden bis heute überwiegend von Hand unkenntlich gemacht bzw. geschwärzt. Das kostet Stunden pro Vorgang und bindet Personal, was an anderer Stelle sinnvollere Aufgaben erledigen könnte. Dazu kommt, dass Menschen dazu tendieren, bei solchen monotonen Aufgaben Fehler zu machen.
  • Bestehende Lösungsansätze passen nicht: Cloud-basierte Dienste scheiden aus, wenn die Daten das Haus nicht verlassen dürfen, auch wenn diese in der EU gehostet sind. Selbstgebaute Skripte erreichen die nötige Genauigkeit im Fachvokabular nicht und binden knappe IT-Ressourcen.

Nescio.AI kombiniert ein auf Named Entity Recognition (NER) spezialisiertes Sprachmodell mit regelbasierter Logik: Das Tool erkennt sensible Informationen im Kontext, nicht nur nach Mustern. Die Fachabteilung bedient das Werkzeug selbst, hat aber kaum Aufwand: Das Dokument wird hochgeladen, Nescio.AI erkennt automatisch sensible Informationen und Sie validieren nur noch und machen den Feinschliff. Ohne eine Zeile Code.

Sie entscheiden je Anwendungsfall, ob Inhalte maskiert, pseudonymisiert oder vollständig anonymisiert werden, jede Entscheidung ist dokumentiert und nachvollziehbar. Der Betrieb ist ressourcenschonend auf Ihren eigenen Servern möglich, eine Grafikkarte ist nicht erforderlich.

Sie möchten es ausprobieren? Wir stellen Ihnen gerne eine Testumgebung bereit, in der Sie Nescio.AI an einem eigenen Dokument erproben können.
 

Jetzt anfragen

So werden vertrauliche Dokumente für die KI-Verwertung nutzbar

Einsatzmöglichkeiten

Finanzen

  • Banken, Versicherungen, Beratungen

Recht

  • Kanzleien und Rechtsabteilungen

Compliance

  • Datenschutz-, Compliance- und KI-Verantwortliche in regulierten Branchen
  • KI-Entwicklerinnen und -Anbieter, die mit sensiblen Daten arbeiten

Medien

  • Fachverlage und Redaktionen

Öffentlicher Sektor

  • Gerichte, Behörden und Verwaltungen
  • Hochschulen, Forschungseinrichtungen und Bibliotheken

8 Vorteile von Nescio.AI

 

  1. Nescio.AI de-identifiziert ein Dokument binnen Sekunden – Sie prüfen nur noch das Ergebnis.
  2. Betrieb auf eigener Infrastruktur: Es sind keine Cloud-Provider notwendig und es besteht keine Abhängigkeit von externen LLM-Anbietern.
  3. Einfache Bedienung durch den Fachbereich: Hochladen, prüfen, freigeben, herunterladen – ohne eine Zeile Code.
  4. Wahl des De-Identifikations-Verfahrens je nach Bedarf: Maskierung, Pseudonymisierung oder Anonymisierung.
  5. Erhalt des ursprünglichen Kontextes: Das neue Dokument bleibt auswertbar, statt durch großflächiges Schwärzen für die weitere Wertschöpfung mit KI unbrauchbar zu werden.
  6. Nachvollziehbare Entscheidungen: Jede Markierung ist dokumentiert, rückverfolgbar und nachjustierbar.
  7. Anpassung an Ihr Fachvokabular: Das Modell lässt sich im Verhältnis zu LLMs kostengünstig auf die Terminologie Ihrer Domäne nachtrainieren.
  8. Zwei Zugangswege: Web-basierte Oberfläche für Fachanwender*innen, API-Endpunkte für automatisierte Verarbeitung für Technologie-Expert*innen.

Was ist De-Identifikation? Warum ist sie für den KI-Einsatz wichtig?

De-Identifikation bezeichnet das Entfernen oder Ersetzen von Angaben, über die sich Personen oder vertrauliche Sachverhalte identifizieren lassen – Namen, Adressen, Aktenzeichen, Kontonummern, Diagnosen. Je nach Schutzbedarf kommen unterschiedliche Verfahren infrage: Maskierung verdeckt einzelne Werte, Pseudonymisierung ersetzt sie durch dechiffrierbare Platzhalter, Anonymisierung entfernt sie unwiderruflich, bspw. durch Schwärzung.

Für den KI-Einsatz ist dieser Schritt entscheidend. Damit ein Sprachmodell oder ein KI-Agent ein Dokument verarbeiten darf, müssen die schützenswerten Angaben zuvor entfernt worden sein – der Rest des Textes muss dabei aber verständlich bleiben, sonst ist die Auswertung wertlos. Präzision ist hier das Wichtigste. Wird zu viel entfernt, kann das Dokument nicht weiterbearbeitet werden. Auch eine KI versteht keine schwarze Seite Text. Wird zu wenig entfernt, steigt das Risiko, dass eine sensible Information durchrutscht und einen Compliance-Vorfall auslöst.

Wo bislang ein Mensch jedes Dokument geprüft hat, greifen autonome Agenten unmittelbar auf Datenbestände zu; der menschliche Kontrollpunkt (human in the loop) entfällt in der Praxis immer mehr. Verlässliche De-Identifikation entscheidet damit darüber, welcher Teil des Wissens einer Organisation für KI überhaupt zugänglich wird.

So funktioniert die KI-Technologie

© Fraunhofer IAIS

Weiterführende Informationen

Wissenschaftliche Paper