Persona

PII-Erkennung: Welche persönlichen Daten stecken im Text?

PII-Erkennung findet Textstellen, die eine Person identifizieren können. Für deutsche E-Mails, Verträge und Support-Tickets reicht eine Suche nach E-Mail-Adressen oft nicht: Namen, Anschriften und indirekte Hinweise stehen mitten im Satz.

Zuletzt aktualisiert: · Redaktion: Persona — Relativity GmbH

Erkennung ist der erste Schritt. Erst eine anschließende Maßnahme wie Entfernen oder Pseudonymisieren verändert den Text. Ein Ergebnis ohne Treffer beweist nicht, dass keine personenbezogenen Daten enthalten sind.

Was bedeutet PII und welche Daten gehören dazu?

Regex, Named Entity Recognition oder Sprachmodell?

So messen Sie die Erkennungsqualität

Erkennung vor dem LLM einsetzen

Quellen & technische Grundlage

Häufige Fragen

Erkennt Persona deutsche personenbezogene Daten?

+

Die API ist für PII-Erkennung in Freitext ausgelegt und verwendet ein trainiertes Modell. Testen Sie deutsche Namen, Formate und Fachtexte aus Ihrem Anwendungsfall; eine vollständige Erkennung aller Angaben ist nicht garantiert.

Was ist der Unterschied zwischen PII Detection und PII Redaction?

+

Detection findet und klassifiziert Fundstellen. Redaction entfernt oder verdeckt die gefundenen Werte. Pseudonymisierung ersetzt sie durch Platzhalter, deren Zuordnung getrennt erhalten bleiben kann.

Ist die Erkennung im kostenlosen Text-Tool dieselbe wie in der API?

+

Nein. Das Text-Tool nutzt Regeln lokal im Browser. Die API verarbeitet Text mit einem trainierten Modell. Die Ergebnisse können deshalb voneinander abweichen.