Hilfe & Anleitung
DatOnym entfernt personenbezogene Daten aus deinem Text, bevor du ihn an ein KI-Sprachmodell (LLM) sendest – und stellt sie in der Antwort wieder her. So nutzt du KI-Chats, ohne echte Namen, Adressen oder Kontonummern preiszugeben.
Der Ablauf in vier Schritten
- Anonymisieren. Füge deinen Originaltext im Feld Eingang ein und klicke Anonymisieren. DatOnym erkennt personenbezogene Daten und ersetzt sie durch Tokens wie [[NAME_1]].
- Kopieren & chatten. Kopiere die tokenisierte Fassung und füge sie in deinen KI-Chat (z. B. ChatGPT, Claude) ein. Das LLM sieht nie die echten Daten.
- Antwort einfügen. Kopiere die Antwort des LLM – sie enthält weiterhin die Tokens – in das Feld LLM-Antwort und klicke Personalisieren.
- Fertig. Im Feld Personalisiert stehen die Tokens wieder durch die echten Daten ersetzt. Diesen Text kannst du verwenden.
Gut zu wissen: Beim Personalisieren wird jedes bekannte Token in der LLM-Antwort durch den echten Wert ersetzt – auch wenn das LLM ein Token an eine neue Stelle setzt. Prüfe die LLM-Antwort daher wie jede KI-Ausgabe, bevor du dich auf darin genannte Kontodaten, Namen oder Beträge verlässt. Dein Originaltext selbst darf keine Sequenzen der Form [[NAME_1]] enthalten – solche Eingaben lehnt DatOnym ab, damit sie nicht mit den Anonymisierungs-Tokens verwechselt werden.
Die Bereiche der Oberfläche
| Bereich | Bedeutung |
|---|---|
| Eingang | Dein Originaltext. Buttons: Anonymisieren, Leeren (setzt alles zurück), Beispiel (lädt einen Demo-Text). |
| Anonymisiert | Die tokenisierte Fassung für den LLM-Chat. Kopieren legt sie in die Zwischenablage. |
| Mapping | Zeigt, welcher Token für welchen echten Wert steht (grüne Tokens). Der Zähler nennt die Anzahl. |
| Erkennung | Liste der gefundenen Rohdaten mit Typ (z. B. PERSON, IBAN) und Position im Text. |
| LLM-Antwort | Hierhin fügst du die Antwort des Sprachmodells ein, um sie zu personalisieren. |
| Personalisiert | Die Antwort mit wiederhergestellten Originaldaten. |
| Statistik | Erkannte Entitäten, Anonymisierungsquote und Anzahl geschützter Zeichen. |
Was wird erkannt?
Namen, E-Mail-Adressen, Telefonnummern, IBANs, Kreditkartennummern, IP-Adressen, Steuer-Identifikationsnummern, Steuernummern (Finanzamt), Sozialversicherungsnummern, KFZ-Kennzeichen, Datumsangaben sowie Adressen (Straße, PLZ, Ort). IBANs, Kreditkarten und Steuer-IDs werden zusätzlich per Prüfsumme validiert, um Fehlalarme zu vermeiden.
Tipps
- Verändere die Tokens im LLM-Chat nicht – sonst können sie nicht mehr zugeordnet werden.
- Gleiche Werte erhalten denselben Token (z. B. zwei Mal dieselbe E-Mail → ein Token).
- Prüfe die Erkennung: Sehr seltene Namen ohne Anrede werden eventuell nicht erkannt. Ergänze im Zweifel eine Anrede („Herr/Frau …") oder ersetze manuell.
- Mit Leeren werden auch die serverseitig gespeicherten Zuordnungen gelöscht.
Wie steht es um den Datenschutz?
Die Anonymisierung läuft on-premise auf dem DatOnym-Server. Die Zuordnung Token→Klartext wird ausschließlich verschlüsselt (AES-256-GCM) und nur befristet gespeichert, damit die Personalisierung funktioniert; danach wird sie automatisch gelöscht. Details unter Datenschutz. Warum sich Anonymisierung lohnt, erklärt der Abschnitt „Warum anonymisieren?" auf der Startseite.