Blog
Benchmarks, Methodik, Engineering-Notizen.
So schwärzen Sie personenbezogene Daten in juristischen PDFs, ohne sie in die Cloud hochzuladen
Wer privilegierte Dokumente in ein Online-Schwärzungstool hochlädt, legt eine Kopie der vertraulichen Daten seiner Mandantschaft auf fremden Servern ab. Hier erfahren Sie, wie Sie personenbezogene Daten in juristischen PDFs richtig schwärzen — auf dem eigenen Rechner, mit tatsächlich entferntem Text und nicht bloß hinter einem schwarzen Kasten verborgen.
Beitrag lesenReversible Schwärzung erklärt: Wie Tokenisierung das Aufheben einer Schwärzung ermöglicht
Reversible Schwärzung ersetzt jeden Namen und jede Kennnummer durch einen stabilen Code und behält die Zuordnung von Code zu Wert auf Ihrem Rechner, sodass Sie ein Dokument mit entfernten Identitäten teilen und es später dekodieren können. Hier erfahren Sie, wie Tokenisierung funktioniert, wann Sie sie statt dauerhafter Schwärzung einsetzen und warum der Speicherort des Schlüssels alles entscheidet.
Beitrag lesenDSGVO-Dokumentenanonymisierung: Was tatsächlich als „anonymisiert“ gilt (und was nicht)
Nach der DSGVO sind Daten nur dann wirklich anonymisiert, wenn niemand die Person realistisch re-identifizieren kann — und ab diesem Punkt fallen sie ganz aus der Verordnung heraus. Behalten Sie eine Zuordnung, haben Sie sie lediglich pseudonymisiert, und sie bleibt vollständig im Anwendungsbereich. Hier ist die Unterscheidung, die die meisten Anonymisierungstools verwischen, und warum sie für Ihre Compliance entscheidend ist.
Beitrag lesenSo schwärzen Sie gescannte PDFs und Bilder (dort, wo gewöhnliche Textschwärzung versagt)
Ein gescanntes PDF ist ein Bild, kein Text — deshalb finden textbasierte Schwärzungstools nichts und übersehen stillschweigend alles. Hier ist die OCR-gestützte Pipeline, die gescannte Dokumente und Bilder tatsächlich schwärzt, und warum es gerade bei Ihren sensibelsten Dateien am wichtigsten ist, dies auf dem Gerät zu tun.
Beitrag lesenWarum wir unser eigenes Demo Studio gebaut haben — und was das für die SaaS-Tools bedeutet, die Sie mieten
Wir haben mit einem fertigen Tool für Demo-Videos angefangen. Zwei Designs, sieben Sprachen und eine Oberfläche, die sich fast jede Woche ändert, brachten es an seine Grenzen. Also haben wir ein eigenes gebaut — und dass uns das gelang, ist die eigentlich größere Geschichte, nicht das Tool selbst.
Beitrag lesenWo promptShield ins Bild passt: eine Landkarte des Datenschutzes für personenbezogene Daten – und die Lücke, die wir füllen
Unternehmen schützen personenbezogene Daten auf vier grundlegend verschiedene Arten – Governance-Plattformen, Cloud-Schwärzungs-APIs, verwaltete Schwärzung und manuelles Schwärzen. Jede ist für eine andere Art von Problem gebaut. Hier ist die ehrliche Landkarte – und die konkrete Lücke, für die promptShield gemacht ist: eine kleine Zahl hochwertiger Dokumente, für die eine einzelne Person geradestehen können muss.
Beitrag lesenWarum wir unsere eigene Engine für personenbezogene Daten gebaut haben, statt Presidio auszuliefern
Presidio ist ein hervorragendes Toolkit. Wir haben trotzdem unsere eigene Erkennungs-Engine geschrieben – weil das, was wir ausliefern, ein abgegrenztes PDF auf dem Gerät eines Menschen ist, kein Textstrom in einer Cloud-Pipeline. Der architektonische Fall, ehrlich erzählt.
Beitrag lesenEine Maschine kann nicht verantwortlich sein. Sie schon — und genau deshalb bleibt ein Mensch in der Schleife
Verantwortung heißt, bereit zu sein, den Preis zu zahlen, wenn etwas schiefgeht — und eine Maschine hat keinen Einsatz zu verlieren. In dem Moment, in dem Sie für die Ausgabe einer KI einstehen, können Sie es nicht blind tun. Diese eine Anforderung ist der Grund, warum verantwortungsvolle Anonymisierung einen Menschen in der Schleife hält.
Beitrag lesenIst es sicher, Dokumente in ChatGPT einzufügen?
Kurze Antwort: manchmal – und in welchem Fall Sie sich befinden, liegt vollständig in Ihrer Hand. Ein praktischer Leitfaden dazu, was das Risiko bestimmt, was mit dem eingefügten Text tatsächlich geschieht und der eine Schritt, der die Frage gegenstandslos macht.
Beitrag lesenAn jene, die heimlich Mandantendokumente mit einem Chatbot teilen
KI-Werkzeuge machen die Preisgabe vertraulicher Daten mühelos – und die Folgen sind weder theoretisch noch fern. Hier ist, was Wissensarbeiter tatsächlich riskieren, wenn sie Mandantendokumente in ChatGPT, Claude oder Gemini einfügen.
Beitrag lesenDer Schutz personenbezogener Daten sieht völlig anders aus, sobald KI im Spiel ist
30 Jahre lang bedeutete der Schutz personenbezogener Daten, zu kontrollieren, wer die Datenbank erreichen konnte. KI-Werkzeuge haben dieses Modell zerschlagen, indem sie einen reibungslosen Weg von kontrollierten Dokumenten zur externen Cloud-Verarbeitung geschaffen haben. Hier ist, was der neue Ansatz erfordert.
Beitrag lesenWir haben unsere Erkennung personenbezogener Daten gegen Microsoft Presidio gemessen – das haben wir gelernt
Ein reproduzierbarer, direkter Benchmark auf 14 PDF-Dokumenten über 7 europäische Sprachen. Die Standardinstallation von Microsoft Presidio gibt 666 Treffer aus; promptShield gibt 252 auf demselben Korpus aus. Der Großteil der Differenz ist keine Leistungsfähigkeit – es ist Rauschen, das wir filtern und Presidio nicht.
Beitrag lesen