Blog
Benchmarks, methodologie, engineering-notities.
De alfabetbelasting: onze AI in één tabblad
Ons detectiemodel droeg een woordenlijst voor 104 talen mee. Wij bieden er zeven. Hoe we er 39 MB uit haalden zonder één gewicht aan te raken.
Lees het artikelToekomst van werkPerfecte omstandigheden om AI-gebruik te verbergen
Geef je AI-gebruik toe en je vak noemt het valsspelen; word je gehoord, dan volgt een verbod. Verbergen is rationeel — en maakt elk AI-beleid loos.
Lees het artikelJuridischPersoonsgegevens uit juridische pdf's zwartlakken
Online tools zetten vertrouwelijke cliëntdata op andermans servers. Zo zwartlak je juridische pdf's lokaal, met de tekst echt verwijderd.
Lees het artikelHoe het werktOmkeerbare zwartlakking: hoe tokenisatie werkt
Omkeerbare zwartlakking vervangt elke naam door een vaste code en houdt de sleutel lokaal: deel het document, decodeer het later. Zo werkt tokenisatie.
Lees het artikelComplianceAVG: wat telt werkelijk als ‘geanonimiseerd’?
Onder de AVG is data pas anoniem als niemand realistisch kan heridentificeren. Bewaart u een sleutel, dan is het pseudoniem en volledig in scope.
Lees het artikelHandleidingenGescande pdf's en afbeeldingen zwartlakken
Een gescande pdf is een plaatje, geen tekst: tekstgebaseerde tools vinden niets en missen alles. De OCR-pijplijn die wél zwartlakt, op je toestel.
Lees het artikelAI-veiligheidMag ik mijn contract in ChatGPT zetten?
De meeste NDA's en contracten beperken aan wie u ze mag verstrekken — en een kopie naar een externe dienst uploaden is precies zo'n verstrekking.
Lees het artikelTechniekWaarom we onze eigen Demo Studio bouwden
We begonnen met een kant-en-klare demo-videotool. Twee thema's, zeven talen en een wekelijks wijzigende UI braken hem. Dus bouwden we onze eigen.
Lees het artikelPositioneringWaarom niemand een lakhulpmiddel bouwde voor wie de scan heeft
Bijna elk hulpmiddel om persoonsgegevens te zwartlakken verwacht tekst, geen pagina — het begint pas na het moeilijkste deel. Daarom is een pdf vol afbeeldingen nog steeds zo lastig te lakken.
Lees het artikelWorkflowDezelfde naam, dezelfde code, elke keer
Professionals werken vele beurten met de AI. Dat lukt alleen als één entiteit het hele gesprek door dezelfde code houdt: gespreksstabiele anonimisering.
Lees het artikelPositioneringHoe bedrijven persoonsgegevens beschermen
Vier manieren om persoonsgegevens te beschermen: governanceplatforms, cloud-API's, uitbestede zwartlakking en handmatig doorhalen. De kaart en ons gat.
Lees het artikelTechniekWaarom onze eigen detectiemotor, niet Presidio
Presidio is een uitstekende toolkit. Toch schreven we onze eigen motor: wij leveren een begrensde pdf op een laptop, geen tekststroom in een cloudpijplijn.
Lees het artikelAI-veiligheidIs het veilig om documenten in ChatGPT te plakken?
Kort antwoord: soms — en in welk geval u zit, hebt u volledig zelf in de hand. Wat het risico bepaalt, en de ene stap die de vraag overbodig maakt.
Lees het artikelVerantwoorde AIEen machine kan niet verantwoordelijk zijn. U wel
Verantwoordelijk zijn betekent iets te verliezen hebben als het misgaat, en een machine heeft niets op het spel. Daarom blijft er altijd een mens bij.
Lees het artikelDatarisicoAan wie stilletjes cliëntdocumenten deelt met een chatbot
AI maakt het lekken van vertrouwelijke gegevens moeiteloos, en de gevolgen zijn niet theoretisch of ver weg. Wat u riskeert met cliëntdossiers in een chatbot.
Lees het artikelPrivacy-engineeringPersoonsgegevens beschermen met AI in de loop
Dertig jaar lang betekende gegevensbescherming het beheersen van databasetoegang. AI schiep een wrijvingsloos pad van document naar publieke cloud.
Lees het artikelBenchmarkspromptShield versus Microsoft Presidio: de benchmark
Reproduceerbare vergelijking over 14 pdf's in 7 talen. Presidio geeft standaard 666 detecties, promptShield 252. Het verschil is ruis, geen kunnen.
Lees het artikel