Blog

Benchmarks, methodologie, engineering-notities.

Techniek
· 6 min leestijd

De alfabetbelasting: onze AI in één tabblad

Ons detectiemodel droeg een woordenlijst voor 104 talen mee. Wij bieden er zeven. Hoe we er 39 MB uit haalden zonder één gewicht aan te raken.

Lees het artikel
Toekomst van werk
· 8 min leestijd

Perfecte omstandigheden om AI-gebruik te verbergen

Geef je AI-gebruik toe en je vak noemt het valsspelen; word je gehoord, dan volgt een verbod. Verbergen is rationeel — en maakt elk AI-beleid loos.

Lees het artikel
Juridisch
· 7 min leestijd

Persoonsgegevens uit juridische pdf's zwartlakken

Online tools zetten vertrouwelijke cliëntdata op andermans servers. Zo zwartlak je juridische pdf's lokaal, met de tekst echt verwijderd.

Lees het artikel
Hoe het werkt
· 5 min leestijd

Omkeerbare zwartlakking: hoe tokenisatie werkt

Omkeerbare zwartlakking vervangt elke naam door een vaste code en houdt de sleutel lokaal: deel het document, decodeer het later. Zo werkt tokenisatie.

Lees het artikel
Compliance
· 6 min leestijd

AVG: wat telt werkelijk als ‘geanonimiseerd’?

Onder de AVG is data pas anoniem als niemand realistisch kan heridentificeren. Bewaart u een sleutel, dan is het pseudoniem en volledig in scope.

Lees het artikel
Handleidingen
· 5 min leestijd

Gescande pdf's en afbeeldingen zwartlakken

Een gescande pdf is een plaatje, geen tekst: tekstgebaseerde tools vinden niets en missen alles. De OCR-pijplijn die wél zwartlakt, op je toestel.

Lees het artikel
AI-veiligheid
· 7 min leestijd

Mag ik mijn contract in ChatGPT zetten?

De meeste NDA's en contracten beperken aan wie u ze mag verstrekken — en een kopie naar een externe dienst uploaden is precies zo'n verstrekking.

Lees het artikel
Techniek
· 8 min leestijd

Waarom we onze eigen Demo Studio bouwden

We begonnen met een kant-en-klare demo-videotool. Twee thema's, zeven talen en een wekelijks wijzigende UI braken hem. Dus bouwden we onze eigen.

Lees het artikel
Positionering
· 7 min leestijd

Waarom niemand een lakhulpmiddel bouwde voor wie de scan heeft

Bijna elk hulpmiddel om persoonsgegevens te zwartlakken verwacht tekst, geen pagina — het begint pas na het moeilijkste deel. Daarom is een pdf vol afbeeldingen nog steeds zo lastig te lakken.

Lees het artikel
Workflow
· 9 min leestijd

Dezelfde naam, dezelfde code, elke keer

Professionals werken vele beurten met de AI. Dat lukt alleen als één entiteit het hele gesprek door dezelfde code houdt: gespreksstabiele anonimisering.

Lees het artikel
Positionering
· 11 min leestijd

Hoe bedrijven persoonsgegevens beschermen

Vier manieren om persoonsgegevens te beschermen: governanceplatforms, cloud-API's, uitbestede zwartlakking en handmatig doorhalen. De kaart en ons gat.

Lees het artikel
Techniek
· 9 min leestijd

Waarom onze eigen detectiemotor, niet Presidio

Presidio is een uitstekende toolkit. Toch schreven we onze eigen motor: wij leveren een begrensde pdf op een laptop, geen tekststroom in een cloudpijplijn.

Lees het artikel
AI-veiligheid
· 9 min leestijd

Is het veilig om documenten in ChatGPT te plakken?

Kort antwoord: soms — en in welk geval u zit, hebt u volledig zelf in de hand. Wat het risico bepaalt, en de ene stap die de vraag overbodig maakt.

Lees het artikel
Verantwoorde AI
· 7 min leestijd

Een machine kan niet verantwoordelijk zijn. U wel

Verantwoordelijk zijn betekent iets te verliezen hebben als het misgaat, en een machine heeft niets op het spel. Daarom blijft er altijd een mens bij.

Lees het artikel
Datarisico
· 7 min leestijd

Aan wie stilletjes cliëntdocumenten deelt met een chatbot

AI maakt het lekken van vertrouwelijke gegevens moeiteloos, en de gevolgen zijn niet theoretisch of ver weg. Wat u riskeert met cliëntdossiers in een chatbot.

Lees het artikel
Privacy-engineering
· 8 min leestijd

Persoonsgegevens beschermen met AI in de loop

Dertig jaar lang betekende gegevensbescherming het beheersen van databasetoegang. AI schiep een wrijvingsloos pad van document naar publieke cloud.

Lees het artikel
Benchmarks
· 8 min leestijd

promptShield versus Microsoft Presidio: de benchmark

Reproduceerbare vergelijking over 14 pdf's in 7 talen. Presidio geeft standaard 666 detecties, promptShield 252. Het verschil is ruis, geen kunnen.

Lees het artikel