AI-security · blog

Is jouw AI te hacken?

LLM-security in de praktijk

We bouwden een AI-security-scanner en richtten 'm op echte taalmodellen — waaronder een AI-assistent in productie. Een deel van de klassieke "jailbreaks" kwam er gewoon doorheen.

Een taalmodel is geen gewone software. Je "programmeert" het met taal — en dus kun je het ook mét taal misleiden. Dat heet een jailbreak of prompt-injectie: een instructie die de AI z'n eigen veiligheidsregels laat negeren.

Wat we deden

We vielen onze eigen AI aan

We vuurden bekende jailbreak-technieken af op echte taalmodellen, waaronder een AI-assistent die daadwerkelijk in productie draait. Een deel van de klassieke jailbreaks kwam er zonder moeite doorheen — de AI liet zich in een alternatieve "persona" duwen die z'n eigen regels losliet. Bij andere technieken hield het model juist wél stand. Niet zwart-wit, maar absoluut niet waterdicht. En zonder test had niemand het geweten.

Waarom dit jou aangaat

Drie risico's bij élke AI-toepassing

Zet je organisatie een chatbot of AI-assistent in? Dan spelen deze risico's mee — of je ze nu kent of niet.

Prompt-injectie

Verstopte instructies

Instructies verstopt in een document of e-mail die je AI overnemen en buiten z'n kaders laten treden.

Datalekken

Meer dan bedoeld

De AI die meer prijsgeeft dan de bedoeling is — vertrouwelijke gegevens die je niet terugkrijgt.

EU AI Act

Aantoonbaar beheerst

De plicht om aan te tonen dat je AI-systeem robuust, beveiligd en getoetst is.

Wat wij bieden

Een AI-securityscan met een helder rapport

We scannen jouw AI/LLM op deze zwakheden — honderden aanvals-scenario's, gemapt op de OWASP LLM Top 10, MITRE ATLAS, NIST AI RMF en de EU AI Act — en leveren een concreet rapport in gewone taal: waar staat je AI sterk, waar niet, en wat je eraan doet. AVG- en AI-Act-bewust, volledig binnen de EU.

Hoe veilig is jouw AI?

Test je AI voordat een ander het doet

AI inzetten zonder 'm te testen is als een deur ophangen zonder het slot te controleren. De eerste kennismaking is gratis.