Als AI-agents ontsnappen
Een agent hoeft niet bewust te zijn om buiten zijn opdracht te raken. De echte vraag is: kunnen we zien wat er gebeurt, hem stoppen en achteraf begrijpen waarom?
Waarom dit mij bezighoudt
Ik werkte als Information Security Officer, leerde ethical hacking en hacking forensics, bouwde publieke informatiesystemen en help nu teams met GenAI. Dat lijken losse hoofdstukken, maar ze draaien om dezelfde vraag: hoe geef je een systeem genoeg ruimte om nuttig te zijn, zonder dat je de controle verliest?
Niet angst voor de machine, maar aandacht voor de grens.
Een agent moet je kunnen volgen
Begrenzen
Geef een agent alleen de toegang en bevoegdheden die bij zijn taak horen.
Loggen
Bewaar wat er gebeurde, zodat een fout geen mysterie wordt.
Stoppen
Een echte stopknop hoort bij een systeem dat echte dingen kan doen.
Begrijpen
Onderzoek achteraf wat de agent zag, besloot en uitvoerde.
Dit wil ik in Studio bouwen
Agents met expliciete bevoegdheden, audit trail, alarmsignalen, menselijke goedkeuring en een stopknop. Niet alleen een chatvenster dat zegt dat alles goed komt.
Bekijk StudioDit is nog in ontwikkeling.
Denk mee