AI-agenten die zelf klikken en aanpassen: handig, maar zet grenzen

AI-systemen geven steeds minder alleen antwoord. Een AI-agent kan een website openen, knoppen aanklikken, gegevens vergelijken, conceptmails maken en instellingen aanpassen. Dat bespaart tijd bij terugkerend werk, maar maakt de gevolgen van een fout ook groter. Een verkeerd antwoord is vervelend; een verkeerd uitgevoerde actie kan een klantmail versturen, bestanden delen of een productieomgeving wijzigen.

De oplossing is niet om agenten niets te laten doen. Juist duidelijke grenzen maken automatisering bruikbaar. Een medewerker krijgt ook niet op de eerste werkdag toegang tot ieder systeem en toestemming om alles zelfstandig te publiceren. Voor een AI-agent hoort hetzelfde principe te gelden.

Waarom klikken meer risico geeft dan adviseren

Een agent combineert informatie uit meerdere bronnen: je opdracht, websites, e-mails, documenten en gekoppelde apps. Daar kan onbetrouwbare of zelfs kwaadwillende inhoud tussen zitten. Bij een zogenaamde prompt injection staat in zo’n externe bron een verborgen instructie die probeert het gedrag van de agent te veranderen.

Een mens herkent een vreemde opdracht in een webpagina misschien als verdacht. Een agent moet actief onderscheid maken tussen informatie die hij moet lezen en instructies die hij mag volgen. Omdat die grens niet altijd perfect is, blijven technische beperkingen en menselijke controle nodig.

Zeven praktische grenzen voor AI-agenten

  1. Geef één concrete opdracht tegelijk. “Controleer deze drie concepten en maak een rapport” is veiliger dan “beheer alles wat aandacht nodig heeft”.
  2. Begin met alleen-lezen. Laat de agent eerst inventariseren en voorstellen doen. Voeg schrijfrechten pas toe wanneer het proces voorspelbaar is.
  3. Gebruik zo weinig mogelijk toegang. Koppel alleen de mailbox, map of website die voor de taak nodig is. Gebruik waar mogelijk een apart account met beperkte rechten.
  4. Vraag bevestiging bij gevolgen. Verzenden, publiceren, verwijderen, betalen en rechten wijzigen horen een duidelijk controlemoment te hebben.
  5. Werk eerst in concept of test. Laat een agent een conceptbericht, proefwijziging of stagingversie maken voordat iets openbaar of definitief wordt.
  6. Bewaar een logboek. Leg vast wat de agent heeft gelezen, voorgesteld en uitgevoerd. Zonder controleerbaar spoor wordt een fout lastig te onderzoeken.
  7. Zorg voor een stop- en herstelmogelijkheid. Een taak moet kunnen worden onderbroken en wijzigingen moeten waar mogelijk teruggedraaid kunnen worden.

Een bevestiging moet specifiek zijn

Een algemene toestemming aan het begin, zoals “je mag alles doen wat nodig is”, geeft weinig bescherming. Een nuttig controlemoment laat vlak voor de actie zien wat er gaat gebeuren: naar wie een bericht wordt gestuurd, welke tekst wordt gepubliceerd, welk bestand wordt verwijderd of welke instelling verandert.

Daarbij helpt het om onderscheid te maken tussen omkeerbare en moeilijk omkeerbare acties. Een concept aanmaken is meestal laag risico. Een bericht naar honderden klanten sturen of beheerdersrechten wijzigen vraagt veel meer controle.

Begin met taken waarbij fouten zichtbaar blijven

Goede eerste toepassingen zijn bijvoorbeeld:

  • informatie verzamelen en samenvatten;
  • conceptmails of conceptblogs voorbereiden;
  • verschillen tussen instellingen rapporteren;
  • een wijzigingsvoorstel maken zonder het direct uit te voeren;
  • terugkerende controles uitvoeren en afwijkingen melden.

Wanneer zulke taken betrouwbaar verlopen, kan de agent stap voor stap meer uitvoeren. Breid toegang uit op basis van bewezen noodzaak, niet omdat de techniek het toevallig mogelijk maakt.

Stel leveranciers en bouwers de juiste vragen

Vraag bij een agentoplossing welke gegevens en systemen bereikbaar zijn, waar informatie wordt opgeslagen, welke acties bevestiging vereisen en hoe lang logs worden bewaard. Controleer ook of rechten per taak kunnen worden beperkt en of een fout kan worden teruggedraaid.

Een goede agent is niet degene die zonder vragen overal doorheen klikt. Het is de agent die nuttig werk zelfstandig afhandelt, maar stopt zodra de gevolgen groter of minder duidelijk worden.

Automatiseren met controle

AI-agenten kunnen kleine organisaties veel handwerk besparen. De veilige route is klein beginnen, toegang beperken en belangrijke acties zichtbaar houden. Rendar helpt bij het praktisch inrichten van automatisering, koppelingen en toegangsgrenzen die bij de organisatie passen.

Bronnen