
Vorige week was ik bij een AI-avond van 48hours.ai. Leuke sessie, op een prachtig paradoxale plek: een AI-avond waarbij de deelnemers omringd zijn door metershoge boekenkasten met oude boeken, precies het soort kennis dat we tegenwoordig aan een model vragen. Hoe bedenk je het?
Naast een leuke introductie over AI en voorbeelden van een aantal projecten die zij hebben gedraaid, gaven ze ook een klein inkijkje in hoe zij hun eigen bedrijfsvoering met AI automatiseren. Bij hen loopt er werk gewoon door zonder dat iemand erop drukt. Dat is een stuk verder dan waar de meeste bedrijven staan.
Toen ik dat zag, was ik onder de indruk. Maar ik vroeg me ook af: hoe weet je nu zeker dat wat je eruit krijgt ook echt klopt? Dat is geen vraag aan hen, want zij hebben dit duidelijk doordacht, maar aan mezelf: als ík dit zou doen, hoe zou ik het dan borgen?
Voor sommige data is het minder erg als die niet klopt. Bijvoorbeeld omdat er uiteindelijk toch nog een mens naar kijkt die beslist of de data gebruikt wordt. Maar wat als je een AI-‘agent’ toegang geeft tot bijvoorbeeld je CRM of je financiële systeem om aanpassingen te doen, zonder dat je zijn werk continu controleert?
Een AI-agent is een stuk software dat AI gebruikt om (meestal) vrij specifieke dingen voor je uit te voeren. Een AI-agent kan bijvoorbeeld vragen van klanten op je website beantwoorden, zelfs op basis van je voorraad. Overigens is de definitie van AI-agent behoorlijk vloeibaar. Je hebt ook agents die je eigenlijk alles kunt vragen wat je maar wilt. “Stuur Henk een e-mail met een factuur van 1500 euro” kan dan uitmonden in een boze klant die wil weten waarom hij een factuur van 15.000 euro kreeg. En dat allemaal vanaf jouw computer. Zo’n alleskunner is dus niet geheel zonder risico.
Vorige week schreef ik al dat je een AI niet kunt aanspreken op zijn fouten. Bij een mens kun je dat wel doen. Een mens zal (hopelijk) verantwoordelijkheid nemen, leren wat er fout ging en zijn gedrag bijsturen. Een AI kan dat niet zelf. Maar je kunt hem wel bijsturen, als je weet wat er misgaat en wanneer het misgaat. En hoe weet je dat? Door:
- Te bepalen wat de agent niet mag doen zonder dat een mens hem toestemming geeft. Wat mag automatisch, wat mag hij na toestemming en wat mag hij nooit?
- Hem te kunnen onderscheiden van een mens. Geef hem dus niet jouw inloggegevens, maar een eigen account.
- Te beperken wat hij kan doen. Dat account van hierboven? Alleen leesrechten als hij de voorraad moet uitlezen. Moet hij ook voorraad kunnen toevoegen? Dan mag hij nog steeds niets verwijderen.
- Een digitaal logboek bij te houden van alles wat hij doet en wat zijn opdracht was. Zonder die informatie kun je hem niet bijsturen als het tóch misging. En zorg er dan meteen voor dat hij zijn eigen logboek niet mag aanpassen.
Want je kunt de werkzaamheden van een mens vervangen door een AI, maar de verantwoordelijkheid voor die werkzaamheden valt uiteindelijk toch terug op een mens. Dat is namelijk degene die eindverantwoordelijk is voor het inzetten van AI.
Vraag eens na bij je IT-partij of softwareleverancier of er al iets meedraait dat namens jullie handelt, en onder wiens account dat dan gebeurt. Grote kans dat het antwoord je verrast.