Kennisbank · Verantwoord AI-gebruik

Hoe test je een AI-toepassing vóór en na ingebruikname?

Een geslaagde demo is geen bewijs dat de toepassing in jouw proces goed werkt.

Kort antwoord. Definieer eerst taak, toegestaan gedrag en stopgrens. Test gewone, onvolledige en afwijkende gevallen met fictieve of veilig toegestane data. Vergelijk resultaten met een betrouwbare bron, leg fouten en onzekerheid vast en beslis per gebruiksfase. Test opnieuw na wijziging van model, prompt, bron, koppeling of bevoegdheid; ook eerdere geslaagde gevallen kunnen regressies krijgen.

Door De Compliance Afdeling · Praktische uitleg voor Nederlandse ondernemers

Welke gevallen horen in de test?

  1. Normale vraag met complete en actuele informatie.
  2. Vraag met ontbrekende bron, productnummer of toestemming.
  3. Tegenstrijdige documenten of verouderde voorwaarden.
  4. Ongebruikelijke formulering, ander taalgebruik of randgeval.
  5. Kwaadwillende instructie in externe tekst wanneer de tool die leest.
  6. Scenario met mogelijke impact op persoon of klant, zonder echte gevoelige testdata.

Bepaal per taak wat je verwacht en wanneer menselijk ingrijpen noodzakelijk is. Een eigen testschaal is een interne keuze, geen officiële AI Act-risicoscore. De FTC Workado-order illustreert waarom een nauwkeurigheidsclaim op een beperkte dataset niet zonder meer op alle typen inhoud past.

DCA-werkaanbeveling: stel de juiste uitkomst vast met een deskundige en een onafhankelijke bron; een tweede AI die hetzelfde antwoord geeft is geen onafhankelijke controle. Bij detectie of selectie tel je onterechte signalen en gemiste gevallen apart. Vermeld bij iedere prestatieclaim taak, testgroep, taal, methode en onzekerheid; een gemiddelde mag een ernstige fout niet verbergen.

Fictief testbesluit voor Noord Service

T-03 geeft zonder productnummer een onjuiste garantie van vijf jaar. De serviceleider zet “externe communicatie” op niet vrijgegeven, onderzoekt de bron en test na aanpassing alle tien scenario’s opnieuw. De interne conceptfase blijft alleen onder gecontroleerde testvoorwaarden lopen. Boekingsrechten zijn nooit verleend.

Hoe leg ik bewijs en onbekende punten vast?

Beoordeel gewone, lastige en onvolledige gevallen. Een mooi geformuleerd antwoord is niet hetzelfde als een juist antwoord.

Veeg in de tabel opzij of gebruik de pijltjestoetsen voor andere kolommen.

AI-test- en beoordelingsblad · volledig fictief voorbeeld
OnderdeelWat leg je vast?Fictief ingevuld voorbeeld
Testcode en versieLeg systeemversie, promptversie en testdatum vast.Fictief T-03; prompt v0.2; 27-09-2026.
Taak en verwachtingWat moet de uitkomst kunnen, en wat juist niet?Vraag naar onderhoud zonder productnummer: vraag om productnummer; geen termijn beloven.
InvoerclassificatieFictief of echt; mogelijke persoonsgegevens of geheimen?Volledig fictieve servicevraag; geen klantdata.
Uitkomst en bronNoteer wat de AI zei en waarmee je het vergelijkt.AI noemde garantie van vijf jaar; prijslijst/voorwaarden tonen twee jaar voor dit onderdeel.
Onzeker of foutMaak onvolledig bewijs en afwijkingen zichtbaar.Foutieve garantieclaim; oorzaak onbekend.
Gevolg en ernstWie kan wat verliezen door gebruik van deze uitkomst?Klant kan op verkeerde toezegging vertrouwen; externe verzending niet toegestaan.
Menselijke controleWelke feiten controleerde wie vóór gebruik?Serviceleider vergelijkt productcode en actuele voorwaarden; test mislukt.
Wijziging en hertestPas aan en test ook eerdere scenario’s opnieuw.Prompt aangepast; T-03 en T-01–T-10 opnieuw testen.
Besluit per gebruiksfaseConcept, extern bericht en systeemactie apart vrijgeven.Intern concept nog in test; geen externe vrijgave.

AI-test- en beoordelingsblad als bewerkbare CSV

Download zonder e-mailadres. Vul echte gegevens uitsluitend in je eigen beveiligde omgeving in; deze website ontvangt geen antwoorden.

Wat verandert na een modelupdate?

Leg versie, datum, gedrag, steekproef en eerdere fouten naast elkaar. Pauzeer een functie als een verandering kritieke stopcriteria raakt. Controleer ook of contract, gegevensstroom of rol veranderde; de AI-toepassingskaart helpt die uitgangspunten vast te leggen.

Verder lezen

Bronnen en broncontrole

Openbare primaire bronnen gecontroleerd op . Het Noord Service-voorbeeld en de hulpmiddelen zijn fictieve, praktische DCA-uitwerkingen.

Wat is jouw volgende stap?

Bespreek een AI-pilot

Voor een testplan met duidelijke vrijgave- en stopcriteria.

Bespreek een AI-pilot

We onthouden jouw cookiekeuze en weergavevoorkeuren. Deze opslag is nodig om de website en jouw instellingen te laten werken.

Clarity registreert klikken, scrollen en pagina-interacties voor gebruiksanalyse en sessieopnamen. Formuliervelden zijn gemaskeerd. De cookies _clck (maximaal 1 jaar) en _clsk (1 dag) koppelen paginaweergaven aan een bezoek of sessie.

Daarnaast gebruiken we Plausible voor geaggregeerde, cookieloze statistieken. Deze meting blijft werken bij weigeren.

We bewaren jouw keuze 30 dagen in deze browser. Bij intrekken kan de pagina opnieuw laden om al geladen volgsoftware te stoppen. Lees ons cookiebeleid.