← Alle hoofdstukkenHoofdstuk 2 van 8

Robuuste prompts ontwerpen en testen

Je maakt prompts die niet alleen één mooi antwoord geven, maar over verschillende invoer betrouwbaar blijven.

Na dit hoofdstukJe kan een professionele promptarchitectuur bouwen, voorbeelden doelgericht inzetten en versies vergelijken met een kleine testset.
Je voortgang0 van 40 lessen
2.1

De anatomie van een professionele prompt

Combineer resultaat, context, output, grenzen en controle; gebruik alleen onderdelen die het risico of de bruikbaarheid veranderen.

Een professionele prompt is een overdracht van werk. Begin met het eindresultaat en voeg daarna de relevante context, gewenste uitvoervorm en noodzakelijke grenzen toe. Geef aan welke broninformatie leidend is en wat bij ontbrekende gegevens moet gebeuren.

Een rol kan perspectief of jargon sturen, maar bewijst geen deskundigheid. Gebruik daarom liever concrete beoordelingscriteria dan een indrukwekkende functietitel. Sluit belangrijke opdrachten af met een controle-instructie: laat ontbrekende informatie, niet-onderbouwde claims en afwijkingen van de opdracht afzonderlijk rapporteren.

  • Resultaat
  • Relevante context
  • Bruikbaar formaat
  • Echte grenzen
  • Controle achteraf
Zo kan je dit gebruiken

Een analyseprompt definieert besluit, bronnen, criteria en onzekerheden; hij vraagt niet alleen om 'diep na te denken'.

Probeer deze prompt
Resultaat: [resultaat]. Context en bronnen: [context]. Output: [vorm]. Grenzen: [grenzen]. Controleer vóór afronding: [criteria]. Markeer ontbrekende informatie en verzin geen bronfeiten.
Snelle kennischeck

Wat maakt een rol in een prompt waardevol?

Jouw praktijkopdracht

Bouw een volledige prompt voor een echte taak en schrap ieder onderdeel dat geen effect heeft.

2.2

Voorbeelden gebruiken zonder blind kopiëren

Voorbeelden maken patroon en kwaliteitsniveau concreet, maar mogen foute of toevallige eigenschappen niet tot regel verheffen.

Met voorbeeldgestuurde instructie toon je invoer en gewenste uitvoer. Dit helpt vooral bij classificatie, vaste formats, tone of voice en uitzonderingen. Kies voorbeelden die samen de normale gevallen én belangrijke grenzen dekken.

Leg uit wat het model uit een voorbeeld moet overnemen: structuur, detailniveau, criterium of toon. Laat namen, feiten en toevallige formuleringen niet automatisch hergebruiken. Voeg minstens één afwijkend of onvolledig geval toe en definieer het juiste gedrag, bijvoorbeeld 'onvoldoende informatie' in plaats van een gok.

  • Representatieve voorbeelden
  • Gewenst kenmerk benoemen
  • Randgeval opnemen
  • Geen ongewenste feitkopie
Zo kan je dit gebruiken

Een e-mailclassificatie toont voorbeelden van een gewone vraag, een klacht, een dubbelzinnige vraag en een bericht buiten scope.

Probeer deze prompt
Leer uit de voorbeelden hieronder uitsluitend [kenmerken]. Neem geen namen of feiten over. Classificeer de nieuwe invoer in [categorieën]. Als geen categorie past, antwoord BUITEN_SCOPE en motiveer kort. Voorbeelden: [voorbeelden].
Snelle kennischeck

Waarom voeg je een randgeval toe?

Jouw praktijkopdracht

Maak drie voorbeelden en één randgeval voor een eigen classificatie- of formattaak.

2.3

Controleerbare tussenstappen vragen

Vraag om relevante bewijsstappen en beslisredenen, niet om een verborgen intern denkproces.

Voor professioneel werk wil je kunnen volgen waarop een uitkomst steunt. Vraag daarom om bronextracties, aannames, berekeningen, besliscriteria en een beknopte motivering. Zulke artefacten kun je controleren zonder te doen alsof een gegenereerde uitleg het werkelijke interne redeneerproces volledig onthult.

Kies tussenstappen die fouten lokaliseren. Bij een vergelijking zijn dat bijvoorbeeld criteria, bronwaarden, ontbrekende gegevens en scores. Bij een tekstcontrole zijn dat claims, bewijs en voorgestelde correcties. Een lange gedachtegang is geen bewijs; controleerbare gegevens en herhaalbare tests zijn dat wel.

  • Bronextractie
  • Aannames apart
  • Berekening of criterium
  • Beknopte motivering
  • Resterende onzekerheid
Zo kan je dit gebruiken

Vraag bij een leverancierskeuze niet om 'alle gedachten', maar om bronwaarden, gewichten, berekening en gevoeligheidsanalyse.

Probeer deze prompt
Analyseer [vraag]. Toon: 1) gebruikte bronfeiten, 2) noodzakelijke aannames, 3) toegepaste criteria of berekeningen, 4) beknopte reden voor de conclusie en 5) resterende onzekerheden. Verzin geen ontbrekende waarden.
Snelle kennischeck

Wat is het sterkste controlebewijs?

Jouw praktijkopdracht

Herschrijf één prompt zodat hij vijf controleerbare tussenproducten oplevert.

2.4

Een kleine maar sterke testset bouwen

Test normale gevallen, grenzen en mislukkingen vóór je een prompt hergebruikt.

Een prompt die één voorbeeld goed verwerkt is nog geen betrouwbare workflow. Maak een testset met representatieve invoer, een moeilijk geval, ontbrekende informatie, tegenstrijdige bronnen en eventueel een ongepaste instructie in bronmateriaal. Definieer per test vooraf wat minimaal goed gedrag is.

Gebruik geen echte gevoelige gegevens wanneer fictieve voorbeelden volstaan. Beoordeel zowel inhoud als veiligheid: volgt de output het schema, worden feiten niet verzonnen, blijft broninhoud ondergeschikt aan de opdracht en stopt de workflow waar dat moet? Bewaar mislukte voorbeelden als regressietest.

  • Normaal geval
  • Onvolledig geval
  • Tegenstrijdigheid
  • Buiten scope
  • Onbetrouwbare broninstructie
Zo kan je dit gebruiken

Een samenvattingsprompt wordt getest met een normaal verslag, ontbrekende besluiten, conflicterende data en een document dat instructies aan de AI bevat.

Probeer deze prompt
Ontwerp zes tests voor [workflow]. Geef per test invoertype, verwacht gedrag, verboden gedrag en bewijscriterium. Gebruik fictieve data. Voeg één promptinjectie-achtig bronfragment toe.
Snelle kennischeck

Wanneer wordt een mislukte test waardevol?

Jouw praktijkopdracht

Maak een testset van zes gevallen en laat een collega één verwachte uitkomst betwisten.

2.5

Promptversies eerlijk vergelijken

Wijzig één belangrijk element per ronde en vergelijk op vooraf vastgelegde criteria.

Vergelijk promptversies niet op gevoel of op één toevallig antwoord. Gebruik dezelfde testset en dezelfde beoordelingscriteria. Wijzig bij voorkeur één factor, zoals broninstructie, uitvoerschema of foutafhandeling. Zo weet je welke aanpassing waarschijnlijk het verschil maakte.

Registreer versienummer, wijziging, reden, tests en bekende beperking. Meet naast kwaliteit ook correctiewerk, consistentie en benodigde tijd. Een versie met een hoger gemiddeld cijfer kan toch ongeschikt zijn als ze één kritisch grensgeval fout behandelt.

  • Zelfde testset
  • Eén hoofdwijziging
  • Criteria vóór test
  • Kritieke fouten apart
  • Versielog
Zo kan je dit gebruiken

Vergelijk v1 zonder bronlabels met v1.1 met bronlabels; verander niet tegelijk ook toon, lengte en taakvolgorde.

Probeer deze prompt
Vergelijk prompt v1 en v2 op [testset]. Scoreer per test: instructietrouw, brongebruik, volledigheid, veiligheid en herstelwerk. Benoem kritieke fouten afzonderlijk; gebruik geen gemiddelde om een knock-outfout te verbergen.
Snelle kennischeck

Waarom verander je liefst één hoofdelement?

Jouw praktijkopdracht

Test twee promptversies op dezelfde vijf gevallen en schrijf een kort wijzigingsbesluit.

Hoofdstukopdracht

Breng alles samen

Bouw een prompt v1, een testset met zes gevallen en een v1.1 waarin je één aantoonbare zwakte corrigeert. Documenteer resultaat, regressietest en resterende beperking.