De beste prompt is neutraal, kort en heeft hooguit drie eisen

Zo stel je op dit moment je vraag aan Claude, ChatGPT of Copilot: formuleer neutraal, geef hooguit drie harde eisen mee, en controleer de rest in een tweede beurt. Voorbeeld:

Beoordeel of een boetebeding van tien procent van de koopsom in een consumentenkoop onredelijk bezwarend is naar Nederlands recht. Zet de argumenten voor en tegen naast elkaar en benoem welk feit de doorslag geeft. Verwijs alleen naar wetgeving en rechtspraak die je met vindplaats kunt noemen.

Waarom die drie dingen, en wat je juist weglaat.

Vraag neutraal, ook als je al een standpunt hebt

Tapan Parikh legde 45 taalmodellen twintig keuzes voor en veranderde telkens één woord aan het eind van de vraag. Met "toch?" liep de uitkomst uiteen van 32 procentpunt meer instemming tot 32 procentpunt minder; oudere modellen gaan met je mee, nieuwere gaan juist tegen je in. Met "misschien?" steeg de instemming bij alle 45 modellen, gemiddeld 19,6 procentpunt. Tien modellen bevestigden allebei de tegengestelde opties.

"Dit beding is onredelijk bezwarend, toch?" meet dus je eigen formulering. Vraag om de weging in plaats van om bevestiging.

Hooguit drie eisen per beurt

Meta Superintelligence Labs testte vijftien modellen op prompts met een oplopend aantal eisen, met 369.753 controles. Bij acht eisen tegelijk haalde een model elke eis afzonderlijk nog in 41 procent van de gevallen, en alle acht samen in 5,7 procent. Twaalf van de vijftien modellen zakken al bij drie eisen of minder onder de vijftig procent.

Vooraf een plan laten maken hielp niets, en zelfcontrole achteraf schoof de grens met één tot twee eisen op. Zet je overige eisen daarom in een tweede beurt, stuk voor stuk, met het concept ernaast. Dat is meteen het bezwaar tegen de zesdelige promptsjablonen die in juridische cursussen rondgaan: die tellen in één beurt op tot meer dan een model vasthoudt.

Geef voorbeelden alleen voor de vorm

Cheng en collega's lieten op EMNLP 2025 zien dat uitgewerkte voorbeelden met redeneerstappen het antwoord inhoudelijk niet beter maken dan dezelfde vraag zonder voorbeelden. Wat ze wel doen, is het antwoordformaat afstemmen op wat je verwacht. Wil je dat een memo eruitziet zoals jullie memo's eruitzien, geef er dan één mee. Voor een scherpere analyse verdient de opdracht zelf de aandacht.

Laat "stap voor stap" weg

IBM Research vergeleek acht prompttechnieken in 430.738 evaluaties. Een kale vraag scoorde 52,1 procent, "let me think step by step" bleef steken op 42,6 procent. Wat wel ruim drie procentpunt won, was een korte rolaanduiding aan het eind van de vraag. De onderzoekers gebruikten voor elk vakgebied dezelfde rol, dus die winst zit in de vorm en niet in een treffend gekozen expertise. Bij modellen die intern al redeneren, voegt "denk stap voor stap" niets toe.

Prompten in Claude, ChatGPT en Copilot

In Claude zet je een lang document bovenaan en je vraag onderaan, wat volgens de promptdocumentatie van Anthropic tot dertig procent scheelt. Schrijf op wat je wel wilt zien, en geef expliciet toestemming om te zeggen dat de informatie ontoereikend is.

In ChatGPT geef je getalsmatige grenzen zoals "drie tot zes zinnen" en zeg je erbij dat je precies wilt wat je vraagt en niets erbij, want de GPT-5-modellen vullen anders zelf aan.

In Copilot voeg je een bron toe naast je doel. Dat is het onderdeel dat de andere twee niet hebben. Microsoft 365 Copilot valt onder enterprise data protection, waarbij Microsoft verwerker is en jouw invoer de onderliggende modellen niet traint. Binnen die tenant kan dossiermateriaal mee. In de algemene Claude-app en in ChatGPT blijven stukken die onder het beroepsgeheim vallen buiten beeld, en een persoonlijk Copilot-account zonder werkinlog valt buiten die afspraken.

Wat geen enkele prompt oplost, is de controle op vindplaatsen: elke aangehaalde uitspraak een ECLI en een randnummer. Onze legal prompts om hallucinaties te beperken staan naast die controle en vervangen hem niet.

Vorige
Vorige

Ook een algoritme zonder invloed op de uitkomst hoort in de motivering van het besluit

Volgende
Volgende

De toegevoegde waarde van artikel 88 quater AVG: een kritische analyse