Bij de keuze tussen Fable 5 en GPT-5.6 wegen budget en beroepsgeheim zwaarder dan de benchmark

OpenAI bracht op 9 juli 2026 de GPT-5.6-familie algemeen beschikbaar, in drie varianten die Sol, Terra en Luna heten. Anthropic had een maand eerder al Fable 5 uitgebracht, zijn sterkste model tot nu toe. Sindsdien krijgen we op de redactie steeds dezelfde vraag uit jullie mails: welke van de twee moet je nemen. Het eerlijke antwoord is dat de topmodellen zo dicht bij elkaar liggen dat de keuze voor juristen vooral neerkomt op kosten, gewoonte en de vraag waar je data wordt verwerkt. De benchmarkscores waar de makers mee schermen, geven daarbij weinig houvast.

Waarom de benchmarks je hier weinig vertellen

Benchmarks zijn de examens waarmee AI-bedrijven hun modellen scoren, en ze zijn het eerste waarmee een lancering opent. Het probleem is dat dezelfde reeks tests bij verschillende partijen tot uiteenlopende verhalen leidt. GPT-5.6 Sol staat bovenaan op een aantal programmeer-indexen, terwijl Fable 5 op andere tests voorop loopt. Elk bedrijf kiest de reeks die zijn eigen model het best laat uitkomen. Voor een kantoor betekent dat de scores niet de doorslag mogen geven. Ze meten smalle taken onder testcondities, geen echt juridisch werk.

Wat we op de redactie zien tussen Fable 5 en GPT-5.6

Bij TIL werken we al langer het liefst met Claude, en Fable 5 heeft daar niets aan veranderd. In onze eigen vergelijkingen van deze week bleef Claude merkbaar sterker in schrijfwerk, in de smaak bij programmeerklussen en in gesprekken die inlevingsvermogen vragen, zoals het formuleren van lastige feedback of een gevoelige mail. Onze collega Xiang zou Fable voor bijna alles gebruiken als geld en gebruikslimieten geen rol speelden. Eén ding kan het model niet, en dat is afbeeldingen maken. Wie dat nodig heeft, is met ChatGPT beter af.

Die limieten spelen wel mee, en daar wordt GPT-5.6 interessant. Het model komt op de meeste taken dicht in de buurt, tegen een lagere prijs. Fable 5 staat met tien dollar per miljoen invoertokens en vijftig per miljoen uitvoertokens op de duurste plek van Anthropics lijst, terwijl GPT-5.6 Sol op vijf en dertig zit en de lichtere varianten Terra en Luna daar nog ruim onder. Voor het gros van het dagelijkse werk is GPT-5.6 goed genoeg, met ruimere gebruikslimieten dan Fable.

Wat een kantoor afweegt bij de modelkeuze

Voor juristen zit onder die consumentenvraag een laag die de meeste vergelijkingen overslaan. De eerste vraag is of het werk überhaupt in een algemeen taalmodel thuishoort. Openbare bronnen, rechtspraak, een algemene onderzoeksvraag of een modeltekst zonder cliëntgegevens kun je er zonder bezwaar in zetten. Voor stukken die onder het beroepsgeheim vallen is een publiek model als Fable of GPT-5.6 geen begaanbare route, tenzij het in een afgeschermde omgeving draait met een verwerkersovereenkomst en zonder training op je invoer. Waarom die grens hard is, beschreven we eerder.

Fable 5 brengt daar een eigen aandachtspunt bij. Het model komt met een verplichte bewaartermijn van dertig dagen op al het verkeer, ook voor klanten die eerder een nul-bewaarafspraak hadden. Anthropic gebruikt die data naar eigen zeggen niet om te trainen en wist haar na dertig dagen, maar de verplichting zelf hoort in je afweging en in je contract thuis. Microsoft haalde Fable om precies die reden uit zijn interne Copilot-keuzemenu, omdat de bewaartermijn botste met zijn eigen standaard.

Pas als die grens vaststaat, telt de rest. Werk je met een krap budget of veel volume, dan haal je uit GPT-5.6 meer voor je geld. Waar je al zit weegt zwaarder dan mensen denken, want een model dat je kent en waarin je projecten en instellingen al staan, verslaat vaak een net iets beter model dat je opnieuw moet leren. En als schrijfkwaliteit of oordeelsvorming vooropstaat, is Fable 5 de proef waard. De keuze is er een van je eigen praktijk, niet van de scorelijst die de aanbieder je voorhoudt.

Vorige
Vorige

De transparantieplicht uit de AI Act geldt vanaf 2 augustus ook voor het kantoor dat zelf AI gebruikt

Volgende
Volgende

Digitale soevereiniteit maakt een AI-tool nog niet geschikt voor juridisch werk