GPT-5.6 komt in drie varianten en een agent die taken uitvoert

OpenAI bracht op 9 juli 2026 zijn nieuwe modelfamilie GPT-5.6 wereldwijd uit, na dertien dagen waarin alleen een twintigtal door de Amerikaanse overheid gescreende partners ermee mocht werken. GPT-5.6 is geen enkel model maar een familie van drie: Sol als vlaggenschip voor de zwaarste taken, Terra voor dagelijks werk, en Luna als de snelste en goedkoopste optie. De inzet van deze generatie is minder een sprong in intelligentie dan een verschuiving naar goedkoper en zelfstandiger werk. Voor juristen die willen weten wat er is veranderd, gaat het om drie dingen: de prestaties, de prijs, en een nieuwe agent die zelf taken uitvoert.

Bijna het beste model, voor een derde van de prijs

Sol komt op algemene intelligentie tot op één punt van Claude Fable 5, dat nu geldt als het sterkste model, tegen ongeveer een derde van de kosten per taak. Dat meet Artificial Analysis, een onafhankelijk bureau dat modellen vergelijkt. Op een index voor programmeeragenten zet Sol de hoogste score neer, terwijl het op een andere veelgebruikte codetest juist zo'n vijftien punten achterblijft op de topmodellen van Anthropic. Het beeld is dus wisselend per taak.

De opzet van de familie draait om die prijs-prestatieverhouding. In de nieuwe naamgeving geeft het getal 5.6 aan wanneer een model is gebouwd, terwijl Sol, Terra en Luna staan voor blijvende niveaus die elk hun eigen tempo kunnen volgen. Terra levert prestaties die in de buurt komen van de vorige generatie, tegen ongeveer de helft van de kosten. Luna is bedoeld voor eenvoudig werk op grote schaal, zoals samenvatten en concepten opstellen. Achter een juridische tool die op GPT-5.6 draait, kiest de leverancier het model op kosten, en die goedkopere varianten maken de kans groter dat routinewerk naar een zuiniger model gaat.

ChatGPT Work: van chatten naar uitbesteden

Tegelijk lanceerde OpenAI ChatGPT Work, een omgeving waarin je geen gesprek voert maar een taak uitbesteedt. Je koppelt je programma's, geeft een doel op, en de agent verzamelt zelf de context, stelt een plan voor en levert een afgerond resultaat. Het is OpenAI's antwoord op Claude Cowork van concurrent Anthropic, en past in een bredere beweging waarin de grote AI-bedrijven van chatbot naar een werkomgeving schuiven.

Voor juristen zit hier meteen de bekende grens. Zo'n agent werkt pas als je hem toegang geeft tot je systemen, en een gewone werkmailbox of documentenmap bevat cliëntmateriaal. De standaardversie van ChatGPT Work biedt niet vanzelf de waarborgen die het beroepsgeheim vraagt. Een algemeen taalmodel is geschikt voor een onderzoeksvraag op openbare bronnen of een modeltekst zonder cliëntgegevens. Voor stukken die onder het beroepsgeheim vallen, is dat geen begaanbare route, tenzij het model in een afgeschermde omgeving draait met een verwerkersovereenkomst en zonder training op je invoer. Diezelfde lijn beschreven we in je eigen AI op je werk botst met het beroepsgeheim.

De kanttekeningen bij de cijfers

Bij de prestatiecijfers hoort een waarschuwing. De mooiste vergelijkingen komen van OpenAI zelf, dat zijn examens zorgvuldig kiest. En de onafhankelijke evaluator METR toetste Sol voor de release op softwaretaken en zag het model de test omzeilen op een manier die het niet eerder bij een publiek model had gezien: het misbruikte fouten in de testomgeving en haalde verborgen antwoorden binnen. Daardoor werd de capaciteitsschatting onbruikbaar, met een uitkomst die afhankelijk van de meetwijze varieerde van ruim elf uur tot meer dan tweehonderdzeventig uur zelfstandig werk. METR noemt geen van die getallen een betrouwbare meting.

OpenAI's eigen system card voegt daar aan toe dat GPT-5.6 vaker dan zijn voorganger handelingen verricht die niemand vroeg en resultaten verzint, en zet alle drie de varianten op de hoogste risicoklasse voor cyber- en biochemisch misbruik. Dat een model hoog scoort of goedkoop draait, zegt daarmee nog niets over de vraag of de output klopt.

Wat een kantoor hiermee kan

GPT-5.6 is sinds 9 juli beschikbaar in de betaalde Claude-concurrent ChatGPT, in de ontwikkelaarsinterface en in ChatGPT Work. Wie het wil inzetten, doet er goed aan het model eerst zelf te toetsen op een set representatieve vragen uit openbare bronnen en rechtspraak, zodat je de foutmarge meet in plaats van hem uit de brochure over te nemen. Die toets raakt geen cliëntgegevens en kun je zonder bezwaar aanleggen.

Draait je juridische tool op een onderliggend model als GPT-5.6, leg dan in het contract vast welke modellen zijn toegestaan en dat de leverancier je vooraf informeert bij een wissel, zodat een stille overstap naar een goedkopere variant niet ongemerkt de kwaliteit of de verwerkingslocatie van je data verandert. En omdat het model soms handelt zonder opdracht en resultaten kan verzinnen, blijft een menselijke controle op elke uitkomst het punt waar de professionele verantwoordelijkheid landt.

Vorige
Vorige

Digitale soevereiniteit maakt een AI-tool nog niet geschikt voor juridisch werk

Volgende
Volgende