Vraag een AI-chatbot naar de regels voor jouw branche en je krijgt een vlot, zelfverzekerd antwoord. Of het klópt, is een tweede. Precies op dat punt zet Anthropic nu de aanval in: Claude Opus 4.8, verschenen op 28 mei, is nadrukkelijk getraind om te zeggen wanneer het iets niet zeker weet.
De feiten
Opus 4.8 kwam 41 dagen na voorganger 4.7 — het tempo ligt hoog dit jaar. De prijs bleef gelijk: 5 dollar per miljoen input-tokens en 25 dollar per miljoen output-tokens. De winst zit vrijwel volledig in betrouwbaarheid en bediening:
- Strenger op eigen fouten. Het model is ongeveer vier keer minder geneigd om eigen codefouten door de vingers te zien. Eerdere versies keurden nog weleens hun eigen bug goed; 4.8 controleert scherper.
- Twijfel wordt zichtbaar. Opus 4.8 markeert onzekerheden vaker. Weet het model iets niet zeker, dan zegt het dat erbij — in plaats van gokken met een stalen gezicht.
- Effort-regelaar voor iedereen. De regelaar waarmee je bepaalt hoeveel denkwerk (en dus tijd en geld) het model in een taak steekt, zat tot nu toe vooral in de API. Nu staat hij ook gewoon in de claude.ai-apps.
- Sneller én goedkoper. De fast mode, die 2,5 keer sneller antwoordt, werd drie keer goedkoper. En Claude Code kreeg “dynamic workflows”: het gereedschap past zijn aanpak onderweg aan de taak aan.
Waarom die eerlijkheid het echte nieuws is
Benchmarkscores halen de krantenkoppen, maar wie AI zakelijk gebruikt weet: de grootste drempel is niet dat AI te dom is. De grootste drempel is dat je niet weet wanneer hij ernaast zit. Een verkeerd telefoonnummer in een klantmail, een verzonnen leveringsvoorwaarde in een offerte — de schade zit in de zelfverzekerde fouten.
Een model dat zegt “dit weet ik niet zeker, controleer dit even” is in de praktijk waardevoller dan een model dat twee procent hoger scoort op een test. Je weet eindelijk wáár je moet kijken.
Wat betekent dit voor jou?
Overweeg je AI in te zetten op plekken waar fouten geld kosten — klantmails, offertes, administratie — dan is dit de eigenschap waar je op zat te wachten. Minder gladde onzin betekent minder verrassingen achteraf, en gerichte controle op de plekken die het model zelf aanwijst.
Blijf wel eindredacteur: “vaker twijfel markeren” is niet hetzelfde als “nooit meer fout”. Maar het gat wordt kleiner, en dat is precies de ontwikkeling die je wilt zien vóór je een agent op automatisch website-onderhoud of klantcontact zet.
De effort-regelaar is de tweede praktische winst. Zet hem laag voor een brainstorm (snel en goedkoop), hoog voor het eindresultaat. Zo bepaal jij de balans tussen kosten en kwaliteit, in plaats van het model. Die regelaar verscheen begin dit jaar met Opus 4.6, het model met een miljoen tokens werkgeheugen — dat hij nu in de gewone apps zit, maakt hem eindelijk bruikbaar voor niet-techneuten.
En de goedkopere fast mode? Die maakt “even snel iets vragen” nog laagdrempeliger voor alledaags werk waar geen diep denkwerk voor nodig is.
Samengevat
- Claude Opus 4.8 verscheen op 28 mei, 41 dagen na 4.7, tegen dezelfde prijs ($5/$25 per miljoen tokens).
- Het laat ongeveer 4x minder eigen codefouten passeren en markeert onzekerheden vaker.
- De effort-regelaar (zelf sturen op kosten versus kwaliteit) zit nu ook in de claude.ai-apps; de fast mode werd 3x goedkoper.
- Voor ondernemers is eerlijke twijfel belangrijker dan een hogere benchmarkscore: het maakt AI een stuk geschikter voor klantcontact en administratie — mét jou als eindredacteur.
