Sam neemt opSam neemt op.

Claude Opus 5 is uit: dit zijn de prestaties, de prijzen en de kanttekeningen

6 min lezen
Claude Opus 5 is uit: dit zijn de prestaties, de prijzen en de kanttekeningen

Anthropic heeft op 24 juli 2026 Claude Opus 5 uitgebracht, de opvolger van Opus 4.8. Het model is per direct beschikbaar via de Claude API, Claude.ai, Claude Code en Claude Cowork. De aankondiging staat vol benchmarkscores, maar het interessantste getal staat niet in de koppen: bij vrijwel elke test die Anthropic noemt, gaat het niet alleen over hoe goed het model presteert, maar over wat die prestatie kost.

Hieronder zetten we op een rij wat er precies is aangekondigd, wat het kost, en — net zo belangrijk — waar je deze cijfers met een gezonde korrel zout moet nemen.

De benchmarkscores op een rij

Anthropic publiceerde resultaten op vijf verschillende tests. Let bij het lezen op het patroon: bijna elke claim koppelt een prestatie aan een kostenvergelijking.

Door Anthropic gepubliceerde resultaten voor Claude Opus 5 (24 juli 2026)
BenchmarkWat Anthropic meldt
Frontier-Bench v0.1Beter dan alle concurrenten. Ruim twee keer de prestatie van Opus 4.8, tegen lagere kosten.
ARC-AGI 3Drie keer zo hoog als het eerstvolgende model.
CursorBench 3.2Binnen 0,5% van de topscore van Fable 5, maar tegen de helft van de kosten per taak.
Zapier AutomationBenchSlagingspercentage ongeveer anderhalf keer dat van het eerstvolgende model, bij gelijke kosten.
OSWorld 2.0Voorbij het beste resultaat van Fable 5, tegen ruim een derde van de kosten.

De sprong op ARC-AGI 3 springt er in absolute zin het meest uit. Die test meet abstract redeneren op puzzels die het model niet eerder heeft gezien — precies het type taak waar taalmodellen traditioneel moeite mee hebben, omdat je er niet omheen kunt met memoriseren. Een score van drie keer de eerstvolgende is daar een groot gat.

Belangrijk voorbehoud

Dit zijn cijfers die Anthropic zelf publiceert over zijn eigen model. Dat maakt ze niet onwaar, maar ze zijn wel geselecteerd: elk bedrijf kiest de benchmarks waarop het goed scoort. Onafhankelijke hertoetsing volgt meestal pas weken later. Behandel deze getallen dus als een goed onderbouwde claim, niet als een neutraal meetrapport.

Wat er kost: $5 en $25 per miljoen tokens

De prijsstelling is misschien wel het echte nieuws. Waar topmodellen doorgaans duurder worden naarmate ze beter presteren, koppelt Anthropic de winst hier expliciet aan lagere kosten per taak.

OnderdeelPrijs
Invoer (input)$5 per miljoen tokens
Uitvoer (output)$25 per miljoen tokens
Fast modeOngeveer 2,5× de standaardsnelheid, tegen twee keer de basisprijs

Die fast mode is het vermelden waard voor wie iets bouwt waar wachttijd pijn doet — denk aan een assistent die in een gesprek moet reageren. Je betaalt het dubbele, maar krijgt het antwoord ruim twee keer zo snel.

Wat er verder is verbeterd

Naast de benchmarks noemt Anthropic een aantal concretere vooruitgangen ten opzichte van Opus 4.8:

  • Organische chemie: +10,2 procentpunt en eiwitgerelateerde taken: +7,7 procentpunt. Dat zijn niche-domeinen, maar wel harde, verifieerbare vakgebieden waar een fout meteen zichtbaar is.
  • Sterker in het controleren van eigen werk. Anthropic beschrijft het model als aanzienlijk beter in het verifiëren van wat het doet en het zorgvuldig blijven itereren tot iets klopt.
  • Betere visuele uitvoer. Wat het model oplevert aan grafische en visuele output is verbeterd.
  • Hogere scores op afstemming en veiligheid dan de vorige generatie.

Dat tweede punt — zichzelf controleren en doorgaan tot het klopt — klinkt saai naast een verdrievoudigde puzzelscore, maar is in de praktijk vaak het verschil tussen een model dat je kunt vertrouwen en eentje waar je alles achteraf van moet nakijken. Een model dat zelf merkt dat het ernaast zat, kost je minder tijd dan een model dat met veel overtuiging het verkeerde antwoord geeft.

Waarom dit ook buiten de techwereld uitmaakt

Voor de meeste ondernemers is een benchmarkscore abstract. De kostenkant is dat niet. Als dezelfde taak vandaag de helft of een derde kost van wat hij vorig jaar kostte, dan verschuift de grens van wat je zinnig kunt automatiseren. Toepassingen die twee jaar geleden alleen rendabel waren voor grote bedrijven, worden betaalbaar voor een zaak met vijf man.

Dat is precies de beweging die je in ons eigen vakgebied ziet. Een telefonische assistent die een gesprek voert, doorvraagt en een nette notitie achterlaat, was een paar jaar geleden een callcenter met mensen. Nu draait diezelfde functie op taalmodellen en spraaktechnologie, tegen een vaste maandprijs. Zie ons artikel over processen automatiseren met AI voor hoe die afweging er in de praktijk uitziet.

Tegelijk is het goed om nuchter te blijven: een beter model maakt een slecht ingerichte toepassing niet plotseling goed. Het verschil tussen een assistent die klanten helpt en eentje die ze wegjaagt, zit meestal niet in het model, maar in wat je hem hebt geleerd over jouw bedrijf.

Benieuwd hoe dit klinkt in de praktijk?

Wij bouwen met deze technologie een Nederlandse telefonist die opneemt als jij niet kunt. Vraag een gratis demo aan, dan belt hij je binnen een halve minuut en hoor je het zelf.

Probeer de gratis demo

Kort samengevat

  • Claude Opus 5 kwam uit op 24 juli 2026 en is direct beschikbaar via de Claude API, Claude.ai, Claude Code en Claude Cowork.
  • Prijs: $5 per miljoen invoertokens en $25 per miljoen uitvoertokens; fast mode is ongeveer 2,5× sneller voor het dubbele tarief.
  • De sterkste absolute claim is ARC-AGI 3, met een score van drie keer het eerstvolgende model.
  • Het terugkerende thema is prijs-prestatie: op meerdere tests evenaart of overtreft het model de duurdere concurrent tegen een derde tot de helft van de kosten per taak.
  • Alle genoemde cijfers komen uit Anthropics eigen aankondiging en zijn nog niet onafhankelijk geverifieerd.

Veelgestelde vragen

Wat kost Claude Opus 5?

$5 per miljoen invoertokens en $25 per miljoen uitvoertokens. Er is daarnaast een fast mode die ongeveer 2,5 keer zo snel werkt tegen twee keer de basisprijs.

Waar kan ik Claude Opus 5 gebruiken?

Het model is sinds 24 juli 2026 beschikbaar op alle platforms van Anthropic: de Claude API, Claude.ai, Claude Code en Claude Cowork.

Is Claude Opus 5 beter dan Fable 5?

Dat hangt af van de taak. Op CursorBench 3.2 blijft Opus 5 net onder de topscore van Fable 5 (binnen 0,5%), maar tegen de helft van de kosten per taak. Op OSWorld 2.0 gaat het er volgens Anthropic overheen, tegen ruim een derde van de kosten. Het verhaal is dus vooral prijs-prestatie, niet een schoonveeg op alle fronten.

Wat is er verbeterd ten opzichte van Opus 4.8?

Op Frontier-Bench v0.1 meer dan een verdubbeling van de prestatie tegen lagere kosten. Verder een verbetering van 10,2 procentpunt op organische chemie en 7,7 procentpunt op eiwitgerelateerde taken, betere visuele uitvoer, en volgens Anthropic een duidelijk sterker vermogen om eigen werk te controleren en door te blijven itereren tot het klopt.

Zijn deze benchmarkscores onafhankelijk getoetst?

Nee. Alle genoemde cijfers komen uit de aankondiging van Anthropic zelf. Dat betekent niet dat ze onjuist zijn, maar wel dat ze door de maker zijn geselecteerd en gepubliceerd. Onafhankelijke hertoetsing door derden volgt bij dit soort releases meestal pas na enkele weken.

Verder lezen

Benieuwd hoe Sam voor jouw bedrijf opneemt?

Vraag een gratis demo aan: Sam belt je binnen 30 seconden terug en je hoort meteen hoe hij klinkt. Geen aansluitkosten, maandelijks opzegbaar.