Sneller model voor minder geld: wat Opus 5.5 verandert

Inhoudsopgave
Wat er anders is
In de aankondiging van Anthropic staat dat Opus 5.5 bij de meeste taken presteert op het niveau van Fable 5.1, het grotere en duurdere model van het bedrijf. Het zou bij normaal gebruik 40 procent minder kosten om te draaien dan Opus 5 en meer dan 30 procent sneller tekst genereren. Voor ontwikkelaars daalt de prijs per miljoen tokens naar 4 dollar voor invoer en 20 dollar voor uitvoer, een verlaging van 20 procent. TechCrunch wijst erop dat het model minder rekenkracht nodig heeft, en dat die besparing dus deels bij de klant terechtkomt.
Voor gewone gebruikers is een andere wijziging interessanter. Anthropic verhoogt de limieten per vijf uur voor Pro, Max, Team en Enterprise met vaste plekken. Daarnaast krijgen abonnees een eenmalige reset van hun limiet die ze kunnen bewaren en inzetten wanneer het hun uitkomt. Wie regelmatig midden in een klus tegen de grens aanloopt, merkt dat direct. Hoe die limieten precies werken, lees je in onze uitleg over de gebruikslimieten van Claude. Over de gratis versie zegt de aankondiging niets.
Ook de schrijfstijl is aangepast. Opus 5.5 zou minder jargon gebruiken en het belangrijkste bovenaan zetten. Dat klinkt klein, maar het was een terugkerende klacht over Opus 5, dat nogal omslachtige antwoorden gaf.
Naast ChatGPT: waar het verschil zit
Opvallend is de timing. OpenAI bracht dezelfde dag GPT-6 Sol en Luna uit, ook met lagere prijzen en ook met de belofte van helderdere antwoorden. De twee bedrijven schuiven dus in dezelfde richting op.
In de eigen vergelijkingstabel van Anthropic wint Opus 5.5 op de meeste onderdelen, vooral bij programmeren en kenniswerk. Maar op twee punten scoort het zwaarste model van OpenAI, GPT-6 Astra, hoger. Bij AutomationBench, een test van Zapier die meet of een model werkprocessen over meerdere gekoppelde apps kan afhandelen, haalt Astra 41,4 procent tegen 40,0 procent voor Opus 5.5. Bij wetenschappelijk onderzoek in de terminal is het verschil groter, 64,6 tegen 58,7 procent. Anthropic schrijft er zelf bij dat kleine verschillen in zulke tests steeds minder zeggen over echt gebruik. Dat is eerlijk, en het geldt voor de cijfers van OpenAI net zo goed.
Voor wie beide gebruikt, is de praktische conclusie dat je niet hoeft over te stappen op basis van een tabel. Zet dezelfde opdracht in beide chatbots en kijk welk antwoord je minder hoeft te herschrijven. Onze vergelijking van Claude en ChatGPT helpt bij het kiezen.
Waar het model nog op vastloopt
De strengere beveiliging heeft een keerzijde. Omdat Opus 5.5 op het gebied van biologie en cyberbeveiliging vergelijkbaar is met de zwaarste modellen van Anthropic, krijgt het dezelfde beperkingen. Die remmen onder meer het zoeken naar lekken in software af. Onderzoekers in die vakgebieden moeten zich aanmelden voor een verificatieprogramma om het model volledig te kunnen gebruiken. In de eigen tests van Anthropic sprong bij zulke taken zelfs een ouder model in zodra de beveiliging ingreep. Wie in beveiliging werkt, kan dus tegen weigeringen aanlopen.
Sonnet 5.5 en Haiku 5.5, de lichtere modellen, volgen volgens Anthropic in de komende weken. Tot die tijd is Opus 5.5 het model om te proberen als je al een abonnement hebt. De ruimere limiet is daarbij misschien de grootste winst.





