Anthropic heeft
Claude Sonnet 5.5 uitgebracht als sneller en efficiënter werkmodel voor programmeren, agents en dagelijks kenniswerk. Het model genereert volgens het bedrijf ruim 30 procent sneller tekst en kan een taak tot 30 procent goedkoper afronden, maar de officiële API-prijs per token daalt niet.
Claude Sonnet 5.5 is direct beschikbaar
Anthropic noemt Sonnet 5.5 het tweede model binnen de Claude 5.5-familie. Het bedrijf bracht de krachtigere Opus 5.5 zes dagen eerder uit. Sonnet 5.5 moet vooral goed afgebakende opdrachten uitvoeren, zoals een bug oplossen, documenten maken, presentaties opbouwen, spreadsheets bewerken en een gebruikersinterface verfijnen.
Het model is volgens de
officiële aankondiging van Anthropic nu beschikbaar in Claude en op het ontwikkelaarsplatform. Bedrijven kunnen het ook afnemen via Amazon Web Services, Google Cloud en Microsoft Azure. Ontwikkelaars gebruiken in de API de modelnaam claude-sonnet-5-5.
Anthropic presenteert Sonnet 5.5 niet als volledige vervanger van Opus 5.5. Opus blijft volgens het bedrijf beter bij onduidelijke, open taken die lang oordeel en planning vragen. Sonnet richt zich op werk met een duidelijk doel, waarbij snelheid en kosten zwaarder wegen.
Die positionering is belangrijk voor gebruikers die de namen door elkaar halen. Sonnet vormt de middenklasse, terwijl Opus de zwaardere categorie blijft. De
complete uitleg over Claude zet de modellen, apps, abonnementen en zakelijke opties naast elkaar.
De grootste sprong zit in agentisch programmeren
Anthropic meldt de opvallendste vooruitgang bij programmeertaken waarbij Claude zelfstandig een terminal en andere hulpmiddelen gebruikt. Sonnet 5.5 behaalt 70,6 procent op Terminal-Bench 4.0. Sonnet 5 kwam in de gepubliceerde vergelijking uit op 10,3 procent en Opus 5.5 op 66,4 procent.
Die cijfers maken Sonnet 5.5 niet automatisch het beste programmeermodel voor iedere situatie. De modellen draaiden met vastgelegde inspanningsniveaus en testinstellingen. Een benchmark meet bovendien een beperkte verzameling opdrachten. Een eigen codebase, rechtenstructuur en ontwikkelomgeving kunnen een ander resultaat geven.
Andere metingen laten een minder extreem verschil zien. Sonnet 5.5 scoort 55,5 procent op CursorBench 4.0, tegenover 57,8 procent voor Opus 5.5. Op GDPval-AA, een test met taken uit echte beroepen, komen Sonnet 5.5 en Opus 5.5 uit op respectievelijk 1844 en 1846 punten. Het oudere Sonnet 5 behaalt daar 1449 punten.
VentureBeat merkt terecht op dat vooral de kleinere afstand tot Opus opvalt.
TechCrunch beschrijft dezelfde positionering als een snellere werkpartner voor veelvoorkomende taken.
Er zit ook een technische kanttekening bij de cijfers. Artificial Analysis testte een vroege versie met een fout bij gestructureerde uitvoer. Anthropic zegt dat die fout inmiddels is hersteld en de score mogelijk iets drukte. Dat is aannemelijk, maar nog geen onafhankelijke bevestiging van alle prestatieclaims.
Lagere taakkosten zijn geen lagere tokenprijs
De API-prijs blijft gelijk aan die van Sonnet 5. Anthropic rekent 2 dollar per miljoen invoertokens en 10 dollar per miljoen uitvoertokens. Een miljoen tokens uit de promptcache kost 0,20 dollar. Sonnet 5.5 wordt dus niet goedkoper wanneer een ontwikkelaar exact dezelfde hoeveelheid tokens gebruikt.
De besparing moet uit de uitvoering komen. Het model produceert volgens Anthropic ruim 30 procent sneller uitvoer en heeft meestal minder tokens en gereedschapsaanroepen nodig. Daardoor kan een complete taak in de tests tot 30 procent minder kosten dan bij Sonnet 5. Het woord ‘tot’ is essentieel. Een lange prompt, veel context, herhaalde controles of dure externe hulpmiddelen kunnen de rekening alsnog verhogen.
Het gekozen inspanningsniveau telt eveneens mee. De Claude-apps en Claude Code gebruiken standaard Medium, terwijl het ontwikkelaarsplatform standaard High gebruikt. Meer inspanning kan de kwaliteit verbeteren, maar laat het model ook langer redeneren en meer tokens verbruiken.
Bedrijven moeten daarom hun eigen taken meten. Zij kunnen dezelfde opdrachten uitvoeren met Sonnet 5 en Sonnet 5.5 en daarna kwaliteit, doorlooptijd, toolgebruik en totale kosten vergelijken. Wie agents met databronnen en bedrijfssoftware verbindt, kan daarnaast de AIWereld-handleiding over
MCP en veilig toolgebruik gebruiken. Een sneller model maakt een onveilige koppeling namelijk niet veiliger.
Sterkere mogelijkheden brengen strengere beveiliging mee
Sonnet 5.5 is het eerste Sonnet-model dat start met cyberbeveiliging die Anthropic eerder voor zijn krachtigste modellen gebruikte. Het systeem moet gewone softwareontwikkeling en het oplossen van fouten toestaan. Bij een kleine groep risicovolle cyberopdrachten kan Claude terugvallen op het oudere Sonnet 5. De biologische beveiliging verandert niet ten opzichte van Sonnet 5.
Anthropic voegt ook bescherming tegen modeldistillatie toe. Aanvallers gebruiken daarbij veel accounts en verzoeken om de mogelijkheden van een model te kopiëren. Daarnaast koppelt ‘preserved thinking’ de interne redeneercontext sterker aan het account dat de sessie begon. Vooral ontwikkelaars die gesprekken tussen accounts verplaatsen, moeten daarom de migratie-instructies controleren.
In een geautomatiseerde audit met ongeveer 1.850 scenario’s presteerde Sonnet 5.5 volgens Anthropic meestal gelijk aan of beter dan zijn voorganger. Het bedrijf vond geen bewijs dat het model doelen nastreeft die botsen met de bedoeling van de gebruiker. Anthropic waarschuwt zelf dat geen enkele test alle fouten en ongewenste neigingen kan vinden.
Voor Nederland speelt ook de Europese transparantieplicht. AI Wereld legde eerder uit hoe
Anthropic nieuwe Claude-modellen van een onzichtbaar tekstwatermerk voorziet. De aankondiging van Sonnet 5.5 zegt niet afzonderlijk hoe goed dat signaal bij dit model detecteerbaar blijft. Gebruikers moeten dus niet aannemen dat iedere Claude-tekst later betrouwbaar herkenbaar is.
Sonnet 5.5 verkleint vooral de afstand tussen Anthropics middenklasse en topmodel. De echte winst hangt niet af van één ranglijst, maar van de hoeveelheid bruikbaar werk die het model binnen een eigen workflow en budget aflevert.