Anthropic heeft vandaag officieel de nieuwste generatie van het grootschalige taalmodel Claude Opus 4.8 uitgebracht, dat zich richt op het verbeteren van de prestaties bij 'agent'-taken zoals het genereren van codes, multidisciplinair redeneren, automatische computerbediening, op kennis gebaseerd werken en financiële analyse. Het wordt officieel omschreven als een ‘efficiëntere samenwerkingspartner’. Gebruikers die aan de test deelnamen, meldden dat Opus 4.8 betrouwbaarder presteerde en scherpere beoordelingen maakte bij het uitvoeren van complexe agenttaken, terwijl het ook aanzienlijke verbeteringen op het gebied van eerlijkheid liet zien.

Anthropic zei dat vroege testresultaten aantonen dat Opus 4.8 waarschijnlijk proactief zijn eigen onzekerheden zal markeren en minder ongegronde beweringen zal doen. Uit interne evaluatiegegevens blijkt dat, vergeleken met de vorige versie, Opus 4.8 ongeveer vier keer minder kans heeft om fouten in zelf gegenereerde code te negeren, wat betekent dat het "zelfcorrectie"-vermogen van het model bij codebeoordeling en kwaliteitscontrole aanzienlijk is verbeterd.
In de afstemmingstest heeft Opus 4.8 een nieuw hoogtepunt bereikt in termen van het ondersteunen van de onafhankelijke besluitvorming van gebruikers en het beschermen van de belangen van gebruikers en andere “pro-sociale kenmerken”. Daarentegen is de incidentie van ‘mismatch-gedrag’, zoals heimelijk bedrog, misleidend gedrag, etc. lager dan in Opus 4.7 en op hetzelfde niveau als het Claude Mythos preview-model dat voorheen slechts openstond voor een klein aantal institutionele tests.
Anthropic heeft ook specifieke resultaten gegeven in meerdere openbare benchmarktests: Opus 4.8 behaalde een score van 69,2% op de software-engineeringbenchmark SWE-Bench Pro en overtrof daarmee concurrerende modellen zoals GPT-5.5 en Gemini 3.1 Pro. Het heeft een voordeel in meerdere testprojecten, maar wordt nog steeds geleid door GPT-5.5 op de terminalcoderingsbenchmark. Wat de prestaties betreft, is de inferentiesnelheid in de snelle modus van Opus 4.8 verhoogd tot 2,5 keer die van het vorige model, en de prijs is verlaagd tot ongeveer een derde van die van het oude model, waardoor de algemene drempel voor gebruik met hoge prestaties verder wordt verlaagd.
Samen met de lancering van het nieuwe model kondigde Anthropic ook de toevoeging aan van een aantal nieuwe functies aan het productsysteem, waaronder "dynamische workflows" voor bedrijfsontwikkelaars (preview van onderzoek). Met deze functie kan Claude grote taken opsplitsen, werkstappen plannen en honderden subagenten parallel plannen binnen één sessie binnen de Claude Code-omgeving om migratieoperaties op repositoryniveau over honderdduizenden regels code te voltooien. Het is momenteel beschikbaar voor Claude Code Enterprise Edition-, Team Edition- en Max-abonnementen.
In termen van interactieve controle heeft Anthropic een functie voor "inspanningsniveaucontrole" toegevoegd waarmee Claude.ai- en Cowork-gebruikers de computerbronnen en redeneerdiepte kunnen kiezen die het model in één enkel antwoord investeert. Als gebruikers een lager inspanningsniveau kiezen, kunnen ze snellere responstijden krijgen en het verbruik van tariefquota verminderen, terwijl Opus 4.8 standaard overgaat op de 'hoge inspanning'-modus, wat volgens ambtenaren de beste balans is tussen antwoordkwaliteit en gebruikerservaring.
Voor ontwikkelaars heeft Anthropic de Messages API bijgewerkt om opdrachtinvoer op systeemniveau in de berichtenarray te accepteren. Dit betekent dat ontwikkelaars Claude's gedragscode en rolinstellingen dynamisch kunnen aanpassen tijdens de taakuitvoering zonder een nieuwe sessie te heropenen, waardoor flexibelere meerstaps geautomatiseerde workflows en applicaties op bedrijfsniveau kunnen worden gebouwd.
Anthropic zei dat Claude Opus 4.8 vanaf vandaag algemeen wereldwijd verkrijgbaar is en dat de normale gebruiksprijzen hetzelfde blijven als Opus 4.7. Het bedrijf onthulde ook dat het werkt aan nieuwe, goedkopere modellen met hetzelfde functionaliteitsniveau, evenals aan een klasse van "next-generation" modellen met mogelijkheden die verder gaan dan de Opus 4.8.
Wat de roadmap voor high-end modellen betreft, test Anthropic een geavanceerd model met de codenaam Claude Mythos met een paar partnerinstellingen en blijft het strengere veiligheidsrails en gebruiksspecificaties rond dit model ontwikkelen. Het bedrijf zei dat het verwacht dat het “in de komende weken” modellen op Mythos-niveau beschikbaar zal maken voor alle klanten, waardoor zijn concurrentiepositie verder zal worden uitgebreid in scenario’s zoals beveiligingsaudits op bedrijfsniveau, codeanalyse en complexe beslissingsondersteuning.