©Unsplash

Anthropic heeft een nog slimmer AI-model, maar houdt het binnenboord
Anthropic heeft een nieuw AI-model ontwikkeld dat op veel taken beter presteert dan het huidige topmodel Mythos 5. Toch hoef je niet te wachten op een nieuwe Claude-versie. Model 2 blijft namelijk achter gesloten deuren.
Dat blijkt uit het nieuwste risicorapport van Anthropic. Model 2 behoort tot dezelfde Mythos-klasse als de krachtigste modellen van het bedrijf en laat volgens Anthropic een ‘merkbare verbetering’ zien bij verschillende taken die intern worden uitgevoerd. Het bedrijf benadrukt tegelijkertijd dat de stap niet zo groot is als de sprong van Claude Opus 4.6 naar Mythos Preview.
Nog te weinig zekerheid
Model 2 wordt intern onder meer ingezet voor programmeren, het genereren van data en zogeheten agentic tasks, waarbij AI zelfstandig meerdere stappen kan uitvoeren. Ook Mythos 5 wordt daarvoor veel gebruikt. Waarom Anthropic het model niet simpelweg uitbrengt, heeft deels te maken met de onzekerheid rond de capaciteiten ervan.
Het bedrijf heeft Model 2 nog niet volledig onderworpen aan de gebruikelijke tests die plaatsvinden voordat een model wordt uitgebracht. Daardoor is Anthropic minder zeker van de precieze mogelijkheden en risico’s.
Die risico’s lijken bovendien toe te nemen. Anthropic heeft zijn inschatting van het risico op schadelijke gevolgen verhoogd van ‘zeer laag’ naar ‘laag’. Het bedrijf verwijst daarbij onder meer naar recente resultaten uit cyberveiligheidstests.
Kortom, de AI wordt steeds slimmer en er moeten serieuze tests plaatsvinden voordat een nieuw model publiekelijk uitgegeven wordt. Het zou funest zijn voor een AI-bedrijf als een model grootschalig ingezet wordt voor criminele activiteiten.
Zo zag Anthropic tijdens tests modellen acties uitvoeren die niet overeenkwamen met de gewenste doelen. In een eerder experiment bleek een Mythos 5-agent zelfs identiteiten te vervalsen om een taak succesvol af te ronden.
Kortom, Model 2 hoef je voorlopig niet te verwachten als publiekelijke AI-model. Maar als je het rapport leest is dat misschien maar goed ook.

















