Per 29 maart 2026 draait het verhaal rond โClaude Mythosโ minder om een afgeronde publieke lancering en meer om een gelekte preview van wat lijkt op Anthropicโs volgende grote stap. Het bedrijf stelde per ongeluk conceptbloginhoud bloot in een openbaar doorzoekbare gegevenscache, waardoor een nietโuitgebracht model werd onthuld dat Anthropic beschreef als een โstapveranderingโ en โhet meest capabele dat we tot nu toe hebben gebouwd.โ Anthropic bevestigde dat het het model ontwikkelt en test met een kleine groep earlyโaccessklanten.
Dat is relevant omdat Anthropicโs huidige publieke modellijn nog steeds draait om Claude Opus 4.6, Claude Sonnet 4.6 en Claude Haiku 4.5. Met andere woorden, het lek is geen bevestigde publieke productlancering; het is een gelekte blik op de volgende laag die Anthropic mogelijk voorbereidt.
Momenteel biedt CometAPI al APIโs voor toonaangevende Claudeโmodellen, zoals Claude Opus 4.6 en Claude Sonnet 4.6. Zodra Claude Mythos beschikbaar is op CometAPI, kun je vergelijkende tests uitvoeren tegen topmodellen van Gemini en OpenAI. CometAPI aggregeert de beste modellen.
Wat is Claude Mythos?
Claude Mythos is het meest geavanceerde AIโmodel van Anthropic tot nu toe, in gelekte interne documenten beschreven als โverreweg het krachtigste AIโmodel dat we ooit hebben ontwikkeld.โ Het introduceert een nieuw prestatieniveauโintern โCapybaraโ genoemdโdat boven de bestaande Opusโlijn van het bedrijf staat, die tot nu toe het toppunt van Claudeโs capaciteiten vormde.
Anthropicโs huidige modelfamilie volgt een duidelijke hiรซrarchie:
- Opus: Grootste, meest capabele en duurste (bijv. Claude Opus 4.6 en het eerdere Opus 4.5, uitgebracht in november 2025).
- Sonnet: Evenwicht tussen snelheid en intelligentie.
- Haiku: Snelst en meest kostenefficiรซnt voor lichte taken.
Mythos/Capybara doorbreekt dit stramien als een aanzienlijk groter, rekenintensiever model. Conceptblogposts stellen expliciet dat het โgroter en intelligenter is dan onze Opusโmodellenโdie tot nu toe onze krachtigste waren.โ De naam โMythosโ is gekozen om โde diepe verbindende weefsels die kennis en ideeรซn bij elkaar brengenโ op te roepen, wat duidt op diepere, meer geรฏntegreerde redenering over domeinen heen.
Dit is geen kleine, incrementele update. Een woordvoerder van Anthropic bevestigde dat het bedrijf โeen algemeen inzetbaar model ontwikkelt met betekenisvolle vooruitgang in redenering, coderen en cybersecurityโ en het beschouwt als โeen stapverandering en het meest capabele dat we tot nu toe hebben gebouwd.โ De training is voltooid, en het model wordt al in de praktijk getest met een kleine groep earlyโaccessklanten.
Ter context: de evolutie van Claude was snel. Claude 3 Opus (2024) zette vroege benchmarks neer, gevolgd door Claude 3.5 Sonnet, Claude 4โvarianten en Opus 4.5/4.6 in 2025. Mythos lijkt de logische opvolgerโmogelijk wat de community heeft gespeculeerd als โOpus 5โโdie frontierโAI naar nieuw terrein duwt en tegelijkertijd serieuze veiligheidsvragen oproept.
Hoe is Claude Mythos uitgelekt?
Het lek vond plaats op of rond 27 maart 2026, door een eenvoudige maar pijnlijke configuratiefout door menselijk handelen in Anthropicโs contentmanagementsysteem (CMS). Bijna 3,000 ongepubliceerde assetsโwaaronder conceptblogposts, afbeeldingen, PDFโs, audiobestanden en zelfs interne documentenโwerden achtergelaten in een openbaar doorzoekbare gegevensopslag (soms een โdata lakeโ genoemd).
Assets stonden standaard op โpublicโ, met te raden URLโs. Securityโonderzoekers Roy Paz (LayerX Security) en Alexandre Pauwels (University of Cambridge) ontdekten de cache en waarschuwden mediakanalen.
De uitgelekte materialen omvatten:
- Twee bijna identieke conceptblogposts (รฉรฉn getiteld โClaude Mythosโ, de andere โClaude Capybaraโ).
- Gestructureerde webpaginadata met koppen en een geplande publicatiedatum.
- Ongebruikte marketingassets van eerdere lanceringen.
- Een interne PDF over een CEOโretraite op uitnodiging, gehost door AnthropicโCEO Dario Amodei.
Anthropic bevestigde snel het incident als โmenselijke foutโ in de CMSโconfiguratie en verwijderde de publieke toegang. Er is geen bewijs dat wijst op kwaadaardige intentie of een diefstal van modelgewichtenโalleen marketingโ en planningsdocumenten werden blootgesteld.
Deze gebeurtenis benadrukt een groeiende kwetsbaarheid in de AIโindustrie: snelle iteratie en interne documentatie halen vaak veilige publicatieworkflows in. Soortgelijke lekken kwamen bij andere labs voor, maar dit lek bood ongebruikelijk gedetailleerd inzicht in een nietโuitgebracht vlaggenschipmodel.
Uitgelekte benchmarkcijfers en prestatieclaims
Exacte numerieke scores werden niet vermeld in de gelekte conceptenโAnthropic heeft nog geen officiรซle benchmarks gepubliceerd. De bewoording is echter ondubbelzinnig en consistent in beide conceptversies:
โVergeleken met ons vorige beste model, Claude Opus 4.6, behaalt Capybara dramatisch hogere scores op tests van softwarecodering, academische redenering en cybersecurity, onder andere.โ
Het model wordt verder omschreven als โmomenteel ver voor op elk ander AIโmodel qua cybercapaciteitenโ en als een model dat โeen naderende golf van modellen voorspelt die kwetsbaarheden kunnen uitbuiten op manieren die de inspanningen van verdedigers ver voorbijstreven.โ
Wat meten deze benchmarkcategorieรซn eigenlijk?
- Softwarecodering (bijv. SWE-Bench Verified, HumanEval, LiveCodeBench): Realistische softwareโengineeringtaken, waaronder bugfixing, functieโimplementatie en begrip op repositoryโniveau. Opus 4.6 stond al bovenaan in veel codeerleaderboards; een โdramatischeโ sprong hier zou betekenen dat Mythos zelfstandig complexe codebases met meerdere bestanden aankan die momenteel senior engineers vereisen.
- Academische redenering (bijv. GPQA, MMLU-Pro, MATH, FrontierMath): Graduateโniveau wetenschap, wiskunde en meerstaps logische problemen. Verbeteringen hier duiden op sterker ketenโvanโgedachtenโredeneren en kennissynthese.
- Cybersecurity: Kwetsbaarheidsdetectie, exploitgeneratie, redโteamingโsimulaties en defensieve hardening. Dit is het meest benadrukteโen het meest zorgwekkendeโgebied.
Hoewel eerdere Claudeโmodellen (Opus 4.5/4.6) sterke resultaten behaaldenโbijv. Opus 4.5 scoorde ~80.9% op SWEโBench Verifiedโplaatsen de gelekte claims Mythos in een kwalitatief andere klasse.
Modelkenmerken en technisch profiel
Naast benchmarks onthullen de concepten meerdere onderscheidende eigenschappen:
- Schaal en kosten: โVoor ons zeer duur om te draaien, en zal voor onze klanten zeer duur zijn om te gebruiken.โ Dit impliceert een enorme parameteromvang en hoge inferentiekosten, wat de eerste beschikbaarheid beperkt tot enterpriseโ en highโvalueโuseโcases.
- Diepte van redenering: De nadruk op โdiepe verbindende weefselsโ tussen kennisdomeinen suggereert superieur begrip van lange contexten en crossโdomeinsynthese.
- Agentโachtige mogelijkheden: Early access lijkt gericht op organisaties die geavanceerde codeeragents en cybersecuritytools nodig hebben.
- Safetyโfirstโfilosofie: In lijn met Anthropicโs โconstitutional AIโโbenadering geeft het bedrijf prioriteit aan risicobeoordelingโvooral in cybersecurityโvรณรณr bredere uitrol.
Cybersecurityโimplicaties: het grootste waarschuwingssignaal
Het meest opvallende element van het lek is Anthropicโs eigen waarschuwing over het dualโuseโpotentieel van het model. Door โver voorโ te liggen in cybercapaciteiten zou Mythos kunnen:
- Autonoom zeroโdaykwetsbaarheden ontdekken.
- Geavanceerde exploitcode op schaal genereren.
- Geavanceerde aanhoudende dreigingen (APTโs) simuleren, sneller dan menselijke verdedigers kunnen reageren.
De concepttekst stelt expliciet dat het bedrijf โmet extra voorzichtigheidโ wil handelen en bevindingen wil delen met cyberverdedigers om hen voor te bereiden op โeen naderende golf van AIโgedreven exploits.โ
De marktreactie was direct: cybersecurityaandelen daalden op 27โ28 maart 2026, omdat beleggers het risico inprijsden dat offensieve AIโcapaciteiten defensieve tools zouden kunnen voorbijstreven.
Dit sluit aan bij bredere industrietrends. OpenAI heeft vergelijkbaar hoge cybercapaciteiten gemarkeerd in modellen zoals GPT-5.3-Codex. Reรซle incidenten tonen al aan dat statelijke actoren (bijv. een Chinese groep) Claudeโvarianten gebruiken voor infiltratiecampagnes. Mythos zou dergelijke dreigingen nog verder aanjagen.
Positieve kant: Vroege toegang voor defensieve organisaties kan veilige codeerpraktijken, geautomatiseerde patches en dreigingsjacht versnellenโwat het internet op de lange termijn veiliger kan maken.
Vergelijkingstabel: Claude Mythos vs. Previous Models
| Aspect | Claude Opus 4.6 (huidig vlaggenschip) | Claude Mythos / Capybara (uitgelekt) | Belangrijkste conclusie |
|---|---|---|---|
| Tier | Opus | Nieuwe โCapybaraโ-tier (boven Opus) | Grote sprong in architectuur |
| Coding Performance | Sterk (bijv. ~80.9% SWE-Bench) | Aanzienlijk hoger | Potentie om productiviteit van senior engineers te evenaren of te overtreffen |
| Academic Reasoning | Uitstekend | Aanzienlijk hoger | Diepere meerstapslogica en kennisintegratie |
| Cybersecurity | Capabel (kwetsbaarheidsdetectie) | Ver voor op elk huidig model | Kwalitatieve sprong; vergroot dualโuseโrisicoโs |
| Inference Cost | Hoog (Opusโtarieven) | Zeer duur (nog hoger) | Aanvankelijk alleen voor enterprise |
| Release Status | Algemeen beschikbaar | Alleen earlyโaccessโtesten | Bedachtzame, op veiligheid gerichte uitrol |
| Overall Capability | Stateโofโtheโart 2025 | โStapveranderingโ / โKrachtigste ooitโ | Nieuwe frontierโbenchmark |
Conclusie: een uitgelekte blik op het volgende AIโtijdperk
Het Claude Mythosโlek biedt een zeldzame, ongefilterde blik op de roadmap van Anthropic. Het bevestigt dat het bedrijf een echte โstapveranderingโ in kerncapaciteiten heeft bereikt en tegelijkertijd de diepe risicoโs erkentโmet name in cybersecurityโdie met zulke kracht gepaard gaan. Of het nu wordt gelabeld als Opus 5 of een nieuwe Capybaraโtier, Mythos signaleert dat frontierโAI een fase ingaat waarin capaciteiten de veilige uitroltijden voorbijstreven.
Klaar om CometAPI te ervaren? Je kunt eerst gebruiker worden en $1 gratis tegoed krijgen, en meldingen ontvangen wanneer Claude Mythos live gaat.
