Blogs

Claude Mythos 5.1: benchmarks, prijzen, toepassingen & complete gids

7 September 2026  ·  Bijgewerkt 9 September 2026

Gabriel Caetano

Gabriel Caetano

ARTIFICIAL INTELIGENCE

Claude Mythos 5.1: benchmarks, prijzen, toepassingen & complete gids

Claude Mythos 5.1 is Anthropics frontiermodel met beperkte toegang voor cybersecurity en levenswetenschappen. Ontdek benchmarks, $10/$50-prijzen, een contextvenster van 1M tokens, toepassingen, beveiliging en de vergelijking met Fable 5.1.

claude-mythos-5-1-benchmarks-pricing-use-cases

Claude Mythos 5.1 Overzicht: Benchmarks, Prijzen, Toepassingen & Alles Wat Je Moet Weten

Een frontier-model kiezen voor serieus onderzoeks- of securitywerk is lastig als de meest geavanceerde optie alleen toegankelijk is via een aanvraagformulier. Claude Mythos 5.1 is Anthropic's model met beperkte toegang voor cybersecurity en life-sciences werk, uitgebracht op 1 september 2026, met een prijs van $10 per miljoen inputtokens en $50 per miljoen outputtokens. Fable 5.1 en Mythos 5.1 zijn hetzelfde model, maar met verschillende niveaus van beveiliging: Fable 5.1 is algemeen beschikbaar, terwijl Mythos 5.1 alleen toegankelijk is via vertrouwde toegangsprogramma's. Dat gezegd hebbende, zal de meeste teams Mythos nooit rechtstreeks gebruiken, dus deze gids behandelt beide.

Hieronder vind je benchmarks, prijzen, hoe het zich verhoudt tot Fable 5.1 en andere frontier-modellen, de sterkste toepassingen, en hoe toegang in de praktijk werkt. Betaal je elke maand voor Claude, ChatGPT of Gemini? Dan bespreken we ook de slimste manier om te voorkomen dat je geld verliest aan buitenlandse transactiekosten op die USD-abonnementen.

Betaal je elke maand in USD voor Claude vanaf een eurorekening? Bleap rekent 0% wisselkoerskosten op je USD-abonnementen en geeft een vaste 20% cashback bij verlenging van Claude, ChatGPT en Gemini. Self-custodial Mastercard, geen eigen abonnement. Vraag de Bleap-kaart aan →

1. Wat is Claude Mythos 5.1?

Model-identiteit en releasecontext

Het aanbod van Anthropic kent een duidelijke structuur. Haiku, Sonnet en Opus zijn respectievelijk de kleine, middelgrote en grote modellen, en de Mythos-klasse staat helemaal boven Opus. De Claude-familie omvat drie benoemde formaatniveaus, Opus, Sonnet en Haiku, en daar kwam in juni 2026 de Mythos-klasse bij, die boven de Opus-klasse staat.

Alleen op uitnodiging en met vertrouwde toegang

De naam "5.1" duidt op een tussentijdse release en niet op een volledige generatiestap. Anthropic bracht de 5.1-update uit op 1 september 2026 als een puntupdate bovenop Fable 5, waarbij de hoofdprijs niet veranderde, het contextvenster niet veranderde, en de model-ID nauwelijks veranderde. Toch zijn de verbeteringen in capaciteit reëel, en concentreren die zich vooral op agentisch en wetenschappelijk werk in plaats van op examenbenchmarks die toch al verzadigd zijn.

Mythos 5.1 is geen model dat je zomaar kunt aanroepen. Mythos 5.1 is identiek aan Fable 5.1, maar dan met lichtere waarborgen, en is voorbehouden aan gescreende organisaties via het Cyber Verification Program en het Life Sciences Verification Program, momenteel alleen in de VS beschikbaar. De reden hiervoor is het risico op tweeërlei gebruik (dual-use). Het is het meest capabele model van Anthropic voor cybersecurity-verdediging en levenswetenschappelijk onderzoek, waaronder dreigingsanalyse, het opsporen van kwetsbaarheden, red teaming en medicijnontwikkeling, en de toegang is beperkt tot een gescreende groep organisaties vanwege het tweeledige (dual-use) karakter van deze domeinen.

Specifiek voor biologie heeft Anthropic een toegangsprogramma opgezet in samenwerking met de Amerikaanse overheid, om toegang te bieden tot de geavanceerde biologiemogelijkheden van Mythos 5.1, en verwacht binnenkort de inschrijving voor wetenschappers te openen. Kom je niet in aanmerking, dan is het algemeen beschikbare Fable 5.1 de tweelingbroer die je in de praktijk zult gebruiken.

2. Claude Mythos 5.1 Benchmarkprestaties

Belangrijkste benchmarkscores in één oogopslag

Omdat de twee 5.1-varianten dezelfde weights delen, komen de meeste gepubliceerde cijfers van Fable 5.1, terwijl Mythos 5.1 opduikt waar losgelaten veiligheidsmaatregelen hogere scores mogelijk maken.

Benchmark

Score

Wat het meet

Terminal-Bench-Science 0.1

52,6%

Volledig wetenschappelijk onderzoek van begin tot eind

Terminal-Bench 4.0 (Mythos 5.1)

60,9%

Langdurig terminalwerk

GPQA Diamond

92,6%

Wetenschappelijk redeneren op universitair niveau

SWE-bench Pro

81,2

Praktijkgerichte software-engineering

CursorBench 3.2.0

73,4%

In IDE geïntegreerd programmeren

ProofBench v1.1

100%

Formele wiskundige bewijzen

ARC-AGI-1

97,5%

Abstract redeneren

GPQA Diamond, de benchmark voor wetenschappelijk redeneren op universitair niveau, komt uit op 92,6%, wat bevestigt dat deze vooruitgang niet beperkt blijft tot agent-achtige workflows. Op het gebied van formele wiskunde noteerde Vals AI een perfecte 100% op ProofBench v1.1, een benchmark voor formele wiskundige bewijzen, een primeur voor een frontier-model.

Claims over de prestatiegrens

Het duidelijkste signaal van vooruitgang zien we bij agentic science. Terminal-Bench-Science 0.1 test of een model een wetenschappelijk onderzoek volledig zelfstandig kan uitvoeren, en Fable 5.1 komt uit op 52,6%, tegenover 24,7% voor Fable 5, 29,0% voor Opus 5 en 22,4% voor GPT-5.6 Sol. Dat is een verdubbeling binnen één puntrelease. De score lag daarmee meer dan twee keer zo hoog als Fable 5's Terminal-Bench-Science.

De enige exclusieve verschijning van Mythos 5.1 laat de kloof zien die door de veiligheidsmaatregelen wordt veroorzaakt. Terminal-Bench 4.0 meet werk op de terminal over een langere tijdspanne, en dit is de enige rij waarin Mythos 5.1 opduikt met 60,9%, tegenover Fable 5.1's 55,8%, Opus 5's 52,3%, Fable 5's 42,0% en GPT-5.6 Sol's 37,3%. Eén eerlijke kanttekening: het veelgenoemde SWE-bench Verified-cijfer van 95,0% dat overal online rondgaat, hoort bij Fable 5 en zijn lancering in juni 2026, Anthropics aankondiging van 5.1 vermeldt geen SWE-bench-score, maar zet juist in op agentische benchmarks.

Geavanceerd redeneervermogen en prestaties bij lange context

Onafhankelijke beoordelaars onderschrijven deze richting. Artificial Analysis zet Fable 5.1 op de eerste plaats van zijn Intelligence Index met een score van 66, ARC-AGI plaatst het op 97,5% op ARC-AGI-1, en Vals AI zet het op nummer één van de Vals Index. De vooruitgang is bewust ongelijk verdeeld. Bij taken waar Fable 5 al goed in was, zoals alledaagse code schrijven, zijn de verbeteringen kleiner, en Anthropic heeft deze metingen gedaan mét veiligheidsmaatregelen aan, wat volgens het bedrijf sommige scores waarschijnlijk drukt. In de praktijk kun je de lanceringstabel het beste zien als een richtingaanwijzer: draai altijd je eigen tests voordat je productieverkeer overzet.

3. Prijzen en tokenkosten van Claude Mythos 5.1

Opbouw van de tokenprijzen

De prijsstelling is simpel en voor de twee tweelingmodellen identiek. Claude Mythos 5.1 begint bij $10 per miljoen inputtokens en $50 per miljoen outputtokens. Het slimme zit in de cache. Fable 5.1 kost $10,00 per miljoen inputtokens en $50,00 per miljoen outputtokens, met Cache Read voor $0,25 per miljoen, Cache Write voor $12,50 per miljoen en Cache Write (1h) voor $20,00 per miljoen. Cache reads zijn met 75% gedaald naar $0,25 per miljoen, en via de Batch API krijg je 50% korting op zowel input als output.

Prijscategorieën en volumekortingen

Die ene verschoven prijs verandert de rekensom voor agents flink. De cache read ging van $1,00 naar $0,25 per miljoen tokens, en dat is belangrijk omdat een lange agentic sessie bij elke stap opnieuw dezelfde bestandsstructuur, systeemprompt en gespreksgeschiedenis inleest, en het grootste deel van die inputtokens zijn cache hits, geen verse tekst. Anthropic zet de besparing in de praktijk duidelijk uiteen. Volgens de eigen schatting van Anthropic vallen de tokenkosten voor typische workloads circa 25% lager uit, en voor sterk agentic workloads kan dat oplopen tot ongeveer 45% lagere kosten.

Binnen het bredere prijsoverzicht staan Mythos en Fable bovenaan. Het aanbod per 1 september 2026 is: Fable 5 op $10/$50 per miljoen tokens, Opus 5 op $5/$25, Sonnet 5 op $2/$10 en Haiku 4.5 op $1/$5.

Overwegingen rond de totale kosten

Anthropic adviseert zelf om eerst te routeren voordat je naar de duurste laag grijpt. In de eigen modelgids van het bedrijf staat dat je voor de meeste workloads met Opus 5 moet beginnen, en pas overstapt naar Fable 5.1 als Opus zakt voor een evaluatie die er echt toe doet. Let bij het budgetteren wel op één toegangsvoorwaarde: Fable 5.1 vereist 30 dagen dataretentie en is niet beschikbaar onder zero data retention, tenzij Anthropic hier expliciet toestemming voor geeft, en het model heeft geen Priority Tier.

Dit heeft geen enkele invloed op je persoonlijke Claude-abonnement, dat apart in USD wordt gefactureerd. Als je betaalt met een euro-kaart, reken je bij elke verlenging op 2-3% aan buitenlandse transactiekosten, en dat loopt over een jaar aardig op. Betalen in USD tegen de echte koers scheelt je die kosten helemaal.

4. Claude Mythos 5.1 versus concurrerende frontier-modellen

Vergelijkingstabel: model tegen model

Functie / Model

Claude Mythos 5.1

Fable 5.1

GPT-5.6 Sol

Gemini 3.1 Pro

Contextvenster

1M tokens

1M tokens

Hier niet gepubliceerd

Hier niet gepubliceerd

Terminal-Bench-Science 0.1

Zelfde gewichten

52,6%

22,4%

Niet gepubliceerd

Terminal-Bench 4.0

60,9%

55,8%

37,3%

Niet gepubliceerd

Inputprijs ($/M)

$10

$10

Niet gepubliceerd

Niet gepubliceerd

Outputprijs ($/M)

$50

$50

Niet gepubliceerd

Niet gepubliceerd

Multimodaal

Tekst, afbeelding, bestand

Tekst, afbeelding, bestand

Ja

Ja

API-beschikbaarheid

Vertrouwde toegang, alleen VS

Algemeen beschikbaar

GA

GA

Gegevensretentie

Beperkte programma's

Standaard 30 dagen

Wisselt

Wisselt

Let op: Anthropic heeft de vergelijkingscijfers met GPT-5.6 Sol zelf uitgevoerd, en van een aantal rijen zijn geen gepubliceerde cijfers voor GPT-5.6 Sol of Gemini beschikbaar. Vul de overige cellen aan met officiële bronnen op het moment van gebruik.

Claude Mythos 5.1 versus Fable 5.1: de belangrijkste verschillen

Dit is de vergelijking die er echt toe doet, en het antwoord is simpeler dan het lijkt. Fable 5.1 en Mythos 5.1 zijn hetzelfde onderliggende model, en het verschil in benchmarks komt door taken waarbij eerdere, minder precieze cyberveiligheidsmaatregelen ingrepen. Met andere woorden: je kiest niet voor Mythos vanwege pure intelligentie. Je kiest ervoor omdat productieveiligheidsmaatregelen anders legitiem cybersecurity- of biologiewerk zouden blokkeren. Voor al het overige is Fable 5.1 hetzelfde model dat je nu al gewoon kunt aanroepen.

Waar Mythos 5.1 uitblinkt en waar het achterblijft

Tegenover OpenAI's topmodel geven Anthropics gepubliceerde cijfers de voorkeur aan hun eigen model. Op de vier benchmarks waar Anthropic beide resultaten publiceerde, versloeg Fable 5.1 GPT-5.6 Sol met 6 tot 30 punten. De eerlijke zwakte zit in de kostenefficiëntie bij gewoon werk. Met $10 per miljoen invoertokens en $50 per miljoen uitvoertokens kost Fable 5.1 twee keer zoveel als Claude Opus 5 vóór caching. Op CursorBench is het verschil met Opus 5 slechts 3,4 punten, voor een model dat dubbel zo duur is. Voor inkoop geldt een simpele vuistregel: betaal de meerprijs alleen als een mislukte run meer kost dan het verschil in tokens.

Welk toonaangevend model je ook kiest, je betaalt nog steeds voor Claude, ChatGPT of Gemini in USD. Met Bleap betaal je 0% wisselkosten op die verlengingen, plus een vaste 20% cashback op alle drie, dus bij een maandabonnement van €20 krijg je elke cyclus €4 terug. Vraag de Bleap-kaart aan →

5. Beste toepassingen van Claude Mythos 5.1

Wetenschappelijk onderzoek en academische toepassingen

Mythos 5.1 is gemaakt voor technisch onderzoek met hoge inzet. Het is Anthropic's meest capabele model voor cybersecurity-verdediging en onderzoek in de life sciences, denk aan dreigingsanalyse, het opsporen van kwetsbaarheden, red teaming, drugontdekking en biodefense-screening. De wetenschappelijke resultaten zijn tastbaar: het werk aan eiwitontwerp haalde een succespercentage van bijna 50%, tegenover de gebruikelijke 10 tot 15%. Voor labs die end-to-end onderzoeken uitvoeren, is de sprong in agentic science dé reden om toegang aan te vragen.

Enterprise en business intelligence

Voor algemeen kenniswerk is Fable 5.1 het werkpaard voor bedrijven. Anthropic noemt het 5.1-duo de meest geavanceerde modellen ter wereld voor coderen en kenniswerk, met onderzoeksmogelijkheden die een eerste kijkje geven in hoe AI-modellen zullen bijdragen aan wetenschappelijke vooruitgang. Praktijkinzet laat zien hoe aantrekkelijk lange, onbewaakte runs zijn. Eén engineer bij Ramp meldde een enkele onbewaakte run van 38 uur op een machine learning-probleem, waarbij het model een eerder resultaat herkende als een label-artefact, dit corrigeerde, 's nachts 6 parallelle experimenten opstartte en terugkwam met een resultaat én vervolgstappen.

Geavanceerd redeneren en agentic workflows

Bij agentic pipelines onderscheidt dit model zich echt van zijn voorganger. De grootste vooruitgang van Fable 5.1 zit in lange taken waarbij tools worden gebruikt: meer dan een verdubbeling ten opzichte van Fable 5 op agentic science, en bijna een verdubbeling op business-automatisering, van 17,1% naar 31,4%. Het ontwerpdoel is autonomie zonder vast te lopen. Ontwikkelaars omschrijven het als een model dat verder komt in lange taken, beter herkent wanneer het vastzit, en een natuurlijkere schrijfstijl heeft.

Toepassingen waarbij een lichter model wellicht volstaat

Niet elke taak vraagt om het topmodel. Anthropic geeft zelf het advies om goedkoper te beginnen. Op de modelpagina van Fable 5.1 raadt Anthropic aan om voor de meeste werkzaamheden met Opus 5 te starten. Voor taken met een hoog volume en een lagere complexiteit houd je de kosten laag met Haiku of Sonnet. Het afwegingskader is simpel: weeg de complexiteit van de taak af tegen je tokenbudget, en bewaar Fable en Mythos voor het zwaarste werk, waar een fout antwoord duur kan uitpakken.

6. Belangrijkste specificaties en mogelijkheden

Contextvenster en geheugen

Het contextvenster is groot en ongewijzigd ten opzichte van de vorige generatie. Het model heeft een contextvenster van 1 miljoen tokens en een maximale output van 128K tokens. Onafhankelijke reviewers geven een nuttige waarschuwing mee: een groot contextlimiet is geen garantie. Een ruim contextvenster garandeert geen perfecte recall of lage kosten, dus meet zelf de kwaliteit van het ophalen van informatie, het cachegedrag en het slagingspercentage van taken op je eigen data.

Ondersteunde modaliteiten

De input is multimodaal, de output is tekst. Fable 5.1 accepteert tekst, afbeeldingen en bestanden zoals pdf's als input en geeft tekst terug. Tool use wordt volledig ondersteund. Het model accepteert tools voor function calling en ondersteunt gestructureerde output via een JSON-schema in response_format. Een gedragsverandering die het vermelden waard is: bij eerdere Claude-modellen moest je uitgebreid denken zelf aanzetten, maar Fable 5.1 denkt standaard na bij elk verzoek.

Model-ID's, versiebeheer en API-endpoints

Het openbare model-ID is simpel. Het bevestigde openbare model-ID is claude-fable-5-1. Het model is breed beschikbaar. Fable 5.1 is algemeen beschikbaar als claude-fable-5-1 via de Claude API, en ook via AWS, Google Cloud en Microsoft Azure. Mythos 5.1 maakt gebruik van de trusted-access verificatieprogramma's in plaats van een open endpoint. Let op deze breaking change: ontwikkelaars die hun agents upgraden, meldden dat bestaande code foutmeldingen gaf. Zet versies dus vast en test grondig voordat je naar productie gaat.

7. Veiligheid, beveiliging en alignment

Constitutional AI en RLHF-aanpak voor alignment

Mythos past helemaal binnen Anthropic's veiligheidskader. Mythos valt onder Anthropic's Responsible Scaling Policy en het AI Safety Level-raamwerk, en de gecontroleerde initiële release is een direct gevolg van Anthropic's beoordeling van de mogelijkheden van het model ten opzichte van de veiligheidsdrempels. De 5.1-release introduceerde ook een nieuwe beveiligingslaag voor bedrijven. Anthropic introduceerde een nieuwe beveiligingsarchitectuur genaamd Enterprise Frontier Safeguards, ontworpen om organisaties monitoringdata te laten bewaren binnen infrastructuur die ze zelf beheren.

Beveiligingsmaatregelen en weigergedrag

Het belangrijkste verschil tussen de twee varianten zit in de precisie van weigeringen. Bij Fable 5.1 zijn de beveiligingsmaatregelen preciezer: biologie-beveiligingen grijpen bij onschuldige verzoeken 85% minder vaak in dan bij de lancering, en vragen over dual-use biologie en chemie worden nog steeds doorgestuurd naar Opus-modellen, terwijl penetratietesten en het genereren van exploits geblokkeerd blijven. Ook cyber-interventies namen af, wat betekent dat er minder onterechte weigeringen zijn voor legitieme onderzoekers die aan defensief onderzoek werken.

Onafhankelijke veiligheidsaudits en certificeringen

Onafhankelijke evaluatie maakt vanaf het begin deel uit van het verhaal van Mythos. Het UK AI Security Institute testte Mythos op hackingtaken van expertniveau en rapporteerde een slagingspercentage van 73% op taken die tot april 2025 door geen enkel AI-model konden worden voltooid. Anthropic publiceerde ook opvallend gedetailleerde documentatie. Het bedrijf publiceerde een systeemkaart van 244 pagina's voor het model, de eerste keer dat het systeemkaart-documentatie uitbracht voor een nog niet uitgebracht model.

8. Toegang en beschikbaarheid

Huidige toegangsstatus

Op het moment van publicatie is Mythos 5.1 nog steeds afgeschermd. Toegang blijft beperkt tot een klein aantal geverifieerde organisaties, via vertrouwde toegangsprogramma's voor een kleine maar groeiende groep. Er geldt een strikte geografische beperking. Mythos 5.1 is uitsluitend toegankelijk voor geverifieerde organisaties via het Cyber Verification Program en het Life Sciences Verification Program, en momenteel alleen in de VS. Fable 5.1 daarentegen is voor iedereen beschikbaar via de standaard Claude API en grote cloudplatforms.

Hoe vraag je vertrouwde toegang aan

Toegang verloopt via de verificatieprogramma's van Anthropic in plaats van via een selfserviceconsole. Organisaties die actief zijn in cybersecurity solliciteren via het Cyber Verification Program, terwijl onderzoeksteams zich aanmelden via het Life Sciences Verification Program. Bij goedkeuring hebben organisaties met een duidelijk defensief of onderzoeksgericht gebruiksdoel en aantoonbare veiligheidspraktijken de voorkeur, gezien de gevoeligheid rond dual-use toepassingen. Voor biologie verwacht Anthropic binnenkort de inschrijving voor wetenschappers te openen.

Routekaart naar algemene beschikbaarheid

Het uitgesproken doel van Anthropic is geleidelijke uitbreiding. Mythos 5 werd beschikbaar gesteld aan een kleine groep geverifieerde partners, met als doel de toegang in de toekomst breder open te stellen. Om de toegang veilig te verruimen, voegde Anthropic extra waarborgen toe om mogelijkheden op Mythos-niveau breder te kunnen uitrollen. Het momenteel algemeen beschikbare pad naar mogelijkheden op Mythos-niveau is Fable 5.1.

9. Gegevensretentie en privacybeleid

Op het frontier-niveau wordt er strenger omgegaan met data. Fable 5.1 hanteert een verplichte gegevensretentie van 30 dagen en is niet beschikbaar met zero data retention, tenzij Anthropic hier expliciet toestemming voor geeft. Ook heeft het geen Priority Tier meer, iets wat Fable 5 nog wel had. Maakte je bij een bestaande Fable 5-workload gebruik van zero data retention of de Priority Tier, houd daar dan rekening mee voordat je overstapt.

De release van 5.1 brengt wel enterprise-grade privacycontroles met zich mee, dankzij de nieuwe beveiligingsarchitectuur. Het Enterprise Frontier Safeguards-systeem slaat gegevens op in cloudinfrastructuur die volledig door de klant zelf wordt beheerd, niet door Anthropic, wat klanten volledige privacy geeft. Voor blootstelling aan AVG en CCPA doen zakelijke afnemers er goed aan om vóór implementatie direct met Anthropic te overleggen over gegevenslocatie en de precieze voorwaarden van een eventuele goedgekeurde zero-data-retentieregeling, aangezien de standaard retentietermijn van 30 dagen niet voor elke gereguleerde workload geschikt zal zijn.

10. Naleving van regelgeving en governance

Doordat Mythos zowel civiel als militair inzetbaar is, heeft het model al direct de aandacht van overheden getrokken. Vanwege veiligheidsoverwegingen gaf de Amerikaanse overheid Anthropic opdracht om de eerdere modellen een paar weken buiten gebruik te stellen. De voorganger kreeg te maken met een nog strengere beperking. In juni 2026 stuurde de Amerikaanse overheid Anthropic een brief waarin toegang tot zowel Mythos 5 als Fable 5 werd verboden voor iedereen die geen Amerikaans staatsburger is, ongeacht waar diegene zich bevindt. Anthropic trok daarop de toegang tot beide modellen in voor alle klanten.

De toegang werd later hersteld met goedkeuring van de overheid, en om die reden wordt het huidige biologieprogramma van Mythos 5.1 uitgevoerd in samenwerking met de Amerikaanse overheid. Voor de EU AI Act zou een model met dit niveau van vaardigheden vallen onder de verplichtingen voor AI voor algemene doeleinden met systeemrisico's, wat inhoudt dat er transparantierapportage en incidentregistratie vereist zijn. Zakelijke afnemers in gereguleerde sectoren doen er goed aan om de gepubliceerde system card te zien als startpunt voor hun eigen compliance-onderzoek, en niet als eindpunt.

Geavanceerde AI gebruiken is al duur genoeg zonder dat je ook nog eens verborgen wisselkoerskosten betaalt over je abonnementen. Bleap rekent 0% wisselkoerskosten op AI-tools die in USD worden gefactureerd en geeft je een vaste 20% cashback op Claude, ChatGPT en Gemini, zonder dat je hiervoor een eigen maandabonnement nodig hebt. Vraag de Bleap-kaart aan →

Veelgestelde vragen over Claude Mythos 5.1

Wat maakt Claude Mythos 5.1 anders dan Claude Opus?

Mythos zit een volledige laag boven Opus in de hiërarchie van Anthropic. Claude Mythos is een nieuwe modelklasse boven Opus, bedoeld voor de meest veeleisende AI-taken, met name die waarbij geavanceerd redeneervermogen, lange agentische taakreeksen en diepgaande domeinkennis nodig zijn. Mythos 5.1 heeft ook lichtere beveiligingen dan de algemeen beschikbare Fable 5.1, en is specifiek afgestemd op werk in cybersecurity en life sciences.

Hoeveel kost Claude Mythos 5.1 per miljoen tokens?

De prijzen voor Claude Mythos 5.1 beginnen bij $10 per miljoen input-tokens en $50 per miljoen output-tokens. Cache reads gingen 75% omlaag naar $0,25 per miljoen, cache writes kosten $12,50 voor het venster van 5 minuten en $20 voor het venster van 1 uur, en via de Batch API krijg je 50% korting op zowel input als output.

Hoe verhoudt Claude Mythos 5.1 zich tot Fable 5.1 op benchmarks?

Het zijn dezelfde gewichten, dus de scores komen overeen, behalve waar de beveiligingen verschillen. Op Terminal-Bench 4.0, de enige rij waarin Mythos 5.1 voorkomt, scoort het 60,9% tegenover 55,8% voor Fable 5.1. Dat verschil van vijf punten komt door taken waarbij Fable's cyberbeveiligingen ingrepen, en zegt dus niets over een verschil in onderliggende capaciteiten.

Hoe groot is het contextvenster van Claude Mythos 5.1?

Het model heeft een contextvenster van 1M tokens en een maximale output van 128K tokens. Dat is ruim voldoende voor lange documenten en agent-sessies met meerdere beurten, al kun je de praktische geheugencapaciteit het beste testen op je eigen data in plaats van uit te gaan van de vermelde limiet.

Is Claude Mythos 5.1 beschikbaar via de Anthropic API?

Niet openlijk. Mythos 5.1 is voorbehouden aan gescreende organisaties via het Cyber Verification Program en het Life Sciences Verification Program, momenteel alleen in de VS. Hetzelfde model is voor iedereen beschikbaar als Fable 5.1 via de Claude API, AWS, Google Cloud en Microsoft Azure.

Voor welke toepassingen is Claude Mythos 5.1 het meest geschikt?

Het is het krachtigste model van Anthropic voor cybersecurity-verdediging en levenswetenschappelijk onderzoek, waaronder threat intelligence, het opsporen van kwetsbaarheden, red teaming, medicijnontwikkeling en biodefense-screening. Voor algemeen redeneerwerk en agentic kenniswerk biedt Fable 5.1 dezelfde mogelijkheden, maar dan zonder de toegangsbeperking. Zie hoofdstuk 5 voor het volledige overzicht.

Conclusie & Samenvatting

Vier conclusies vatten Claude Mythos 5.1 samen. Op het gebied van benchmarks loopt het voorop bij agentic wetenschap: Fable 5.1 verdubbelt de score van zijn voorganger op Terminal-Bench-Science ruimschoots, en Mythos 5.1 scoort het hoogst op langlopend terminalwerk met 60,9%. Qua prijs staat het bovenaan de ladder met $10/$50 per miljoen tokens, waarbij cache-reads met 75% zijn verlaagd om langdurig draaiende agents te belonen. Qua toepassingen is het gebouwd voor cybersecurity en levenswetenschappelijk onderzoek, terwijl Fable 5.1 algemeen kenniswerk voor zijn rekening neemt. Wat toegang betreft blijft Mythos beperkt tot vertrouwde gebruikers en alleen beschikbaar in de VS, dus de meeste teams kunnen beter bouwen op Fable 5.1 of goedkopere taken naar Opus 5 doorsturen. Het model ontwikkelt zich snel, dus check altijd de officiële changelog van Anthropic voordat je het inzet voor een productieomgeving.

Voor welke AI-tools je ook kiest, betaal slim. Met Bleap sla je de wisselkoerskosten op USD-abonnementen over, en op Claude, ChatGPT en Gemini krijg je bij elke verlenging een vaste 20% cashback. Het is een selfcustodial Mastercard die je overal kunt gebruiken, zonder eigen maandelijks abonnement.

Een slimmere manier om te betalen, verzenden, verdienen en traden

Afbeelding sectie Belangrijkste punten
  • Artificial Inteligence

Gerelateerde artikelen