Claude Mythos 5.1: benchmark, prezzi, casi d’uso e guida completa
7 September 2026 · Aggiornato 9 September 2026

Gabriel Caetano
ARTIFICIAL INTELIGENCE
Claude Mythos 5.1: benchmark, prezzi, casi d’uso e guida completa
Claude Mythos 5.1 è il modello frontier ad accesso limitato di Anthropic per cybersecurity e scienze della vita. Scopri benchmark, prezzi $10/$50, contesto da 1M di token, casi d’uso, sicurezza e confronto con Fable 5.1.

Panoramica di Claude Mythos 5.1: benchmark, prezzi, casi d'uso e tutto quello che c'è da sapere
Scegliere un modello frontier per attività di ricerca o sicurezza serie non è facile quando l'opzione più performante è accessibile solo tramite modulo di richiesta. Claude Mythos 5.1 è il modello di Anthropic ad accesso limitato pensato per il lavoro in ambito cybersecurity e scienze della vita, uscito il 1° settembre 2026, con un prezzo di 10 dollari per milione di token in input e 50 dollari per milione di token in output. Fable 5.1 e Mythos 5.1 sono in pratica lo stesso modello, ma con livelli di protezione diversi: Fable 5.1 è disponibile per tutti, mentre Mythos 5.1 è accessibile solo tramite programmi di accesso riservato. Detto questo, la maggior parte dei team non avrà mai a che fare direttamente con Mythos, quindi in questa guida parliamo di entrambi.
Qui sotto trovi i benchmark, i prezzi, il confronto con Fable 5.1 e altri modelli frontier, i casi d'uso più interessanti e come funziona davvero l'accesso. Se paghi ogni mese per Claude, ChatGPT o Gemini, ti spieghiamo anche il modo più intelligente per non perdere soldi con le commissioni sulle transazioni estere legate a questi abbonamenti in dollari.
Paghi Claude ogni mese in dollari da un conto in euro? Con Bleap non paghi commissioni di cambio sui tuoi abbonamenti in USD e ottieni un cashback fisso del 20% sui rinnovi di Claude, ChatGPT e Gemini. Carta Mastercard self-custodial, nessun abbonamento richiesto. Scopri la carta Bleap →
1. Cos'è Claude Mythos 5.1?
Identità del modello e contesto di rilascio
La gamma di Anthropic ha una struttura ben precisa. Haiku, Sonnet e Opus sono i modelli piccolo, medio e grande, mentre la fascia Mythos si colloca interamente sopra Opus. La famiglia Claude copre tre fasce dimensionali con nome proprio, Opus, Sonnet e Haiku, a cui si è aggiunta a giugno 2026 la fascia Mythos, posizionata sopra la classe Opus.
Il nome "5.1" indica un aggiornamento puntuale, non un vero salto generazionale. Anthropic ha rilasciato l'aggiornamento 5.1 il 1° settembre 2026 come point release sopra Fable 5, e il prezzo di riferimento non è cambiato, la finestra di contesto non è cambiata, e l'ID del modello è variato appena. Ciò nonostante, i miglioramenti nelle capacità sono concreti, e si concentrano soprattutto nel lavoro agentico e scientifico piuttosto che nei benchmark d'esame ormai saturi.
Lancio su invito e accesso riservato
Mythos 5.1 non è un modello a cui puoi semplicemente accedere. Mythos 5.1 è identico a Fable 5.1 ma con meno restrizioni di sicurezza, ed è riservato alle organizzazioni verificate tramite il Cyber Verification Program e il Life Sciences Verification Program, al momento disponibili solo negli Stati Uniti. La ragione sta nel rischio di duplice uso. È il modello più avanzato di Anthropic per la difesa informatica e la ricerca nelle scienze della vita, comprese intelligence sulle minacce, scoperta di vulnerabilità, red teaming e scoperta di farmaci, e l'accesso è limitato a un gruppo selezionato di organizzazioni proprio per la natura duale di questi ambiti.
Per quanto riguarda specificamente la biologia, Anthropic ha creato un programma di accesso sviluppato in collaborazione con il governo degli Stati Uniti per consentire l'utilizzo delle avanzate capacità biologiche di Mythos 5.1, e prevede di aprire presto le iscrizioni per i ricercatori. Se non rientri nei requisiti, la versione generalmente disponibile Fable 5.1 è il "gemello" che userai davvero.
2. Prestazioni di Claude Mythos 5.1 nei benchmark
I punteggi chiave dei benchmark in sintesi
Dato che le due varianti 5.1 condividono gli stessi pesi, la maggior parte dei numeri pubblicati arriva da Fable 5.1, mentre Mythos 5.1 compare dove le protezioni allentate gli permettono di ottenere punteggi più alti.
Benchmark | Punteggio | Cosa misura |
|---|---|---|
Terminal-Bench-Science 0.1 | 52,6% | Indagine scientifica end-to-end |
Terminal-Bench 4.0 (Mythos 5.1) | 60,9% | Lavoro da terminale su lungo orizzonte temporale |
GPQA Diamond | 92,6% | Ragionamento scientifico di livello universitario avanzato |
SWE-bench Pro | 81,2 | Ingegneria del software nel mondo reale |
CursorBench 3.2.0 | 73,4% | Programmazione integrata in IDE |
ProofBench v1.1 | 100% | Dimostrazioni matematiche formali |
ARC-AGI-1 | 97,5% | Ragionamento astratto |
GPQA Diamond, il benchmark sul ragionamento scientifico di livello universitario avanzato, si attesta al 92,6%, a conferma che questi progressi non riguardano solo i flussi di lavoro basati su agenti. Sulla matematica formale, Vals AI ha registrato un perfetto 100% su ProofBench v1.1, un benchmark per le dimostrazioni matematiche formali, un primato assoluto per un modello di frontiera.
Le affermazioni sui limiti delle prestazioni
Il segnale più chiaro dei progressi arriva dalla scienza agentica. Terminal-Bench-Science 0.1 verifica se un modello riesce a condurre un'indagine scientifica dall'inizio alla fine, e Fable 5.1 si posiziona al 52,6%, contro il 24,7% di Fable 5, il 29,0% di Opus 5 e il 22,4% di GPT-5.6 Sol. Un vero e proprio raddoppio in una versione minore. Il punteggio ha più che raddoppiato quello di Fable 5 su Terminal-Bench-Science.
L'unica apparizione esclusiva di Mythos 5.1 mette in luce il divario legato ai safeguard. Terminal-Bench 4.0 misura il lavoro su terminale a lungo orizzonte temporale, ed è l'unica riga in cui compare Mythos 5.1 con il 60,9%, contro il 55,8% di Fable 5.1, il 52,3% di Opus 5, il 42,0% di Fable 5 e il 37,3% di GPT-5.6 Sol. Vale la pena segnalare un avvertimento onesto: il dato del 95,0% su SWE-bench Verified che circola ampiamente online appartiene a Fable 5, dal suo lancio di giugno 2026, e l'annuncio di Anthropic sulla 5.1 non riporta alcun punteggio SWE-bench, puntando invece sui benchmark agentici.
Prestazioni avanzate di ragionamento e contesto lungo
I valutatori indipendenti confermano la direzione. Artificial Analysis colloca Fable 5.1 al primo posto nel suo Intelligence Index con 66 punti, ARC-AGI le assegna il 97,5% su ARC-AGI-1, e Vals AI la posiziona al primo posto nel Vals Index. I miglioramenti sono volutamente disomogenei. I progressi sono più contenuti nei compiti in cui Fable 5 già eccelleva, come la programmazione quotidiana, e Anthropic ha effettuato queste misurazioni con i safeguard attivi, il che, a suo dire, probabilmente abbassa un po' alcuni punteggi. In pratica, conviene considerare la tabella di lancio come una mappa orientativa e condurre le proprie valutazioni prima di spostare il traffico in produzione.
3. Prezzi e costi dei token di Claude Mythos 5.1
Struttura dei prezzi dei token
Il prezzo è semplice e identico tra i due modelli gemelli. Per Claude Mythos 5.1 si parte da 10$ per milione di token in input e 50$ per milione di token in output. Ma la vera storia dell'efficienza si gioca sulla cache. Fable 5.1 costa 10,00$ per milione di token in input e 50,00$ per milione in output, con la Cache Read a 0,25$ per milione, la Cache Write a 12,50$ per milione e la Cache Write (1h) a 20,00$ per milione. Le letture cache sono scese del 75%, a 0,25$ per milione, e la Batch API offre uno sconto del 50% su input e output.
Fasce di costo e sconti sui volumi
Questa singola modifica cambia le carte in tavola per gli agenti. La cache read è passata da 1,00$ a 0,25$ per milione di token, un dettaglio che conta parecchio perché una sessione agentica lunga rilegge continuamente lo stesso albero di file, lo stesso system prompt e la stessa cronologia della conversazione a ogni passaggio: la stragrande maggioranza dei token in input finisce per essere cache hit, non testo nuovo. Anthropic è chiara sul risparmio concreto: stima che i costi fatturati a token saranno circa il 25% più bassi per i carichi di lavoro tipici, e fino a circa il 45% più bassi per quelli fortemente agentici.
Guardando l'intera gamma di prezzi, Mythos e Fable occupano il gradino più alto. Al 1° settembre 2026, il listino prevede Fable 5 a 10$/50$ per milione di token, Opus 5 a 5$/25$, Sonnet 5 a 2$/10$ e Haiku 4.5 a 1$/5$.
Considerazioni sul costo totale di possesso
È la stessa Anthropic a consigliare di instradare le richieste prima di puntare subito al modello top di gamma. La guida ufficiale ai modelli suggerisce di partire con Opus 5 per la maggior parte dei carichi di lavoro e passare a Fable 5.1 solo quando Opus non supera una valutazione che conta davvero. C'è però un'avvertenza da tenere presente per il budget: Fable 5.1 richiede una conservazione dei dati di 30 giorni e non è disponibile in modalità "zero data retention", a meno che Anthropic non lo autorizzi espressamente, e non dispone di un livello Priority Tier.
Niente di tutto questo riguarda il tuo abbonamento personale a Claude, che viene fatturato separatamente in dollari. Se paghi con una carta in euro, ti viene applicata una commissione per transazioni estere del 2-3% a ogni rinnovo, e questo sovrapprezzo si accumula silenziosamente nel corso dell'anno. Pagando in USD al tasso reale, elimini completamente questo costo.
4. Claude Mythos 5.1 vs. i modelli frontier concorrenti
Tabella di confronto diretto
Caratteristica / Modello | Claude Mythos 5.1 | Fable 5.1 | GPT-5.6 Sol | Gemini 3.1 Pro |
|---|---|---|---|---|
Finestra di contesto | 1M token | 1M token | Non pubblicato qui | Non pubblicato qui |
Terminal-Bench-Science 0.1 | Stessi pesi | 52,6% | 22,4% | Non pubblicato |
Terminal-Bench 4.0 | 60,9% | 55,8% | 37,3% | Non pubblicato |
Prezzo input ($/M) | $10 | $10 | Non pubblicato | Non pubblicato |
Prezzo output ($/M) | $50 | $50 | Non pubblicato | Non pubblicato |
Multimodale | Testo, immagini, file | Testo, immagini, file | Sì | Sì |
Disponibilità API | Accesso riservato, solo USA | Disponibile pubblicamente | GA | GA |
Conservazione dati | Programmi con accesso limitato | 30 giorni di default | Variabile | Variabile |
Nota: i numeri di confronto con GPT-5.6 Sol sono stati calcolati direttamente da Anthropic, e per diverse righe non esistono dati ufficiali pubblicati su GPT-5.6 Sol o Gemini. Completa le celle mancanti consultando le fonti ufficiali al momento dell'utilizzo.
Claude Mythos 5.1 vs. Fable 5.1: le differenze principali
Questo è il confronto che conta davvero, e la risposta è più semplice di quanto sembri. Fable 5.1 e Mythos 5.1 sono lo stesso modello di base, e il divario nei benchmark riflette i compiti in cui intervenivano protezioni informatiche precedenti, meno precise. In altre parole, non si sceglie Mythos per l'intelligenza pura. Lo si sceglie perché altrimenti le protezioni di produzione bloccherebbero un legittimo lavoro di cybersecurity o biologia. Per tutto il resto, Fable 5.1 è lo stesso identico modello che puoi già richiamare oggi.
Dove Mythos 5.1 primeggia e dove resta indietro
Rispetto al modello di punta di OpenAI, i numeri pubblicati da Anthropic favoriscono il proprio modello. Sui quattro benchmark dove Anthropic ha pubblicato entrambi i risultati, Fable 5.1 ha battuto GPT-5.6 Sol da 6 a 30 punti. Il punto debole, in tutta onestà, è l'efficienza dei costi sul lavoro ordinario. Con $10 per milione di token in input e $50 per milione di token in output, Fable 5.1 costa il doppio rispetto a Claude Opus 5 prima della cache. Su CursorBench, il divario rispetto a Opus 5 è di 3,4 punti, su un modello che costa il doppio. Per chi deve decidere gli acquisti, la regola è semplice: pagare il sovrapprezzo solo dove un'esecuzione fallita costa più della differenza in token.
Qualunque modello di punta tu scelga, paghi comunque Claude, ChatGPT o Gemini in dollari USA. Bleap ti offre lo 0% di commissioni sul cambio valuta per questi rinnovi, oltre a un cashback fisso del 20% su tutti e tre, così un piano mensile da 20€ ti fa tornare indietro 4€ ogni ciclo. Richiedi la carta Bleap →
5. I migliori casi d'uso di Claude Mythos 5.1
Ricerca scientifica e applicazioni accademiche
Mythos 5.1 nasce per la ricerca tecnica ad alto rischio. È il modello più capace di Anthropic per la difesa informatica e la ricerca nelle scienze della vita, comprese intelligence sulle minacce, scoperta di vulnerabilità, red teaming, ricerca farmaceutica e screening per la biodifesa. I risultati scientifici sono concreti: il lavoro sulla progettazione di proteine ha raggiunto un tasso di successo di quasi il 50%, contro un tipico 10-15%. Per i laboratori che gestiscono indagini complete end-to-end, il salto in avanti nella scienza agentica è il motivo principale per richiedere l'accesso.
Business intelligence ed enterprise
Per il lavoro di conoscenza generale, Fable 5.1 è il vero cavallo da lavoro per le aziende. Anthropic definisce la coppia 5.1 come i modelli più avanzati al mondo per coding e knowledge work, con capacità di ricerca che offrono un primo assaggio di come i modelli AI contribuiranno al progresso scientifico. I dispiegamenti reali mostrano quanto siano interessanti le sessioni lunghe e senza supervisione. Un ingegnere di Ramp ha raccontato di una singola sessione di 38 ore senza supervisione su un problema di machine learning, durante la quale il modello ha diagnosticato un risultato precedente come un artefatto dovuto a un'etichettatura errata, lo ha corretto, ha avviato 6 esperimenti paralleli durante la notte ed è tornato con un risultato e i passi successivi da seguire.
Ragionamento avanzato e workflow agentici
È nelle pipeline agentiche che il modello si distacca davvero dal suo predecessore. I maggiori progressi di Fable 5.1 riguardano i compiti lunghi che richiedono l'uso di strumenti: più del doppio rispetto a Fable 5 nella scienza agentica, e quasi il doppio nell'automazione aziendale, passando dal 17,1% al 31,4%. L'obiettivo di design è l'autonomia senza blocchi. Le descrizioni degli sviluppatori dicono che riesce ad andare più avanti nei compiti lunghi, è più bravo a capire quando è bloccato e ha uno stile di scrittura più naturale.
Casi d'uso in cui un modello più leggero potrebbe bastare
Non tutti i compiti richiedono il livello top. Lo stesso Anthropic consiglia di partire dai modelli più economici. La pagina dedicata al modello Fable 5.1 di Anthropic raccomanda esplicitamente di iniziare con Opus 5 per la maggior parte dei lavori. Per attività ad alto volume e bassa complessità, Haiku o Sonnet permettono di tenere sotto controllo i costi. Il criterio decisivo è la complessità del compito rapportata al budget di token: riserva Fable e Mythos ai lavori di difficoltà estrema, dove un errore avrebbe un costo elevato.
6. Specifiche tecniche e funzionalità principali
Finestra di contesto e memoria
La finestra di contesto è ampia e non è cambiata rispetto alla generazione precedente. Il modello ha una finestra di contesto da 1M di token e un output massimo di 128K token. Un promemoria pratico da parte dei recensori indipendenti: un limite di contesto elevato non è una garanzia. Un ampio limite di contesto non garantisce un richiamo perfetto delle informazioni né costi contenuti, quindi è bene misurare la qualità del retrieval, il comportamento della cache e il successo dei compiti sui propri dati.
Modalità supportate
Gli input sono multimodali, l'output è testuale. Fable 5.1 accetta come input testo, immagini e file come i PDF, e restituisce testo. L'uso di strumenti è pienamente supportato. Accetta strumenti per il function calling e supporta output strutturati tramite uno schema JSON in response_format. Un cambiamento comportamentale degno di nota: a differenza dei precedenti modelli Claude, dove il ragionamento esteso era opzionale, Fable 5.1 ragiona su ogni richiesta per impostazione predefinita.
ID del modello, versioning ed endpoint API
L'ID pubblico del modello è semplice. L'ID pubblico confermato è claude-fable-5-1. È disponibile su ampia scala. Fable 5.1 è generalmente disponibile come claude-fable-5-1 sulle API di Claude, oltre che su AWS, Google Cloud e Microsoft Azure. Mythos 5.1 utilizza i programmi di verifica ad accesso riservato invece di un endpoint aperto. Un cambiamento da tenere d'occhio: gli sviluppatori che hanno aggiornato i propri agenti hanno segnalato errori nel codice esistente, quindi è consigliabile bloccare le versioni e testare tutto prima di passare in produzione.
7. Sicurezza, protezione e allineamento
Approccio Constitutional AI e allineamento RLHF
Mythos si inserisce a pieno titolo nel framework di sicurezza di Anthropic. Mythos rientra nella Responsible Scaling Policy e nell'AI Safety Level framework di Anthropic, e il suo rilascio iniziale controllato è una conseguenza diretta della valutazione fatta da Anthropic sulle capacità del modello rispetto alle sue soglie di sicurezza. La versione 5.1 ha introdotto anche un nuovo livello di sicurezza pensato per le aziende. Anthropic ha presentato una nuova architettura di sicurezza chiamata Enterprise Frontier Safeguards, pensata per permettere alle organizzazioni di mantenere i dati di monitoraggio all'interno di un'infrastruttura sotto il loro controllo.
Meccanismi di protezione e comportamento nei rifiuti
La differenza principale tra i due modelli gemelli sta nella precisione dei rifiuti. Con Fable 5.1 i meccanismi di protezione sono più precisi: le protezioni in ambito biologico intervengono su richieste innocue l'85% in meno rispetto al lancio, mentre le domande a duplice uso su biologia e chimica continuano a essere indirizzate ai modelli Opus, e penetration testing e generazione di exploit restano bloccati. Sono diminuiti anche gli interventi in ambito cyber, il che si traduce in meno rifiuti ingiustificati per chi fa ricerca difensiva legittima.
Audit di sicurezza e certificazioni di terze parti
La valutazione indipendente fa parte della storia di Mythos fin dall'inizio. L'UK AI Security Institute ha valutato Mythos su compiti di hacking di livello esperto, riportando un tasso di successo del 73% su compiti che, fino ad aprile 2025, nessun modello AI era in grado di completare. Anthropic ha inoltre pubblicato una documentazione insolitamente dettagliata: l'azienda ha rilasciato una system card di 244 pagine per il modello, la prima volta in assoluto in cui viene pubblicata questo tipo di documentazione per un modello non ancora rilasciato.
8. Accesso e disponibilità
Stato attuale dell'accesso
Al momento della pubblicazione, Mythos 5.1 resta ad accesso limitato. L'accesso è riservato a un piccolo gruppo di organizzazioni verificate, tramite programmi di accesso fidato riservati a un numero ristretto ma in crescita di soggetti. C'è anche una restrizione geografica netta: Mythos 5.1 è limitato alle organizzazioni verificate tramite il Cyber Verification Program e il Life Sciences Verification Program, al momento disponibili solo negli Stati Uniti. Fable 5.1, invece, è accessibile a chiunque tramite la Claude API standard e le principali piattaforme cloud.
Come richiedere l'accesso fidato
L'accesso passa attraverso i programmi di verifica di Anthropic, non una console self-service. Le organizzazioni che lavorano nella cybersecurity possono fare richiesta tramite il Cyber Verification Program, mentre i team di ricerca passano dal Life Sciences Verification Program. L'approvazione premia le organizzazioni con un caso d'uso difensivo o di ricerca ben definito e pratiche di sicurezza dimostrabili, vista la delicatezza legata al possibile duplice uso. Per l'ambito biologico, Anthropic prevede di aprire presto le iscrizioni ai ricercatori.
Verso la disponibilità generale
L'obiettivo dichiarato di Anthropic è un'espansione graduale. Mythos 5 è stato reso disponibile a un piccolo gruppo di partner verificati, con l'intenzione di allargare l'accesso più in là nel tempo. Per ampliare l'accesso in sicurezza, Anthropic ha aggiunto ulteriori misure di protezione per rilasciare le capacità di livello Mythos su scala più ampia. Al momento, la strada generalmente disponibile per ottenere capacità di livello Mythos è Fable 5.1.
9. Conservazione dei dati e politiche sulla privacy
Sul livello frontier la gestione dei dati è più rigida. Fable 5.1 richiede una conservazione dei dati di 30 giorni e non è disponibile in modalità "zero data retention" a meno che Anthropic non lo autorizzi espressamente, e non ha più il Priority Tier che invece era presente in Fable 5. Se ti affidavi alla zero data retention o al Priority Tier per un workload esistente su Fable 5, è meglio pianificare questo cambiamento prima di migrare.
La versione 5.1 introduce però controlli sulla privacy di livello enterprise grazie alla nuova architettura di sicurezza. Il sistema Enterprise Frontier Safeguards conserva i dati su infrastrutture cloud controllate interamente dal cliente, non da Anthropic, garantendo così una privacy completa. Per quanto riguarda l'esposizione a GDPR e CCPA, le aziende dovrebbero verificare direttamente con Anthropic la residenza dei dati e i dettagli di eventuali accordi autorizzati di zero-data-retention prima del deployment, dato che la conservazione predefinita di 30 giorni non è adatta a tutti i workload soggetti a normative specifiche.
10. Conformità normativa e governance
La natura a duplice uso di Mythos ha già attirato l'attenzione diretta dei governi. Per motivi di sicurezza, il governo statunitense ha ordinato ad Anthropic di sospendere i modelli precedenti per alcune settimane. Il modello predecessore era stato sottoposto a una restrizione ancora più ampia. Nel giugno 2026 il governo USA ha inviato ad Anthropic una lettera che vietava l'accesso sia a Mythos 5 che a Fable 5 per qualsiasi cittadino non statunitense, indipendentemente dalla sua posizione geografica, e Anthropic ha di conseguenza revocato l'accesso a entrambi i modelli per tutti i clienti.
L'accesso è stato poi ripristinato con l'approvazione del governo, motivo per cui l'attuale programma di biologia di Mythos 5.1 viene condotto in collaborazione con il governo statunitense. Ai fini dell'AI Act europeo, un modello con questo livello di capacità rientrerebbe negli obblighi previsti per i modelli di IA per finalità generali con considerazioni di rischio sistemico, il che comporta obblighi di trasparenza e registrazione degli incidenti. Le aziende che operano in settori regolamentati dovrebbero considerare la system card pubblicata come punto di partenza per la propria verifica di conformità, non come punto d'arrivo.
Far girare l'AI di frontiera costa già abbastanza senza doverci pagare sopra anche una tassa nascosta sul cambio valuta. Bleap applica 0% di commissioni sul cambio per gli strumenti AI fatturati in USD e restituisce un cashback fisso del 20% su Claude, ChatGPT e Gemini, senza alcun abbonamento mensile proprio. Scopri la carta Bleap →
Domande frequenti su Claude Mythos 5.1
In cosa Claude Mythos 5.1 è diverso da Claude Opus?
Mythos si colloca un intero livello sopra Opus nella gerarchia di Anthropic. Claude Mythos è una nuova classe di modelli superiore a Opus, pensata per i compiti AI più impegnativi, in particolare quelli che richiedono ragionamento avanzato, sequenze di task agentici lunghe e una conoscenza approfondita di settori specifici. Mythos 5.1 ha anche protezioni più leggere rispetto a Fable 5.1, la versione disponibile pubblicamente, ed è calibrato appositamente per attività di cybersicurezza e scienze della vita.
Quanto costa Claude Mythos 5.1 per milione di token?
I prezzi di Claude Mythos 5.1 partono da 10$ per milione di token in input e 50$ per milione di token in output. Le letture dalla cache sono scese del 75%, a 0,25$ per milione, le scritture in cache costano 12,50$ per la finestra di 5 minuti e 20$ per quella di 1 ora, mentre la Batch API offre uno sconto del 50% su input e output.
Come si confronta Claude Mythos 5.1 con Fable 5.1 nei benchmark?
Sono gli stessi pesi del modello, quindi i punteggi coincidono tranne dove le protezioni differiscono. Su Terminal-Bench 4.0, l'unico test in cui compare Mythos 5.1, il punteggio è 60,9% contro il 55,8% di Fable 5.1. Il divario di cinque punti riflette i casi in cui sono intervenute le protezioni cyber di Fable, non una differenza nelle capacità di base del modello.
Qual è la dimensione della finestra di contesto di Claude Mythos 5.1?
Il modello ha una finestra di contesto da 1M di token e un output massimo di 128K token. Questo permette di gestire documenti lunghi e sessioni agentiche multi-turno, anche se la reale capacità di richiamo delle informazioni andrebbe verificata sui propri dati, senza darla per scontata solo in base al limite dichiarato.
Claude Mythos 5.1 è disponibile tramite l'API di Anthropic?
Non pubblicamente. Mythos 5.1 è riservato a organizzazioni verificate tramite il Cyber Verification Program e il Life Sciences Verification Program, al momento disponibili solo negli Stati Uniti. Lo stesso identico modello è invece accessibile a tutti come Fable 5.1 tramite Claude API, AWS, Google Cloud e Microsoft Azure.
Per quali casi d'uso è più indicato Claude Mythos 5.1?
È il modello più avanzato di Anthropic per la difesa informatica e la ricerca nelle scienze della vita, con applicazioni in threat intelligence, scoperta di vulnerabilità, red teaming, drug discovery e screening per la biodifesa. Per il ragionamento generale e il lavoro agentico basato sulla conoscenza, Fable 5.1 copre lo stesso terreno ma senza restrizioni di accesso. Consulta la Sezione 5 per l'analisi completa.
Conclusione e riepilogo
Quattro punti chiave riassumono Claude Mythos 5.1. Sui benchmark, guida la classifica nella scienza agentica, con Fable 5.1 che più che raddoppia il suo predecessore su Terminal-Bench-Science e Mythos 5.1 che domina il lavoro terminale a lungo termine con il 60,9%. Sul prezzo, si posiziona al vertice della scala con 10$/50$ per milione di token, con le letture cache ridotte del 75% per premiare gli agenti che lavorano su sessioni prolungate. Sui casi d'uso, è costruito per la cybersecurity e la ricerca nelle scienze della vita, mentre Fable 5.1 gestisce il lavoro di conoscenza generale. Sull'accesso, Mythos resta riservato ad accessi verificati e limitato agli Stati Uniti, quindi la maggior parte dei team dovrebbe puntare su Fable 5.1 o instradare i compiti più economici verso Opus 5. Il modello si sta evolvendo rapidamente, quindi controlla il changelog ufficiale di Anthropic prima di impegnarti in un carico di lavoro di produzione.
Qualunque strumento AI tu scelga, paga in modo intelligente. Con Bleap eviti le commissioni di cambio valuta sugli abbonamenti in USD, e su Claude, ChatGPT e Gemini guadagni un cashback fisso del 20% a ogni rinnovo. È una Mastercard self-custodial utilizzabile ovunque, senza alcun canone mensile proprio.
Un modo più intelligente di spendere, inviare, guadagnare e fare trading

- Artificial Inteligence








