Claude Mythos 5.1: benchmarks, preços, casos de uso e guia completo
7 September 2026 · Atualizado 9 September 2026

Gabriel Caetano
ARTIFICIAL INTELIGENCE
Claude Mythos 5.1: benchmarks, preços, casos de uso e guia completo
O Claude Mythos 5.1 é o modelo frontier de acesso restrito da Anthropic para cibersegurança e ciências da vida. Conheça benchmarks, preços de US$10/US$50, contexto de 1M de tokens, casos de uso, segurança e comparação com o Fable 5.1.

Visão Geral do Claude Mythos 5.1: Benchmarks, Preços, Casos de Uso e Tudo que Você Precisa Saber
Escolher um modelo de ponta para trabalhos sérios de pesquisa ou segurança é difícil quando a opção mais avançada está trancada atrás de um formulário de solicitação. Claude Mythos 5.1 é o modelo de acesso restrito da Anthropic para trabalhos de cibersegurança e ciências da vida, lançado em 1º de setembro de 2026, com preço de US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída. Fable 5.1 e Mythos 5.1 são o mesmo modelo com diferentes níveis de proteções, sendo o Fable 5.1 de disponibilidade geral e o Mythos 5.1 disponível apenas por meio de programas de acesso confiável. Dito isso, a maioria das equipes nunca vai lidar diretamente com o Mythos, então este guia cobre os dois.
A seguir, você vai encontrar benchmarks, preços, como ele se compara ao Fable 5.1 e a outros modelos de ponta, os casos de uso mais fortes e como o acesso realmente funciona. Se você paga por Claude, ChatGPT ou Gemini todo mês, também vamos mostrar a forma mais inteligente de evitar perder dinheiro com taxas de transação internacional nessas assinaturas em dólar.
Paga pelo Claude todo mês em dólar a partir de uma conta em euro? A Bleap cobra 0% de taxas de câmbio nas suas assinaturas em USD e ainda dá 20% de cashback fixo nas renovações de Claude, ChatGPT e Gemini. Cartão Mastercard autocustodial, sem assinatura própria. Peça o cartão Bleap →
1. O Que É o Claude Mythos 5.1?
Identidade do Modelo e Contexto de Lançamento
O portfólio da Anthropic tem uma estrutura bem definida. Haiku, Sonnet e Opus são os modelos pequeno, médio e grande, e o nível Mythos fica acima do Opus. A família Claude abrange três níveis nomeados, Opus, Sonnet e Haiku, que ganharam companhia em junho de 2026 com o nível Mythos, posicionado acima da classe Opus.
O nome "5.1" indica uma atualização pontual, não um salto geracional completo. A Anthropic lançou a atualização 5.1 em 1º de setembro de 2026 como uma versão incremental sobre o Fable 5, e o preço principal não mudou, a janela de contexto não mudou, e o ID do modelo mudou muito pouco. Ainda assim, os ganhos de capacidade são reais, concentrados em trabalho agêntico e científico, e não em benchmarks de exames já saturados.
Lançamento por Convite e Acesso Restrito e Confiável
O Mythos 5.1 não é um modelo que você simplesmente chama via API. O Mythos 5.1 é idêntico ao Fable 5.1, mas com salvaguardas mais leves, restrito a organizações previamente aprovadas por meio do Cyber Verification Program e do Life Sciences Verification Program, disponível apenas nos EUA por enquanto. O motivo é o risco de uso duplo. É o modelo mais capaz da Anthropic para defesa em cibersegurança e pesquisa em ciências da vida, incluindo inteligência de ameaças, descoberta de vulnerabilidades, red teaming e descoberta de fármacos, e o acesso é limitado a um conjunto selecionado de organizações dada a natureza de uso duplo desses domínios.
No caso específico da biologia, a Anthropic criou um programa de acesso desenvolvido em parceria com o governo dos EUA para viabilizar o acesso às capacidades avançadas de biologia do Mythos 5.1, e espera abrir as inscrições para cientistas em breve. Se você não se qualificar, o Fable 5.1, disponível de forma geral, é o "gêmeo" que você vai usar na prática.
2. Desempenho do Claude Mythos 5.1 nos Benchmarks
Principais Pontuações de Benchmark em Resumo
Como as duas variantes 5.1 compartilham os mesmos pesos, a maioria dos números publicados vem do Fable 5.1, com o Mythos 5.1 aparecendo nos casos em que a remoção de restrições permite pontuações mais altas.
Benchmark | Pontuação | O que mede |
|---|---|---|
Terminal-Bench-Science 0.1 | 52,6% | Investigação científica de ponta a ponta |
Terminal-Bench 4.0 (Mythos 5.1) | 60,9% | Trabalho de terminal de longo horizonte |
GPQA Diamond | 92,6% | Raciocínio científico de nível de pós-graduação |
SWE-bench Pro | 81,2 | Engenharia de software no mundo real |
CursorBench 3.2.0 | 73,4% | Programação integrada a IDE |
ProofBench v1.1 | 100% | Provas matemáticas formais |
ARC-AGI-1 | 97,5% | Raciocínio abstrato |
O GPQA Diamond, o benchmark de raciocínio científico de nível de pós-graduação, registrou 92,6%, reforçando que esses avanços não se limitam a fluxos de trabalho no estilo agente. Em matemática formal, a Vals AI registrou 100% de acerto no ProofBench v1.1, um benchmark de provas matemáticas formais, algo inédito para qualquer modelo de ponta.
Alegações sobre a Fronteira de Desempenho
O sinal mais claro de progresso está na ciência agêntica. O Terminal-Bench-Science 0.1 testa se um modelo consegue conduzir uma investigação científica do início ao fim, e o Fable 5.1 atinge 52,6%, contra 24,7% do Fable 5, 29,0% do Opus 5 e 22,4% do GPT-5.6 Sol. Isso representa uma duplicação em uma versão pontual. A pontuação mais que dobrou em relação ao Terminal-Bench-Science do Fable 5.
A única aparição exclusiva do Mythos 5.1 mostra a lacuna causada pelas salvaguardas. O Terminal-Bench 4.0 mede tarefas de terminal de longo horizonte, e é a única linha em que o Mythos 5.1 aparece com 60,9%, contra 55,8% do Fable 5.1, 52,3% do Opus 5, 42,0% do Fable 5 e 37,3% do GPT-5.6 Sol. Vale destacar uma ressalva importante: o número de 95,0% no SWE-bench Verified, amplamente repetido pela internet, pertence ao Fable 5 desde seu lançamento em junho de 2026, e o anúncio da Anthropic sobre o 5.1 não traz uma pontuação no SWE-bench, priorizando em vez disso benchmarks agênticos.
Desempenho Avançado em Raciocínio e Contexto Longo
Avaliadores independentes confirmam essa direção. A Artificial Analysis coloca o Fable 5.1 em primeiro lugar no seu Intelligence Index, com pontuação 66; o ARC-AGI aponta 97,5% no ARC-AGI-1; e a Vals AI o classifica em primeiro no Vals Index. Os ganhos são propositalmente desiguais. Eles são menores em tarefas nas quais o Fable 5 já se saía bem, como codificação do dia a dia, e a Anthropic mediu esses resultados com as salvaguardas ativadas, o que, segundo a empresa, provavelmente reduz algumas pontuações. Na prática, encare a tabela de lançamento como um mapa e faça suas próprias avaliações antes de migrar o tráfego de produção.
3. Preços e custos de tokens do Claude Mythos 5.1
Estrutura de preços por token
O preço é simples e idêntico entre os gêmeos. O preço do Claude Mythos 5.1 começa em US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída. A grande história de eficiência está no cache. O Fable 5.1 custa US$ 10,00 por milhão de tokens de entrada e US$ 50,00 por milhão de tokens de saída, com leitura de cache a US$ 0,25 por milhão, escrita de cache a US$ 12,50 por milhão e escrita de cache (1h) a US$ 20,00 por milhão. As leituras de cache caíram 75%, para US$ 0,25 por milhão, e a Batch API dá 50% de desconto em entrada e saída.
Faixas de custo e descontos por volume
Essa única mudança de valor transforma a economia para agentes. A leitura de cache caiu de US$ 1,00 para US$ 0,25 por milhão de tokens, o que faz diferença porque uma sessão longa de agente relê a mesma árvore de arquivos, o mesmo prompt de sistema e o mesmo histórico de conversa a cada passo, e a grande maioria dos tokens de entrada acaba sendo cache hit, não texto novo. A Anthropic deixa clara a economia no mundo real: a empresa estima que os custos cobrados por token sejam cerca de 25% menores para cargas de trabalho típicas e até aproximadamente 45% menores para cargas de trabalho altamente agênticas.
Na escala mais ampla, Mythos e Fable ficam no topo. A partir de 1º de setembro de 2026, a lista de preços é: Fable 5 a US$ 10/US$ 50 por milhão de tokens, Opus 5 a US$ 5/US$ 25, Sonnet 5 a US$ 2/US$ 10 e Haiku 4.5 a US$ 1/US$ 5.
Considerações sobre o custo total de propriedade
A própria Anthropic recomenda direcionar o tráfego antes de recorrer ao modelo topo de linha. O guia oficial de modelos da empresa diz para começar com o Opus 5 na maioria das cargas de trabalho e migrar para o Fable 5.1 apenas quando o Opus falhar em uma avaliação relevante. Uma ressalva sobre acesso afeta o planejamento de orçamento: o Fable 5.1 exige retenção de dados por 30 dias e não está disponível sob retenção zero de dados, a menos que a Anthropic autorize, além de não contar com o Priority Tier.
Nada disso afeta sua assinatura pessoal do Claude, que é cobrada separadamente em USD. Se você paga com um cartão em euros, isso adiciona uma taxa de transação internacional de 2-3% em cada renovação, e essa taxa extra vai se acumulando silenciosamente ao longo do ano. Pagar em USD na cotação real elimina esse custo por completo.
4. Claude Mythos 5.1 vs. Modelos de Ponta Concorrentes
Tabela Comparativa Direta
Recurso / Modelo | Claude Mythos 5.1 | Fable 5.1 | GPT-5.6 Sol | Gemini 3.1 Pro |
|---|---|---|---|---|
Janela de contexto | 1M tokens | 1M tokens | Não divulgado aqui | Não divulgado aqui |
Terminal-Bench-Science 0.1 | Mesmos pesos | 52,6% | 22,4% | Não divulgado |
Terminal-Bench 4.0 | 60,9% | 55,8% | 37,3% | Não divulgado |
Preço de entrada ($/M) | US$ 10 | US$ 10 | Não divulgado | Não divulgado |
Preço de saída ($/M) | US$ 50 | US$ 50 | Não divulgado | Não divulgado |
Multimodal | Texto, imagem, arquivo | Texto, imagem, arquivo | Sim | Sim |
Disponibilidade na API | Acesso restrito, somente EUA | Disponível ao público em geral | GA | GA |
Retenção de dados | Programas restritos | Padrão de 30 dias | Varia | Varia |
Observação: a própria Anthropic conduziu os números de comparação do GPT-5.6 Sol, e várias linhas não têm valores divulgados para o GPT-5.6 Sol ou o Gemini. Preencha as células restantes com fontes oficiais no momento do uso.
Claude Mythos 5.1 vs. Fable 5.1: Principais Diferenças
Essa é a comparação que mais importa, e a resposta é mais simples do que parece. Fable 5.1 e Mythos 5.1 são o mesmo modelo por baixo dos panos, e a diferença nos benchmarks reflete tarefas em que salvaguardas cibernéticas anteriores, menos precisas, entravam em ação. Em outras palavras, você não escolhe o Mythos por inteligência bruta. Você o escolhe porque as salvaguardas de produção, do contrário, bloqueariam trabalhos legítimos de cibersegurança ou biologia. Para todo o resto, o Fable 5.1 é o mesmo modelo idêntico que você já pode chamar hoje.
Onde o Mythos 5.1 Lidera e Onde Fica Atrás
Contra o modelo de ponta da OpenAI, os números publicados pela Anthropic favorecem o seu modelo. Nos quatro benchmarks em que a Anthropic publicou ambos os resultados, o Fable 5.1 superou o GPT-5.6 Sol de 6 a 30 pontos. O ponto fraco honesto é a eficiência de custo em trabalhos comuns. A $10 por milhão de tokens de entrada e $50 por milhão de tokens de saída, o Fable 5.1 custa o dobro do Claude Opus 5 antes do cache. No CursorBench, a diferença para o Opus 5 é de 3,4 pontos, em um modelo que custa o dobro. Para quem faz compras corporativas, a regra é simples: pague o valor extra somente onde uma execução falha custa mais do que a diferença de tokens.
Seja qual for o modelo de ponta que você escolher, você ainda paga pelo Claude, ChatGPT ou Gemini em dólares. A Bleap te dá 0% de taxas de câmbio nessas renovações, além de 20% de cashback fixo nos três, então um plano mensal de €20 devolve €4 a cada ciclo. Peça o cartão Bleap →
5. Melhores Casos de Uso do Claude Mythos 5.1
Pesquisa Científica e Aplicações Acadêmicas
O Mythos 5.1 existe para pesquisas técnicas de alto risco. É o modelo mais capaz da Anthropic para defesa cibernética e pesquisa em ciências biológicas, incluindo inteligência de ameaças, descoberta de vulnerabilidades, red teaming, descoberta de medicamentos e triagem de biodefesa. Os ganhos científicos são concretos. O trabalho de design de proteínas atingiu uma taxa de sucesso de quase 50%, comparado aos típicos 10 a 15%. Para laboratórios que conduzem investigações de ponta a ponta, o salto na ciência agêntica é o principal motivo para solicitar acesso.
Inteligência Empresarial e de Negócios
Para o trabalho de conhecimento em geral, o Fable 5.1 é o cavalo de batalha das empresas. A Anthropic descreve a dupla 5.1 como os modelos mais avançados do mundo para programação e trabalho de conhecimento, com capacidades de pesquisa que oferecem uma prévia de como os modelos de IA vão contribuir para o avanço científico. Implementações reais mostram o apelo das execuções longas e sem supervisão. Um engenheiro da Ramp relatou uma única execução sem supervisão de 38 horas em um problema de machine learning, que diagnosticou um resultado anterior como um artefato de rotulagem, corrigiu o problema, iniciou 6 experimentos em paralelo durante a noite e retornou com um resultado e próximos passos.
Raciocínio Avançado e Fluxos de Trabalho Agênticos
É nos pipelines agênticos que o modelo se distancia do seu antecessor. Os maiores ganhos do Fable 5.1 estão em trabalhos longos que envolvem o uso de ferramentas, mais que dobrando o desempenho do Fable 5 em ciência agêntica e quase dobrando na automação de negócios, de 17,1% para 31,4%. O objetivo do design é a autonomia sem travamentos. Descrições de desenvolvedores dizem que ele avança mais em tarefas longas, é melhor em identificar quando está travado e tem um estilo de escrita mais natural.
Casos de Uso em que um Modelo Mais Leve Pode Ser Suficiente
Nem toda tarefa exige o modelo topo de linha. A própria recomendação de roteamento da Anthropic é começar pelo mais barato. A página do modelo Fable 5.1 da Anthropic recomenda explicitamente começar com o Opus 5 para a maioria dos trabalhos. Para tarefas de alto volume e baixa complexidade, o Haiku ou o Sonnet mantêm os custos baixos. O critério de decisão é a complexidade da tarefa em relação ao orçamento de tokens: reserve o Fable e o Mythos para trabalhos de dificuldade extrema, em que uma resposta errada sai caro.
6. Especificações e capacidades principais
Janela de contexto e memória
A janela de contexto é grande e permanece igual à da geração anterior. O modelo tem uma janela de contexto de 1M de tokens e saída máxima de 128 mil tokens. Um lembrete prático de avaliadores independentes: um limite de contexto grande não é garantia de nada. Um limite de contexto amplo não garante memória perfeita nem custo baixo, então é importante medir a qualidade de recuperação, o comportamento de cache e o sucesso das tarefas com seus próprios dados.
Modalidades suportadas
As entradas são multimodais, a saída é em texto. O Fable 5.1 aceita texto, imagens e arquivos como PDFs como entrada e retorna texto. O uso de ferramentas é totalmente suportado. Ele aceita ferramentas para chamadas de função e suporta saídas estruturadas via esquema JSON em response_format. Uma mudança de comportamento que vale destacar: diferente dos modelos Claude anteriores, em que o "extended thinking" era opcional, o Fable 5.1 pensa em toda solicitação por padrão.
IDs de modelo, versionamento e endpoints de API
O ID público do modelo é simples. O ID público confirmado do modelo é claude-fable-5-1. Ele está amplamente disponível. O Fable 5.1 está disponível de forma geral como claude-fable-5-1 na API da Claude, além de AWS, Google Cloud e Microsoft Azure. O Mythos 5.1 usa os programas de verificação de acesso confiável em vez de um endpoint aberto. Uma mudança que quebra compatibilidade e merece atenção: desenvolvedores que atualizaram seus agentes relataram erros em códigos já existentes, então fixe as versões e teste antes de colocar em produção.
7. Segurança, Proteção e Alinhamento
Abordagem de Alinhamento com Constitutional AI e RLHF
O Mythos se encaixa perfeitamente na estrutura de segurança da Anthropic. O Mythos está inserido na Política de Escalonamento Responsável (Responsible Scaling Policy) e no framework de Nível de Segurança de IA (AI Safety Level) da Anthropic, e seu lançamento inicial controlado é resultado direto da avaliação que a empresa fez das capacidades do modelo em relação aos seus limites de segurança. O lançamento da versão 5.1 também trouxe uma nova camada de segurança corporativa. A Anthropic apresentou uma nova arquitetura de segurança chamada Enterprise Frontier Safeguards, criada para permitir que as organizações mantenham os dados de monitoramento dentro de sua própria infraestrutura controlada.
Salvaguardas e Comportamento de Recusa
A principal diferença entre os dois modelos está na precisão das recusas. No Fable 5.1, as salvaguardas são mais precisas: as proteções relacionadas à biologia intervêm 85% menos em pedidos inofensivos do que no lançamento original, e perguntas de uso duplo sobre biologia e química continuam sendo direcionadas aos modelos Opus, enquanto testes de invasão e geração de exploits continuam bloqueados. As intervenções relacionadas a cibersegurança também caíram, resultando em menos recusas indevidas para pesquisadores que atuam legitimamente na área de defesa.
Auditorias de Segurança e Certificações de Terceiros
A avaliação independente faz parte da história do Mythos desde o início. O UK AI Security Institute avaliou o Mythos em tarefas de hacking de nível especialista e relatou uma taxa de sucesso de 73% em tarefas que, até abril de 2025, nenhum modelo de IA conseguia concluir. A Anthropic também publicou uma documentação incomumente detalhada. A empresa divulgou um system card de 244 páginas para o modelo, sendo a primeira vez que lançou esse tipo de documentação para um modelo ainda não disponível ao público.
8. Acesso e Disponibilidade
Situação Atual de Acesso
Até o momento da publicação, o Mythos 5.1 continua com acesso restrito. O acesso permanece limitado a um pequeno grupo de organizações verificadas, disponibilizado por meio de programas de acesso confiável para um conjunto pequeno, mas crescente, de participantes. Há uma restrição geográfica rígida. O Mythos 5.1 é restrito a organizações verificadas por meio do Cyber Verification Program e do Life Sciences Verification Program, atualmente disponíveis apenas nos EUA. Já o Fable 5.1 está disponível para qualquer pessoa por meio da API padrão da Claude e das principais plataformas de nuvem.
Como Solicitar Acesso Confiável
O acesso é concedido por meio dos programas de verificação da Anthropic, e não por um console de autoatendimento. Organizações que atuam com segurança cibernética se inscrevem pelo Cyber Verification Program, enquanto equipes de pesquisa se candidatam pelo Life Sciences Verification Program. A aprovação favorece organizações com um caso de uso defensivo ou de pesquisa bem definido e práticas de segurança comprováveis, dada a sensibilidade do uso dual dessa tecnologia. No campo da biologia, a Anthropic espera abrir as inscrições para cientistas em breve.
Roteiro para a Disponibilidade Geral
O objetivo declarado da Anthropic é uma expansão gradual. O Mythos 5 foi disponibilizado a um pequeno grupo de parceiros verificados, com a meta de ampliar esse acesso de forma mais abrangente no futuro. Para expandir o acesso com segurança, a Anthropic adicionou salvaguardas extras a fim de liberar as capacidades de nível Mythos de maneira mais ampla. Hoje, o caminho de acesso geral às capacidades de nível Mythos é o Fable 5.1.
9. Retenção de Dados e Políticas de Privacidade
O tratamento de dados é mais rigoroso no nível de ponta. O Fable 5.1 exige retenção de dados por 30 dias e não está disponível com retenção zero de dados, a menos que a Anthropic autorize isso, além de não contar com o Priority Tier, que o Fable 5 tinha. Se você dependia da retenção zero de dados ou do Priority Tier para alguma carga de trabalho existente no Fable 5, planeje essa mudança antes de migrar.
O lançamento da versão 5.1 traz controles de privacidade de nível empresarial por meio de sua nova arquitetura de segurança. O sistema Enterprise Frontier Safeguards armazena dados em uma infraestrutura de nuvem controlada inteiramente pelo cliente, e não pela Anthropic, garantindo privacidade total. Para questões relacionadas à GDPR e à CCPA, compradores corporativos devem confirmar diretamente com a Anthropic a residência dos dados e os detalhes de qualquer acordo autorizado de retenção zero de dados antes da implantação, já que a retenção padrão de 30 dias pode não atender a todas as cargas de trabalho regulamentadas.
10. Conformidade Regulatória e Governança
A natureza de uso dual do Mythos já atraiu envolvimento direto do governo. Preocupações de segurança levaram o governo dos EUA a ordenar que a Anthropic suspendesse os modelos anteriores por algumas semanas. O modelo predecessor foi alvo de uma restrição ainda mais ampla. Em junho de 2026, o governo dos EUA enviou uma carta à Anthropic proibindo o acesso ao Mythos 5 e ao Fable 5 para qualquer cidadão não americano, independentemente da localização, e a Anthropic revogou o acesso a ambos os modelos para todos os clientes como resultado.
O acesso foi restaurado posteriormente com aprovação governamental, motivo pelo qual o atual programa de biologia do Mythos 5.1 é conduzido em parceria com o governo dos EUA. Para os fins do EU AI Act, um modelo com esse nível de capacidade se enquadraria nas obrigações de IA de uso geral com considerações de risco sistêmico, o que implica relatórios de transparência e registro de incidentes. Compradores corporativos em setores regulados devem tratar o system card publicado como ponto de partida para sua própria análise de conformidade, e não como a etapa final.
Rodar IA de ponta já é caro o suficiente sem precisar pagar uma taxa cambial escondida nas suas assinaturas. A Bleap cobra 0% de taxa de câmbio em ferramentas de IA cobradas em dólar e devolve 20% de cashback fixo em Claude, ChatGPT e Gemini, sem nenhuma assinatura mensal própria. Peça o cartão Bleap →
Perguntas Frequentes Sobre o Claude Mythos 5.1
O que diferencia o Claude Mythos 5.1 do Claude Opus?
O Mythos fica um nível inteiro acima do Opus na hierarquia da Anthropic. O Claude Mythos é uma nova classe de modelo acima do Opus, projetada para as tarefas de IA mais exigentes, principalmente aquelas que exigem raciocínio avançado, longas sequências de tarefas agênticas e conhecimento especializado profundo em domínios específicos. O Mythos 5.1 também traz proteções mais leves do que o Fable 5.1 (disponível ao público em geral), ajustadas especificamente para trabalhos de cibersegurança e ciências da vida.
Quanto custa o Claude Mythos 5.1 por milhão de tokens?
Os preços do Claude Mythos 5.1 começam em US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída. As leituras de cache caíram 75%, para US$ 0,25 por milhão, as gravações de cache custam US$ 12,50 na janela de 5 minutos e US$ 20 na janela de 1 hora, e a Batch API oferece 50% de desconto tanto na entrada quanto na saída.
Como o Claude Mythos 5.1 se compara ao Fable 5.1 em benchmarks?
Eles usam os mesmos pesos, então as pontuações coincidem, exceto onde as proteções diferem. No Terminal-Bench 4.0, a única linha em que o Mythos 5.1 aparece, ele obtém 60,9% contra 55,8% do Fable 5.1. Essa diferença de cinco pontos reflete tarefas em que as proteções cibernéticas do Fable intervieram, e não uma diferença na capacidade real do modelo.
Qual é o tamanho da janela de contexto do Claude Mythos 5.1?
O modelo tem uma janela de contexto de 1 milhão de tokens e um limite máximo de saída de 128 mil tokens. Isso é suficiente para documentos longos e sessões de agentes com múltiplas interações, embora a capacidade real de retenção de informações deva ser medida com seus próprios dados, e não simplesmente assumida a partir do limite anunciado.
O Claude Mythos 5.1 está disponível pela API da Anthropic?
Não de forma aberta. O Mythos 5.1 é restrito a organizações previamente aprovadas por meio do Cyber Verification Program e do Life Sciences Verification Program, disponíveis atualmente apenas nos EUA. O mesmo modelo, de forma idêntica, está disponível para todos como Fable 5.1 na API do Claude, AWS, Google Cloud e Microsoft Azure.
Para quais casos de uso o Claude Mythos 5.1 é mais indicado?
É o modelo mais capaz da Anthropic para defesa cibernética e pesquisa em ciências da vida, incluindo inteligência de ameaças, descoberta de vulnerabilidades, red teaming, descoberta de medicamentos e triagem de biodefesa. Para raciocínio geral e trabalho de conhecimento agêntico, o Fable 5.1 cobre o mesmo terreno sem a barreira de acesso. Veja a Seção 5 para o detalhamento completo.
Conclusão e Resumo
Quatro pontos resumem o Claude Mythos 5.1. Nos benchmarks, ele lidera em ciência agêntica, com o Fable 5.1 mais do que dobrando o desempenho de seu antecessor no Terminal-Bench-Science e o Mythos 5.1 na liderança em tarefas de terminal de longo prazo com 60,9%. No quesito preço, ele fica no topo da tabela, custando $10/$50 por milhão de tokens, com leituras de cache reduzidas em 75% para recompensar agentes que rodam por longos períodos. Em termos de casos de uso, ele foi feito para pesquisa em cibersegurança e ciências da vida, enquanto o Fable 5.1 cuida do trabalho de conhecimento geral. Quanto ao acesso, o Mythos continua restrito a acesso confiável e exclusivo dos EUA, então a maioria das equipes deve construir com base no Fable 5.1 ou direcionar tarefas mais baratas para o Opus 5. O modelo está evoluindo rápido, então confira o changelog oficial da Anthropic antes de colocar qualquer carga de trabalho em produção.
Seja qual for a ferramenta de IA que você escolher, pague de forma inteligente. Com o Bleap, você não paga taxas de câmbio em assinaturas em dólar, e no Claude, ChatGPT e Gemini você ganha 20% de cashback fixo em cada renovação. É um cartão Mastercard autocustodiado que você pode usar em qualquer lugar, sem nenhuma mensalidade própria.
Um jeito mais inteligente de gastar, enviar, ganhar e negociar

- Artificial Inteligence








