Blogs

Claude Mythos 5.1: benchmarks, preços, casos de uso e guia completo

7 September 2026  ·  Atualizado 9 September 2026

Gabriel Caetano

Gabriel Caetano

ARTIFICIAL INTELIGENCE

Claude Mythos 5.1: benchmarks, preços, casos de uso e guia completo

O Claude Mythos 5.1 é o modelo frontier de acesso restrito da Anthropic para cibersegurança e ciências da vida. Descobre benchmarks, preços de $10/$50, contexto de 1M de tokens, casos de uso, segurança e comparação com o Fable 5.1.

claude-mythos-5-1-benchmarks-pricing-use-cases

Claude Mythos 5.1: Benchmarks, Preços, Casos de Uso e Tudo o que Precisa de Saber

Escolher um modelo de ponta para investigação séria ou trabalho de segurança é complicado quando a opção mais capaz está trancada atrás de um formulário de candidatura. Claude Mythos 5.1 é o modelo da Anthropic de acesso restrito para trabalho de cibersegurança e ciências da vida, lançado a 1 de setembro de 2026, com preços de 10 $ por milhão de tokens de entrada e 50 $ por milhão de tokens de saída. Fable 5.1 e Mythos 5.1 são o mesmo modelo com diferentes níveis de salvaguardas: o Fable 5.1 está disponível ao público em geral, enquanto o Mythos 5.1 só está acessível através de programas de acesso de confiança. Dito isto, a maioria das equipas nunca vai lidar diretamente com o Mythos, por isso este guia cobre ambos.

Abaixo encontra benchmarks, preços, uma comparação com o Fable 5.1 e outros modelos de ponta, os casos de uso mais fortes e como funciona o acesso na prática. Se paga mensalmente pelo Claude, ChatGPT ou Gemini, também vamos abordar a forma mais inteligente de evitar perder dinheiro com comissões de transação em moeda estrangeira nessas subscrições em USD.

Paga o Claude todos os meses em USD a partir de uma conta em euros? A Bleap cobra 0% de comissões cambiais nas suas subscrições em USD e oferece 20% de cashback fixo nas renovações do Claude, ChatGPT e Gemini. Cartão Mastercard self-custodial, sem subscrição própria. Peça já o cartão Bleap →

1. O Que É o Claude Mythos 5.1?

Identidade do Modelo e Contexto de Lançamento

A gama da Anthropic tem uma estrutura clara. Haiku, Sonnet e Opus são os modelos pequeno, médio e grande, e o nível Mythos-class situa-se inteiramente acima do Opus. A família Claude abrange três níveis de tamanho, Opus, Sonnet e Haiku, aos quais se juntou, em junho de 2026, o nível Mythos-class, que se posiciona acima da classe Opus.

A designação "5.1" indica uma atualização pontual e não um salto geracional completo. A Anthropic lançou a atualização 5.1 a 1 de setembro de 2026 como uma versão pontual sobre o Fable 5, e o preço principal não mudou, a janela de contexto não mudou, e o ID do modelo praticamente não mudou. Ainda assim, os ganhos de capacidade são reais, concentrados em trabalho agêntico e científico em vez de benchmarks de exames já saturados.

Lançamento por Convite e Acesso Restrito a Entidades de Confiança

O Mythos 5.1 não é um modelo que se possa simplesmente invocar. O Mythos 5.1 é idêntico ao Fable 5.1, mas com salvaguardas mais leves, e está restrito a organizações previamente validadas através do Cyber Verification Program e do Life Sciences Verification Program, atualmente disponível apenas nos EUA. A razão para isto é o risco de utilização dupla. É o modelo mais capaz da Anthropic para defesa em cibersegurança e investigação nas ciências da vida, incluindo inteligência de ameaças, descoberta de vulnerabilidades, red teaming e descoberta de fármacos, e o acesso é limitado a um conjunto restrito de organizações validadas, dada a natureza de dupla utilização destes domínios.

Especificamente para a área da biologia, a Anthropic criou um programa de acesso desenvolvido em parceria com o governo dos EUA para permitir o acesso às capacidades avançadas de biologia do Mythos 5.1, e espera abrir brevemente as inscrições para cientistas. Se não reunir os requisitos necessários, o Fable 5.1, esse sim disponível ao público em geral, é o modelo gémeo que efetivamente vai utilizar.

2. Desempenho do Claude Mythos 5.1 nos Benchmarks

Principais Pontuações dos Benchmarks num Relance

Como as duas variantes 5.1 partilham os mesmos pesos, a maioria dos números publicados vem do Fable 5.1, com o Mythos 5.1 a aparecer nos casos em que as salvaguardas retiradas lhe permitem pontuar mais alto.

Benchmark

Pontuação

O que mede

Terminal-Bench-Science 0.1

52,6%

Investigação científica ponta a ponta

Terminal-Bench 4.0 (Mythos 5.1)

60,9%

Trabalho de terminal de longo horizonte

GPQA Diamond

92,6%

Raciocínio científico de nível pós-graduação

SWE-bench Pro

81,2

Engenharia de software no mundo real

CursorBench 3.2.0

73,4%

Programação integrada em IDE

ProofBench v1.1

100%

Provas matemáticas formais

ARC-AGI-1

97,5%

Raciocínio abstrato

O GPQA Diamond, o benchmark de raciocínio científico de nível pós-graduação, fica-se pelos 92,6%, o que reforça que estes ganhos não se limitam a fluxos de trabalho do tipo agente. Na matemática formal, a Vals AI registou uns perfeitos 100% no ProofBench v1.1, um benchmark de provas matemáticas formais, uma primeira vez para qualquer modelo de fronteira.

Afirmações sobre a Fronteira de Desempenho

O sinal mais claro de progresso está na ciência agêntica. O Terminal-Bench-Science 0.1 testa se um modelo consegue conduzir uma investigação científica do início ao fim, e o Fable 5.1 fica nos 52,6%, contra os 24,7% do Fable 5, os 29,0% do Opus 5 e os 22,4% do GPT-5.6 Sol. Isto representa uma duplicação numa versão pontual. A pontuação mais do que duplicou o resultado do Fable 5 no Terminal-Bench-Science.

A única aparição exclusiva do Mythos 5.1 revela a diferença motivada pelas salvaguardas. O Terminal-Bench 4.0 mede trabalho de terminal de longo alcance, e é a única linha em que o Mythos 5.1 aparece com 60,9%, contra 55,8% do Fable 5.1, 52,3% do Opus 5, 42,0% do Fable 5 e 37,3% do GPT-5.6 Sol. Uma ressalva honesta a assinalar: o valor de 95,0% no SWE-bench Verified, amplamente repetido online, pertence ao Fable 5, do seu lançamento em junho de 2026, e o anúncio do 5.1 da Anthropic não apresenta uma pontuação no SWE-bench, optando antes por destacar benchmarks agênticos.

Desempenho Avançado em Raciocínio e Contexto Longo

Avaliadores independentes confirmam esta tendência. A Artificial Analysis coloca o Fable 5.1 em primeiro lugar no seu Intelligence Index, com 66 pontos, o ARC-AGI atribui-lhe 97,5% no ARC-AGI-1, e a Vals AI classifica-o em primeiro no Vals Index. Os ganhos são propositadamente desiguais. São menores nas tarefas em que o Fable 5 já tinha bom desempenho, como a programação do dia a dia, e a Anthropic mediu estes resultados com as salvaguardas ativadas, o que, segundo afirma, provavelmente reduz algumas pontuações. Na prática, encare a tabela de lançamento como um ponto de partida e faça as suas próprias avaliações antes de mudar o tráfego em produção.

3. Preços e Custos de Tokens do Claude Mythos 5.1

Estrutura de Preços dos Tokens

O sistema de preços é simples e idêntico entre os dois modelos gémeos. O Claude Mythos 5.1 começa em $10 por milhão de tokens de entrada e $50 por milhão de tokens de saída. A verdadeira história da eficiência está na cache. O Fable 5.1 custa $10,00 por milhão de tokens de entrada e $50,00 por milhão de tokens de saída, com a Leitura de Cache a $0,25 por milhão, a Escrita de Cache a $12,50 por milhão, e a Escrita de Cache (1h) a $20,00 por milhão. As leituras de cache baixaram 75% para $0,25 por milhão, e a API em Lote (Batch API) tem um desconto de 50% na entrada e na saída.

Níveis de Custo e Descontos por Volume

Esta única alteração muda por completo a economia para os agentes. A leitura de cache baixou de $1,00 para $0,25 por milhão de tokens, o que é importante porque uma sessão agêntica longa volta a ler a mesma árvore de ficheiros, o mesmo prompt de sistema e o mesmo histórico de conversa a cada passo, e a grande maioria dos seus tokens de entrada são acertos de cache (cache hits) e não texto novo. A Anthropic explica claramente as poupanças reais. A empresa estima que os custos faturados por tokens sejam cerca de 25% mais baixos para cargas de trabalho típicas e até cerca de 45% mais baixos para cargas de trabalho altamente agênticas.

Comparando com a restante gama de modelos, o Mythos e o Fable ficam no topo. A partir de 1 de setembro de 2026, a linha de produtos inclui o Fable 5 a $10/$50 por milhão de tokens, o Opus 5 a $5/$25, o Sonnet 5 a $2/$10 e o Haiku 4.5 a $1/$5.

Considerações sobre o Custo Total de Utilização

A própria Anthropic recomenda começar por outros modelos antes de recorrer ao nível mais elevado. O guia de modelos da empresa aconselha começar com o Opus 5 para a maioria das cargas de trabalho e só avançar para o Fable 5.1 quando o Opus falhar numa avaliação que seja relevante. Há uma ressalva de acesso a ter em conta no orçamento: o Fable 5.1 exige retenção de dados de 30 dias e não está disponível com retenção de dados zero, a menos que a Anthropic o autorize, além de não ter Nível de Prioridade (Priority Tier).

Nada disto afeta a tua subscrição pessoal do Claude, que é faturada separadamente em USD. Se pagares com um cartão em euros, isso acrescenta uma taxa de transação estrangeira de 2-3% em cada renovação, e essa margem vai-se acumulando silenciosamente ao longo do ano. Pagar em USD à taxa real elimina isso por completo.

4. Claude Mythos 5.1 vs. Modelos de Fronteira Concorrentes

Tabela de Comparação Direta

Funcionalidade / Modelo

Claude Mythos 5.1

Fable 5.1

GPT-5.6 Sol

Gemini 3.1 Pro

Janela de contexto

1M tokens

1M tokens

Não divulgado aqui

Não divulgado aqui

Terminal-Bench-Science 0.1

Mesmos pesos

52,6%

22,4%

Não divulgado

Terminal-Bench 4.0

60,9%

55,8%

37,3%

Não divulgado

Preço de entrada ($/M)

10 $

10 $

Não divulgado

Não divulgado

Preço de saída ($/M)

50 $

50 $

Não divulgado

Não divulgado

Multimodal

Texto, imagem, ficheiro

Texto, imagem, ficheiro

Sim

Sim

Disponibilidade da API

Acesso de confiança, apenas nos EUA

Disponível ao público em geral

DG

DG

Retenção de dados

Programas restritos

Padrão de 30 dias

Variável

Variável

Nota: A Anthropic calculou por si própria os números de comparação com o GPT-5.6 Sol, e várias linhas não têm valores publicados para o GPT-5.6 Sol ou o Gemini. Preencha as células em falta com base em fontes oficiais no momento da utilização.

Claude Mythos 5.1 vs. Fable 5.1: Principais Diferenças

Esta é a comparação que mais importa, e a resposta é mais simples do que parece. O Fable 5.1 e o Mythos 5.1 são, no fundo, o mesmo modelo, e a diferença nos benchmarks reflete tarefas em que salvaguardas de cibersegurança anteriores, menos precisas, intervinham. Ou seja, não se escolhe o Mythos pela inteligência bruta. Escolhe-se porque, de outra forma, as salvaguardas de produção bloqueariam trabalho legítimo de cibersegurança ou biologia. Para tudo o resto, o Fable 5.1 é exatamente o mesmo modelo que já se pode usar hoje.

Onde o Mythos 5.1 Se Destaca e Onde Fica Atrás

Frente ao modelo de ponta da OpenAI, os números publicados pela Anthropic favorecem o seu modelo. Nos quatro benchmarks em que a Anthropic publicou ambos os resultados, o Fable 5.1 superou o GPT-5.6 Sol entre 6 e 30 pontos. O ponto fraco honesto é a eficiência de custo em trabalho comum. A $10 por milhão de tokens de entrada e $50 por milhão de tokens de saída, o Fable 5.1 custa o dobro do Claude Opus 5 antes de aplicar caching. No CursorBench, a diferença para o Opus 5 é de 3,4 pontos, num modelo que custa o dobro. Para efeitos de aquisição, a regra é simples: só vale a pena pagar o extra quando uma execução falhada custa mais do que a diferença em tokens.

Seja qual for o modelo de ponta que escolher, continua a pagar por Claude, ChatGPT ou Gemini em dólares (USD). A Bleap oferece 0% de comissões cambiais nessas renovações, mais 20% de cashback fixo nos três, pelo que um plano mensal de 20€ devolve 4€ em cada ciclo. Peça já o cartão Bleap →

5. Melhores casos de uso do Claude Mythos 5.1

Investigação científica e aplicações académicas

O Mythos 5.1 existe para investigação técnica de alto risco. É o modelo mais capaz da Anthropic para defesa em cibersegurança e investigação nas ciências da vida, incluindo inteligência sobre ameaças, deteção de vulnerabilidades, red teaming, descoberta de fármacos e rastreio de biodefesa. Os ganhos científicos são concretos. O trabalho de design de proteínas atingiu uma taxa de sucesso próxima dos 50%, comparada com os habituais 10 a 15%. Para laboratórios que realizam investigações completas de ponta a ponta, o salto na ciência agêntica é a principal razão para pedir acesso.

Inteligência empresarial e para negócios

Para trabalho de conhecimento geral, o Fable 5.1 é o cavalo de batalha das empresas. A Anthropic apelida a dupla 5.1 de modelos mais avançados do mundo para programação e trabalho de conhecimento, com capacidades de investigação que oferecem uma primeira ideia de como os modelos de IA vão contribuir para o progresso científico. As implementações reais mostram o atrativo das execuções longas e sem supervisão. Um engenheiro da Ramp relatou uma única execução sem supervisão de 38 horas num problema de machine learning, que diagnosticou um resultado anterior como um artefacto de rotulagem, corrigiu-o, lançou 6 experiências paralelas durante a noite e regressou com um resultado e os próximos passos.

Raciocínio avançado e fluxos de trabalho agênticos

É nos pipelines agênticos que o modelo se distingue do antecessor. Os maiores ganhos do Fable 5.1 estão em tarefas longas que envolvem o uso de ferramentas, mais do que duplicando o desempenho do Fable 5 em ciência agêntica e quase duplicando-o em automação empresarial, de 17,1% para 31,4%. O objetivo de design é a autonomia sem bloqueios. As descrições dos programadores indicam que o modelo avança mais em tarefas longas, é melhor a identificar quando está bloqueado e tem um estilo de escrita mais natural.

Casos de uso em que um modelo mais leve pode ser suficiente

Nem todas as tarefas precisam do nível mais avançado. O próprio conselho de encaminhamento da Anthropic é começar por opções mais económicas. A página do modelo Fable 5.1 da Anthropic recomenda explicitamente começar com o Opus 5 para a maioria dos trabalhos. Para tarefas de grande volume e menor complexidade, o Haiku ou o Sonnet mantêm os custos controlados. O critério de decisão baseia-se na complexidade da tarefa face ao orçamento de tokens: reserve o Fable e o Mythos para trabalhos de dificuldade extrema, onde uma resposta errada sai cara.

6. Especificações e Capacidades Principais

Janela de Contexto e Memória

A janela de contexto é grande e mantém-se inalterada em relação à geração anterior. O modelo tem uma janela de contexto de 1M de tokens e um máximo de 128K tokens de output. Um aviso prático de analistas independentes: um limite de contexto elevado não é garantia de nada. Um limite de contexto grande não garante uma memorização perfeita nem custos baixos, por isso convém medir a qualidade de recuperação, o comportamento da cache e o sucesso das tarefas com os seus próprios dados.

Modalidades Suportadas

Os inputs são multimodais, o output é em texto. O Fable 5.1 aceita texto, imagens e ficheiros como PDFs como input e devolve texto. O uso de ferramentas é totalmente suportado. Aceita ferramentas para chamadas de funções e suporta outputs estruturados através de um esquema JSON em response_format. Uma mudança de comportamento a assinalar: ao contrário dos modelos Claude anteriores, em que o "extended thinking" era opcional, o Fable 5.1 pensa em todos os pedidos por defeito.

IDs de Modelo, Versionamento e Endpoints da API

O ID público do modelo é simples. O ID público confirmado do modelo é claude-fable-5-1. Está amplamente disponível. O Fable 5.1 está disponível de forma geral como claude-fable-5-1 na API da Claude, além da AWS, Google Cloud e Microsoft Azure. O Mythos 5.1 utiliza os programas de verificação de acesso fidedigno em vez de um endpoint aberto. Uma alteração significativa a ter em conta: programadores que atualizaram agentes reportaram erros em código já existente, por isso fixe as versões e teste antes de avançar para produção.

7. Segurança, Proteção e Alinhamento

Abordagem de Alinhamento com IA Constitucional e RLHF

O Mythos enquadra-se perfeitamente na estrutura de segurança da Anthropic. O Mythos insere-se na Política de Escalonamento Responsável e na estrutura de Nível de Segurança de IA da Anthropic, e o seu lançamento inicial controlado é resultado direto da avaliação feita pela Anthropic das capacidades do modelo em relação aos seus limiares de segurança. O lançamento da versão 5.1 introduziu também uma nova camada de segurança empresarial. A Anthropic apresentou uma nova arquitetura de segurança chamada Enterprise Frontier Safeguards, concebida para permitir que as organizações mantenham os dados de monitorização dentro de infraestrutura que controlam.

Salvaguardas e Comportamento de Recusa

A principal diferença entre os dois modelos gémeos está na precisão das recusas. No Fable 5.1, as salvaguardas são mais precisas: as salvaguardas relacionadas com biologia intervêm em pedidos inofensivos 85% menos vezes do que no lançamento inicial, e as questões de duplo uso em biologia e química continuam a ser encaminhadas para os modelos Opus, enquanto os testes de intrusão e a criação de exploits continuam bloqueados. As intervenções na área da cibersegurança também diminuíram, o que significa menos recusas indevidas para investigadores legítimos que trabalham em defesa.

Auditorias de Segurança e Certificações de Terceiros

A avaliação independente faz parte da história do Mythos desde o início. O UK AI Security Institute avaliou o Mythos em tarefas de hacking de nível especializado e reportou uma taxa de sucesso de 73% em tarefas que, até abril de 2025, nenhum modelo de IA conseguia concluir. A Anthropic publicou também uma documentação invulgarmente detalhada. A empresa publicou um cartão de sistema (system card) com 244 páginas para o modelo, sendo esta a primeira vez que divulgou este tipo de documentação para um modelo ainda não lançado.

8. Acesso e Disponibilidade

Estado Atual de Acesso

À data de publicação, o Mythos 5.1 continua restrito. O acesso mantém-se limitado a um pequeno conjunto de organizações previamente validadas, disponibilizado através de programas de acesso de confiança a um grupo reduzido mas em crescimento. Existe uma restrição geográfica rígida. O Mythos 5.1 está limitado a organizações validadas através do Cyber Verification Program e do Life Sciences Verification Program, atualmente disponíveis apenas nos EUA. O Fable 5.1, por outro lado, está disponível para qualquer pessoa através da API padrão da Claude e das principais plataformas cloud.

Como Solicitar Acesso de Confiança

O acesso é gerido através dos programas de verificação da Anthropic, em vez de uma consola de autoatendimento. As organizações que trabalham em cibersegurança candidatam-se através do Cyber Verification Program, enquanto as equipas de investigação se candidatam através do Life Sciences Verification Program. A aprovação favorece organizações com um caso de uso claramente defensivo ou de investigação e práticas de segurança demonstráveis, dada a sensibilidade do duplo uso. No caso da biologia, a Anthropic espera abrir brevemente as inscrições para cientistas.

Roteiro para a Disponibilidade Geral

O objetivo declarado da Anthropic é uma expansão gradual. O Mythos 5 foi disponibilizado a um pequeno grupo de parceiros validados, com o objetivo de alargar o acesso de forma mais abrangente no futuro. Para ampliar o acesso com segurança, a Anthropic acrescentou salvaguardas adicionais de modo a disponibilizar as capacidades ao nível do Mythos de forma mais generalizada. O caminho atualmente disponível ao público em geral para aceder a capacidades de nível Mythos é o Fable 5.1.

9. Retenção de Dados e Políticas de Privacidade

O tratamento de dados é mais rigoroso no nível frontier. O Fable 5.1 exige retenção de dados de 30 dias e não está disponível com retenção zero de dados, a menos que a Anthropic o autorize, além de não ter o Priority Tier que o Fable 5 tinha. Se dependia da retenção zero de dados ou do Priority Tier numa carga de trabalho existente com o Fable 5, é preciso planear essa mudança antes de migrar.

O lançamento da versão 5.1 acrescenta controlos de privacidade de nível empresarial através da sua nova arquitetura de segurança. O sistema Enterprise Frontier Safeguards armazena os dados numa infraestrutura cloud totalmente controlada pelo cliente, e não pela Anthropic, garantindo privacidade total. No que toca à exposição ao RGPD e à CCPA, as empresas compradoras devem confirmar diretamente com a Anthropic, antes da implementação, a residência dos dados e os detalhes de qualquer acordo autorizado de retenção zero de dados, uma vez que a retenção padrão de 30 dias não será adequada para todas as cargas de trabalho regulamentadas.

10. Conformidade Regulatória e Governação

A natureza de duplo uso do Mythos já provocou o envolvimento direto de governos. Preocupações de segurança levaram o governo dos EUA a ordenar à Anthropic a suspensão dos modelos anteriores durante algumas semanas. O modelo antecessor foi alvo de uma restrição ainda mais ampla. Em junho de 2026, o governo dos EUA enviou à Anthropic uma carta a proibir o acesso tanto ao Mythos 5 como ao Fable 5 a qualquer cidadão não norte-americano, independentemente da sua localização, e a Anthropic revogou o acesso a ambos os modelos para todos os clientes como consequência.

O acesso foi mais tarde restabelecido com a aprovação do governo, razão pela qual o atual programa de biologia do Mythos 5.1 é conduzido em parceria com o governo dos EUA. Para efeitos da Lei da IA da UE, um modelo com este nível de capacidade enquadrar-se-ia nas obrigações aplicáveis à IA de finalidade geral com considerações de risco sistémico, o que implica relatórios de transparência e registo de incidentes. As empresas compradoras em setores regulados devem encarar o system card publicado como o ponto de partida para a sua própria revisão de conformidade, e não como o ponto final.

Utilizar IA de ponta já é dispendioso o suficiente sem ainda pagar uma taxa cambial oculta nas suas subscrições. A Bleap não cobra taxas de câmbio em ferramentas de IA faturadas em USD e devolve um cashback fixo de 20% em Claude, ChatGPT e Gemini, sem qualquer mensalidade própria. Obtenha o cartão Bleap →

Perguntas Frequentes sobre o Claude Mythos 5.1

O que distingue o Claude Mythos 5.1 do Claude Opus?

O Mythos situa-se um nível inteiro acima do Opus na hierarquia da Anthropic. O Claude Mythos é uma nova classe de modelo superior ao Opus, concebida para as tarefas de IA mais exigentes, sobretudo as que requerem raciocínio avançado, longas sequências de tarefas agênticas e um conhecimento profundo de domínios específicos. O Mythos 5.1 tem também salvaguardas mais leves do que o Fable 5.1, disponível ao público em geral, tendo sido afinado especificamente para trabalho em cibersegurança e ciências da vida.

Quanto custa o Claude Mythos 5.1 por milhão de tokens?

Os preços do Claude Mythos 5.1 começam nos $10 por milhão de tokens de entrada e $50 por milhão de tokens de saída. As leituras de cache baixaram 75%, para $0,25 por milhão, as escritas de cache custam $12,50 na janela de 5 minutos e $20 na janela de 1 hora, e a Batch API tem um desconto de 50% tanto na entrada como na saída.

Como se compara o Claude Mythos 5.1 ao Fable 5.1 nos testes de referência?

Tratam-se dos mesmos pesos, por isso as pontuações coincidem, exceto onde as salvaguardas diferem. No Terminal-Bench 4.0, a única linha em que o Mythos 5.1 aparece, obtém 60,9% face aos 55,8% do Fable 5.1. A diferença de cinco pontos reflete tarefas em que as salvaguardas de ciber do Fable interviram, e não uma diferença na capacidade subjacente.

Qual é o tamanho da janela de contexto do Claude Mythos 5.1?

O modelo tem uma janela de contexto de 1M de tokens e um máximo de 128K tokens de saída. Isto permite trabalhar com documentos longos e sessões de agentes com múltiplas trocas, embora a capacidade de retenção real deva ser avaliada com os seus próprios dados, e não simplesmente assumida a partir do limite anunciado.

O Claude Mythos 5.1 está disponível através da API da Anthropic?

Não de forma aberta. O Mythos 5.1 está restrito a organizações previamente aprovadas através do Cyber Verification Program e do Life Sciences Verification Program, atualmente apenas nos EUA. O modelo idêntico está disponível para todos como Fable 5.1 na API do Claude, na AWS, no Google Cloud e no Microsoft Azure.

Para que casos de uso é o Claude Mythos 5.1 mais indicado?

É o modelo mais capaz da Anthropic para defesa em cibersegurança e investigação em ciências da vida, incluindo threat intelligence, deteção de vulnerabilidades, red teaming, descoberta de fármacos e triagem de biodefesa. Para raciocínio geral e trabalho de conhecimento agêntico, o Fable 5.1 cobre o mesmo terreno sem a barreira de acesso. Consulta a Secção 5 para a explicação completa.

Conclusão e Resumo

Quatro conclusões resumem o Claude Mythos 5.1. Nos benchmarks, lidera em ciência agêntica, com o Fable 5.1 a mais do que duplicar o desempenho do antecessor no Terminal-Bench-Science e o Mythos 5.1 a liderar o trabalho de terminal de longo alcance com 60,9%. No preço, situa-se no topo da tabela, a 10$/50$ por milhão de tokens, com as leituras de cache reduzidas em 75% para recompensar agentes de execução prolongada. Nos casos de uso, foi construído para cibersegurança e investigação em ciências da vida, enquanto o Fable 5.1 trata do trabalho de conhecimento geral. No acesso, o Mythos mantém-se de acesso restrito e exclusivo dos EUA, pelo que a maioria das equipas deve optar pelo Fable 5.1 ou encaminhar o trabalho mais económico para o Opus 5. O modelo está a evoluir rapidamente, por isso confirma o changelog oficial da Anthropic antes de o colocar em produção.

Seja qual for a ferramenta de IA em que decidas apostar, paga de forma inteligente. Com a Bleap evitas as comissões cambiais nas subscrições em USD e, no Claude, ChatGPT e Gemini, ganhas um cashback fixo de 20% em cada renovação. É um Mastercard self-custodial que podes usar em qualquer lado, sem qualquer subscrição mensal própria.

Uma forma mais inteligente de gastar, enviar, ganhar e negociar

Imagem da seção Principais Conclusões
  • Artificial Inteligence

Artigos relacionados