Blogs

Claude Mythos 5.1: benchmarks, precios, casos de uso y guía completa

7 September 2026  ·  Actualizado 9 September 2026

Gabriel Caetano

Gabriel Caetano

ARTIFICIAL INTELIGENCE

Claude Mythos 5.1: benchmarks, precios, casos de uso y guía completa

Claude Mythos 5.1 es el modelo frontier de acceso restringido de Anthropic para ciberseguridad y ciencias de la vida. Descubre sus benchmarks, precios de $10/$50, contexto de 1M de tokens, casos de uso, seguridad y comparación con Fable 5.1.

claude-mythos-5-1-benchmarks-pricing-use-cases

Claude Mythos 5.1: benchmarks, precios, casos de uso y todo lo que necesitas saber

Elegir un modelo de frontera para trabajo de investigación o seguridad serio es complicado cuando la opción más potente está bloqueada tras un formulario de solicitud. Claude Mythos 5.1 es el modelo de Anthropic de acceso restringido para trabajo en ciberseguridad y ciencias de la vida, lanzado el 1 de septiembre de 2026, con un precio de 10 $ por millón de tokens de entrada y 50 $ por millón de tokens de salida. Fable 5.1 y Mythos 5.1 son el mismo modelo con distintos niveles de salvaguardas: Fable 5.1 está disponible de forma general, mientras que Mythos 5.1 solo se puede usar a través de programas de acceso de confianza. Dicho esto, la mayoría de los equipos nunca llegará a usar Mythos directamente, así que esta guía cubre ambos.

A continuación encontrarás los benchmarks, los precios, cómo se compara con Fable 5.1 y otros modelos de frontera, los casos de uso donde más destaca, y cómo funciona realmente el acceso. Si pagas mensualmente por Claude, ChatGPT o Gemini, también te contamos la forma más inteligente de evitar perder dinero en comisiones por transacciones en el extranjero con esas suscripciones en dólares.

¿Pagas Claude cada mes en dólares desde una cuenta en euros? Con Bleap no pagas comisiones de cambio de divisa en tus suscripciones en USD y obtienes un 20% de cashback fijo en las renovaciones de Claude, ChatGPT y Gemini. Tarjeta Mastercard autocustodiada, sin suscripción propia. Consigue la tarjeta Bleap →

1. ¿Qué es Claude Mythos 5.1?

Identidad del modelo y contexto de lanzamiento

La gama de Anthropic tiene una estructura clara. Haiku, Sonnet y Opus son los modelos pequeño, mediano y grande, y el nivel de la clase Mythos se sitúa por completo por encima de Opus. La familia Claude abarca tres niveles de tamaño con nombre propio, Opus, Sonnet y Haiku, a los que se unió en junio de 2026 el nivel de clase Mythos, situado por encima de la clase Opus.

El nombre "5.1" indica una actualización puntual más que un salto generacional completo. Anthropic lanzó la actualización 5.1 el 1 de septiembre de 2026 como una versión puntual sobre Fable 5, y el precio principal no cambió, la ventana de contexto no cambió, y el identificador del modelo apenas cambió. Aun así, las mejoras de capacidad son reales, concentradas en el trabajo agéntico y científico más que en pruebas de referencia ya saturadas.

Lanzamiento por invitación y acceso restringido a organizaciones de confianza

Mythos 5.1 no es un modelo al que simplemente puedas llamar. Mythos 5.1 es idéntico al modelo Fable 5.1 pero con menos salvaguardas, y está restringido a organizaciones verificadas a través del Programa de Verificación Cibernética y el Programa de Verificación de Ciencias de la Vida, disponibles por ahora solo en EE. UU. La razón es el riesgo de doble uso. Es el modelo más capaz de Anthropic para la defensa en ciberseguridad y la investigación en ciencias de la vida, incluyendo inteligencia de amenazas, descubrimiento de vulnerabilidades, red teaming y descubrimiento de fármacos, y el acceso está limitado a un conjunto verificado de organizaciones dada la naturaleza de doble uso de estos ámbitos.

En el caso concreto de la biología, Anthropic ha puesto en marcha un programa de acceso desarrollado en colaboración con el gobierno de EE. UU. para permitir el acceso a las capacidades biológicas avanzadas de Mythos 5.1, y espera abrir pronto las inscripciones para científicos. Si no cumples los requisitos, la versión Fable 5.1, de disponibilidad general, es la gemela que realmente podrás usar.

2. Rendimiento de Claude Mythos 5.1 en los benchmarks

Puntuaciones clave de un vistazo

Como las dos variantes de 5.1 comparten pesos, la mayoría de las cifras publicadas provienen de Fable 5.1, apareciendo Mythos 5.1 solo en los casos donde la eliminación de las salvaguardas le permite puntuar más alto.

Benchmark

Puntuación

Qué mide

Terminal-Bench-Science 0.1

52,6%

Investigación científica de principio a fin

Terminal-Bench 4.0 (Mythos 5.1)

60,9%

Trabajo prolongado en terminal

GPQA Diamond

92,6%

Razonamiento científico de nivel de posgrado

SWE-bench Pro

81,2

Ingeniería de software en el mundo real

CursorBench 3.2.0

73,4%

Programación integrada en el IDE

ProofBench v1.1

100%

Demostraciones matemáticas formales

ARC-AGI-1

97,5%

Razonamiento abstracto

GPQA Diamond, el benchmark de razonamiento científico de nivel de posgrado, se sitúa en el 92,6%, lo que confirma que estas mejoras no se limitan a los flujos de trabajo de tipo agente. En matemáticas formales, Vals AI registró un 100% perfecto en ProofBench v1.1, un benchmark de demostraciones matemáticas formales, algo inédito hasta ahora en cualquier modelo de vanguardia.

Afirmaciones sobre la frontera del rendimiento

La señal más clara de progreso está en la ciencia agéntica. Terminal-Bench-Science 0.1 comprueba si un modelo es capaz de llevar a cabo una investigación científica de principio a fin, y Fable 5.1 se sitúa en el 52,6%, frente al 24,7% de Fable 5, el 29,0% de Opus 5 y el 22,4% de GPT-5.6 Sol. Eso supone duplicar el resultado en una versión menor. La puntuación más que duplicó la de Fable 5 en Terminal-Bench-Science.

La única aparición exclusiva de Mythos 5.1 muestra la brecha impulsada por las salvaguardas. Terminal-Bench 4.0 mide el trabajo en terminal de largo alcance, y es la única fila donde aparece Mythos 5.1, con un 60,9%, frente al 55,8% de Fable 5.1, el 52,3% de Opus 5, el 42,0% de Fable 5 y el 37,3% de GPT-5.6 Sol. Una advertencia honesta que merece la pena señalar: la cifra del 95,0% en SWE-bench Verified que circula ampliamente por internet pertenece a Fable 5 desde su lanzamiento en junio de 2026, y el anuncio de Anthropic sobre 5.1 no incluye una puntuación de SWE-bench, sino que destaca sobre todo los benchmarks agénticos.

Rendimiento avanzado en razonamiento y contexto largo

Los evaluadores independientes respaldan esta tendencia. Artificial Analysis sitúa a Fable 5.1 en primer lugar en su Intelligence Index con 66 puntos, ARC-AGI le otorga un 97,5% en ARC-AGI-1, y Vals AI lo coloca primero en el Vals Index. Las mejoras son desiguales de forma intencionada. Los avances son menores en las tareas en las que Fable 5 ya destacaba, como la programación del día a día, y Anthropic las midió con las salvaguardas activadas, lo que según indican probablemente reduce algunas puntuaciones. En la práctica, conviene tratar la tabla de lanzamiento como una guía orientativa y realizar tus propias pruebas antes de aplicar los cambios al tráfico de producción.

3. Precios y costes de tokens de Claude Mythos 5.1

Estructura de precios por token

El sistema de precios es sencillo e idéntico entre los dos modelos gemelos. Los precios de Claude Mythos 5.1 arrancan en 10$ por millón de tokens de entrada y 50$ por millón de tokens de salida. La verdadera historia de eficiencia está en la caché. Fable 5.1 cuesta 10,00$ por millón de tokens de entrada y 50,00$ por millón de tokens de salida, con la lectura de caché a 0,25$ por millón, la escritura de caché a 12,50$ por millón, y la escritura de caché (1h) a 20,00$ por millón. Las lecturas de caché bajaron un 75% hasta los 0,25$ por millón, y la Batch API ofrece un 50% de descuento en entrada y salida.

Niveles de coste y descuentos por volumen

Ese único cambio de cifra transforma la economía para los agentes. La lectura de caché bajó de 1,00$ a 0,25$ por millón de tokens, algo que importa porque una sesión agéntica larga vuelve a leer el mismo árbol de archivos, el mismo prompt del sistema y el mismo historial de conversación en cada paso, y la inmensa mayoría de sus tokens de entrada son aciertos de caché en lugar de texto nuevo. Anthropic expone con claridad el ahorro real. La compañía calcula que los costes facturados por token serán alrededor de un 25% más bajos para las cargas de trabajo habituales, y hasta aproximadamente un 45% más bajos para las cargas de trabajo altamente agénticas.

Dentro de la escala general de precios, Mythos y Fable ocupan la posición más alta. A fecha de 1 de septiembre de 2026, la gama queda así: Fable 5 a 10$/50$ por millón de tokens, Opus 5 a 5$/25$, Sonnet 5 a 2$/10$, y Haiku 4.5 a 1$/5$.

Consideraciones sobre el coste total de propiedad

La propia Anthropic recomienda dirigir el tráfico con cabeza antes de recurrir directamente al nivel más alto. Su propia guía de modelos aconseja empezar con Opus 5 para la mayoría de las cargas de trabajo y pasar a Fable 5.1 solo cuando Opus falle en una evaluación que realmente importe. Hay un matiz de acceso que afecta a la planificación de presupuesto: Fable 5.1 requiere una retención de datos de 30 días y no está disponible con retención cero de datos salvo que Anthropic lo autorice expresamente, y además no cuenta con Nivel Prioritario.

Nada de esto afecta a tu suscripción personal de Claude, que se factura por separado en USD. Si pagas con una tarjeta en euros, se aplica una comisión por transacción en el extranjero del 2-3% en cada renovación, un recargo que se va acumulando silenciosamente a lo largo del año. Pagar en USD al tipo de cambio real lo elimina por completo.

4. Claude Mythos 5.1 frente a los modelos frontera de la competencia

Tabla comparativa directa

Característica / Modelo

Claude Mythos 5.1

Fable 5.1

GPT-5.6 Sol

Gemini 3.1 Pro

Ventana de contexto

1M de tokens

1M de tokens

No publicado aquí

No publicado aquí

Terminal-Bench-Science 0.1

Mismos pesos

52,6%

22,4%

No publicado

Terminal-Bench 4.0

60,9%

55,8%

37,3%

No publicado

Precio de entrada ($/M)

10 $

10 $

No publicado

No publicado

Precio de salida ($/M)

50 $

50 $

No publicado

No publicado

Multimodal

Texto, imagen, archivo

Texto, imagen, archivo

Disponibilidad de la API

Acceso de confianza, solo EE. UU.

Disponibilidad general

DG

DG

Retención de datos

Programas restringidos

30 días por defecto

Variable

Variable

Nota: Anthropic elaboró por su cuenta las cifras comparativas de GPT-5.6 Sol, y varias filas no tienen datos publicados para GPT-5.6 Sol o Gemini. Completa las celdas restantes con fuentes oficiales en el momento de consultarlas.

Claude Mythos 5.1 frente a Fable 5.1: principales diferencias

Esta es la comparación que más importa, y la respuesta es más sencilla de lo que parece. Fable 5.1 y Mythos 5.1 son el mismo modelo subyacente, y la diferencia en las pruebas de referencia refleja tareas en las que salvaguardas cibernéticas anteriores, menos precisas, intervenían. Dicho de otro modo, no se elige Mythos por su inteligencia bruta. Se elige porque, de lo contrario, las salvaguardas de producción bloquearían trabajo legítimo de ciberseguridad o biología. Para todo lo demás, Fable 5.1 es el mismo modelo idéntico al que ya puedes acceder hoy.

Dónde destaca Mythos 5.1 y dónde se queda atrás

Frente a la frontera de OpenAI, los datos publicados por Anthropic favorecen a su modelo. En las cuatro pruebas de referencia donde Anthropic publicó ambos resultados, Fable 5.1 superó a GPT-5.6 Sol por entre 6 y 30 puntos. El punto débil honesto es la eficiencia de coste en el trabajo ordinario. Con 10 $ por millón de tokens de entrada y 50 $ por millón de tokens de salida, Fable 5.1 cuesta el doble que Claude Opus 5 antes de aplicar el caché. En CursorBench, la diferencia con Opus 5 es de 3,4 puntos en un modelo que cuesta el doble. Para las decisiones de compra, la regla es sencilla: paga el sobrecoste solo cuando un fallo en la ejecución cueste más que la diferencia de tokens.

Elijas el modelo de frontera que elijas, seguirás pagando Claude, ChatGPT o Gemini en dólares. Bleap te ofrece 0% de comisiones de cambio de divisa en esas renovaciones, además de un 20% de cashback plano en las tres, así que un plan mensual de 20€ te devuelve 4€ cada ciclo. Consigue la tarjeta Bleap →

5. Mejores casos de uso de Claude Mythos 5.1

Investigación científica y aplicaciones académicas

Mythos 5.1 está pensado para la investigación técnica de alto nivel. Es el modelo más capaz de Anthropic para la defensa en ciberseguridad y la investigación en ciencias de la vida, incluyendo inteligencia de amenazas, descubrimiento de vulnerabilidades, red teaming, descubrimiento de fármacos y cribado de biodefensa. Los avances científicos son tangibles: el trabajo de diseño de proteínas alcanzó una tasa de éxito cercana al 50%, frente al 10-15% habitual. Para los laboratorios que llevan a cabo investigaciones de principio a fin, este salto en ciencia agéntica es el gran motivo para solicitar acceso.

Inteligencia empresarial y de negocio

Para el trabajo de conocimiento en general, Fable 5.1 es el caballo de batalla empresarial. Anthropic define el dúo 5.1 como los modelos más avanzados del mundo para programación y trabajo de conocimiento, con capacidades de investigación que ofrecen un primer vistazo de cómo los modelos de IA contribuirán al progreso científico. Los despliegues reales demuestran el atractivo de las ejecuciones largas sin supervisión. Un ingeniero de Ramp relató una ejecución sin supervisión de 38 horas seguidas en un problema de aprendizaje automático, en la que el modelo diagnosticó que un resultado anterior era un artefacto de etiquetado, lo corrigió, puso en marcha 6 experimentos en paralelo durante la noche y volvió con un resultado y los siguientes pasos a seguir.

Razonamiento avanzado y flujos de trabajo agénticos

Es en los flujos de trabajo agénticos donde este modelo se distancia de su predecesor. Las mayores mejoras de Fable 5.1 se dan en tareas largas que requieren el uso de herramientas, más que duplicando a Fable 5 en ciencia agéntica y casi duplicándolo en automatización empresarial, pasando del 17,1% al 31,4%. El objetivo de diseño es lograr autonomía sin que el modelo se quede bloqueado. Según describen los desarrolladores, avanza más en tareas largas, detecta mejor cuándo se ha quedado atascado y tiene un estilo de escritura más natural.

Casos de uso en los que un modelo más ligero puede ser suficiente

No todas las tareas necesitan la gama alta. La propia recomendación de enrutamiento de Anthropic es empezar por lo más económico. La página del modelo Fable 5.1 de Anthropic recomienda explícitamente empezar con Opus 5 para la mayoría de los trabajos. Para tareas de gran volumen y baja complejidad, Haiku o Sonnet mantienen los costes bajos. El criterio de decisión es sopesar la complejidad de la tarea frente al presupuesto de tokens: reserva Fable y Mythos para trabajos de dificultad extrema en los que una respuesta incorrecta salga cara.

6. Especificaciones básicas y funciones

Ventana de contexto y memoria

La ventana de contexto es amplia y no ha cambiado respecto a la generación anterior. El modelo tiene una ventana de contexto de 1 millón de tokens y una salida máxima de 128.000 tokens. Un recordatorio práctico de analistas independientes: un límite de contexto grande no es garantía de nada. Un límite de contexto amplio no garantiza una recuperación perfecta ni un coste bajo, así que conviene medir la calidad de recuperación, el comportamiento de la caché y el éxito de las tareas con tus propios datos.

Modalidades admitidas

Las entradas son multimodales, la salida es texto. Fable 5.1 acepta texto, imágenes y archivos como PDF como entrada, y devuelve texto. El uso de herramientas está totalmente soportado. Admite herramientas para llamadas a funciones y admite salidas estructuradas mediante un esquema JSON en response_format. Un cambio de comportamiento a tener en cuenta: a diferencia de modelos Claude anteriores, donde el pensamiento extendido era opcional, Fable 5.1 razona en cada solicitud por defecto.

IDs de modelo, versiones y endpoints de la API

El ID de modelo público es sencillo. El ID de modelo público confirmado es claude-fable-5-1. Su disponibilidad es amplia. Fable 5.1 está disponible de forma general como claude-fable-5-1 en la API de Claude, además de en AWS, Google Cloud y Microsoft Azure. Mythos 5.1 utiliza los programas de verificación de acceso de confianza en lugar de un endpoint abierto. Un cambio disruptivo a vigilar: desarrolladores que actualizaron sus agentes informaron de que el código existente devolvía errores, así que conviene fijar versiones y probar antes de pasar a producción.

7. Seguridad, protección y alineación

Enfoque de alineación mediante Constitutional AI y RLHF

Mythos se enmarca claramente dentro del sistema de seguridad de Anthropic. Mythos se sitúa dentro de la Responsible Scaling Policy y el marco de niveles de seguridad de IA (AI Safety Level) de Anthropic, y su lanzamiento inicial controlado es consecuencia directa de la evaluación que hizo Anthropic de las capacidades del modelo en relación con sus umbrales de seguridad. El lanzamiento de la versión 5.1 también incorporó una nueva capa de seguridad empresarial. Anthropic presentó una nueva arquitectura de seguridad llamada Enterprise Frontier Safeguards, diseñada para que las organizaciones puedan conservar los datos de monitorización dentro de su propia infraestructura.

Salvaguardas y comportamiento ante negativas de respuesta

La diferencia clave entre los dos modelos gemelos está en la precisión a la hora de negarse a responder. Con Fable 5.1 las salvaguardas son más precisas: las relacionadas con biología intervienen un 85 % menos en solicitudes inofensivas que en el lanzamiento original, y las preguntas de doble uso sobre biología y química siguen derivándose a los modelos Opus, mientras que las pruebas de penetración y la generación de exploits siguen bloqueadas. Las intervenciones relacionadas con ciberseguridad también se redujeron, lo que se traduce en menos negativas injustificadas para quienes investigan con fines defensivos legítimos.

Auditorías y certificaciones de seguridad de terceros

La evaluación independiente ha formado parte de la historia de Mythos desde el principio. El UK AI Security Institute evaluó a Mythos en tareas de hacking de nivel experto y registró una tasa de éxito del 73 % en tareas que, hasta abril de 2025, ningún modelo de IA había logrado completar. Anthropic también publicó una documentación inusualmente detallada: la compañía sacó a la luz una system card de 244 páginas sobre el modelo, la primera vez que publicaba este tipo de documentación para un modelo aún no lanzado.

8. Acceso y disponibilidad

Estado actual del acceso

A fecha de esta publicación, Mythos 5.1 sigue siendo de acceso restringido. El acceso continúa limitado a un pequeño grupo de organizaciones verificadas, a través de programas de acceso de confianza dirigidos a un conjunto reducido pero en crecimiento. Existe una restricción geográfica estricta. Mythos 5.1 solo está disponible para organizaciones verificadas mediante el Programa de Verificación de Ciberseguridad y el Programa de Verificación de Ciencias de la Vida, actualmente limitados a EE. UU. Fable 5.1, en cambio, está disponible para cualquiera a través de la API estándar de Claude y las principales plataformas en la nube.

Cómo solicitar acceso de confianza

El acceso se gestiona a través de los programas de verificación de Anthropic, y no mediante una consola de autoservicio. Las organizaciones que trabajan en ciberseguridad solicitan el acceso a través del Programa de Verificación de Ciberseguridad, mientras que los equipos de investigación lo hacen a través del Programa de Verificación de Ciencias de la Vida. La aprobación favorece a las organizaciones con un caso de uso claramente defensivo o de investigación, y con prácticas de seguridad demostrables, dada la sensibilidad de su doble uso. En el ámbito de la biología, Anthropic prevé abrir próximamente la inscripción para científicos.

Hoja de ruta hacia la disponibilidad general

El objetivo declarado de Anthropic es una expansión gradual. Mythos 5 se puso a disposición de un pequeño grupo de socios verificados, con la intención de ampliar su acceso más adelante. Para ampliar el acceso de forma segura, Anthropic ha añadido salvaguardas adicionales que permitan ofrecer las capacidades de nivel Mythos a un público más amplio. Hoy por hoy, la vía de acceso general a capacidades de la categoría Mythos es Fable 5.1.

9. Retención de datos y políticas de privacidad

La gestión de datos es más estricta en el nivel frontier. Fable 5.1 requiere una retención de datos de 30 días y no está disponible con retención cero de datos a menos que Anthropic lo autorice, y no cuenta con el Priority Tier que sí tenía Fable 5. Si dependías de la retención cero de datos o del Priority Tier para una carga de trabajo existente con Fable 5, ten en cuenta este cambio antes de migrar.

La versión 5.1 sí incorpora controles de privacidad de nivel empresarial gracias a su nueva arquitectura de seguridad. El sistema Enterprise Frontier Safeguards almacena los datos en una infraestructura en la nube controlada completamente por el cliente, no por Anthropic, lo que garantiza una privacidad total. En cuanto a la exposición ante el RGPD y la CCPA, las empresas deberían confirmar directamente con Anthropic la residencia de los datos y los detalles de cualquier acuerdo autorizado de retención cero antes de implementarlo, ya que la retención predeterminada de 30 días no será adecuada para todas las cargas de trabajo sujetas a regulación.

10. Cumplimiento normativo y gobernanza

La naturaleza de doble uso de Mythos ya ha atraído la implicación directa de los gobiernos. Las preocupaciones de seguridad llevaron al gobierno de EE. UU. a ordenar a Anthropic que suspendiera los modelos anteriores durante unas semanas. Su predecesor fue objeto de una restricción aún más amplia. En junio de 2026, el gobierno estadounidense envió a Anthropic una carta prohibiendo el acceso tanto a Mythos 5 como a Fable 5 a cualquier ciudadano no estadounidense, independientemente de su ubicación, y Anthropic revocó el acceso a ambos modelos para todos los clientes como resultado.

El acceso se restableció posteriormente con la aprobación del gobierno, razón por la cual el actual programa de biología de Mythos 5.1 se lleva a cabo en colaboración con el gobierno estadounidense. A efectos de la Ley de IA de la UE, un modelo con este nivel de capacidad estaría sujeto a las obligaciones de IA de propósito general con consideraciones de riesgo sistémico, lo que implica informes de transparencia y registro de incidentes. Las empresas compradoras en sectores regulados deberían considerar la ficha del sistema publicada como el punto de partida para su propia revisión de cumplimiento, no como el punto final.

Usar IA de vanguardia ya es bastante caro como para encima pagar un impuesto oculto en divisas por tus suscripciones. Bleap no cobra comisiones de cambio de divisa en herramientas de IA facturadas en USD y te devuelve un 20% fijo en Claude, ChatGPT y Gemini, sin ninguna suscripción mensual propia. Consigue la tarjeta Bleap →

Preguntas frecuentes sobre Claude Mythos 5.1

¿En qué se diferencia Claude Mythos 5.1 de Claude Opus?

Mythos está un nivel completo por encima de Opus en la jerarquía de Anthropic. Claude Mythos es una nueva clase de modelo superior a Opus, diseñada para las tareas de IA más exigentes, especialmente aquellas que requieren razonamiento avanzado, secuencias largas de tareas agénticas y un conocimiento profundo del dominio. Mythos 5.1 también cuenta con salvaguardas más ligeras que las del Fable 5.1 disponible de forma general, ajustadas específicamente para trabajos de ciberseguridad y ciencias de la vida.

¿Cuánto cuesta Claude Mythos 5.1 por millón de tokens?

El precio de Claude Mythos 5.1 empieza en 10 $ por millón de tokens de entrada y 50 $ por millón de tokens de salida. Las lecturas de caché bajaron un 75%, hasta 0,25 $ por millón; las escrituras de caché cuestan 12,50 $ para la ventana de 5 minutos y 20 $ para la de 1 hora, y la Batch API ofrece un 50% de descuento tanto en entrada como en salida.

¿Cómo se compara Claude Mythos 5.1 con Fable 5.1 en los benchmarks?

Se trata de los mismos pesos, así que las puntuaciones coinciden salvo donde difieren las salvaguardas. En Terminal-Bench 4.0, la única prueba en la que aparece Mythos 5.1, obtiene un 60,9% frente al 55,8% de Fable 5.1. Esa diferencia de cinco puntos refleja tareas en las que intervinieron las salvaguardas de ciberseguridad de Fable, no una diferencia en la capacidad subyacente.

¿Cuál es el tamaño de la ventana de contexto de Claude Mythos 5.1?

El modelo tiene una ventana de contexto de 1M de tokens y una salida máxima de 128K tokens. Esto permite trabajar con documentos largos y sesiones de agentes con múltiples turnos, aunque la capacidad real de recuperación de información debe medirse con tus propios datos y no asumirse a partir del límite anunciado.

¿Está disponible Claude Mythos 5.1 a través de la API de Anthropic?

No de forma abierta. Mythos 5.1 está restringido a organizaciones verificadas a través del Cyber Verification Program y el Life Sciences Verification Program, disponibles actualmente solo en EE. UU. El mismo modelo, de forma idéntica, está disponible para todo el mundo como Fable 5.1 en la API de Claude, AWS, Google Cloud y Microsoft Azure.

¿Para qué casos de uso es más adecuado Claude Mythos 5.1?

Es el modelo más capaz de Anthropic para la defensa en ciberseguridad y la investigación en ciencias biológicas, incluyendo inteligencia de amenazas, descubrimiento de vulnerabilidades, red teaming, descubrimiento de fármacos y cribado de biodefensa. Para el razonamiento general y el trabajo de conocimiento agéntico, Fable 5.1 cubre el mismo terreno sin la barrera de acceso. Consulta la Sección 5 para ver el desglose completo.

Conclusión y resumen

Cuatro conclusiones resumen Claude Mythos 5.1. En cuanto a benchmarks, lidera en ciencia agéntica, con Fable 5.1 más que duplicando a su predecesor en Terminal-Bench-Science y Mythos 5.1 encabezando el trabajo en terminal de largo alcance con un 60,9%. En precios, se sitúa en lo más alto de la escala con 10$/50$ por millón de tokens, con las lecturas de caché reducidas un 75% para recompensar a los agentes que trabajan durante periodos prolongados. En cuanto a casos de uso, está diseñado para la ciberseguridad y la investigación en ciencias biológicas, mientras que Fable 5.1 se encarga del trabajo de conocimiento general. En cuanto al acceso, Mythos sigue siendo de acceso restringido y exclusivo para EE. UU., así que la mayoría de los equipos deberían construir sobre Fable 5.1 o derivar el trabajo más económico a Opus 5. El modelo evoluciona rápido, así que revisa el registro de cambios oficial de Anthropic antes de comprometerte con una carga de trabajo en producción.

Sea cual sea la herramienta de IA que elijas, paga con inteligencia. Con Bleap te olvidas de las comisiones de cambio de divisa en las suscripciones en USD, y en Claude, ChatGPT y Gemini obtienes un 20% de cashback fijo en cada renovación. Es una Mastercard autocustodiada que puedes usar en cualquier sitio, sin ninguna suscripción mensual propia.

Una forma más inteligente de gastar, enviar, ganar y operar

Imagen de la sección Puntos Clave
  • Artificial Inteligence

Artículos relacionados