Claude Mythos 5.1: benchmarks, precios, casos de uso y guía completa
7 September 2026 · Actualizado 9 September 2026

Gabriel Caetano
ARTIFICIAL INTELIGENCE
Claude Mythos 5.1: benchmarks, precios, casos de uso y guía completa
Claude Mythos 5.1 es el modelo frontier de acceso restringido de Anthropic para ciberseguridad y ciencias de la vida. Conoce sus benchmarks, precios de $10/$50, contexto de 1M de tokens, casos de uso, seguridad y comparación con Fable 5.1.

Claude Mythos 5.1: Guía Completa con Benchmarks, Precios, Casos de Uso y Todo lo que Necesitas Saber
Elegir un modelo de vanguardia para trabajo serio de investigación o seguridad es complicado cuando la opción más potente está bloqueada detrás de un formulario de solicitud. Claude Mythos 5.1 es el modelo de acceso restringido de Anthropic para trabajo de ciberseguridad y ciencias de la vida, lanzado el 1 de septiembre de 2026, con un precio de $10 dólares por millón de tokens de entrada y $50 dólares por millón de tokens de salida. Fable 5.1 y Mythos 5.1 son el mismo modelo pero con distintos niveles de restricciones: Fable 5.1 está disponible para todo público, mientras que Mythos 5.1 solo se puede conseguir mediante programas de acceso confiable. Dicho esto, la mayoría de los equipos nunca va a usar Mythos directamente, así que esta guía cubre ambos.
Aquí encontrarás los benchmarks, precios, cómo se compara con Fable 5.1 y otros modelos de vanguardia, los mejores casos de uso, y cómo funciona realmente el acceso. Si pagas mensualmente por Claude, ChatGPT o Gemini, también te contamos la forma más inteligente de evitar perder dinero por comisiones de conversión de divisas en esas suscripciones en dólares.
¿Pagas Claude cada mes en dólares desde una cuenta en euros? Con Bleap no pagas comisiones de cambio de divisa en tus suscripciones en USD y obtienes un cashback plano del 20% en las renovaciones de Claude, ChatGPT y Gemini. Mastercard autocustodiada, sin suscripción propia. Consigue la tarjeta Bleap →
1. ¿Qué es Claude Mythos 5.1?
Identidad del modelo y contexto de lanzamiento
La línea de Anthropic tiene una estructura clara. Haiku, Sonnet y Opus son los modelos chico, mediano y grande, y el nivel Mythos se ubica completamente por encima de Opus. La familia Claude abarca tres niveles con nombre propio, Opus, Sonnet y Haiku, a los que se sumó en junio de 2026 el nivel Mythos, que queda por encima de la clase Opus.
El nombre "5.1" indica una actualización puntual y no un salto generacional completo. Anthropic lanzó la actualización 5.1 el 1 de septiembre de 2026 como un release puntual sobre Fable 5, y el precio principal no cambió, la ventana de contexto no cambió, y el ID del modelo prácticamente tampoco. Aun así, las mejoras en capacidades son reales, concentradas en trabajo agéntico y científico más que en benchmarks de exámenes ya saturados.
Lanzamiento solo por invitación y acceso confiable
Mythos 5.1 no es un modelo al que simplemente puedas llamar. Mythos 5.1 es idéntico al modelo Fable 5.1 pero con salvaguardas más ligeras, y está restringido a organizaciones verificadas a través del Programa de Verificación Cibernética y el Programa de Verificación de Ciencias de la Vida, por ahora disponible solo en Estados Unidos. La razón es el riesgo de doble uso. Es el modelo más capaz de Anthropic para defensa en ciberseguridad e investigación en ciencias de la vida, incluyendo inteligencia de amenazas, descubrimiento de vulnerabilidades, red teaming y descubrimiento de fármacos, y el acceso está limitado a un conjunto verificado de organizaciones dada la naturaleza de doble uso de estos ámbitos.
En el caso específico de biología, Anthropic creó un programa de acceso desarrollado en colaboración con el gobierno de Estados Unidos para habilitar el acceso a las capacidades avanzadas de biología de Mythos 5.1, y espera abrir pronto las inscripciones para científicos. Si no calificas, Fable 5.1, disponible de forma general, es el modelo gemelo que en realidad vas a usar.
2. Rendimiento de Claude Mythos 5.1 en Benchmarks
Puntajes clave de benchmarks de un vistazo
Como las dos variantes de 5.1 comparten los mismos pesos, la mayoría de las cifras publicadas provienen de Fable 5.1, y Mythos 5.1 aparece en los casos donde las salvaguardas reducidas le permiten obtener puntajes más altos.
Benchmark | Puntaje | Qué mide |
|---|---|---|
Terminal-Bench-Science 0.1 | 52.6% | Investigación científica de principio a fin |
Terminal-Bench 4.0 (Mythos 5.1) | 60.9% | Trabajo en terminal de largo alcance |
GPQA Diamond | 92.6% | Razonamiento científico de nivel posgrado |
SWE-bench Pro | 81.2 | Ingeniería de software del mundo real |
CursorBench 3.2.0 | 73.4% | Programación integrada en IDE |
ProofBench v1.1 | 100% | Demostraciones matemáticas formales |
ARC-AGI-1 | 97.5% | Razonamiento abstracto |
GPQA Diamond, el benchmark de razonamiento científico de nivel posgrado, registra 92.6%, lo que confirma que estas mejoras no se limitan solo a flujos de trabajo tipo agente. En matemáticas formales, Vals AI registró un perfecto 100% en ProofBench v1.1, un benchmark de demostraciones matemáticas formales, algo nunca antes logrado por ningún modelo de vanguardia.
Afirmaciones sobre la frontera de rendimiento
La señal más clara de avance está en la ciencia con agentes. Terminal-Bench-Science 0.1 evalúa si un modelo puede llevar a cabo una investigación científica de principio a fin, y Fable 5.1 llega a 52.6%, frente al 24.7% de Fable 5, el 29.0% de Opus 5 y el 22.4% de GPT-5.6 Sol. Eso es duplicar el puntaje en una versión menor (punto release). El puntaje más que duplicó el de Fable 5 en Terminal-Bench-Science.
La única aparición exclusiva de Mythos 5.1 muestra la brecha impulsada por las medidas de seguridad. Terminal-Bench 4.0 mide trabajo en terminal de largo alcance, y es la única fila donde Mythos 5.1 aparece con 60.9%, contra el 55.8% de Fable 5.1, el 52.3% de Opus 5, el 42.0% de Fable 5 y el 37.3% de GPT-5.6 Sol. Vale la pena mencionar una advertencia honesta: la cifra de 95.0% en SWE-bench Verified que tanto se repite en línea corresponde a Fable 5 desde su lanzamiento en junio de 2026, y el anuncio de la versión 5.1 de Anthropic no reporta un puntaje de SWE-bench, sino que se enfoca en benchmarks de tipo agéntico.
Razonamiento avanzado y desempeño en contexto largo
Los evaluadores independientes respaldan esta tendencia. Artificial Analysis ubica a Fable 5.1 en primer lugar en su Intelligence Index con 66 puntos, ARC-AGI lo coloca en 97.5% en ARC-AGI-1, y Vals AI lo pone en primer lugar en el Vals Index. Las mejoras son desiguales por diseño. Los avances son menores en las tareas en las que Fable 5 ya tenía buen desempeño, como la programación cotidiana, y Anthropic midió esto con las medidas de seguridad activadas, lo cual, según indican, probablemente reduce algunos puntajes. En la práctica, toma la tabla de lanzamiento como una referencia general y corre tus propias evaluaciones antes de cambiar el tráfico de producción.
3. Precios y costos de tokens de Claude Mythos 5.1
Estructura de precios por token
Los precios son sencillos e idénticos entre los modelos gemelos. El precio de Claude Mythos 5.1 comienza en $10 por millón de tokens de entrada y $50 por millón de tokens de salida. La verdadera eficiencia está en el caché. Fable 5.1 cuesta $10.00 por millón de tokens de entrada y $50.00 por millón de tokens de salida, con lectura de caché a $0.25 por millón, escritura de caché a $12.50 por millón, y escritura de caché (1h) a $20.00 por millón. Las lecturas de caché bajaron 75% hasta $0.25 por millón, y la API por lotes (Batch API) tiene un descuento del 50% en entrada y salida.
Niveles de costo y descuentos por volumen
Ese único cambio en la lectura de caché transforma la economía para los agentes. La lectura de caché bajó de $1.00 a $0.25 por millón de tokens, algo que importa mucho porque una sesión agéntica larga vuelve a leer el mismo árbol de archivos, el prompt del sistema y el historial de la conversación en cada paso, y la gran mayoría de sus tokens de entrada son aciertos de caché en lugar de texto nuevo. Anthropic explica con claridad el ahorro real. Anthropic estima que los costos facturados por token serán alrededor de 25% más bajos para cargas de trabajo típicas, y hasta aproximadamente 45% más bajos para cargas de trabajo altamente agénticas.
Dentro del panorama más amplio, Mythos y Fable se ubican en la cima. La alineación al 1 de septiembre de 2026 queda así: Fable 5 a $10/$50 por millón de tokens, Opus 5 a $5/$25, Sonnet 5 a $2/$10, y Haiku 4.5 a $1/$5.
Consideraciones sobre el costo total de propiedad
El propio Anthropic recomienda evaluar bien antes de recurrir al nivel superior. La guía oficial de modelos de la empresa sugiere empezar con Opus 5 para la mayoría de las cargas de trabajo y pasar a Fable 5.1 solo cuando Opus falle en una evaluación que realmente importe. Hay una advertencia sobre el acceso que afecta la planeación de presupuesto: Fable 5.1 requiere retención de datos de 30 días y no está disponible bajo retención cero de datos, a menos que Anthropic lo autorice, y tampoco cuenta con Nivel Prioritario (Priority Tier).
Nada de esto afecta tu suscripción personal de Claude, que se factura por separado en dólares. Si pagas con una tarjeta en euros, se te suma un cargo por transacción extranjera de 2-3% en cada renovación, y ese sobrecosto se va acumulando a lo largo del año sin que te des cuenta. Pagar en USD al tipo de cambio real elimina ese cargo por completo.
4. Claude Mythos 5.1 frente a los modelos frontera de la competencia
Tabla comparativa cara a cara
Característica / Modelo | Claude Mythos 5.1 | Fable 5.1 | GPT-5.6 Sol | Gemini 3.1 Pro |
|---|---|---|---|---|
Ventana de contexto | 1M tokens | 1M tokens | No publicado aquí | No publicado aquí |
Terminal-Bench-Science 0.1 | Mismos pesos | 52.6% | 22.4% | No publicado |
Terminal-Bench 4.0 | 60.9% | 55.8% | 37.3% | No publicado |
Precio de entrada ($/M) | $10 | $10 | No publicado | No publicado |
Precio de salida ($/M) | $50 | $50 | No publicado | No publicado |
Multimodal | Texto, imagen, archivo | Texto, imagen, archivo | Sí | Sí |
Disponibilidad de la API | Acceso confiable, solo EE. UU. | Disponibilidad general | GA | GA |
Retención de datos | Programas restringidos | 30 días por defecto | Varía | Varía |
Nota: Anthropic obtuvo por su cuenta las cifras de comparación de GPT-5.6 Sol, y varias filas no tienen cifras publicadas de GPT-5.6 Sol o Gemini. Completa las celdas restantes con fuentes oficiales al momento de usar esta información.
Claude Mythos 5.1 frente a Fable 5.1: diferenciadores clave
Esta es la comparación que más importa, y la respuesta es más sencilla de lo que parece. Fable 5.1 y Mythos 5.1 son en el fondo el mismo modelo, y la diferencia en los benchmarks refleja tareas donde intervinieron salvaguardas cibernéticas anteriores y menos precisas. En otras palabras, no eliges Mythos por inteligencia bruta. Lo eliges porque, de otro modo, las salvaguardas de producción bloquearían trabajo legítimo de ciberseguridad o biología. Para todo lo demás, Fable 5.1 es el mismo modelo idéntico que ya puedes usar hoy.
Dónde Mythos 5.1 Va a la Cabeza y Dónde Se Queda Atrás
Frente a la frontera de OpenAI, las cifras publicadas por Anthropic favorecen a su modelo. En los cuatro benchmarks donde Anthropic publicó ambos resultados, Fable 5.1 superó a GPT-5.6 Sol por 6 a 30 puntos. La debilidad honesta está en la eficiencia de costos para trabajo ordinario. Con $10 por millón de tokens de entrada y $50 por millón de tokens de salida, Fable 5.1 cuesta el doble que Claude Opus 5 antes del caching. En CursorBench, la diferencia con Opus 5 es de 3.4 puntos en un modelo que cuesta el doble. Para temas de compras, la regla es simple: paga el extra solo cuando una corrida fallida cueste más que la diferencia en tokens.
Sin importar qué modelo de frontera elijas, de todos modos pagas por Claude, ChatGPT o Gemini en dólares. Bleap te da 0% de comisiones por tipo de cambio en esas renovaciones, más un cashback plano del 20% en las tres, así que un plan mensual de €20 te regresa €4 en cada ciclo. Consigue la tarjeta Bleap →
5. Mejores casos de uso de Claude Mythos 5.1
Investigación científica y aplicaciones académicas
Mythos 5.1 fue creado para investigación técnica de alto riesgo. Es el modelo más capaz de Anthropic para defensa en ciberseguridad e investigación en ciencias de la vida, lo que incluye inteligencia de amenazas, descubrimiento de vulnerabilidades, red teaming, descubrimiento de fármacos y detección de biodefensa. Los avances científicos son concretos. El trabajo de diseño de proteínas alcanzó una tasa de éxito de casi 50%, comparado con el 10 a 15% habitual. Para los laboratorios que corren investigaciones de principio a fin, el salto en ciencia agéntica es la razón principal para solicitar acceso.
Inteligencia empresarial y de negocios
Para el trabajo de conocimiento general, Fable 5.1 es el caballo de batalla empresarial. Anthropic describe al par 5.1 como los modelos más avanzados del mundo para programación y trabajo de conocimiento, con capacidades de investigación que ofrecen un primer vistazo de cómo los modelos de IA contribuirán al progreso científico. Los despliegues reales muestran el atractivo de las ejecuciones largas sin supervisión. Un ingeniero de Ramp reportó una sola ejecución de 38 horas sin supervisión en un problema de machine learning, en la que el modelo diagnosticó que un resultado anterior era un artefacto de etiquetado, lo corrigió, lanzó 6 experimentos en paralelo durante la noche, y regresó con un resultado y los siguientes pasos a seguir.
Razonamiento avanzado y flujos de trabajo agénticos
Los pipelines agénticos son donde el modelo se distingue de su predecesor. Las mayores mejoras de Fable 5.1 están en el trabajo largo que usa herramientas, más que duplicando a Fable 5 en ciencia agéntica y casi duplicándolo en automatización de negocios, pasando de 17.1% a 31.4%. El objetivo de diseño es lograr autonomía sin quedarse atorado. Las descripciones de los desarrolladores dicen que avanza más en tareas largas, es mejor para identificar cuándo se estancó, y tiene un estilo de escritura más natural.
Casos de uso donde un modelo más ligero puede ser suficiente
No todas las tareas necesitan el nivel más alto. La propia recomendación de enrutamiento de Anthropic es empezar por lo más económico. La página del modelo Fable 5.1 de Anthropic recomienda explícitamente empezar con Opus 5 para la mayoría de los trabajos. Para tareas de alto volumen y menor complejidad, Haiku o Sonnet mantienen los costos bajos. El criterio de decisión es la complejidad de la tarea contra el presupuesto de tokens: reserva Fable y Mythos para trabajos de dificultad extrema, donde una respuesta equivocada sale cara.
6. Especificaciones y capacidades principales
Ventana de contexto y memoria
La ventana de contexto es amplia y no cambió respecto a la generación anterior. El modelo tiene una ventana de contexto de 1M de tokens y un máximo de salida de 128K tokens. Un recordatorio práctico de revisores independientes: un límite de contexto grande no es garantía de nada. Un límite de contexto amplio no garantiza un recall perfecto ni un costo bajo, así que mide la calidad de recuperación, el comportamiento de la caché y el éxito de la tarea con tus propios datos.
Modalidades compatibles
Las entradas son multimodales, la salida es texto. Fable 5.1 acepta texto, imágenes y archivos como PDFs como entrada, y devuelve texto. El uso de herramientas es totalmente compatible. Acepta herramientas para llamadas a funciones y soporta salidas estructuradas mediante un esquema JSON en response_format. Vale la pena mencionar un cambio de comportamiento: a diferencia de modelos anteriores de Claude, donde el pensamiento extendido era opcional, Fable 5.1 piensa en cada solicitud por defecto.
IDs de modelo, versiones y endpoints de la API
El ID público del modelo es sencillo. El ID público confirmado del modelo es claude-fable-5-1. Está ampliamente disponible. Fable 5.1 está disponible de forma general como claude-fable-5-1 en la API de Claude, además de AWS, Google Cloud y Microsoft Azure. Mythos 5.1 usa los programas de verificación de acceso confiable en lugar de un endpoint abierto. Un cambio importante a tener en cuenta: desarrolladores que actualizaron sus agentes reportaron errores en código que ya funcionaba, así que fija las versiones y prueba antes de pasar a producción.
7. Seguridad, Protección y Alineación
Enfoque de alineación mediante IA Constitucional y RLHF
Mythos encaja perfectamente dentro del marco de seguridad de Anthropic. Mythos forma parte de la Política de Escalamiento Responsable (Responsible Scaling Policy) y del marco de Nivel de Seguridad de IA de Anthropic, y su lanzamiento inicial controlado es resultado directo de la evaluación que hizo Anthropic sobre las capacidades del modelo en relación con sus umbrales de seguridad. La versión 5.1 también trajo consigo una nueva capa de seguridad empresarial. Anthropic presentó una nueva arquitectura de seguridad llamada Enterprise Frontier Safeguards, diseñada para que las organizaciones puedan conservar los datos de monitoreo dentro de su propia infraestructura.
Salvaguardas y comportamiento de rechazo
La diferencia principal entre ambos gemelos está en la precisión de sus rechazos. Con Fable 5.1, las salvaguardas son más precisas: las medidas de seguridad en temas de biología intervienen un 85% menos en solicitudes inofensivas comparado con el lanzamiento inicial, y las preguntas de doble uso relacionadas con biología y química siguen dirigiéndose a los modelos Opus, mientras que las pruebas de penetración y la generación de exploits siguen bloqueadas por completo. Las intervenciones en temas de ciberseguridad también bajaron, lo que significa menos rechazos injustificados para quienes investigan con fines defensivos legítimos.
Auditorías de seguridad y certificaciones de terceros
La evaluación independiente ha sido parte de la historia de Mythos desde el principio. El UK AI Security Institute evaluó a Mythos en tareas de hacking de nivel experto y reportó una tasa de éxito del 73% en tareas que, hasta abril de 2025, ningún modelo de IA había logrado completar. Anthropic también publicó documentación con un nivel de detalle poco común. La empresa publicó una ficha técnica del sistema (system card) de 244 páginas para el modelo, siendo esta la primera vez que se publica este tipo de documentación para un modelo que aún no salía al público.
8. Acceso y disponibilidad
Estado actual del acceso
Al momento de esta publicación, Mythos 5.1 sigue siendo de acceso restringido. El acceso se limita a un pequeño grupo de organizaciones verificadas, disponible a través de programas de acceso confiable para un conjunto reducido pero en crecimiento. Existe una restricción geográfica estricta. Mythos 5.1 está limitado a organizaciones verificadas mediante el Programa de Verificación Cibernética y el Programa de Verificación en Ciencias de la Vida, actualmente disponibles solo en Estados Unidos. Fable 5.1, en cambio, está disponible para cualquiera a través de la API estándar de Claude y las principales plataformas en la nube.
Cómo aplicar para obtener acceso confiable
El acceso se gestiona a través de los programas de verificación de Anthropic, en lugar de una consola de autoservicio. Las organizaciones que trabajan en ciberseguridad pueden aplicar a través del Programa de Verificación Cibernética, mientras que los equipos de investigación lo hacen mediante el Programa de Verificación en Ciencias de la Vida. La aprobación favorece a las organizaciones que tienen un caso de uso claro, ya sea defensivo o de investigación, y que pueden demostrar buenas prácticas de seguridad, dada la sensibilidad de este tipo de tecnología de doble uso. Para el área de biología, Anthropic espera abrir pronto la inscripción para científicos.
Plan hacia la disponibilidad general
El objetivo declarado de Anthropic es una expansión gradual. Mythos 5 se puso a disposición de un pequeño grupo de socios verificados, con la meta de abrirlo más ampliamente en el futuro. Para ampliar el acceso de forma segura, Anthropic incorporó medidas de seguridad adicionales que permitirán liberar las capacidades de nivel Mythos a un público más amplio. Hoy en día, la vía de acceso general a capacidades de nivel Mythos es Fable 5.1.
9. Retención de Datos y Políticas de Privacidad
El manejo de datos es más estricto en el nivel frontera. Fable 5.1 requiere una retención de datos de 30 días y no está disponible con retención cero de datos a menos que Anthropic lo autorice, además de que no cuenta con Nivel Prioritario, algo que Fable 5 sí tenía. Si dependías de la retención cero de datos o del Nivel Prioritario para algún flujo de trabajo existente con Fable 5, es importante que planees ese cambio antes de migrar.
El lanzamiento de la versión 5.1 sí incorpora controles de privacidad de nivel empresarial gracias a su nueva arquitectura de seguridad. El sistema Enterprise Frontier Safeguards almacena los datos en una infraestructura en la nube controlada totalmente por el cliente, no por Anthropic, lo que le da al cliente privacidad total. En cuanto a temas de GDPR y CCPA, las empresas que estén evaluando esta opción deben confirmar directamente con Anthropic la residencia de los datos y los detalles de cualquier acuerdo autorizado de retención cero de datos antes de implementarlo, ya que la retención predeterminada de 30 días no será adecuada para todos los flujos de trabajo sujetos a regulación.
10. Cumplimiento normativo y gobernanza
La naturaleza de doble uso de Mythos ya ha atraído la intervención directa de gobiernos. Por razones de seguridad, el gobierno de EE. UU. le ordenó a Anthropic suspender los modelos anteriores durante algunas semanas. Su predecesor estuvo sujeto a una restricción aún más amplia. En junio de 2026, el gobierno de EE. UU. le envió una carta a Anthropic prohibiendo el acceso tanto a Mythos 5 como a Fable 5 para cualquier persona que no fuera ciudadana estadounidense, sin importar su ubicación, y como resultado Anthropic revocó el acceso a ambos modelos para todos sus clientes.
El acceso se restableció más tarde con aprobación gubernamental, razón por la cual el programa actual de biología de Mythos 5.1 se lleva a cabo en colaboración con el gobierno de EE. UU. Para efectos de la Ley de IA de la UE, un modelo con este nivel de capacidad quedaría sujeto a las obligaciones para IA de propósito general con consideraciones de riesgo sistémico, lo que implica reportes de transparencia y registro de incidentes. Las empresas compradoras en sectores regulados deberían tomar la ficha técnica del sistema publicada como punto de partida para su propia revisión de cumplimiento, y no como el punto final.
Ya de por sí operar IA de vanguardia sale caro, como para encima pagar un impuesto cambiario oculto en tus suscripciones. Bleap cobra 0% de comisiones cambiarias en herramientas de IA facturadas en dólares y te regresa un 20% de cashback plano en Claude, ChatGPT y Gemini, sin ninguna suscripción mensual propia. Consigue la tarjeta Bleap →
Preguntas frecuentes sobre Claude Mythos 5.1
¿Qué hace diferente a Claude Mythos 5.1 de Claude Opus?
Mythos está un nivel completo por encima de Opus en la jerarquía de Anthropic. Claude Mythos es una nueva clase de modelo por encima de Opus, diseñada para las tareas de IA más exigentes, en particular aquellas que requieren razonamiento avanzado, secuencias largas de tareas agénticas y un conocimiento profundo de dominios específicos. Mythos 5.1 también cuenta con protecciones más ligeras que Fable 5.1, el modelo disponible al público en general, ajustadas específicamente para trabajos de ciberseguridad y ciencias de la vida.
¿Cuánto cuesta Claude Mythos 5.1 por millón de tokens?
El precio de Claude Mythos 5.1 comienza en $10 dólares por millón de tokens de entrada y $50 dólares por millón de tokens de salida. Las lecturas de caché bajaron 75%, a $0.25 dólares por millón; las escrituras de caché cuestan $12.50 dólares para la ventana de 5 minutos y $20 dólares para la de 1 hora, y la API por lotes (Batch API) tiene un descuento del 50% tanto en entrada como en salida.
¿Cómo se compara Claude Mythos 5.1 con Fable 5.1 en las pruebas de rendimiento?
Son los mismos pesos del modelo, así que las puntuaciones coinciden excepto donde las protecciones difieren. En Terminal-Bench 4.0, la única prueba donde aparece Mythos 5.1, obtiene 60.9% frente al 55.8% de Fable 5.1. Esa diferencia de cinco puntos refleja las tareas donde intervinieron las protecciones de ciberseguridad de Fable, no una diferencia en la capacidad real del modelo.
¿Cuál es el tamaño de la ventana de contexto de Claude Mythos 5.1?
El modelo tiene una ventana de contexto de 1 millón de tokens y una salida máxima de 128K tokens. Esto permite trabajar con documentos largos y sesiones de agentes con múltiples turnos, aunque la capacidad real de recordar información debería medirse con tus propios datos y no asumirse solo por el límite anunciado.
¿Claude Mythos 5.1 está disponible a través de la API de Anthropic?
No de forma abierta. Mythos 5.1 está restringido a organizaciones verificadas a través del Programa de Verificación Cibernética y el Programa de Verificación en Ciencias de la Vida, disponible por ahora solo en Estados Unidos. El mismo modelo, de forma idéntica, está disponible para todos como Fable 5.1 en la API de Claude, AWS, Google Cloud y Microsoft Azure.
¿Para qué casos de uso es más adecuado Claude Mythos 5.1?
Es el modelo más capaz de Anthropic para defensa en ciberseguridad e investigación en ciencias biológicas, incluyendo inteligencia de amenazas, detección de vulnerabilidades, red teaming, descubrimiento de fármacos y detección de biodefensa. Para razonamiento general y trabajo de conocimiento con agentes, Fable 5.1 cubre el mismo terreno sin la restricción de acceso. Consulta la Sección 5 para el desglose completo.
Conclusión y resumen
Cuatro conclusiones resumen a Claude Mythos 5.1. En benchmarks, lidera en ciencia con agentes, con Fable 5.1 más que duplicando a su predecesor en Terminal-Bench-Science y Mythos 5.1 encabezando el trabajo de terminal a largo plazo con 60.9%. En precios, se ubica en la cima con $10/$50 por millón de tokens, con lecturas de caché reducidas 75% para recompensar a los agentes que corren por periodos largos. En casos de uso, está diseñado para ciberseguridad e investigación en ciencias biológicas, mientras que Fable 5.1 se encarga del trabajo de conocimiento general. En cuanto al acceso, Mythos se mantiene como acceso confiable y solo para EE. UU., así que la mayoría de los equipos deberían construir sobre Fable 5.1 o mandar el trabajo más económico a Opus 5. El modelo está evolucionando rápido, así que revisa el changelog oficial de Anthropic antes de comprometerte con una carga de trabajo en producción.
Sin importar en qué herramientas de IA termines, paga inteligente. Con Bleap te saltas las comisiones cambiarias en suscripciones en USD, y en Claude, ChatGPT y Gemini ganas un cashback plano del 20% en cada renovación. Es una Mastercard autocustodiada que puedes usar en cualquier lugar, sin ninguna suscripción mensual propia.
Una forma más inteligente de gastar, enviar, ganar y operar

- Artificial Inteligence








