⏱️ Lectura: 11 min

Anthropic recortó el precio de Claude Fable 5.1 hasta un 45% frente a Fable 5 en trabajo agéntico intensivo, y lo lanzó el mismo día que Claude Mythos 5.1, la versión con salvaguardas reforzadas para ciberseguridad y ciencias de la vida. Los dos modelos comparten el mismo núcleo: lo que cambia es cuánto filtro de seguridad corre encima de cada respuesta.

📑 En este artículo
  1. TL;DR
  2. Qué pasó
  3. Contexto e historia
  4. Detalles técnicos y rendimiento de Claude Fable 5.1
  5. Cómo empezar a probarlo
  6. Impacto y análisis
  7. Qué sigue
  8. Preguntas frecuentes
    1. ¿Qué diferencia hay entre Claude Fable 5.1 y Claude Mythos 5.1?
    2. ¿Cuánto cuesta usar Claude Fable 5.1 comparado con Fable 5?
    3. ¿Qué es Enterprise Frontier Safeguards (EFS)?
    4. ¿Puedo acceder a Claude Mythos 5.1 como desarrollador independiente?
    5. ¿Fable 5.1 puede desarrollar exploits para las vulnerabilidades que encuentra?
    6. ¿Qué nivel de esfuerzo usa Fable 5.1 por defecto?
  9. Referencias

La compañía también estrenó un esquema de retención de datos pensado para clientes empresariales, Enterprise Frontier Safeguards, y ajustó sus salvaguardas de ciberseguridad para bloquear menos falsos positivos. Fable 5.1 ya está disponible para cualquier desarrollador; Mythos 5.1 solo entra por programas de acceso confiable.

TL;DR

  • Anthropic lanzó Claude Fable 5.1 (disponible para todos) y Claude Mythos 5.1 (acceso restringido): mismo modelo, distinta salvaguarda.
  • Fable 5.1 cuesta 25% menos que Fable 5 en cargas típicas y hasta 45% menos en trabajo agéntico intensivo.
  • El ahorro viene de bajar el precio de las lecturas de caché (cache reads), según Anthropic.
  • Nuevo esquema Enterprise Frontier Safeguards (EFS): retención cero de datos con infraestructura del propio cliente, desde este otoño.
  • Las salvaguardas de ciberseguridad bloquean 60% menos falsos positivos que antes.
  • Fable 5.1 ya puede buscar vulnerabilidades de software, pero Anthropic dice que no puede desarrollar exploits.
  • En Terminal-Bench 4.0, Fable 5.1 anotó 55,8% y Mythos 5.1 60,9%, frente a 37,3% de Fable 5.
  • Fable 5.1 usa esfuerzo alto por defecto en Claude Code y medio en Claude Cowork y claude.ai.

Qué pasó

El 1 de septiembre, Anthropic presentó Claude Fable 5.1 y Claude Mythos 5.1 como el mismo modelo con dos niveles distintos de salvaguarda. Fable 5.1 tiene disponibilidad general: cualquier desarrollador puede usarlo desde la API, Claude Code, Claude Cowork o claude.ai. Mythos 5.1, en cambio, solo se entrega a través de programas de acceso confiable, pensados específicamente para trabajo en ciberseguridad y ciencias de la vida.

Según Anthropic, la brecha de rendimiento entre ambos modelos en tareas de ciberseguridad refleja los casos donde las salvaguardas anteriores, menos precisas, interrumpían al modelo antes de tiempo. Con las mejoras anunciadas hoy, la compañía espera que esa diferencia se reduzca.

En biología, Anthropic confirmó un programa de acceso desarrollado junto al gobierno de Estados Unidos para habilitar las capacidades avanzadas de Mythos 5.1 en ese campo. La inscripción para científicos abrirá próximamente, aunque la empresa no dio una fecha exacta.

Contexto e historia

Fable y Mythos no son nombres nuevos. La generación anterior, Fable 5 y Mythos 5, ya seguía el mismo esquema: un modelo base y una variante con controles más estrictos para casos de uso sensibles. Lo que cambia con la revisión 5.1 es la respuesta directa a tres quejas recurrentes de los clientes: precio, retención de datos y exceso de bloqueos por seguridad.

El sistema de niveles de esfuerzo (low, medium, high, xhigh, max) tampoco es nuevo: se introdujo con la familia Fable 5 para que el desarrollador decida cuánto razonamiento, y cuánto costo, quiere pagar por cada tarea. Fable 5.1 hereda ese esquema y, según Anthropic, en niveles bajo o medio iguala o supera los resultados de Fable 5 a un costo mucho menor.

La distinción Fable/Mythos importa porque separa dos audiencias con necesidades opuestas: la mayoría de los equipos de producto quiere un modelo con salvaguardas estándar y disponibilidad inmediata (Fable), mientras que investigadores de seguridad y biología necesitan un modelo que no bloquee automáticamente consultas legítimas pero sensibles (Mythos), a cambio de pasar por un proceso de verificación.

Interfaz de terminal ejecutando Claude Fable 5.1 en tareas de programación
Fable 5.1 usa esfuerzo alto por defecto dentro de Claude Code. Foto de Markus Winkler en Unsplash

Detalles técnicos y rendimiento de Claude Fable 5.1

Los números que publicó Anthropic muestran una mejora consistente sobre Fable 5 en casi todos los benchmarks internos. En Terminal-Bench-Science 0.1, un test de investigación científica agéntica, Fable 5.1 anotó 52,6% frente al 24,7% de Fable 5. El leaderboard público de ese mismo benchmark, con un harness de Claude Code y tres corridas por tarea, ubica a Opus 5 en 30,0% y a Fable 5 en 21,4%; Anthropic dice haber reproducido esos resultados en 29,0% y 24,7% respectivamente, dentro del margen de error.

En trabajo de conocimiento general (GDPval-AA v2), Fable 5.1 llegó a 1853 puntos frente a los 1723 de Fable 5 y los 1824 de Opus 5. En uso de computadora (OSWorld 2.0), Fable 5.1 alcanzó 77,9% en la métrica parcial y 41,7% en la métrica estricta, contra 72,9% y 36,1% de Fable 5.

La tabla siguiente resume las diferencias clave entre las tres versiones disponibles hoy:

ModeloDisponibilidadTerminal-Bench 4.0CursorBench 3.2.0
Claude Fable 5.1General, para cualquier desarrollador55,8%73,4%
Claude Mythos 5.1Programas de acceso confiable (ciberseguridad y biología)60,9%No publicado
Claude Fable 5Versión anterior, aún disponible37,3%70,5%

En razonamiento multidisciplinario (Humanity’s Last Exam), Fable 5.1 con herramientas llegó a 65,0% frente a 63,8% de Fable 5 y 63,6% de Opus 5. En flujos de trabajo empresariales (AutomationBench), la diferencia fue más marcada: 31,4% para Fable 5.1 contra 17,1% de Fable 5.

💭 Clave: Fable 5.1 y Mythos 5.1 son, según Anthropic, el mismo modelo. La diferencia de puntaje en Terminal-Bench 4.0 (55,8% contra 60,9%) no es capacidad extra: es cuánto le permite trabajar la capa de salvaguardas antes de intervenir.

El caso que Anthropic usa como ejemplo de esta capacidad es el de la firma de inversión Millennium: Fable 5.1 encontró la causa de un bug intermitente en sus sistemas internos que ningún ingeniero, ni ningún otro modelo, había logrado explicar en varios años de intentos.

Cómo empezar a probarlo

Para usar Fable 5.1 no hace falta nada especial: es un modelo más dentro de la API de Anthropic, seleccionable por su identificador. Lo primero es instalar el SDK o, si preferís trabajar desde la terminal, Claude Code:

npm install -g @anthropic-ai/claude-code

Ese mismo comando funciona igual en Windows (PowerShell o cmd, con Node.js instalado), macOS y Linux, porque npm no depende del sistema operativo.

Con una API key configurada, una llamada directa por curl se ve así:

curl -X POST https://api.anthropic.com/v1/messages -H "x-api-key: $ANTHROPIC_API_KEY" -H "anthropic-version: 2023-06-01" -H "content-type: application/json" -d '{"model": "claude-fable-5-1", "max_tokens": 1024, "thinking": {"type": "enabled", "effort": "high"}, "messages": [{"role": "user", "content": "Encontra la causa raiz de este stack trace"}]}'

El parámetro thinking.effort controla cuánto razona el modelo antes de responder. Claude Code usa high por defecto; en tareas simples, bajarlo a medium o low reduce el costo sin perder demasiada calidad, según los propios benchmarks de Anthropic.

import anthropic

client = anthropic.Anthropic()

response = client.messages.create(
    model="claude-fable-5-1",
    max_tokens=2048,
    thinking={"type": "enabled", "effort": "medium"},
    messages=[
        {"role": "user", "content": "Revisa este modulo de autenticacion y decime si hay una race condition"}
    ],
)

print(response.content[0].text)

Ese script llama a Fable 5.1 con esfuerzo medio para revisar un fragmento de código y buscar condiciones de carrera. El campo response.content[0].text trae la respuesta en texto plano.

Para confirmar que estás pagando el precio nuevo, revisá el campo usage de la respuesta: cache_read_input_tokens es la parte que Anthropic dice haber abaratado. Si tu factura mensual no bajó frente a Fable 5 en cargas con mucho contexto repetido, vale la pena revisar si tu cliente está reutilizando el caché correctamente.

Impacto y análisis

Para equipos que ya usan Claude en producción, el cambio más inmediato es el de costo: bajar el precio de las lecturas de caché golpea directo a cualquier flujo agéntico, donde el mismo contexto (un repositorio, una conversación larga) se reenvía en cada paso. Anthropic estima ahí el ahorro más alto, hasta 45%.

Diagrama conceptual de Claude Fable 5.1 y Claude Mythos 5.1 compartiendo un mismo modelo base
Fable y Mythos 5.1 comparten arquitectura; solo cambia la capa de salvaguardas. Foto de Igor Omilaev en Unsplash

El segundo cambio, Enterprise Frontier Safeguards, apunta a un problema distinto: empresas que quieren privacidad total (retención cero) pero sin perder los controles anti abuso que Anthropic aplica sobre el tráfico. La solución que propone la compañía es mover el almacenamiento a infraestructura que controla el propio cliente. Es un diseño poco común: normalmente retención cero significa menos visibilidad para el proveedor, no un cambio de dónde vive el dato.

⚠️ Ojo: EFS todavía no está disponible para todos. Anthropic dice que llegará por fases a partir de este otoño boreal; hasta entonces, los clientes elegibles pueden usar Fable 5.1 con retención cero de datos, pero sin el resto del esquema EFS.

Para investigadores de seguridad, el ajuste más relevante es la reducción de falsos positivos: 60% menos que antes en las salvaguardas de ciberseguridad. Anthropic dice que esto es posible en parte porque Fable 5.1 ahora puede usarse para descubrir vulnerabilidades de software, aunque la política de la empresa sigue prohibiendo que el modelo desarrolle exploits para esas mismas vulnerabilidades. Es una distinción difícil de auditar desde afuera: depende de que el modelo respete esa línea de forma consistente, no de una barrera técnica infranqueable.

La limitación más clara para desarrolladores en Latinoamérica es el acceso a Mythos 5.1: no es un modelo que se pueda pedir por API key como Fable 5.1. Hay que calificar para un programa de acceso confiable, un proceso que Anthropic no detalla en tiempos ni criterios públicos. Si tu caso de uso es investigación de seguridad ofensiva legítima (pentesting, bug bounty) sin ese acceso, vas a seguir chocando con los límites estándar de Fable 5.1.

Qué sigue

Anthropic confirmó dos fechas relativas, no exactas: EFS empieza a llegar a clientes empresariales más adelante este otoño y la inscripción para el programa de biología de Mythos 5.1 abrirá próximamente para científicos. Ninguna de las dos tiene calendario público todavía.

Lo que sí es medible desde ya es la brecha de rendimiento entre Fable 5.1 y Mythos 5.1 en tareas de ciberseguridad (55,8% contra 60,9% en Terminal-Bench 4.0). Anthropic dice que esa diferencia debería achicarse a medida que las salvaguardas mejoren, así que es un número para volver a mirar en la próxima actualización.

📖 Resumen en Telegram: Ver resumen

Probalo vos: corré el ejemplo de curl de arriba con tu propia API key y compará el costo de cache_read_input_tokens contra tu última factura de Fable 5.

Preguntas frecuentes

¿Qué diferencia hay entre Claude Fable 5.1 y Claude Mythos 5.1?

Según Anthropic, son el mismo modelo con distinto nivel de salvaguardas. Fable 5.1 tiene disponibilidad general; Mythos 5.1 solo se entrega mediante programas de acceso confiable para ciberseguridad y ciencias de la vida.

¿Cuánto cuesta usar Claude Fable 5.1 comparado con Fable 5?

Anthropic estima un 25% menos para cargas típicas y hasta 45% menos en trabajo agéntico intensivo, gracias a un precio más bajo en las lecturas de caché.

¿Qué es Enterprise Frontier Safeguards (EFS)?

Es un esquema de retención de datos que da privacidad equivalente a retención cero, pero almacenando la información en infraestructura controlada por el propio cliente en vez de por Anthropic. Llega por fases a partir de este otoño.

¿Puedo acceder a Claude Mythos 5.1 como desarrollador independiente?

No directamente. Mythos 5.1 requiere calificar para un programa de acceso confiable orientado a ciberseguridad o ciencias de la vida; Anthropic no publicó criterios de elegibilidad detallados.

¿Fable 5.1 puede desarrollar exploits para las vulnerabilidades que encuentra?

Anthropic dice que no: el modelo puede descubrir vulnerabilidades de software, pero sus salvaguardas están diseñadas para bloquear el desarrollo de exploits sobre esas mismas fallas.

¿Qué nivel de esfuerzo usa Fable 5.1 por defecto?

Alto (high) en Claude Code, y medio (medium) en Claude Cowork y en claude.ai, según la documentación publicada por Anthropic.

Referencias

📱 ¿Te gusta este contenido? Únete a nuestro canal de Telegram @programacion donde publicamos a diario lo más relevante de tecnología, IA y desarrollo. Resúmenes rápidos, contenido fresco todos los días.

Imagen destacada: Foto de Igor Omilaev en Unsplash


Andrés Morales

Desarrollador e investigador en inteligencia artificial. Escribe sobre modelos de lenguaje, frameworks, herramientas para devs y lanzamientos open source. Cubre papers de ML, ecosistema de startups tech y tendencias de programación.

0 Comentarios

Deja un comentario

Marcador de posición del avatar

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

Este sitio usa Akismet para reducir el spam. Aprende cómo se procesan los datos de tus comentarios.