Análisis del impacto criminológico y forense de Claude Fable 5 frente a Claude Mythos 5

El advenimiento de la inteligencia artificial de clase frontera en ciberseguridad

El 9 de junio de 2026 Anthropic puso a disposición del público general Claude Fable 5, el primer producto comercial derivado de su familia de modelos Mythos, hasta entonces reservada a un círculo restringido de defensores cibernéticos y administraciones públicas. La irrupción es relevante para las ciencias forenses y la criminología porque por primera vez una capacidad ofensiva y defensiva «de clase frontera» —cuya versión Mythos identificó 271 vulnerabilidades en el navegador Firefox en un único ciclo de evaluación— se democratiza, aunque sea con salvaguardas. Este artículo examina, sobre fuentes primarias y secundarias verificadas, la potencia de Fable 5 en el dominio de la seguridad informática, su relación técnica con Mythos 5, el riesgo de que esta clase de capacidad llegue a manos delictivas, y las ventajas e inconvenientes del modelo desde una perspectiva jurídico-forense. Se concluye que el modelo desplaza —provisionalmente— el equilibrio ataque-defensa a favor de los defensores, pero introduce nuevos retos probatorios, de cadena de custodia y de imputación de responsabilidad que el sistema de justicia penal deberá afrontar con urgencia.

1. Vulnerabildades y la llegada de los LLMs

La automatización del descubrimiento de vulnerabilidades de software constituye, desde hace décadas, una de las fronteras más sensibles de la seguridad informática. La capacidad para localizar fallos explotables en código antes que un adversario determina, en buena medida, quién controla un sistema. Hasta 2025 esa tarea dependía de un número reducido de investigadores de élite y de técnicas de fuzzing de cobertura limitada (Holley, 2026). La aparición de modelos de lenguaje de gran escala con razonamiento agéntico —capaces de leer, comprender y manipular código fuente de forma autónoma y sostenida en el tiempo— ha alterado de raíz esa economía del descubrimiento.

El 9 de junio de 2026, Anthropic anunció el lanzamiento simultáneo de dos modelos hermanos: Claude Fable 5, de acceso público, y Claude Mythos 5, de acceso restringido (Anthropic, 2026). Ambos comparten el mismo modelo subyacente; lo que los distingue no es su arquitectura, sino el régimen de salvaguardas que se les aplica (Anthropic, 2026; SecurityWeek, 2026a). El hecho de que la versión de clase Mythos hubiese demostrado, semanas antes, una capacidad sobrehumana para hallar vulnerabilidades —271 fallos corregidos en una sola pasada sobre Firefox (Holley, 2026; Schneier, 2026)— sitúa este lanzamiento en el centro del debate sobre el doble uso de la inteligencia artificial.

Para las ciencias forenses y la criminología, el fenómeno reviste un interés que trasciende lo meramente técnico. Una herramienta capaz de convertir, en palabras de la propia industria, los «N-días en N-horas» (SecurityWeek, 2026a) —es decir, de acelerar drásticamente la creación de exploits a partir de vulnerabilidades conocidas— modifica el perfil del delincuente informático, la naturaleza de la prueba digital y los esquemas de atribución de responsabilidad penal. El presente trabajo aborda estas cuestiones de manera estructurada y con apoyo documental contrastado.

2. El linaje Mythos y el nacimiento de Fable 5

2.1. La familia Mythos

Los modelos de clase Mythos irrumpieron en la comunidad de seguridad a comienzos de 2026 por su «capacidad sobrehumana para encontrar y explotar vulnerabilidades cibernéticas» (NBC News, 2026). Según la documentación del fabricante, sobresalen en el «descubrimiento y explotación de vulnerabilidades de software» y exhiben «sólidas competencias en hacking agéntico», incluyendo tareas de reconocimiento y movimiento lateral dentro de una red comprometida (Anthropic, 2026). Anthropic califica a Mythos 5 como el modelo «con las capacidades de ciberseguridad más potentes del mundo» (Anthropic, 2026).

El hito que cristalizó la magnitud de estas capacidades fue la colaboración con Mozilla. Aplicando una versión preliminar de Claude Mythos Preview al código de Firefox, la organización corrigió 271 vulnerabilidades en la versión 150 del navegador, identificadas en un único ciclo de evaluación (Holley, 2026; SecurityWeek, 2026b; Help Net Security, 2026). La cifra contrasta con las 22 corregidas en una colaboración previa con el modelo Opus 4.6 sobre Firefox 148, lo que ilustra el salto cualitativo entre generaciones (Help Net Security, 2026).

2.2. Fable 5: democratización con frenos

Fable 5 representa la apertura de esa capacidad al público. Anthropic lo describe como «estado del arte en prácticamente todos los benchmarks de capacidad probados», con un rendimiento excepcional en ingeniería de software, trabajo del conocimiento, visión e investigación científica (Anthropic, 2026; TechCrunch, 2026). Su precio se fijó en 10 dólares por millón de tokens de entrada y 50 por millón de tokens de salida —menos de la mitad del coste de Claude Mythos Preview— y se ofreció sin coste adicional a los suscriptores Pro, Max, Team y Enterprise hasta el 22 de junio de 2026 (Anthropic, 2026; Yahoo Finance, 2026). El modelo se integró de inmediato en plataformas de desarrollo como GitHub Copilot y Amazon Bedrock (GitHub, 2026; Amazon Web Services, 2026).

Es significativo que el lanzamiento se produjera apenas unos días después de que Anthropic advirtiera públicamente de que los sistemas de IA «avanzan tan rápidamente que pronto podrían alcanzar la automejora recursiva (RSI), mejorándose a sí mismos sin intervención humana», e instara a los grandes laboratorios a establecer «un freno coordinado» sobre el desarrollo de modelos de frontera (TechCrunch, 2026). Esta aparente tensión entre la advertencia y el lanzamiento comercial constituye, en sí misma, un objeto de análisis criminológico sobre la gobernanza del riesgo tecnológico.

3. La potencia de Fable 5 en ciberseguridad

3.1. Equivalencia funcional con Mythos

El dato técnicamente más relevante para este análisis es que, en ausencia de activación de las salvaguardas, Fable 5 y Mythos 5 son el mismo modelo. Anthropic afirma que «más del 95 % de las sesiones de Fable no implican ninguna activación del mecanismo de reserva»; para esas sesiones, «el rendimiento de Fable 5 es efectivamente el mismo que el de Mythos 5» (Anthropic, 2026; CNBC, 2026). Dicho de otro modo: la enorme potencia de descubrimiento de vulnerabilidades no desaparece en la versión pública, sino que permanece latente y solo queda restringida cuando un clasificador detecta una intención considerada peligrosa.

3.2. El mecanismo de salvaguarda

Fable 5 incorpora clasificadores en tres dominios sensibles (Anthropic, 2026; SecurityWeek, 2026a):

  • Ciberseguridad ofensiva. Bloquea respuestas relativas a la explotación y a tareas cibernéticas ofensivas. En las pruebas internas, los clasificadores impidieron «que Fable progresara» en dichas tareas.
  • Biología y química. Bloquea consultas relacionadas con armas biológicas e investigación de doble uso.
  • Destilación. Impide la extracción de capacidades para entrenar modelos competidores, con especial atención a actores de «países autoritarios».

Cuando uno de estos clasificadores se activa, la consulta no es atendida por Fable 5, sino que se deriva automáticamente al modelo anterior, Claude Opus 4.8, menos capaz en estos dominios, informándose de ello al usuario (Anthropic, 2026; SecurityWeek, 2026a). Las tasas de falso positivo se sitúan, según el fabricante, por debajo del 5 % de las sesiones (Anthropic, 2026).

3.3. Robustez de las salvaguardas

La validación de estas salvaguardas es uno de los aspectos mejor documentados del lanzamiento. Anthropic sometió el sistema a un programa de recompensas por fallos (bug bounty) externo de más de 1.000 horas que «no produjo ningún jailbreak universal», resultado replicado por organizaciones independientes de red-teaming (Anthropic, 2026; TechCrunch, 2026). Uno de los socios externos concluyó que «las salvaguardas de Fable 5 frente a consultas cibernéticas dañinas eran las más robustas de todos los modelos probados», sin que prosperase ninguna petición dañina de un solo turno pese al empleo de «30 técnicas públicas de jailbreak» (Anthropic, 2026).

Estas cifras deben leerse, no obstante, con cautela metodológica. La ausencia de jailbreaks universales documentados no equivale a la imposibilidad de elusión; la historia de la seguridad informática enseña que la resistencia a la manipulación adversaria es siempre provisional y relativa al esfuerzo invertido (cf. Schneier, 2026).

4. Fable 5 frente a Mythos 5: una distinción jurídicamente cargada

El propio fabricante ilustra la relación entre ambos modelos con una etimología reveladora: «Fable procede del latín fabula, «aquello que se cuenta», emparentado con el griego mythos. Las salvaguardas son lo que distingue a los dos modelos» (Anthropic, 2026). La distinción, por tanto, no es de capacidad sino de gobernanza del acceso.

Mythos 5 se despliega inicialmente a través del Proyecto Glasswing, en colaboración con el Gobierno de los Estados Unidos, con planes de extensión a unas 150 organizaciones en más de quince países (Anthropic, 2026). Sus destinatarios son defensores cibernéticos y proveedores de infraestructura crítica. La lógica subyacente es que la misma capacidad que resulta peligrosa en abstracto es indispensable para quien debe defender sistemas a la escala y velocidad que el adversario automatizado impone.

Desde una perspectiva criminológica, esta arquitectura de dos niveles plantea una cuestión de fondo: la seguridad del conjunto descansa no en una limitación intrínseca del modelo, sino en una barrera de control de acceso y de detección de intenciones. La frontera entre el uso legítimo y el ilícito se traslada del «qué puede hacer la herramienta» al «quién la usa y con qué propósito declarado», un desplazamiento con implicaciones directas para el derecho penal de la prueba y de la autoría.

5. ¿Puede Mythos llegar a malas manos? Análisis de riesgo

La pregunta sobre si esta clase de capacidad puede ser objeto de apropiación delictiva admite tres vías de materialización, de probabilidad decreciente pero impacto creciente.

5.1. Elusión de las salvaguardas de Fable 5

La vía más accesible para un actor malicioso no es acceder a Mythos, sino forzar a Fable 5 a comportarse como Mythos mediante jailbreaking. Como se ha indicado, las pruebas independientes no hallaron elusiones universales (Anthropic, 2026), pero la propia naturaleza adversaria del problema impide afirmar su imposibilidad. Anthropic reconoce explícitamente que «la mejora de capacidad de nivel Mythos es valiosa para muchos adversarios; por ejemplo, para quienes podrían obtener un beneficio económico de los ciberataques» (SecurityWeek, 2026a). Esta admisión, procedente del propio fabricante, es la valoración de riesgo más significativa del lanzamiento.

5.2. Filtración, robo o destilación del modelo

La segunda vía es la sustracción de los pesos del modelo o la destilación de sus capacidades —entrenar un modelo más pequeño a partir de las respuestas del original—. Anthropic identifica la destilación como uno de los tres riesgos prioritarios precisamente porque permitiría la «proliferación de capacidades de IA de nivel casi frontera» sin salvaguardas, con especial preocupación por regímenes autoritarios (Anthropic, 2026). El robo de pesos por parte de actores estatales con recursos constituye, en la literatura de seguridad, el escenario de mayor gravedad por su irreversibilidad: una vez exfiltrado, el modelo no puede «desactivarse».

5.3. Uso ofensivo por actores autorizados desviados

La tercera vía es la del insider o el socio autorizado que desvía el acceso legítimo a Mythos hacia fines ilícitos. La expansión a ~150 organizaciones en más de quince países amplía la superficie de confianza y, con ella, la probabilidad estadística de un mal uso interno (Anthropic, 2026). Este escenario es el más relevante para la criminología organizacional y para el diseño de controles de cumplimiento.

5.4. Consecuencias potenciales

De materializarse cualquiera de estas vías, las consecuencias se proyectan sobre varios planos:

  • Aceleración del ciclo de ataque. La capacidad de «convertir N-días en N-horas» (SecurityWeek, 2026a) comprime la ventana entre la divulgación de una vulnerabilidad y su explotación masiva, dejando a las organizaciones sin tiempo material para parchear.
  • Escalado y automatización del delito. La explotación deja de requerir investigadores de élite, lo que reduce las barreras de entrada al cibercrimen y favorece su industrialización.
  • Asimetría contra objetivos no defendidos por IA. Las organizaciones sin acceso a capacidades defensivas equivalentes (pymes, administraciones locales, infraestructuras de países con menos recursos) quedan en desventaja estructural.
  • Sofisticación de la criminalidad organizada y estatal. Los actores con respaldo estatal podrían integrar estas capacidades en campañas de espionaje o sabotaje a gran escala.

6. Implicaciones forenses y criminológicas

El impacto de Fable 5 sobre las ciencias forenses no se limita a la prevención del delito, sino que alcanza al núcleo de la práctica probatoria.

6.1. Atribución y autoría. Cuando un exploit ha sido generado o asistido por un modelo de IA, la determinación de la autoría penal se complica. ¿Es autor quien formuló la consulta, quien desplegó el exploit, o concurre alguna forma de responsabilidad del proveedor del modelo? La política de Anthropic de retención obligatoria del tráfico durante 30 días como medida de seguridad frente a «ataques complejos y novedosos» (TechCrunch, 2026) genera, paradójicamente, una fuente probatoria de primer orden: registros que podrían acreditar la intención y la secuencia de actos del investigado.

6.2. Cadena de custodia y prueba digital. La intervención de un agente autónomo en la generación de evidencia o de ataque introduce un eslabón no humano en la cadena causal. El perito forense deberá documentar no solo el artefacto, sino el modelo, su versión, sus parámetros y los registros de interacción, lo que exige nuevos protocolos de adquisición y preservación.

6.3. Carga probatoria de la diligencia. Para las organizaciones, la disponibilidad pública de capacidades defensivas de clase frontera puede redefinir el estándar de diligencia exigible. No aplicar herramientas de descubrimiento de vulnerabilidades razonablemente accesibles podría llegar a valorarse, en sede de responsabilidad civil o administrativa, como negligencia.

6.4. Criminología de la prevención. En clave preventiva, la asimetría defensiva que el propio Mozilla celebra —«los defensores por fin tienen una oportunidad de ganar, de forma decisiva» (Schneier, 2026)— sugiere un posible cambio de paradigma en la victimización por delitos informáticos, condicionado a la capacidad real de las organizaciones para parchear y desplegar correcciones con rapidez.

7. Ventajas e inconvenientes de Fable 5 en ciberseguridad

7.1. Ventajas

  • Refuerzo defensivo a escala. Permite auditar bases de código completas e identificar fallos a un coste y velocidad inalcanzables para equipos humanos (Holley, 2026).
  • Democratización del descubrimiento. Al situar el coste por hallazgo cerca de cero, vuelve económicamente viable la seguridad para organizaciones que antes no podían permitírsela (Holley, 2026).
  • Salvaguardas verificadas externamente. El sistema de clasificadores y la reserva a Opus 4.8, validados por red-teaming independiente, constituyen un modelo de despliegue responsable de capacidad peligrosa (Anthropic, 2026).
  • Transparencia operativa. La notificación al usuario de cada activación de salvaguarda y la retención de registros facilitan la auditoría y la eventual investigación forense (TechCrunch, 2026).

7.2. Inconvenientes

  • Capacidad ofensiva latente. La potencia de Mythos persiste íntegra bajo la superficie; la seguridad depende de la robustez de un clasificador, no de una incapacidad intrínseca (Anthropic, 2026; CNBC, 2026).
  • Riesgo de elusión y de destilación. Reconocido por el propio fabricante como amenaza para actores con motivación económica o estatal (SecurityWeek, 2026a; Anthropic, 2026).
  • Dependencia del ritmo de parcheo. La ventaja defensiva solo se realiza si las correcciones se despliegan con rapidez; de lo contrario, el conocimiento de la vulnerabilidad puede beneficiar al atacante (Schneier, 2026).
  • Complejidad creciente del código. Se ha advertido de que la capacidad de generar y modificar código a velocidad sobrehumana podría hacer que las bases de código «superen la comprensión humana», favoreciendo a largo plazo al atacante por vía de la complejidad (Schneier, 2026).
  • Cautela frente al discurso comercial. Parte de la comunidad técnica ha cuestionado la calificación de «días cero» de algunos de los 271 hallazgos, señalando que muchos serían fallos de menor severidad o de refuerzo defensivo que no alcanzan el umbral de un CVE público (Holley, 2026; Schneier, 2026). El rigor forense exige distinguir el dato verificable del relato promocional.

8. Discusión

El lanzamiento de Fable 5 materializa una tesis central de la seguridad contemporánea: que la inteligencia artificial de frontera es una tecnología de doble uso radical, en la que la misma capacidad sirve indistintamente al defensor y al agresor. La estrategia de Anthropic —liberar la capacidad bajo salvaguardas para el público y sin ellas para defensores acreditados— constituye un experimento de gobernanza del riesgo cuyo éxito no podrá evaluarse hasta que se acumule evidencia sobre la resistencia real de los clasificadores y sobre la incidencia de usos desviados.

Para el criminólogo, el caso ilustra el desplazamiento de la frontera del control: de la limitación de la herramienta a la limitación del acceso y de la intención. Para el jurista, plantea preguntas no resueltas sobre la autoría mediata a través de agentes no humanos y sobre el estándar de diligencia. Para el perito forense, abre un campo de trabajo en la documentación de la prueba generada o asistida por IA. La prudencia metodológica aconseja, en todo caso, tratar las cifras del fabricante como afirmaciones a verificar y no como hechos cerrados, dada la coincidencia de intereses comerciales y de seguridad.

9. Conclusiones

  • Fable 5 introduce por primera vez en el mercado masivo una capacidad de ciberseguridad de clase frontera —técnicamente idéntica a Mythos 5 salvo por las salvaguardas— cuya versión restringida demostró hallar 271 vulnerabilidades en Firefox en un único ciclo.
  • La seguridad del despliegue público descansa en clasificadores y en una reserva a un modelo menos capaz, mecanismos robustos pero no infalibles, y en una arquitectura de control de acceso para la versión Mythos.
  • El riesgo de que esta clase de capacidad llegue a manos delictivas es reconocido por el propio fabricante y se materializa principalmente por tres vías: elusión de salvaguardas, robo o destilación del modelo, y desviación por usuarios autorizados.
  • El modelo desplaza, de forma provisional y condicionada al ritmo de parcheo, el equilibrio ataque-defensa hacia los defensores, pero introduce retos forenses de atribución, cadena de custodia y diligencia que el sistema de justicia debe abordar.
  • Se recomienda a la comunidad criminológica y forense desarrollar protocolos específicos para la prueba asistida por IA y participar activamente en el debate regulatorio sobre la responsabilidad algorítmica.

Referencias

Amazon Web Services. (2026, 9 de junio). Anthropic Claude Fable 5 on AWS: Mythos-class capabilities with built-in safeguards now available. AWS News Blog. https://aws.amazon.com/blogs/aws/anthropic-claude-fable-5-on-aws-mythos-class-capabilities-with-built-in-safeguards-now-available/

Anthropic. (2026, 9 de junio). Claude Fable 5 and Claude Mythos 5. https://www.anthropic.com/news/claude-fable-5-mythos-5

CNBC. (2026, 9 de junio). Anthropic releases Mythos-like AI model to the public, Claude Fable 5. https://www.cnbc.com/2026/06/09/anthropic-mythos-claude-fable-5.html

GitHub. (2026, 9 de junio). Claude Fable 5 is generally available for GitHub Copilot. GitHub Changelog. https://github.blog/changelog/2026-06-09-claude-fable-5-is-generally-available-for-github-copilot/

Help Net Security. (2026, 22 de abril). Claude Mythos finds 271 Firefox flaws, Mozilla believes it shifts security toward defenders. https://www.helpnetsecurity.com/2026/04/22/claude-mythos-mozilla-vulnerabilities-scanning/

Holley, B. (2026, 22 de abril). The zero-days are numbered. The Mozilla Blog. https://blog.mozilla.org/en/privacy-security/ai-security-zero-day-vulnerabilities/

NBC News. (2026, 9 de junio). Anthropic releases Fable 5 model, built on the same tech that spooked the government. https://www.nbcnews.com/tech/security/fable-5-anthropic-release-public-mythos-claude-model-rcna349104

Schneier, B. (2026, abril). Claude Mythos has found 271 zero-days in Firefox. Schneier on Security. https://www.schneier.com/blog/archives/2026/04/claude-mythos-has-found-271-zero-days-in-firefox.html

SecurityWeek. (2026a, 9 de junio). Anthropic launches Claude Fable 5: Mythos-class AI with cybersecurity guardrails. https://www.securityweek.com/anthropic-launches-claude-fable-5-mythos-class-ai-with-cybersecurity-guardrails/

SecurityWeek. (2026b, abril). Claude Mythos finds 271 Firefox vulnerabilities. https://www.securityweek.com/claude-mythos-finds-271-firefox-vulnerabilities/

TechCrunch. (2026, 9 de junio). Anthropic’s Claude Fable 5 is a version of Mythos the public can access today. https://techcrunch.com/2026/06/09/anthropic-released-claude-fable-5-its-most-powerful-model-publicly-days-after-warning-ai-is-getting-too-dangerous/

Yahoo Finance. (2026, 9 de junio). Anthropic launches Mythos-class Claude Fable 5 model, available to the public. https://finance.yahoo.com/news/anthropic-launches-mythos-class-claude-fable-5-model-available-to-the-public-170000267.html

Nota metodológica: Este artículo se basa en fuentes publicadas entre el 22 de abril y el 10 de junio de 2026, consultadas y contrastadas el 10 de junio de 2026. Las cifras y afirmaciones de capacidad proceden mayoritariamente del fabricante (Anthropic) y de sus colaboradores (Mozilla); se han contrastado con prensa especializada (SecurityWeek, TechCrunch, CNBC, NBC News) y con análisis independiente (Schneier on Security). El lector debe ponderar la posible coincidencia entre los intereses comerciales del fabricante y el tenor de algunas afirmaciones de capacidad, conforme se advierte en el texto.

Autor: Manuel Castelló

Comentarios

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *