El nuevo modelo Mythos de Anthropic, un motor de lenguaje masivo, puede generar exploits funcionales para el shell de JavaScript de Firefox en el 72,4 % de los ensayos, un salto desde menos del 1 % hace unos meses. El tamaño del modelo compite con el breve GPT‑4.5, y su precio ronda los $125/MTok.
El sandboxing constituye el núcleo de la seguridad móvil y web, apilando protecciones de navegador, JavaScript y del sistema operativo. El éxito de Mythos significa que un solo LLM puede ahora vulnerar el sandbox más interno, lo que potencialmente permite que sitios maliciosos escapen y comprometan los dispositivos de los usuarios.
Aunque el exploit solo afecta al shell SpiderMonkey, la tendencia señala un riesgo más amplio: máquinas virtuales en la nube, iframes publicitarios y servicios multi‑arrendamiento dependen de aislamientos similares. Si los atacantes encadenan estos puntos débiles, podrían tomar el control de millones de dispositivos o regiones de la nube.
Anthropic ha retenido el lanzamiento público completo, ofreciendo el modelo a un grupo limitado de ciberseguridad. Sin embargo, la amenaza subyacente persiste, ya que modelos más pequeños podrían heredar las capacidades de Mythos, y el hardware más nuevo podría ampliar la superficie de ataque. La industria debe replantear sus supuestos sobre sandboxing ahora.
Entidades clave: Empresas: Anthropic
Preguntas frecuentes: ¿Cómo se compara la tasa de exploits de Mythos con modelos anteriores?
El Mythos de Anthropic alcanza una tasa de éxito del 72,4 % en la generación de exploits funcionales, un aumento dramático respecto al menos del 1 % observado con Opus 4.6 en pruebas anteriores.
Fuente: Hacker News · Resumido por HeadlinesBriefing