O novo modelo Mythos da Anthropic, um motor de linguagem massivo, pode gerar exploits funcionais para o shell JavaScript do Firefox em 72,4% das tentativas, um salto em relação a menos de 1% há alguns meses. O tamanho do modelo rivaliza com o GPT‑4.5 de curta duração, e seu preço está em US$125/MTok.
O sandboxing forma o núcleo da segurança móvel e web, sobrepondo proteções do navegador, JavaScript e do sistema operacional. O sucesso do Mythos significa que um único LLM agora pode violar o sandbox mais interno, permitindo que sites maliciosos escapem e comprometam dispositivos dos usuários.
Embora o exploit atinja apenas o shell SpiderMonkey, a tendência sinaliza um risco mais amplo: VMs em nuvem, iframes de anúncios e serviços multi‑tenant dependem de isolamento semelhante. Se os atacantes encadearem esses pontos fracos, eles poderiam assumir o controle de milhões de dispositivos ou regiões na nuvem.
A Anthropic manteve o lançamento completo em sigilo, oferecendo o modelo a um coorte limitado de especialistas em cibersegurança. No entanto, a ameaça subjacente permanece, pois modelos menores podem em breve herdar as capacidades do Mythos, e hardware mais novo poderia ampliar ainda mais a superfície de ataque. A indústria precisa reavaliar as premissas do sandbox agora.
Entidades-chave: Empresas: Anthropic
Perguntas frequentes: Como a taxa de exploração do Mythos se compara aos modelos anteriores?
O Mythos da Anthropic alcança uma taxa de sucesso de 72,4% na geração de exploits funcionais, um aumento dramático em relação à taxa inferior a 1% observada com o Opus 4.6 em testes anteriores.
Fonte: Hacker News · Resumido por HeadlinesBriefing