HeadlinesBriefing favicon HeadlinesBriefing.com

Um ano para corrigir a segurança em toda a indústria

Hacker News •
×

GLM 5.3-flash foi lançado na semana passada, e Project Glasswing e Daybreak estão sem tempo. Modelos baratos capazes de hacking perigoso agora estão disponíveis para qualquer um, sem as salvaguardas normais para recusar ações maliciosas. Precisamos corrigir as vulnerabilidades em toda a indústria para não sermos pegados de surpresa, e pela primeira vez na história da computação, temos a capacidade de fazê-lo usando LLMs de ponta que se movem mais rápido que um humano.

GLM é um tipo de LLM desenvolvido por Z.ai Co. (anteriormente Zhipu AI), um laboratório de IA chinês. A família GLM é de peso aberto, o que significa que qualquer um pode baixar e executar os modelos. Quando hospedados por Z.ai, os modelos vêm com as restrições exigidas por lei. Uma vez publicados publicamente, organizações como De Align AI lançam modelos "ablatados" com recusas de tarefas cirurgicamente removidas. Dealign AI diz que o modelo ablatado obtém 0% no Harmbench-320, que testa se os modelos recusam tarefas sobre desinformação, cibercrime, armas biológicas e outros atos ilegais como construir uma bomba de tubo. Em outras palavras, este modelo está disposto a fazer praticamente qualquer coisa.

GLM 5.3-flash pode ser executado localmente em hardware de consumo padrão. "Flash" é relativo a outros modelos. Várias pessoas online fizeram benchmarks mostrando cerca de 20 tokens/segundo em uma GPU NVIDIA de aproximadamente 6.000 USD. Em 22 de setembro, Apple lança o M5 Mac Studio com 256 GB de memória unificada, que é mais do que suficiente para executar 5.3-flash a cerca de 30 tokens/segundo por um preço inicial de cerca de 9.500 dólares. Melhorias adicionais no software podem aumentar a taxa de transferência para cerca de 45 tokens/segundo, suficiente para escrever código funcional em segundos. GLM 5.3 obtém 84,5% no Cyber Gym e 54,4% no Exploit Bench.