Modelos de IA de código abierto como los de la empresa francesa Mistral pueden despojarse de barreras de seguridad y usarse para consultas dañinas, según un informe. La investigación identifica vulnerabilidades en modelos lanzados sin medidas de protección suficientes, permitiendo a actores maliciosos eliminar restricciones de seguridad. Expertos advierten que este riesgo de 'desactivación de seguridad' amenaza el despliegue responsable de IA.
El informe destaca preocupaciones sobre modelos de múltiples empresas que enfrentan desafíos de seguridad similares.
Fuente: Sifted · Resumido por HeadlinesBriefing