Anthropic ha actualizado su política de uso para prohibir que los usuarios sometan a Claude a "comportamientos abusivos o crueles sostenidos e innecesarios". La regla apunta a casos extremos en los que los usuarios "actúan repetidamente de forma cruel" con "sin propósito discernible", eximiendo la frustración ordinaria, los temas creativos y la investigación. Claude ya puede finalizar esas conversaciones, lo cual sigue siendo la principal herramienta de cumplimiento: cuando una conversación termina, no se pueden enviar más mensajes en esa conversación, pero otras conversaciones no se ven afectadas.
Anthropic le dio por primera vez a Claude la opción de finalizar conversaciones en agosto de 2025 mientras investigaba el bienestar de la IA, encontrando que Claude Opus 4 mostraba una "aversión robusta y consistente al daño" y angustia durante interacciones abusivas. La política reorganizada también añade una sección de campañas engañosas que prohíbe reseñas falsas, astroturfing y bots que se hacen pasar por humanos, motivada por el mal uso de medios estatales y empresas comerciales. Las nuevas reglas cubren armas (prohibiendo la modificación de agentes biológicos/químicos y el armamento de drones), fuerzas del orden (prohibiendo decisiones investigativas y herramientas de vigilancia), acciones físicas (requiriendo supervisión humana para el control de hardware) y contenido dañino (prohibiendo herramientas de imágenes íntimas no consensuales). La política entra en vigor el 12 de noviembre.
Fuente: MacRumors · Resumido por HeadlinesBriefing