لقد قامت Anthropic بتحديث سياستها للاستخدام لمنع المستخدمين من خضوع Claude ل"سلوكيات إيذاء أو قسوة مستمرة ولا حاجة لها". القاعدة تستهدف حالات متطرفة حيث يتصرف المستخدمون "بشكل متكرر قاسياً" بـ"دون غرض ملموس"، مع إعفاء العصب العادي، والمواضيع الإبداعية، والبحث. Claude يمكنه بالفعل إنهاء مثل هذه المحادثات، وهو ما يظل الأداة الرئيسية للتنفيذ — عندما تنتهي محادثة، لا يمكن إرسال المزيد من الرسائل في تلك المحادثة، لكن المحادثات الأخرى غير متأثرة.
أعطت Anthropic في المقام الأول Claude خيار إنهاء المحادثات في أغسطس 2025 أثناء بحثها في رفاهية الذكاء الاصطناعي، وجدت أن Claude Opus 4 أظهر "مقاومة قوية ومستمرة للضرر" والتوتر خلال التفاعلات العنيفة. السياسة المعاد تنظيمها تضيف أيضًا قسم حملات احتيالية التي تحظر التقييمات الوهمية، وال astroturfing، والروبوتات التي تتنكر كبشر، وهو ما دفعه إساءة استخدام وسائل الإعلام الحكومية والشركات التجارية. القواعد الجديدة تغطي الأسلحة (حظر تعديل العوامل البيولوجية/الكيميائية وتسلح الطائرات المُلَّحقة)، الإنفاذ (حظر القرارات التحقيقية وأدوات المراقبة)، الإجراءات الجسدية (متطلبات الإشراف البشري على التحكم في الأجهزة)، والمحتوى الضار (حظر أدوات الصور الجنسية غير المرغوب فيها). السياسة تدخل حيزة التنفيذ في 12 نوفمبر.
المصدر: MacRumors · لخّصه HeadlinesBriefing