আমরা সম্প্রতি আমাদের মডেল থেকে সুরক্ষিত যুক্তি বের করার জন্য ডিজাইন করা একটি সমন্বিত অভিযান শনাক্ত ও ব্যাহত করেছি, যার earliest observed activity জুলাই মাসের প্রথম সপ্তাহে ঘটে। এই কার্যকলাপ প্রতিকূল ডিস্টিলেশনের সাথে সামঞ্জস্যপূর্ণ: অন্য একটি মডেলকে প্রশিক্ষণ, পুনরুৎপাদন বা উন্নত করতে সাহায্য করার জন্য একটি মডেলের আউটপুট বা যুক্তির পদ্ধতিগত এবং অননুমোদিত ব্যবহার। অপারেটররা মডেল মিথস্ক্রিয়াকে এমনভাবে ম্যানিপুলেট করেছিল যাতে সুরক্ষিত যুক্তি অনুরোধকারীর কাছে দৃশ্যমান আকারে একটি সমন্বিত, বর্ধিত পদ্ধতিতে পুনরুৎপাদন করা যায়, যা আমাদের পরিষেবার শর্তাবলী লঙ্ঘন করে।
আমরা লক্ষ্য করেছি যে অপারেটররা নতুন উপায়ে সুরক্ষিত যুক্তি বের করার চেষ্টা করেছিল, যার মধ্যে একটি কথোপকথন থেকে এনক্রিপ্ট করা যুক্তি কপি করা এবং অন্য কথোপকথনে একটি মডেলকে লুকানো যুক্তির বিষয়বস্তু ডিক্রিপ্ট ও ট্রান্সক্রাইব করতে বলা অন্তর্ভুক্ত। এই কার্যকলাপ 1 জুলাই শুরু হয়, যার মধ্যে 24 ও 25 জুলাই উচ্চ-ভলিউম স্পাইক ছিল, যা 4,000 এর বেশি ব্যবহারকারী থেকে 16,000 অনুরোধ নিয়ে গঠিত। আরও তদন্তে 15,000 এর বেশি ব্যবহারকারী এর একটি ক্লাস্টার জুড়ে সম্পর্কিত প্রম্পট-প্যাটার্ন কার্যকলাপ চিহ্নিত করা হয়েছে, যা আমরা 28 জুলাই এর মধ্যে সম্পূর্ণরূপে ব্যাহত করেছি।
আমরা কার্যকলাপের একটি মূল ক্লাস্টারকে Moonshot AI (Kimi-এর ডেভেলপার) এর সাথে যুক্ত ব্যক্তিদের জন্য দায়ী করি। প্রতিকূল ডিস্টিলেশন নিরাপত্তা ও জাতীয় নিরাপত্তা ঝুঁকি তৈরি করে। বের করা যুক্তি আসল মডেলের ব্যবহারকারী-মুখী আউটপুটে প্রয়োগ করা সুরক্ষা সংরক্ষণ না করে অন্য একটি মডেলকে প্রশিক্ষণ দিতে ব্যবহার করা যেতে পারে।
আমরা অ্যাকাউন্ট প্রয়োগ, প্রযুক্তিগত নিয়ন্ত্রণ এবং অংশীদার সমন্বয়ের সমন্বয়ের মাধ্যমে এই সাম্প্রতিক ডিস্টিলেশন অভিযানকে প্রশমিত করেছি। আমরা ব্যবহারকারী, ওয়ার্কস্পেস, সংস্থা এবং মডেল পরিবার জুড়ে লুকানো যুক্তির জন্য সুরক্ষা জোরদার করেছি।
উৎস: OpenAI Blog · সারাংশ: HeadlinesBriefing