HeadlinesBriefing favicon HeadlinesBriefing.com

এলএলএম ওয়াটারমার্কিং-এর আইএ এজেন্ট আচরণের উপর প্রভাব

Hacker News •
×

অ্যান্থ্রোপিক ঘোষণা করেছে যে ভবিষ্যের ক্লোড মডেলগুলো গুগল ডিপমাইন্ডের সিন্থ আইডি-টেক্স্টের ভিত্তিতে অদৃশ্য ওয়াটারমার্ক ব্যবহার করবে। এই ওয়াটারমার্কিং, যা ইউরোপিইন ইউনিয়নের আইএ আইনের ৫০(২) নম্বর আর্টিকেল দ্বারা সিন্থেটিক টেক্স্টের জন্য প্রয়োজনীয়, মডেলের টোকেন জেনারেশন প্রক্রিয়া পরিবর্তন করে। মডেল স্তরে, এটি নিরাপত্তার আচরণ পরিবর্তন করতে পারে, যেমন ক্ষতিকর অনুরোধ প্রত্যাখ্যান করা, এবং এগুলোকে প্রম্পট ইনজেকশনের জন্য ঝুঁকিতে ফেলতে পারে। এজেন্ট স্তরে, একই স্যাম্পল করা টোকেন নির্ধারণ করে যে কোন টুল কল করা হয় এবং কী যুক্তিসমূহ পাঠানো হয়। এই আচরণগত প্রভাকে স্যাম্পলিং ড্রিফ্ট বলা হয়, এবং এটি মডেলের প্রত্যাখ্যান আচরণ এবং এজেন্টের টুল কল উভয়ের মধ্যে নিশ্চিত হয়েছে। এই প্রভাব মডেল এবং কী-র উপর নির্ভরশীল এবং একত্রীকৃত স্কোরের দ্বারা অন্ধকার করা যেতে পারে। আর্টিকেলটি আইএ নিরাপত্তা এবং নিরাপত্তার জন্য অর্থহীনতা এবং ডেভেলপারদের কী করা উচিত তা আলোচনা করে। অ্যান্থ্রোপিকের ডিপ্লয়মেন্ট মডেল স্তরে ওয়াটারমার্ক প্রয়োগ করে, যা ক্লোড প্লাটফর্ম এপিএ এবং ক্ল৉ড প্রদাতাদের মাধ্যমে অ্যাক্সেস করা সমর্থিত মডেলগুলোকে আবৃত করে, যা মডেল স্তরের আচরণগত প্রভাবকে এই মডেলগুলোর চারোদিকে তৈরি করা এজেন্টদের জন্য প্রাসঙ্গিক করে। সিন্থ আইডি-টেক্স্ট দ্বারা ব্যবহৃত টুর্নামেন্ট স্যাম্পলিং, মডেল যেখানে অনিশ্চিত সেখানে টোকেন নির্বাচন পরিবর্তনের সুযোগ বেশি করে, যা একটি এজেন্ট যে যুক্তিসমূহ নির্বাহ করে তা পরিবর্তন করতে পারে।