HeadlinesBriefing favicon HeadlinesBriefing.com

AI কোড কমেন্ট ডিটেক্টর: 77% নির্ভুলতা

Hacker News •
×

যখন আমি আগের AI কমেন্ট ক্লাসিফায়ার প্রশিক্ষণ দিয়েছিলাম, তখন আমি আংশিক ব্যক্তিগত/প্রাইভেট ডেটা ব্যবহার করেছিলাম এবং এটি কিছুটা অস্থিতিশীল ভিত্তির উপর নির্মাণ করেছিলাম, তাই আমি কোড বা ডেটা ভাগ করতে পারিনি। আমি এটি পাবলিক ডেটা এবং একটি ভাল ভিত্তির উপর পুনর্নির্মাণ করেছি!

প্রথমে, আপনি এটি চেষ্টা করে দেখতে চাইতে পারেন। আপনি সেই ওয়েব পেজে আটকে দেওয়া কিছুই আপনার ব্রাউজার ছেড়ে যায় না, তাই আপনি নিরাপদে যা খুশি তা নিয়ে চেষ্টা করতে পারেন। আমি কিছু পরীক্ষককে এর একটি আগের সংস্করণ চেষ্টা করার জন্য আমন্ত্রণ জানিয়েছি, এবং তারা প্রধানত ইতিবাচক প্রতিক্রিয়া দিয়েছে। আমরা পূর্ববর্তী নিবন্ধে যেভাবে রোবট-বিশিষ্টতাগুলি বিশ্লেষণ করেছি সেভাবে আমরা সেগুলি বিশ্লেষণ করব না, কারণ নতুন ক্লাসিফায়ারের ইউজার ইন্টারফেসে আপনি শ্রেণীবদ্ধ পাঠ্যের যেকোনো অংশে ক্লিক করতে পারেন দেখতে যে সেই অংশে কোন বৈশিষ্ট্যগুলি সক্রিয় হয় এবং সেগুলি সামগ্রিক বিচারে কীভাবে অবদান রাখে।

কর্মক্ষমতা সম্পর্কে, মূল সংখ্যা হল 77% ভারসাম্যপূর্ণ নির্ভুলতা। এর অর্থ হলো, মানুষ বনাম রোবটের রায় সঠিকভাবে বিচার করার জন্য ক্লাসিফায়ারটি কতবার সঠিক হয়, ধরে নিলাম মানুষ-লিখিত এবং রোবট-উত্পন্ন মন্তব্য সমান সম্ভাব্য। ক্লাসিফায়ারটি একটি ভবিষ্যদ্বাণীকৃত শতাংশও আউটপুট করে যা ক্রমাঙ্কিত, যার অর্থ এটিকে নির্দিষ্ট রায় সঠিক হওয়ার সম্ভাবনা হিসাবে পড়া যেতে পারে। আমরা ক্রমাঙ্কন বক্ররেখার মাধ্যমে এটি পরীক্ষা করি, যা দেখায় যে ক্লাসিফায়ারটি একটি পরিচিত সম্ভাবনার ইভেন্টে কী সম্ভাবনা বরাদ্দ করে। যেহেতু সমস্ত বিন্দু রেফারেন্স কর্ণের খুব কাছাকাছি, আমরা জানি তারা প্রায় সঠিক।

যখন ক্লাসিফায়ার খুব আত্মবিশ্বাসী হয় – যেমন যখন আত্মবিশ্বাস 80% বা তার বেশি হয় – মিথ্যা ইতিবাচক ঝুঁকি 5% এ নেমে আসে। আমি মানুষের এবং রোবটের বাস্তব-বিশ্বের মন্তব্যের একটি ছোট, অ-সিন্থেটিক সেটও ম্যানুয়ালি পরীক্ষা করেছি যাতে দেখা যায় ক্লাসিফায়ারটি নমুনার বাইরে সামান্য কতটা সাধারণীকরণ করে। এটি 88% নির্ভুলতায় অনুবাদ করে। অবশ্যই, এই সব শুধুমাত্র কোড মন্তব্য দিয়ে পরীক্ষা করা হয়েছে। ক্লাসিফায়ারটি অন্যান্য ধরণের রোবট-উত্পন্ন পাঠ্য সনাক্ত করার জন্য তৈরি করা হয়নি।

প্রশ্নোত্তর: নতুন AI কোড কমেন্ট ক্লাসিফায়ারের ভারসাম্যপূর্ণ নির্ভুলতা কত?

ভারসাম্যপূর্ণ নির্ভুলতা 77%, যার অর্থ এটি 77% সময় সঠিকভাবে মানুষ বনাম রোবট বিচার করে যখন উভয় শ্রেণি সমান সম্ভাব্য হয়।