HeadlinesBriefing favicon HeadlinesBriefing.com

এলোমেলো পুরস্কার ক্লাসিক গেম থিওরি সমৃদ্ধ করে

Ars Technica •
×

সরল খেলা শব্দের মুখোমুখি হলে সমৃদ্ধ কৌশল অর্জন করে। ঐতিহ্যবাহী খেলা সাধারণত একটি স্থির পটভূমির বিরুদ্ধে খেলা হয়: প্রতিটি ফলাফলের জন্য পুরস্কার ধ্রুবক। এটি আচরণের সাথে তাদের প্রাসঙ্গিকতা সীমাবদ্ধ করে কারণ বাস্তব জীবনে, কৌশলগত পছন্দের পুরস্কার এবং পরিণতি সর্বদা পরিবর্তিত হয়। এখন, গবেষকরা একটি গাণিতিক মডেল ব্যবহার করে এমন একাধিক খেলা অধ্যয়ন করেছেন যাতে বিবর্তনশীল কৌশল এবং এলোমেলোভাবে পরিবর্তিত রিটার্ন অন্তর্ভুক্ত রয়েছে।

সম্ভবত সবচেয়ে বিখ্যাত গেম-থিওরি প্রতিযোগিতা হল বন্দীর দ্বিধা। বন্দীর দ্বিধায়, এক জোড়া চোরকে ধরা হয়েছে এবং পুলিশ তাদের আলাদাভাবে জিজ্ঞাসাবাদ করছে। যদি উভয়েই চুপ থাকে, তবে তাদের একটি কম অপরাধের জন্য শাস্তি দেওয়া হবে। যদি একজন বন্দী একটি চুক্তি করে (দলত্যাগ করে) তবে সেই বন্দী মুক্তি পায় এবং অন্যজন আরও ভারী সাজা পায়। যদি উভয়েই চুক্তি করে, তবে উভয়েই মাঝামাঝি শাস্তি পায়। যে ব্যক্তি খেলাটি পরিচালনা করছে সে সহযোগিতা এবং দলত্যাগের জন্য বিভিন্ন পুরস্কার দিয়ে এটি শুরু করতে পারে যাতে পুরস্কার এবং ঝুঁকির সাথে সর্বোত্তম কৌশল কীভাবে পরিবর্তিত হয় তা অন্বেষণ করা যায়, যা খেলোয়াড়রা একাধিক রাউন্ডে কৌশল পরিবর্তন করে বুঝতে পারে। চুপ থাকার (সহযোগিতা) পুরস্কার এবং বিশ্বাসঘাতকতার মধ্যে ভারসাম্যের উপর নির্ভর করে, খেলাটি সবাই সবাইকে বিশ্বাসঘাতকতা করার সাথে স্থিতিশীল হয়। এই সরল পরিস্থিতিতে, সবাই হারে। অনুরূপ গতিশীলতা চিকেন, পাথর-কাগজ-কাঁচি এবং আরও অনেক খেলায় পাওয়া যায়।

কৌশলগুলির বিবর্তন স্থিতিশীল জনসংখ্যা, দ্বি-স্থিতিশীল জনসংখ্যা (যেখানে জনসংখ্যা দুটি স্থিতিশীল কৌশলের মধ্যে পরিবর্তিত হয়), বা সীমা চক্রের দিকে নিয়ে যেতে পারে, যেখানে জনসংখ্যা একাধিক কৌশলের মধ্যে ক্রমাগত পরিবর্তিত হয়। খেলা চলাকালীন খেলা পরিবর্তনেরও একটি সমৃদ্ধ ইতিহাস রয়েছে। সাধারণত, এগুলি খেলার মধ্যে পরিবর্তন। উদাহরণস্বরূপ, আপনি উপলব্ধ পুরস্কারের পরিমাণে একটি সীমা নির্ধারণ করতে পারেন, তাই রাউন্ডের সংখ্যা বাড়ার সাথে সাথে ক্রমবর্ধমান সীমিত সম্পদ বিবেচনায় নেওয়ার জন্য কৌশলগুলি বিকশিত হয়। অন্য কথায়, এই পুরানো কাজের বেশিরভাগই এমন পরিস্থিতি অধ্যয়ন করেছে যেখানে বর্তমান রাউন্ডে খেলোয়াড়ের আচরণ পরবর্তী রাউন্ডের জন্য উপলব্ধ সম্পদ বা পুরস্কার পরিবর্তন করে।

তবে বাস্তব জীবনে, আমরা বাহ্যিক কারণ দ্বারা চালিত হই যা আমাদের নিয়ন্ত্রণে নেই। খরগোশ তার গর্তে বন্যা সৃষ্টিকারী বৃষ্টি বা তার খাদ্য ধ্বংসকারী খরা নিয়ন্ত্রণ করে না। প্রতিটি রাউন্ডে খেলা পরিবর্তিত হয় কারণ প্রতিটি কৌশলের ঝুঁকি এবং পুরস্কার সময়ের সাথে পরিবর্তিত হয়। গবেষকরা স্বীকৃতি দিয়েছেন যে এই গতিশীলতাগুলি একটি গাণিতিক মডেলে অন্তর্ভুক্ত করলে নতুন আচরণ প্রকাশ করতে পারে। এবং তারা ভুল ছিল না। উপরে বর্ণিত বন্দীর দ্বিধার শুধুমাত্র একটি স্থিতিশীল বিন্দু রয়েছে (সবাই হারে)। মডেলটি দ্রুত সেই বিন্দুতে একত্রিত হয়, যেখানে সমস্ত খেলোয়াড় কয়েক রাউন্ডের মধ্যে একই কৌশল গ্রহণ করে। কিন্তু নতুন কাজটি দেখেছে যে যদি পুরস্কার সময়ের সাথে পরিবর্তিত হয় (এমনকি অল্প পরিমাণেও), তবে মডেল থেকে একটি দ্বিতীয় স্থিতিশীল বিন্দু আবির্ভূত হয়, যা সহযোগী এবং দলত্যাগী উভয়কেই সহাবস্থান করতে দেয়। আরও বেশি পরিবর্তনের অধীনে, দলত্যাগী বিন্দু অস্থিতিশীল হয়ে যায়, যার অর্থ কেবল সহযোগীরা বিদ্যমান। চিকেনে, মডেলের ফলাফল কিছুটা ভয়ঙ্কর: পুরস্কারে কোনও পরিবর্তন না থাকলে, স্থিতিশীল বিন্দু হল সবাই সরে যায় এবং আমরা সবাই বেঁচে থাকি। শুধু একটু পরিবর্তন যোগ করুন, এবং একটি জনসংখ্যা আবির্ভূত হয় যা সরে না। আরও শব্দ যোগ করুন, এবং বেঁচে থাকা এবং সংঘর্ষের মধ্যে একটি দ্বি-স্থিতিশীল পরিবর্তন আবির্ভূত হয়। (যেহেতু চিকেন মূলত স্নায়ুযুদ্ধের কৌশল ছিল, আমি আরও বিস্মিত যে আমরা সবাই আমাদের পরবর্তী অস্তিত্বের চ্যালেঞ্জ মোকাবেলার জন্য বেঁচে গেছি।) পাথর-কাগজ-কাঁচির জন্য, আরও জটিল গতিশীলতা আবির্ভূত হয়। স্থিতিশীল এবং অস্থিতিশীল বিন্দুর পরিপ্রেক্ষিতে, নিয়মিত পাথর-কাগজ-কাঁচির কোনও স্থিতিশীল বিন্দু নেই - কৌশলটি কখনই সবাই পাথর বেছে নেওয়ার মধ্যে স্থির হয় না, উদাহরণস্বরূপ। পরিবর্তে, সবাই তিনটি বিকল্পের মধ্যে ক্রমাগত পরিবর্তন করতে থাকে। তবে, যদি পুরস্কার প্রতি রাউন্ডে এলোমেলোভাবে পরিবর্তিত হয়, নতুন স্থিতিশীল এবং অস্থিতিশীল বিন্দু আবির্ভূত হয়। কেসের উপর নির্ভর করে, এটি খেলাটিকে আরও...