HeadlinesBriefing favicon HeadlinesBriefing.com

OpenAI AI এজেন্টসের সাথে গবেষণা তাড়াতাড়ি করছে

Hacker News •
×

এগি যাতে AGI সম্পূর্ণ মানবজাতাকে লাভ করবে, আমরা মনে করি এটি demokratically governed হতে হবে। এটি সম্ভব csak knowledgeable publique debate about the capabilities, risks and safeguards of highly capable AI systems মাধ্যমে। পৃথিবীর সবাইকে আগের AI frontier systemsের संभाव্য ভবিষ্যৎ ট্র্যাক্টরি বোঝাতে হবে, তাতে তারা এর বিকাশে znaczক অর্থাৎ meaningful voice পায়। নির্দিষ্টリスク, incidents এবং safeguards সম্পর্কে transparency necesaria, কিন্তু sufficient নয়। আমরা মনে করি públicoও বোঝাতে হবে কীভাবে সবচেয়ে সক্ষম systems উন্নত হচ্ছে, এবং কীভাবে frontier labsে research progress চালাচ্ছে। আমরা সুরক্ষাময়ভাবে একটি অটোমেটেড AI গবেষক তৈরি করতে চাই যা মানব সুপারভিশনে কাজ করবে, গহন শিক্ষা এবং সামঞ্জস্য উন্নত করতে, পরিক্রমাগত উন্নতি সক্ষম করবে। আমাদের পরিমাপ অনুযায়ী, আমরা এখন পেছনের autumn ঘোষণা করা লক্ষ্য, এই বছর সেপ্টেম্বর পর্যন্ত অটোমেটেড research intern পায়।" research intern " দ্বারা, আমাদের মানে হলো skilled researcher একে কিছু দিন লাগে এমন well-defined research tasks under human direction করতে পারে এমন একটি system। আমরা মার্চ 2028 পর্যন্ত অটোমেটেড AI গবেষক তৈরি করার দিশায় মজবুর প্রগতি করছি। এই বছর, OpenAI के शोधकर्ताओंের দৈনন্দিন কাজে বদলাবadt আনা হয়েছে। শोधকर्तা পূর্ণ দিন কোডিং এজেন্ট ব্যবহার করছেন (অক্সরপ্লে সেশনস মধ্যে অক্সরপ্লে), এবং মোট ব্যবহার দ্রুত বেড়ছে, অন্য OpenAI teamsের বৃদ্ধির তুলনায়। শोधকর্তা কোড দ quicker দিয়ে দিয়ে योगदान দিয়ে এবং অধিক পরীক্ষা চালাচ্ছেন। শोधকর্তারা কীভাবে এজেন্ট ব্যবহার করছেন, এটিও বদলাচ্ছে: এজেন্ট জটিল task संभালছে এবং সেগুলো অধিক বার সফল হচ্ছে। AI গবেষণা একটি জটিল প্রক্রিয়া যার মধ্যে অনেক potential bottleneck আছে, তাই মোট প্রগ্রেসের প speed এটা এই নির্দিষ্ট মেট্রিকসের সাথে মেলে না পারে। কিন্তু মোট体,these findings আমাদের আত্মিক অনেক মানুষের বোঝায় generic প্রভাবের সাথে suitable, যে এজেন্ট টুলস actually research progress তাড়াতাড়ি করছে। মানুষ আজও আমাদের গবেষণা প্রriority নির্ধারণ করছেন, আইডি কী ideas এবং results persegu করতে চায়, এবং decide করতে পারছেন কি বাড়াব, থামাব, বা systemsdeploy করতে। যদি জিম্মেদারভাবে করা হয়, তবে আমরা মনে করি অটোমেটেড AI গবেষণা থেকে মডেল তৈরি হবে যা মানব কল্যাণে সরাসরি বর্ধন করবে এবং OpenAI মিশনকে আগেয়ে যাবে। এটি উন্নত বুদ্ধিমত্তার খরচ কমাতে পারে যাতে পৃথিবীর সবাই লাভ করতে পারে। আমরা এই কাজের অংশে therefore করছি কারণ অটোমেটেড গবেষণা আমাদেরকে alignment সমাধান করতে এবং দিনে আরও সক্ষম AI এজেন্টসের Against রক্ষা বনাম করতে সাহায্য করতে পারে। একটি অটোমেটেড AI গবেষক একটি অটোমেটেড সিক SECURITY বা alignment গবেষকও হতে পারে। অধিক সক্ষম এবং সামঞ্জস্যপূর্ণ systems কীভাবে ক্ritical infrastructure সুরক্ষা করতে পারে, দারুণ AI এজেন্টসের Against রক্ষা করতে পারে, এবং নতুন রক্ষামূলক measure বিকাশ করতে পারে। এই ব্যবহারীয় অটোমেটেড গবেষণা ক্ষমতা বিকাশের জন্য কারণ, কিন্তু এর মানে এটিই না যে rapid RSI perseguir করা উচিত। কেউ কীভাবে also আগের বনাম মানব কন্ট্রোল রাখতে এবং লব profit এবং risk সম্পর্কে informed democratic選択ে about about। আমরা এখনও নিশ্চিত না যে কীভাবে safely পূর্ণরূপে aligned RSI পায়। আমরা ক্ষমতা সাথে scales-up করছি এবং alignment এবং security measure। কিন্তু আমরা যেকোনোভাবে assumption না করি যে alignment এবং security প্রগ্রেস ক্ষমতার সাথে কাপে রাখবে, এবং অধিক সক্ষম systems কীভাবে কঠিন মনিটর করা হবে। সাবধান alignment এবং security কাজ এই প্রচেষ্টার কে কেন্দ্রে আছে, এবং এটি আজ এজেন্ট কোডিং সিস্টেমে দেখা গেলে security সমস্যা measurement এবং mitigating থেকে শুরু হয়। যেকোনোভাবেই পাবা যাক যে proceeding would pose an unacceptable safety risk, আমরা প্রয়োগ করবো উপযুক্ত প্রতিক্রিয়া, অন্তর্ভুক্ত করে slowing বা stopping our development বা deployment of systems যা আমরা ourselves কে sufficient safeguard না পায়। আপনার récents Hugging Face ঘটনা পরপর, আমরা এই প্রতীকমককে কার্যকর করেছি, reinforcement learning (RL) training on our latest models meant for deployment mientras we further hardened এবং red-teamed our research environments এবং expanded coverage of our monitoring systems।