HeadlinesBriefing favicon HeadlinesBriefing.com

Dream-RSI ढांचा पुनरावर्ती AI आत्म-सुधारन

Hacker News •
×

लेखक: Tong Zheng, Xidong Wu, Zheng Zhang, Zhankui He, Chaoyi Zhang, Benjamin Coleman, Ruoqiao Wei, Di Bai, Haolin Liu, Rui Liu, Xue Wang, Yue Zhuan, Wang-Cheng Kang, Renkai Xiang, Heng Huang, Xinwu Cheng, Yunsong Guo

Dream-RSI एक ढांचा प्रस्तुत करता है जो स्वतंत्र AI एजेंट्स में पुनरावर्ती आत्म-सुधार के लिए स्केलेबल है। यह सिस्टम खोज बैंकर प्रोग्राम करने के लिए एक हल्का ओर्केस्ट्रेशन लेयर के माध्यम से खोज इतिहास को स्पष्ट और प्रोग्रामेबल बनाकर समस्या को हल करता है। मुख्य अंतर्दृष्टि ने प्राप्त खोज इतिहास का उपयोग समीकृत खोज स्थान पर रीप्ले सिमुलेटर के रूप में किया है। इस ऐतिहासिक रीप्ले सिमुलेटर में सपने देने के साथ, Dream-RSI तुरंत, कम लागत वाली ऑफ-पॉलिसी फ़ीडबैक सुनिश्चित करता है ताकि बिना महंगी ऑनलाइन मूल्यांकन के खोज नीतियों का मूल्यांकन और सुधार किया जा सके। सुधारी गई नीति को आगे के खोज के लिए ऑनलाइन फिर से तैनात किया जाता है, जो सिमुलेटर पूल का निरंतर विस्तार करता है एक आत्म-सुधार वाले लूप में। एल्गोरिदम इंजीनियरिंग, गणितीय अनुकूलन और GPU कर्नेल इंजीनियरिंग में, Dream-RSI कई सेटिंग्स में खोज गुणवत्ता में स्पतंत्र या सुधार हासिल करता है जबकि खोज लागत को काफी हद तक कम करता है। यह सबमिशन Tong Zheng से है और PDF तथा प्रयोगात्मक HTML संस्करण के रूप में उपलब्ध है।