HeadlinesBriefing favicon HeadlinesBriefing.com

إطار Dream-RSI يمكنه التحسين الذاتي المتكرر

Hacker News •
×

المؤلفون: Tong Zheng, Xidong Wu, Zheng Zhang, Zhankui He, Chaoyi Zhang, Benjamin Coleman, Ruoqiao Wei, Di Bai, Haolin Liu, Rui Liu, Xue Wang, Yue Zhuan, Wang-Cheng Kang, Renkai Xiang, Heng Huang, Xinwu Cheng, Yunsong Guo

يقدم Dream-RSI إطاراً للتحسين الذاتي المتكرر القابل للتوسع في وكلاء الذكاء الاصطناعي المستقلة. يتعامل النظام مع bottleneكهل استكشافي من خلال جعل تاريخ الاكتشاف صريحاً وقابلاً للبرمجة من خلال طبقة تنسيق خفيفة الوزن. الفكرة الرئيسية تستخدم تاريخ الاكتشاف المتراكم كمحاكي استعادة على فضاء البحث المحقق. من خلال القيام بحلم في هذا المحاكي الاستعادي التاريخي، يحقق Dream-RSI تغذة راجعة فورية ومنخفضة التكلفة خارج السياسة لتقييم وتحسين سياسات الاستكشاف دون الحاجة إلى تقييمات أونلاين مكلفة. تم إعادة نشر السياسة المحسنة أونلاين لدفع المزيد من الاكتشاف، موسعة باستمرار مجموعة المحاكيات في حلقة ذاتية التحسين. عبر هندسة الخوارزميات، والتحسين الرياضي، وهندسة نواة GPU، يحقق Dream-RSI جودة اكتشاف تنافسية أو محسنة بينما يقلل بشكل كبير من تكلفة الاكتشاف في عدة إعدادات. يأتي هذا الإرسال من Tong Zheng وهو متاح بصيغة PDF وإصدار HTML تجريبي.