HeadlinesBriefing favicon HeadlinesBriefing.com

Dream-RSI permite auto-melhoria recursiva da IA

Hacker News •
×

Autores: Tong Zheng, Xidong Wu, Zheng Zhang, Zhankui He, Chaoyi Zhang, Benjamin Coleman, Ruoqiao Wei, Di Bai, Haolin Liu, Rui Liu, Xue Wang, Yue Zhuan, Wang-Cheng Kang, Renkai Xiang, Heng Huang, Xinwu Cheng, Yunsong Guo

Dream-RSI introduz um quadro para uma auto-melhoria recursiva escalável em agentes de IA autônomos. O sistema aborda o gargalo de exploração tornando a história de descoberta explícita e programável por meio de uma camada de orquestração leve. O insight-chave utiliza a história acumulada de descoberta como um simulador de replay sobre o espaço de busca realizado. Ao realizar sonhos neste simulador de replay histórico, Dream-RSI garante feedback imediato e de baixo custo, off-policy, para avaliar e refinar políticas de exploração sem avaliações on-line caras. A política melhorada é redesployada on-line para impulsionar mais descobertas, expandindo continuamente o pool de simuladores em um loop de auto-melhoria. Em engenharia de algoritmos, otimização matemática e engenharia de kernels GPU, Dream-RSI alcança qualidade de descoberta competitiva ou melhorada, reduzindo significativamente o custo de descoberta em várias configurações. A submissão provém de Tong Zheng e está disponível como PDF e versão HTML experimental.