arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Xiaohongshu(小红书)

2026-01-30 至 2026-01-30 共收录 2
2601.21919 2026-01-30 cs.AI cs.CL

Self-Compression of Chain-of-Thought via Multi-Agent Reinforcement Learning

通过多智能体强化学习实现链式思维的自我压缩

Yiqun Chen, Jinyuan Feng, Wei Yang, Meizhi Zhong, Zhengliang Shi, Rui Li, Xiaochi Wei, Yan Gao, Yi Wu, Yao Hu, Zhiqiang Pu, Jiaxin Mao

机构 * Renmin University of China(中国人民大学) Xiaohongshu Inc.(小红书公司) Institute of Automation,Chinese Academy of Sciences(中国科学院自动化研究所) University of Southern California(南加州大学) Shandong University(山东大学)

AI总结 通过多智能体强化学习实现链式思维的自我压缩,有效减少响应长度并提升准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21916 2026-01-30 cs.AI cs.CL cs.IR

JADE: Bridging the Strategic-Operational Gap in Dynamic Agentic RAG

JADE:动态代理RAG中战略-操作鸿沟的弥合

Yiqun Chen, Erhan Zhang, Tianyi Hu, Shijie Wang, Zixuan Yang, Meizhi Zhong, Xiaochi Wei, Yan Gao, Yi Wu, Yao Hu, Jiaxin Mao

机构 * Renmin University of China(中国人民大学) Xiaohongshu Inc.(小红书公司) Institute of Automation,Chinese Academy of Sciences(中国科学院自动化研究所) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 JADE通过联合优化规划与执行,解决动态代理RAG中战略与操作不匹配的问题,提升多轮工作流的性能与灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏