ClueWeaver: Reward-Guided Dual-Agent Evidence Reasoning for Compact LLMs on Literary Long Narratives
ClueWeaver:面向紧凑型大语言模型的、针对文学长篇叙事的奖励引导双智能体证据推理框架
Jihao Zhu, Zhiwei Yang, Wenxiao Zhang, Junqian Zhao, Qi You, Fangqi Wang, Zheyuan Deng, Hanzhe Yang, Yu Liu, Jin B. Hong
机构
*
Institute of Information Engineering, CAS(中国科学院信息工程研究所)
;
University of Aberdeen(阿伯丁大学)
;
The University of Western Australia(西澳大学)
;
Brown University(布朗大学)
It's a matter of timescale: non-linear utility in successor features and multi-objective planning and learning
这是一个时间尺度问题:后继特征与多目标规划和学习中的非线性效用
Liam P.H. Mertens, Lucas N. Alegre, Florent Delgrange, Diederik M. Roijers, Ann Nowé, Peter Vamplew
机构
*
AI Lab, Vrije Universiteit Brussel(布鲁塞尔自由大学AI实验室)
;
Institute of Informatics - Federal University of Rio Grande do Sul(南大河州联邦大学信息学研究所)
;
Federation University Australia(澳大利亚联邦大学)
Agentic Game Development as a Verifiable Trajectory Data Engine for Scaling World Models
智能体游戏开发:用于扩展世界模型的可验证轨迹数据引擎
Pengfei Zhou, Hexin Wang, Zhengfeiyang Zhang, Yixing Ma, Zhenglin Wan, Kaipeng Zhang, Wangbo Zhao, Yang You
机构
*
Cardinal AI Lab(卡迪纳尔人工智能实验室)
;
University of California, Berkeley(加州大学伯克利分校)
;
Hong Kong University of Science and Technology(香港科技大学)
;
National University of Singapore(新加坡国立大学)
;
HPC-AI Lab(高性能计算与人工智能实验室)
机构
*
School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)人工智能学院)
;
vivo AI Lab(vivo AI实验室)
;
University of the Chinese Academy of Sciences(中国科学院大学)
;
Southeast University(东南大学)
;
Peking University(北京大学)
;
School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)理工学院)
;
Shenzhen Future Network of Intelligence Institute (FNii-Shenzhen)(深圳未来智能网络研究院)
;
Guangdong Provincial Key Laboratory of Future Networks of Intelligence, CUHK-Shenzhen(香港中文大学(深圳)广东省未来智能网络重点实验室)