Causal Reward World Models: Zero-shot Reward Design for Automated Skill Generation
因果奖励世界模型:面向自动化技能生成的零样本奖励设计
Yang Yang, Yuchuang Tong, Zhengtao Zhang, Xu Ding, Ning Yang, Yifan Zhang, Haipeng Li, Kehu Yang, Miao Xin
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Intelligent Manufacturing Institute, HFUT(合肥工业大学智能制造研究院)
;
School of Electrical Engineering and Automation, Anhui University(安徽大学电气工程与自动化学院)
;
School of Artificial Intelligence, China University of Mining and Technology (Beijing)(中国矿业大学(北京)人工智能学院)
;
National Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institution of Automation, Chinese Academy of Sciences(中国科学院自动化研究所复杂系统认知与决策智能全国重点实验室)
专题命中
效率与部署
:LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract)
Building AI Companions that Prioritise Learning over Performance
构建以学习优先于性能的人工智能伴侣
Hassan Khosravi, Dragan Gasevic, Shazia Sadiq, Lixiang Yan, Jason Lodge, Jason Tangen, Paul Denny, Kristen DiCerbo, Simon Buckingham Shum, Ryan S. Baker
专题命中
效率与部署
:LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)
3D Smoke Scene Reconstruction Guided by Vision Priors from Multimodal Large Language Models
由多模态大语言模型视觉先验引导的3D烟雾场景重建
Xinye Zheng, Fei Wang, Yiqi Nie, Kun Li, Junjie Chen, Jiaqi Zhao, Yanyan Wei, Zhiliang Wu
机构
*
Hefei University of Technology(合肥工业大学)
;
Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合性国家科学中心人工智能研究院)
;
Anhui University(安徽大学)
;
United Arab Emirates University(阿联酋大学)
;
Nanyang Technological University(南洋理工大学)
专题命中
效率与部署
:large language model(title);language model(title)
机构
*
Artificial Intelligence Innovation and Incubation Institute, Fudan University(复旦大学人工智能创新与孵化院)
;
School of Data Science, Fudan University(复旦大学数据科学学院)
;
College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院)
;
Department of Information and Intelligence Development, Zhongshan Hospital, Fudan University(复旦大学中山医院信息与智能发展部)
SpecBound: Adaptive Bounded Self-Speculation with Layer-wise Confidence Calibration
SpecBound: 带层间置信度校准的自适应有界自我猜测
Zhuofan Wen, Yang Feng
机构
*
Key Laboratory of Intelligent Information Processing, Institute of Computing Technology, Chinese Academy of Sciences(智能信息处理重点实验室,计算技术研究所,中国科学院)
;
State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(人工智能安全国家重点实验室,计算技术研究所,中国科学院)
;
University of Chinese Academy of Sciences, Beijing, China(中国科学院大学,北京,中国)
专题命中
效率与部署
:LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG