机构
*
Vanke School of Public Health, Tsinghua University, Beijing, China(范克学校公共卫生学院,清华大学,北京,中国)
;
Zhongguancun Academy, Beijing, China(中关村学院,北京,中国)
;
Department of Electronic Engineering, Tsinghua University, Beijing, China(电子工程系,清华大学,北京,中国)
Inducing Causal World Models in LLMs for Zero-Shot Physical Reasoning
在LLM中诱导因果世界模型以实现零样本物理推理
Aditya Sharma, Ananya Gupta, Chengyu Wang, Chiamaka Adebayo, Jakub Kowalski
机构
*
Department of Electrical Engineering(电气工程系)
;
Indian Institute of Technology Bombay(印度理工学院孟买分校)
;
Department of Computer Science and Automation(计算机科学与自动化系)
;
Indian Institute of Science(印度科学研究所)
;
Department of Computer Science(计算机科学系)
;
San Francisco State University(旧金山州立大学)
;
University of Lagos(拉各斯大学)
;
Faculty of Mathematics, Informatics, and Mechanics(数学、信息学与力学学院)
;
University of Warsaw(华沙大学)
TCM-Eval: An Expert-Level Dynamic and Extensible Benchmark for Traditional Chinese Medicine
TCM-Eval: 一个专家级动态且可扩展的中医基准测试
Zihao Cheng, Yuheng Lu, Huaiqian Ye, Zeming Liu, Minqi Wang, Jingjing Liu, Zihan Li, Wei Fan, Yuanfang Guo, Ruiji Fu, Shifeng She, Gang Wang, Yunhong Wang
机构
*
School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院)
;
Beijing Zhimingtang Technology Co., Ltd.(北京智明堂科技有限公司)
;
Beijing Zhiyan AI Technology Co., Ltd.(北京智言AI科技有限公司)
;
Guangzhou University of Chinese Medicine(广州中医药大学)
机构
*
Thrust of Artificial Intelligence, The Hong Kong University of Science and Technology (Guangzhou), China(香港科学与技术大学人工智能研究所)
;
Department of Computer Science and Engineering, The Hong Kong University of Science and Technology Hong Kong SAR, China(香港科学与技术大学计算机科学与工程系)
;
Microsoft Research Asia(微软亚洲研究院)
;
University of Cambridge(剑桥大学)
;
Microsoft(微软)
机构
*
Chinese University of Hong Kong(香港中文大学)
;
Sun Yat-sen Memorial Hospital, Sun Yat-sen University(中山大学孙逸仙纪念医院)
;
Southern Medical University(南方医科大学)
;
Zhongshan Hospital, Fudan University(复旦大学中山医院)
;
Department of Neurosurgery, Prince of Wales Hospital(威尔士王室医院神经外科部)
RefactorCoderQA: Benchmarking LLMs for Multi-Domain Coding Question Solutions in Cloud and Edge Deployment
RefactorCoderQA: 评估LLMs在云和边缘部署中多领域编程问题解决方案的基准测试
Shadikur Rahman, Aroosa Hameed, Gautam Srivastava, Syed Muhammad Danish
机构
*
York University and Algoma University(约克大学和阿尔戈马大学)
;
Algoma University(阿尔戈马大学)
;
Department of Systems and Computer Engineering, Carleton University(系统与计算机工程系,卡尔顿大学)
;
Department of Math and Computer Science, Brandon University(数学与计算机科学系,布兰登大学)
Rethinking Sample Polarity in Reinforcement Learning with Verifiable Rewards
重新思考强化学习中的样本极性与可验证奖励
Xinyu Tang, Yuliang Zhan, Zhixun Li, Wayne Xin Zhao, Zhenduo Zhang, Zujie Wen, Zhiqiang Zhang, Jun Zhou
机构
*
Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院)
;
The Chinese University of Hong Kong(香港中文大学)
;
Ant Group(蚂蚁集团)