From Shortcut to Induction Head: How Data Diversity Shapes Algorithm Selection in Transformers
从捷径到归纳头:数据多样性如何影响Transformer中的算法选择
Ryotaro Kawata, Yujin Song, Alberto Bietti, Naoki Nishikawa, Taiji Suzuki, Samuel Vaiter, Denny Wu
机构
*
The University of Tokyo(东京大学)
;
RIKEN AIP(理化学研究所AIP)
;
Flatiron Institute(Flatiron研究所)
;
CNRS(法国国家科学研究中心)
;
Université Côte d’Azur(蔚蓝海岸大学)
;
New York University(纽约大学)
Mitigating Hallucination Through Theory-Consistent Symmetric Multimodal Preference Optimization
通过理论一致的对称多模态偏好优化缓解幻觉
Wenqi Liu, Xuemeng Song, Jiaxi Li, Yinwei Wei, Na Zheng, Jianhua Yin, Liqiang Nie
机构
*
Shandong University(山东大学)
;
Southern University of Science and Technology(南方科技大学)
;
University of Georgia(佐治亚大学)
;
National University of Singapore(新加坡国立大学)
;
Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))
Deliberation on Priors: Trustworthy Reasoning of Large Language Models on Knowledge Graphs
对先验的探讨:大型语言模型在知识图谱上的可信推理
Jie Ma, Ning Qu, Zhitao Gao, Rui Xing, Jun Liu, Hongbin Pei, Jiang Xie, Linyun Song, Pinghui Wang, Jing Tao, Zhou Su
机构
*
MOE KLINNS Lab, Xi’an Jiaotong University(MOE KLINNS实验室,西安交通大学)
;
School of Computer Science and Technology, Xi’an Jiaotong University(计算机科学与技术学院,西安交通大学)
;
Shaanxi Province Key Laboratory of Big Data Knowledge Engineering(陕西省大数据知识工程重点实验室)
;
School of Artificial Intelligence, Chongqing University of Post and Telecommunications(人工智能学院,重庆邮电大学)
;
School of Computer Science, Northwestern Polytechnical University(计算机学院,西北工业大学)
Solver-Informed RL: Grounding Large Language Models for Authentic Optimization Modeling
Solver-Informed RL: 为真实优化建模奠定大语言模型基础
Yitian Chen, Jingfan Xia, Siyu Shao, Dongdong Ge, Yinyu Ye
机构
*
Cardinal Operations, China(中国卡迪纳尔运营公司)
;
Shanghai University of Finance and Economics(上海财经大学)
;
The University of Hong Kong(香港大学)
;
Antai School of Economics and Management, Shanghai Jiao Tong University(上海交通大学安泰经济管理学院)
;
Department of Management Science and Engineering, Stanford University(斯坦福大学管理科学与工程系)
AI总结
SIRL通过强化学习与外部优化求解器结合,提升大语言模型在优化建模中的准确性与实用性。
Journal ref39th Conference on Neural Information Processing Systems (NeurIPS 2025)
机构
*
City University of Hong Kong(香港城市大学)
;
Huazhong University of Science and Technology(华中科技大学)
;
Tencent(腾讯)
;
Shenzhen Technology University(深圳技术大学)
;
Peking University(北京大学)
;
Shenzhen University(深圳大学)
CommentsAccepted to NeurIPS 2025 Workshops: SPACE in Vision, Language, and Embodied AI; and What Makes a Good Video: Next Practices in Video Generation and Evaluation
TOMCAT: Test-time Comprehensive Knowledge Accumulation for Compositional Zero-Shot Learning
TOMCAT:测试时综合知识积累用于组合零样本学习
Xudong Yan, Songhe Feng
机构
*
School of Computer Science and Technology, Beijing Jiaotong University(计算机科学与技术学院,北京交通大学)
;
Key Laboratory of Big Data and Artificial Intelligence in Transportation (Beijing Jiaotong University), Ministry of Education(交通运输大数据与人工智能重点实验室(北京交通大学),教育部)