arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-31 至 2025-10-31 共收录 190 信号源:cs.CL, cs.AI, cs.LG

1. 后训练与偏好优化 6 篇

2506.07127 2025-10-31 cs.RO cs.AI 83%

Human-assisted Robotic Policy Refinement via Action Preference Optimization

Wenke Xia, Yichu Yang, Hongtao Wu, Xiao Ma, Tao Kong, Di Hu

机构 * Gaoling School of Artificial Intelligence, Renmin University of China, Beijing(中国人民大学北京校区人工智能学院) Engineering Research Center of Next-Generation Intelligent Search(下一代智能搜索与推荐工程研究中心) Beijing Key Laboratory of Research on Large Models(北京大型模型研究重点实验室)

专题命中 后训练与偏好优化 :preference optimization(title,abstract);foundation model(abstract);分类 cs.AI

Comments Accepted By NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01369 2025-10-31 cs.LG cs.AI 79%

Incentivizing LLMs to Self-Verify Their Answers

Fuxiang Zhang, Jiacheng Xu, Chaojie Wang, Ce Cui, Yang Liu, Bo An

机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡) Skywork AI

专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25884 2025-10-31 cs.AI cs.CL cs.LG 75%

Approximating Human Preferences Using a Multi-Judge Learned System

Eitán Sprejer, Fernando Avalos, Augusto Bernardi, Jose Pedro Brito de Azevedo Faustino, Jacob Haimes, Narmeen Fatimah Oozeer

机构 * BAISH | UBA | Apart Research(BAISH | UBA | Apart研究) University of São Paulo(圣保罗大学) Apart Research(Apart研究) Dovetail Research | Apart Research(Dovetail研究 | Apart研究)

专题命中 后训练与偏好优化 :LLM(abstract);RLHF(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01223 2025-10-31 cs.LG math.PR 74%

Explainable post-training bias mitigation with distribution-based fairness metrics

Ryan Franks, Alexey Miroshnikov, Konstandinos Kotsiopoulos

机构 * Discover Financial Services(Discover金融服务公司)

专题命中 后训练与偏好优化 :post-training(title);分类 cs.LG

Comments 45 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 长上下文与记忆 4 篇

2508.21204 2025-10-31 cs.AI cs.CL 86%

Fuzzy, Symbolic, and Contextual: Enhancing LLM Instruction via Cognitive Scaffolding

Vanessa Figueiredo

机构 * Department of Computer Science University of Regina(计算机科学系 皇家大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03305 2025-10-31 cs.DC 82%

Analysis and Optimized CXL-Attached Memory Allocation for Long-Context LLM Fine-Tuning

Yong-Cheng Liaw, Shuo-Han Chen

专题命中 长上下文与记忆 :LLM(title);large language model(abstract);language model(abstract)

Comments 13 pages, 15 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25160 2025-10-31 cs.CL cs.AI cs.IR 79%

Model-Document Protocol for AI Search

Hongjin Qian, Zheng Liu

机构 * BAAI(北京人工智能研究院)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14409 2025-10-31 cs.CL cs.IR 70%

Unstructured Evidence Attribution for Long Context Query Focused Summarization

Dustin Wright, Zain Muhammad Mujahid, Lu Wang, Isabelle Augenstein, David Jurgens

机构 * Department of Computer Science, University of Copenhagen(哥本哈根大学计算机科学系) Department of Computer Science and Engineering, University of Michigan(密歇根大学计算机科学与工程系) School of Information, University of Michigan(密歇根大学信息学院)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL

Comments EMNLP 2025 Main; 29 pages; 24 figures; 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 推理与问题求解 28 篇

2506.08410 2025-10-31 cs.CL 90%

Large Language Models Have Intrinsic Meta-Cognition, but Need a Good Lens

Ziyang Ma, Qingyue Yuan, Zhenglin Wang, Deyu Zhou

机构 * School of Computer Science and Engineering, Key Laboratory of Computer Network and Information Integration, Ministry of Education, Southeast University, China(计算机科学与工程学院、计算机网络与信息集成重点实验室、教育部、东南大学,中国) Department of Neurosurgery, Shanghai Tenth People’s Hospital, School of Clinical Medicine of Nanjing Medical University, China(神经外科科、上海第十人民医院、南京医科大学临床医学学院,中国)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments Accepted to EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21935 2025-10-31 cs.CL cs.AI 90%

From Reasoning to Learning: A Survey on Hypothesis Discovery and Rule Learning with Large Language Models

Kaiyu He, Zhiyu Chen

机构 * University of Texas at Dallas(德克萨斯大学达拉斯分校)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments TMLR Survey Certification

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24797 2025-10-31 cs.CL cs.AI 90%

Large Language Models Report Subjective Experience Under Self-Referential Processing

Cameron Berg, Diogo de Lucena, Judd Rosenblatt

机构 * AE Studio(AE工作室)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05948 2025-10-31 cs.CR cs.AI 89%

Chain-of-Scrutiny: Detecting Backdoor Attacks for Large Language Models

Xi Li, Ruofan Mao, Yusen Zhang, Renze Lou, Chen Wu, Jiaqi Wang

机构 * University of Alabama at Birmingham(阿拉巴马大学伯明翰分校) The Pennsylvania State University(宾夕法尼亚州立大学) Meta Auburn University(阿伯丁大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments This paper has been accepted to ACL Findings 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26768 2025-10-31 cs.CL cs.AI 88%

AMO-Bench: Large Language Models Still Struggle in High School Math Competitions

Shengnan An, Xunliang Cai, Xuezhi Cao, Xiaoyu Li, Yehao Lin, Junlin Liu, Xinxuan Lv, Dan Ma, Xuanlin Wang, Ziwen Wang, Shuang Zhou

机构 * Meituan(美团) University of Chinese Academy of Sciences(中国科学院大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 14 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17784 2025-10-31 cs.LG cs.AI 88%

Revealing Multimodal Causality with Large Language Models

Jin Li, Shoujin Wang, Qi Zhang, Feng Liu, Tongliang Liu, Longbing Cao, Shui Yu, Fang Chen

机构 * University of Technology Sydney(技术大学悉尼大学) Tongji University(同济大学) University of Melbourne(墨尔本大学) University of Sydney(悉尼大学) Macquarie University(麦考瑞大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26603 2025-10-31 cs.AI cs.MA cs.SY eess.SY 88%

Agentic AI Home Energy Management System: A Large Language Model Framework for Residential Load Scheduling

Reda El Makroum, Sebastian Zwickl-Bernhard, Lukas Kranzl

机构 * Department of Industrial Economics and Technology Management, The Norwegian University of Science and Technology(工业经济学与技术管理系,挪威科学与技术大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments 34 pages, 9 figures. Code available at https://github.com/RedaElMakroum/agentic-ai-hems

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17197 2025-10-31 cs.LG cs.AI eess.SP 88%

SignalLLM: A General-Purpose LLM Agent Framework for Automated Signal Processing

Junlong Ke, Qiying Hu, Shenghai Yuan, Yuecong Xu, Jianfei Yang

机构 * Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) School of Electrical and Electronic Engineering, Nanyang Technological University, Singapore(南洋理工大学电子与电气工程学院) MARS Lab, Nanyang Technological University, Singapore(南洋理工大学MARS实验室)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26193 2025-10-31 cs.CL 86%

RCScore: Quantifying Response Consistency in Large Language Models

Dongjun Jang, Youngchae Ahn, Hyopil Shin

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);分类 cs.CL

Journal ref EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26274 2025-10-31 cs.CR cs.CL cs.LG 86%

PVMark: Enabling Public Verifiability for LLM Watermarking Schemes

Haohua Duan, Liyao Xiang, Xin Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Ant Group(蚂蚁集团)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26143 2025-10-31 cs.AI cs.CL 86%

Reasoning Curriculum: Bootstrapping Broad LLM Reasoning from Math

Bo Pang, Deqian Kong, Silvio Savarese, Caiming Xiong, Yingbo Zhou

机构 * Salesforce AI Research(Salesforce AI研究院) University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);pretraining(abstract)

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26242 2025-10-31 cs.AI 85%

Retrieval Augmented Generation-Enhanced Distributed LLM Agents for Generalizable Traffic Signal Control with Emergency Vehicles

Xinhang Li, Qing Guo, Junyu Chen, Zheng Guo, Shengzhe Xu, Lei Li, Lin Zhang

机构 * School of Artificial Intelligence, Beijing University of Posts(人工智能学院,北京邮电大学) Beijing Big Data Center(北京大数据中心)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02878 2025-10-31 cs.LG cs.AI cs.CL 85%

Language Models can Self-Improve at State-Value Estimation for Better Search

Ethan Mendes, Alan Ritter

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25933 2025-10-31 cs.AI cs.HC cs.LG cs.NE 84%

Humains-Junior: A 3.8B Language Model Achieving GPT-4o-Level Factual Accuracy by Directed Exoskeleton Reasoning

Nissan Yaron, Dan Bystritsky, Ben-Etzion Yaron

机构 * Humains AI Research(Humains人工智能研究) Inpris Ltd(Inpris公司)

专题命中 推理与问题求解 :language model(title,abstract);small language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14970 2025-10-31 cs.AI cs.LG 84%

Self-Evolving Curriculum for LLM Reasoning

Xiaoyin Chen, Jiarui Lu, Minsu Kim, Dinghuai Zhang, Jian Tang, Alexandre Piché, Nicolas Gontier, Yoshua Bengio, Ehsan Kamalloo

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23968 2025-10-31 cs.CV 82%

Reasoning Visual Language Model for Chest X-Ray Analysis

Andriy Myronenko, Dong Yang, Baris Turkbey, Mariam Aboian, Sena Azamat, Esra Akcicek, Hongxu Yin, Pavlo Molchanov, Marc Edgar, Yufan He, Pengfei Guo, Yucheng Tang, Daguang Xu

机构 * NVIDIA NIH/NCI CHOP/UPenn Basaksehir Cam and Sakura City Hospital

专题命中 推理与问题求解 :language model(title,abstract);SFT(abstract)

Comments NV-Reason-CXR-3B

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25997 2025-10-31 cs.AI cs.SE 79%

From Queries to Insights: Agentic LLM Pipelines for Spatio-Temporal Text-to-SQL

Manu Redd, Tao Zhe, Dongjie Wang

机构 * University of Kansas(堪萨斯大学)

专题命中 推理与问题求解 :LLM(title);prompting(abstract);分类 cs.AI

Comments 8 pages, 5 figures, GeoGenAgent'25 - ACM SIGSPATIAL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25776 2025-10-31 cs.CL cs.LG 79%

StreetMath: Study of LLMs' Approximation Behaviors

Chiung-Yi Tseng, Somshubhra Roy, Maisha Thasin, Danyang Zhang, Blessing Effiong

机构 * LuxMuse AI(LuxMuse人工智能公司) Department of Electrical and Computer Engineering, North Carolina State University(北卡罗来纳州立大学电气与计算机工程系) Department of Mathematics, University of Waterloo(滑铁卢大学数学系) Vokram Group(Vokram集团) Department of Computer Science, Saint Louis University(圣路易斯大学计算机科学系)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24388 2025-10-31 cs.CL 77%

ClueAnchor: Clue-Anchored Knowledge Reasoning Exploration and Optimization for Retrieval-Augmented Generation

Hao Chen, Yukun Yan, Sen Mei, Wanxiang Che, Zhenghao Liu, Qi Shi, Xinze Li, Yuchun Fan, Pengcheng Huang, Qiushi Xiong, Zhiyuan Liu, Maosong Sun

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);preference optimization(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.06736 2025-10-31 cs.CL 77%

Are LLMs Rigorous Logical Reasoners? Empowering Natural Language Proof Generation by Stepwise Decoding with Contrastive Learning

Ying Su, Mingwen Liu, Zhijiang Guo

机构 * South China University of Technology(华南理工大学) Likelihood Lab(Likelihood实验室) HKUST(GZ)(香港科技大学(广州)) HKUST(香港科技大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 15 pages, 2 figures, 11 tables. Accepted by AACL 2025 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26027 2025-10-31 cs.CV 75%

Enhancing Temporal Understanding in Video-LLMs through Stacked Temporal Attention in Vision Encoders

Ali Rasekh, Erfan Bagheri Soula, Omid Daliran, Simon Gottschalk, Mohsen Fayyaz

机构 * Leibniz University Hannover(莱比锡大学汉诺威分校) L3S Research Center(L3S研究中心) Microsoft(微软公司)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23925 2025-10-31 cs.AI cs.CL 73%

Latent Chain-of-Thought for Visual Reasoning

Guohao Sun, Hang Hua, Jian Wang, Jiebo Luo, Sohail Dianat, Majid Rabbani, Raghuveer Rao, Zhiqiang Tao

机构 * Rochester Institute of Technology(罗切斯特技术研究所) Snap Inc.(Snap公司) University of Rochester(罗切斯特大学) DEVCOM Army Research Laboratory(陆军研究实验室)

专题命中 推理与问题求解 :language model(abstract);SFT(abstract);分类 cs.CL、cs.AI

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏