arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-13 至 2025-08-13 共收录 159 信号源:cs.CL, cs.AI, cs.LG

1. 后训练与偏好优化 7 篇

2508.08641 2025-08-13 cs.LG cs.AI cs.CL 75%

MiGrATe: Mixed-Policy GRPO for Adaptation at Test-Time

Peter Phan, Dhruv Agarwal, Kavitha Srinivas, Horst Samulowitz, Pavan Kapanipathi, Andrew McCallum

专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04700 2025-08-13 cs.AI cs.CL cs.CV cs.LG cs.MA cs.MM 67%

SEAgent: Self-Evolving Computer Use Agent with Autonomous Learning from Experience

Zeyi Sun, Ziyu Liu, Yuhang Zang, Yuhang Cao, Xiaoyi Dong, Tong Wu, Dahua Lin, Jiaqi Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学)

专题命中 后训练与偏好优化 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Code at https://github.com/SunzeY/SEAgent

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11002 2025-08-13 cs.SD cs.MM eess.AS 67%

Dopamine Audiobook: A Training-free MLLM Agent for Emotional and Immersive Audiobook Generation

Yan Rong, Shan Yang, Chenxing Li, Dong Yu, Li Liu

专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 长上下文与记忆 4 篇

2508.04903 2025-08-13 cs.CL cs.AI cs.MA 86%

RCR-Router: Efficient Role-Aware Context Routing for Multi-Agent LLM Systems with Structured Memory

Jun Liu, Zhenglun Kong, Changdi Yang, Fan Yang, Tianqi Li, Peiyan Dong, Joannah Nanjekye, Hao Tang, Geng Yuan, Wei Niu, Wenbin Zhang, Pu Zhao, Xue Lin, Dong Huang, Yanzhi Wang

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08322 2025-08-13 cs.SE cs.AI 86%

Context Engineering for Multi-Agent LLM Code Assistants Using Elicit, NotebookLM, ChatGPT, and Claude Code

Muhammad Haseeb

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 15 pages, 5 figures, research paper on multi-agent LLM systems for code generation

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08774 2025-08-13 cs.AI cs.CL 79%

Designing Memory-Augmented AR Agents for Spatiotemporal Reasoning in Personalized Task Assistance

Dongwook Choi, Taeyoon Kwon, Dongil Yang, Hyojun Kim, Jinyoung Yeo

机构 * Language & AGI Lab(语言与人工智能实验室)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.CL、cs.AI

Comments 7 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08585 2025-08-13 eess.AS 78%

Joint decoding method for controllable contextual speech recognition based on Speech LLM

Yangui Fang, Jing Peng, Yu Xi, Xu Li, Haoyu Li, Chengwei Zhang, Guohui Zhong, Kai Yu

专题命中 长上下文与记忆 :LLM(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 推理与问题求解 21 篇

2508.08386 2025-08-13 cs.CL 90%

CoDAE: Adapting Large Language Models for Education via Chain-of-Thought Data Augmentation

Shuzhou Yuan, William LaCroix, Hardik Ghoshal, Ercong Nie, Michael Färber

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.04928 2025-08-13 cs.CL cs.AI cs.HC cs.SI 90%

Leveraging Large Language Models for Collective Decision-Making

Marios Papachristou, Longqi Yang, Chin-Chia Hsu

机构 * Cornell University(康奈尔大学) Microsoft(微软公司)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments To appear at ACM CSCW 2025

Journal ref Proceedings of the ACM on Human-Computer Interaction 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08308 2025-08-13 cs.AI 89%

First Ask Then Answer: A Framework Design for AI Dialogue Based on Supplementary Questioning with Large Language Models

Chuanruo Fu, Yuncheng Du

机构 * Beijing Information Science and Technology University(北京信息科技大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04276 2025-08-13 cs.CL cs.AI 88%

A Few Words Can Distort Graphs: Knowledge Poisoning Attacks on Graph-based Retrieval-Augmented Generation of Large Language Models

Jiayi Wen, Tianxin Chen, Zhirun Zheng, Cheng Huang

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08653 2025-08-13 cs.CL cs.AI 88%

LLM driven Text-to-Table Generation through Sub-Tasks Guidance and Iterative Refinement

Rajmohan C, Sarthak Harne, Arvind Agarwal

机构 * IBM Research(IBM研究院) IIIT-Bangalore(班加罗尔印度理工学院)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02757 2025-08-13 cs.MA cs.GT cs.RO 88%

Frequency Point Game Environment for UAVs via Expert Knowledge and Large Language Model

Jingpu Yang, Hang Zhang, Fengxian Ji, Yufeng Wang, Mingjie Wang, Yizhe Luo, Wenrui Ding

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05496 2025-08-13 cs.AI 84%

InfiAlign: A Scalable and Sample-Efficient Framework for Aligning LLMs to Enhance Reasoning Capabilities

Shuo Cai, Su Lu, Qi Zhou, Kejing Yang, Zhijie Sang, Congkai Xie, Hongxia Yang

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);post-training(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08273 2025-08-13 cs.CL cs.LG 84%

TT-XAI: Trustworthy Clinical Text Explanations via Keyword Distillation and LLM Reasoning

Kristian Miok, Blaz Škrlj, Daniela Zaharie, Marko Robnik Šikonja

机构 * Faculty of Computer and Information Science, University of Ljubljana, Slovenia(卢布尔雅那大学计算机与信息科学学院) ICAM - Advanced Environmental Research Institute, West University of Timisoara, Romania(蒂米șoara西大学先进环境研究所) Department of Computer Science, West University of Timisoara, Romania(蒂米șoa拉西大学计算机科学系)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06671 2025-08-13 cs.CL cs.AI 80%

Do Biased Models Have Biased Thoughts?

Swati Rajwal, Shivank Garg, Reem Abdel-Salam, Abdelrahman Zayed

机构 * Emory University(埃默里大学) Indian Institute of Technology Roorkee(印度理工学院罗里克分校) Cairo University(开罗大学) Mila - Quebec AI Institute(魁北克人工智能研究所) Polytechnique Montréal(蒙特利尔理工学院) Amazon(亚马逊)

专题命中 推理与问题求解 :language model(abstract,comments);large language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments Accepted at main track of the Second Conference on Language Modeling (COLM 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08926 2025-08-13 cs.AI 79%

Safe Semantics, Unsafe Interpretations: Tackling Implicit Reasoning Safety in Large Vision-Language Models

Wei Cai, Jian Zhao, Yuchu Jiang, Tianle Zhang, Xuelong Li

机构 * Peking University(北京大学) Institute of Artificial Intelligence (TeleAI), China Telecom(人工智能研究所(TeleAI),中国电信) Northwestern Polytechnical University(西北工业大学) Southeast University(东南大学)

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00324 2025-08-13 cs.AI 79%

Vision Language Models See What You Want but not What You See

Qingying Gao, Yijiang Li, Haiyun Lyu, Haoran Sun, Dezhi Luo, Hokin Deng

机构 * Johns Hopkins University(约翰霍普金斯大学) University of California San Diego(加州大学圣地亚哥分校) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) University of Michigan(密歇根大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.AI

Comments Published at the ICLR 2025 Workshop on Bidirectional Human-AI Alignment (BiAlign)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09129 2025-08-13 cs.AI 77%

BrowseMaster: Towards Scalable Web Browsing via Tool-Augmented Programmatic Agent Pair

Xianghe Pang, Shuo Tang, Rui Ye, Yuwen Du, Yaxin Du, Siheng Chen

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(人工智能学院,上海交通大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08726 2025-08-13 cs.AI cs.CY 77%

Simulating Generative Social Agents via Theory-Informed Workflow Design

Yuwei Yan, Jinghua Piao, Xiaochong Lan, Chenyang Shao, Pan Hui, Yong Li

机构 * Information Hub The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)信息中心) Department of Electronic Engineering Tsinghua University(清华大学电子工程系)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08401 2025-08-13 cs.CL 77%

Mol-R1: Towards Explicit Long-CoT Reasoning in Molecule Discovery

Jiatong Li, Weida Wang, Qinggang Zhang, Junxian Li, Di Zhang, Changmeng Zheng, Shufei Zhang, Xiaoyong Wei, Qing Li

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08940 2025-08-13 cs.CL cs.AI cs.LG 75%

Train Long, Think Short: Curriculum Learning for Efficient Reasoning

Hasan Abed Al Kader Hammoud, Kumail Alhamoud, Abed Hammoud, Elie Bou-Zeid, Marzyeh Ghassemi, Bernard Ghanem

机构 * King Abdullah University of Science and Technology (KAUST), Saudi Arabia(卡布尔大学科学与技术大学) Massachusetts Institute of Technology (MIT), Cambridge, MA, USA(麻省理工学院) Princeton University, Princeton, NJ, USA(普林斯顿大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00043 2025-08-13 cs.CL cs.AI cs.CV 73%

CrossWordBench: Evaluating the Reasoning Capabilities of LLMs and LVLMs with Controllable Puzzle Generation

Jixuan Leng, Chengsong Huang, Langlin Huang, Bill Yuchen Lin, William W. Cohen, Haohan Wang, Jiaxin Huang

机构 * CMU(卡内基梅隆大学) WUSTL(华盛顿大学) UIUC(伊利诺伊大学香槟分校)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08816 2025-08-13 cs.AI 70%

Efficient Agent: Optimizing Planning Capability for Multimodal Retrieval Augmented Generation

Yuechen Wang, Yuming Qiao, Dan Meng, Jun Yang, Haonan Lu, Zhenyu Yang, Xudong Zhang

机构 * OPPO Research Institute(OPPO研究院) OPPO AI Center(OPPO人工智能中心)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08149 2025-08-13 cs.CL 70%

REX-RAG: Reasoning Exploration with Policy Correction in Retrieval-Augmented Generation

Wentao Jiang, Xiang Feng, Zengmao Wang, Yong Luo, Pingbo Xu, Zhe Chen, Bo Du, Jing Zhang

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 17 pages, 4 figures; updated references

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21425 2025-08-13 cs.SE 67%

GUARD:Dual-Agent based Backdoor Defense on Chain-of-Thought in Neural Code Generation

Naizhu Jin, Zhong Li, Tian Zhang, Qingkai Zeng

专题命中 推理与问题求解 :large language model(abstract);language model(abstract)

Comments Accepted by SEKE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09099 2025-08-13 cs.LG 57%

Bridging Formal Language with Chain-of-Thought Reasoning to Geometry Problem Solving

Tianyun Yang, Yunwen Li, Ziniu Li, Zhihang Lin, Ruoyu Sun, Tian Ding

专题命中 推理与问题求解 :language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10066 2025-08-13 cs.MM cs.CV 50%

LayLens: Improving Deepfake Understanding through Simplified Explanations

Abhijeet Narang, Parul Gupta, Liuyijia Su, Abhinav Dhall

机构 * Monash University(墨尔本大学)

专题命中 推理与问题求解 :language model(abstract)

Comments Accepted to ACM ICMI 2025 Demos

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 评测与基准 30 篇

2502.09577 2025-08-13 cs.HC 90%

Polymind: Parallel Visual Diagramming with Large Language Models to Support Prewriting Through Microtasks

Qian Wan, Jiannan Li, Huanchen Wang, Zhicong Lu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments Accepted to CSCW 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08277 2025-08-13 cs.CL cs.LG 90%

Objective Metrics for Evaluating Large Language Models Using External Data Sources

Haoze Du, Richard Li, Edward Gehringer

机构 * Department of Computer Science(计算机科学系) North Carolina State University(北卡罗来纳州立大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

Comments This version of the paper is lightly revised from the EDM 2025 proceedings for the sake of clarity

Journal ref EDM 2025 Palermo, Italy, July, 2025, pp. 489-495. International Educational Data Mining Society (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏