arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-05 至 2025-11-05 共收录 155 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 5 篇

2507.09378 2025-11-05 q-bio.GN cs.AI 57%

Context-Aware Regularization with Markovian Integration for Attention-Based Nucleotide Analysis

Mohammadsaleh Refahi, Mahdi Abavisani, Bahrad A. Sokhansanj, James R. Brown, Gail Rosen

机构 * Drexel University(德雷塞尔大学) Dataminr

专题命中 长上下文与记忆 :pretraining(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 推理与问题求解 21 篇

2511.02285 2025-11-05 cs.AR cs.PL cs.SE 90%

VFocus: Better Verilog Generation from Large Language Model via Focused Reasoning

Zhuorui Zhao, Bing Li, Grace Li Zhang, Ulf Schlichtmann

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments accepted by SOCC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04365 2025-11-05 cs.LG cs.AI cs.PL 88%

AutoPDL: Automatic Prompt Optimization for LLM Agents

Claudio Spiess, Mandana Vaziri, Louis Mandel, Martin Hirzel

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments An earlier version of this paper was published in AutoML 2025 Methods Track. This version adds missing standard deviations in Table 1

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05758 2025-11-05 cs.AI cs.LO 87%

APOLLO: Automated LLM and Lean Collaboration for Advanced Formal Reasoning

Azim Ospanov, Farzan Farnia, Roozbeh Yousefzadeh

机构 * Huawei Hong Kong Research Center(华为香港研究中心) Department of Computer Science & Engineering, The Chinese University of Hong Kong(香港中文大学计算机科学与工程系)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15207 2025-11-05 cs.LG cs.AI cs.CL 87%

FlowRL: Matching Reward Distributions for LLM Reasoning

Xuekai Zhu, Daixuan Cheng, Dinghuai Zhang, Hengli Li, Kaiyan Zhang, Che Jiang, Youbang Sun, Ermo Hua, Yuxin Zuo, Xingtai Lv, Qizheng Zhang, Lin Chen, Fanghao Shao, Bo Xue, Yunchong Song, Zhenjie Yang, Ganqu Cui, Ning Ding, Jianfeng Gao, Xiaodong Liu, Bowen Zhou, Hongyuan Mei, Zhouhan Lin

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Microsoft Research(微软研究院) Tsinghua University(清华大学) Peking University(北京大学) Renmin University of China(中国人民大学) Stanford University(斯坦福大学) Toyota Technological Institute at Chicago(芝加哥丰田技术研究所)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02712 2025-11-05 cs.CV 85%

VidEmo: Affective-Tree Reasoning for Emotion-Centric Video Foundation Models

Zhicheng Zhang, Weicheng Wang, Yongjie Zhu, Wenyu Qin, Pengfei Wan, Di Zhang, Jufeng Yang

机构 * Nankai University(南开大学) Pengcheng Laboratory(鹏城实验室) Kuaishou Technology(快手科技) Nankai International Advanced Research Institute (SHENZHEN·FUTIAN)(南开国际先进研究院(深圳·福田))

专题命中 推理与问题求解 :foundation model(title,abstract);large language model(abstract);language model(abstract)

Comments 41 pages, 26 figures

Journal ref NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02303 2025-11-05 cs.AI cs.CL 84%

Unlocking the Power of Multi-Agent LLM for Reasoning: From Lazy Agents to Deliberation

Zhiwei Zhang, Xiaomin Li, Yudi Lin, Hui Liu, Ramraj Chandradevan, Linlin Wu, Minhua Lin, Fali Wang, Xianfeng Tang, Qi He, Suhang Wang

机构 * The Pennsylvania State University(宾夕法尼亚州立大学) Harvard University(哈佛大学) Michigan State University(密歇根州立大学) University of Utah(犹他大学) Microsoft(微软公司)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02182 2025-11-05 cs.CV 83%

Pinpointing Trigger Moment for Grounded Video QA: Enhancing Spatio-temporal Grounding in Multimodal Large Language Models

Jinhwan Seo, Yoonki Cho, Junhyug Noh, Sung-eui Yoon

机构 * KAIST(韩国科学技术院) Ewha Womans University(成均馆大学)

专题命中 推理与问题求解 :large language model(title);language model(title)

Comments 1st place winner of Grounded Videoqa track at the ICCV2025 Perception Test

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02194 2025-11-05 cs.AI cs.CL cs.CY cs.LG 80%

Personalized Decision Modeling: Utility Optimization or Textualized-Symbolic Reasoning

Yibo Zhao, Yang Zhao, Hongru Du, Hao Frank Yang

机构 * Department of Civil and Systems Engineering(土木与系统工程系) Johns Hopkins University(约翰霍普金斯大学) Department of Systems and Information Engineering(系统与信息工程系) University of Virginia(弗吉尼亚大学) Johns Hopkins Data Science and AI Institute(约翰霍普金斯大学数据科学与人工智能研究所)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00960 2025-11-05 cs.CL cs.AI 79%

The Riddle of Reflection: Evaluating Reasoning and Self-Awareness in Multilingual LLMs using Indian Riddles

Abhinav P M, Ojasva Saxena, Oswald C, Parameswari Krishnamurthy

机构 * International Institute of Information Technology, Hyderabad(国际信息科技研究所,海得拉巴) National Institute of Technology, Tiruchirappalli(国家理工学院,特里奇里帕利)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02690 2025-11-05 cs.LG 77%

Curriculum Design for Trajectory-Constrained Agent: Compressing Chain-of-Thought Tokens in LLMs

Georgios Tzannetos, Parameswaran Kamalaruban, Adish Singla

机构 * MPI-SWS(马克斯·普朗克所际研究所)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments NeurIPS'25 paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02197 2025-11-05 cs.SE cs.AI 77%

Open the Oyster: Empirical Evaluation and Improvement of Code Reasoning Confidence in LLMs

Shufan Wang, Xing Hu, Junkai Chen, Zhiyuan Pan, Xin Xia

机构 * Singapore Management University(新加坡国立管理学院)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 13 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01906 2025-11-05 cs.CY cs.AI cs.FL 77%

Thinking Like a Student: AI-Supported Reflective Planning in a Theory-Intensive Computer Science Course

Noa Izsak

机构 * Noa Izsak(独立研究者)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 7 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20527 2025-11-05 cs.CL 77%

SAND-Math: Using LLMs to Generate Novel, Difficult and Useful Mathematics Questions and Answers

Chaitanya Manem, Pratik Prabhanjan Brahma, Prakamya Mishra, Zicheng Liu, Emad Barsoum

机构 * Advanced Micro Devices, Inc. (AMD)(先进微器件公司(AMD))

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.CL

Comments Accepted at MATH-AI workshop, NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02415 2025-11-05 cs.CV 75%

ChartM$^3$: A Multi-Stage Code-Driven Pipeline for Constructing Multi-Dimensional and Multi-Step Visual Reasoning Data in Chart Comprehension

Duo Xu, Hao Cheng, Xin Lin, Zhen Xie, Hao Wang

机构 * Alibaba Cloud Computing(阿里巴巴云计算)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);SFT(abstract)

Comments 23 pages, EMNLP25 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02378 2025-11-05 cs.HC 75%

Revisiting put-that-there, context aware window interactions via LLMs

Riccardo Bovo, Daniele Giunchi, Pasquale Cascarano, Eric J. Gonzalez, Mar Gonzalez-Franco

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02490 2025-11-05 cs.LG cs.AI 73%

BRAINS: A Retrieval-Augmented System for Alzheimer's Detection and Monitoring

Rajan Das Gupta, Md Kishor Morol, Nafiz Fahad, Md Tanzib Hosain, Sumaya Binte Zilani Choya, Md Jakir Hossen

机构 * American International University-Bangladesh(美国国际大学-孟加拉国) Multimedia University(多媒体大学) George Mason University(乔治·梅森大学) ELITE Research Lab(ELITE研究实验室)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted for publication in ICMLA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02309 2025-11-05 cs.LG cs.AI 73%

The Sequential Edge: Inverse-Entropy Voting Beats Parallel Self-Consistency at Matched Compute

Aman Sharma, Paras Chopra

机构 * Lossfunk

专题命中 推理与问题求解 :LLM(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02779 2025-11-05 cs.CV 67%

When Visualizing is the First Step to Reasoning: MIRA, a Benchmark for Visual Chain-of-Thought

Yiyang Zhou, Haoqin Tu, Zijun Wang, Zeyu Wang, Niklas Muennighoff, Fan Nie, Yejin Choi, James Zou, Chaorui Deng, Shen Yan, Haoqi Fan, Cihang Xie, Huaxiu Yao, Qinghao Ye

机构 * ByteDance Seed(字节跳动种子) UNC-Chapel Hill(北卡罗来纳大学教堂山分校) UC Santa Cruz(圣克拉拉大学) Stanford(斯坦福大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract)

Comments 28 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00510 2025-11-05 cs.AI cs.CL 62%

Understanding and Optimizing Agentic Workflows via Shapley value

Yingxuan Yang, Bo Huang, Siyuan Qi, Chao Feng, Haoyi Hu, Yuxuan Zhu, Jinbo Hu, Haoran Zhao, Ziyi He, Xiao Liu, Muning Wen, Zongyu Wang, Lin Qiu, Xuezhi Cao, Xunliang Cai, Yong Yu, Weinan Zhang

专题命中 推理与问题求解 :LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19610 2025-11-05 cs.AI 57%

Program Synthesis Dialog Agents for Interactive Decision-Making

Matthew Toles, Nikhil Balwani, Rattandeep Singh, Valentina Giulia Sartori Rodriguez, Zhou Yu

机构 * Columbia University(哥伦比亚大学) Amazon(亚马逊) Sciences Po Paris(巴黎社会科学高等研究院)

专题命中 推理与问题求解 :language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01999 2025-11-05 cs.RO cs.AI 57%

TRACE: Textual Reasoning for Affordance Coordinate Extraction

Sangyun Park, Jin Kim, Yuchen Cui, Matthew S. Brown

机构 * ABB Robotics(ABB机器人公司) University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 推理与问题求解 :language model(abstract);分类 cs.AI

Comments ICCV 2025. *Equal contribution. †Corresponding author

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 评测与基准 42 篇

2511.02458 2025-11-05 cs.CL cs.CE econ.GN q-fin.EC 90%

Prompting for Policy: Forecasting Macroeconomic Scenarios with Synthetic LLM Personas

Giulia Iadisernia, Carolina Camassa

机构 * Banca d’Italia(意大利银行)

专题命中 评测与基准 :LLM(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)

Comments 9 pages, 8-pages appendix, accepted at ICAIF 25

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02119 2025-11-05 cs.AI cs.CL 90%

InsurAgent: A Large Language Model-Empowered Agent for Simulating Individual Behavior in Purchasing Flood Insurance

Ziheng Geng, Jiachen Liu, Ran Cao, Lu Cheng, Dan M. Frangopol, Minghui Cheng

机构 * University of Miami(迈阿密大学) Hunan University(湖南大学) University of Illinois Chicago(伊利诺伊大学香槟分校) Lehigh University(莱斯大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02347 2025-11-05 cs.CL 89%

LTD-Bench: Evaluating Large Language Models by Letting Them Draw

Liuhao Lin, Ke Li, Zihan Xu, Yuchen Shi, Yulei Qin, Yan Zhang, Xing Sun, Rongrong Ji

机构 * Youtu-Agent Team(优图智能团队)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08903 2025-11-05 cs.SE 89%

Assessing and Advancing Benchmarks for Evaluating Large Language Models in Software Engineering Tasks

Xing Hu, Feifei Niu, Junkai Chen, Xin Zhou, Junwei Zhang, Junda He, Xin Xia, David Lo

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23081 2025-11-05 cs.CL 89%

A Survey on LLM Mid-Training

Chengying Tu, Xuemiao Zhang, Rongxiang Weng, Rumei Li, Chen Zhang, Yang Bai, Hongfei Yan, Jingang Wang, Xunliang Cai

机构 * Peking University(北京大学) Meituan(美团)

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02593 2025-11-05 cs.LG 88%

A Large Language Model for Corporate Credit Scoring

Chitro Majumdar, Sergio Scandizzo, Ratanlal Mahanta, Avradip Mandal, Swarnendu Bhattacharjee

机构 * RsRL (R-square RiskLab)(RsRL(R-square RiskLab))

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18835 2025-11-05 cs.SE 87%

AUCAD: Automated Construction of Alignment Dataset from Log-Related Issues for Enhancing LLM-based Log Generation

Hao Zhang, Dongjun Yu, Lei Zhang, Guoping Rong, Yongda Yu, Haifeng Shen, He Zhang, Dong Shao, Hongyu Kuang

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments In the 16th International Conference on Internetware 2025. 13 pages

Journal ref Proceedings of the 16th International Conference on Internetware (2025) 413-425

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24450 2025-11-05 cs.CL cs.AI 86%

Charting the European LLM Benchmarking Landscape: A New Taxonomy and a Set of Best Practices

Špela Vintar, Taja Kuzman Pungeršek, Mojca Brglez, Nikola Ljubešić

机构 * Jožef Stefan Institute(乔塞夫·斯塔芬研究所) University of Ljubljana(卢布尔雅那大学) Faculty of Arts, University of Ljubljana(艺术学院,卢布尔雅那大学) Faculty of Computer and Information Science, University of Ljubljana(计算机与信息科学学院,卢布尔雅那大学) Institute of Contemporary History(现代史研究所)

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 17 pages, 1 figure, 4 tables. Submitted to the LREC 2026 conference

详情

展开后加载摘要…

URL PDF HTML 收藏