arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-06 至 2025-08-06 共收录 181 信号源:cs.CL, cs.AI, cs.LG

1. 后训练与偏好优化 5 篇

2507.23095 2025-08-06 cs.CL cs.AI 62%

SMART-Editor: A Multi-Agent Framework for Human-Like Design Editing with Structural Integrity

Ishani Mondal, Meera Bharadwaj, Ayush Roy, Aparna Garimella, Jordan Lee Boyd-Graber

专题命中 后训练与偏好优化 :preference optimization(abstract);分类 cs.CL、cs.AI

Comments This requires some internal approval before the public release

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03619 2025-08-06 physics.chem-ph 50%

FlowBack-Adjoint: Physics-Aware and Energy-Guided Conditional Flow-Matching for All-Atom Protein Backmapping

Alex Berlaga, Michael S. Jones, Andrew L. Ferguson

专题命中 后训练与偏好优化 :post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 长上下文与记忆 3 篇

2508.02308 2025-08-06 cs.CL 77%

LaMPE: Length-aware Multi-grained Positional Encoding for Adaptive Long-context Scaling Without Training

Sikui Zhang, Guangze Gao, Ziyun Gan, Chunfeng Yuan, Zefeng Lin, Houwen Peng, Bing Li, Weiming Hu

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.CL

Comments 13 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03137 2025-08-06 cs.CL cs.AI 73%

Long Story Generation via Knowledge Graph and Literary Theory

Ge Shi, Kaiyu Huang, Guochen Feng

机构 * Beijing Jiaotong University(北京交通大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02732 2025-08-06 cs.CL 70%

Why do LLMs attend to the first token?

Federico Barbero, Álvaro Arroyo, Xiangming Gu, Christos Perivolaropoulos, Michael Bronstein, Petar Veličković, Razvan Pascanu

机构 * University of Oxford(牛津大学) National University of Singapore(新加坡国立大学) Google DeepMind(谷歌DeepMind)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 推理与问题求解 19 篇

2508.03500 2025-08-06 cs.AI 90%

Error Detection and Correction for Interpretable Mathematics in Large Language Models

Yijin Yang, Cristina Cornelio, Mario Leiva, Paulo Shakarian

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02913 2025-08-06 cs.AI 89%

Enhancing Japanese Large Language Models with Reasoning Vectors

Carolina Minami Oguchi, Leo Wei, Koyo Kobayashi, Hsin-Tai Wu, Dipak Ghosal

机构 * University of California, Davis(加州大学戴维斯分校) Santa Clara University(圣克拉拉大学) NTT DOCOMO, INC(NTT DOCOMO公司) DOCOMO Innovations, Inc(DOCOMO创新公司)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);post-training(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03120 2025-08-06 eess.SP cs.ET cs.RO 89%

Can Large Language Models Identify Materials from Radar Signals?

Jiangyou Zhu, Hongyu Deng, He Chen

机构 * The Chinese University of Hong Kong(香港中文大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01056 2025-08-06 cs.ET cs.AI 88%

Managing Escalation in Off-the-Shelf Large Language Models

Sebastian Elbaum, Jonathan Panter

机构 * Council on Foreign Relations and University of Virginia(美国对外关系委员会和弗吉尼亚大学) Council on Foreign Relations(美国对外关系委员会)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02823 2025-08-06 cs.HC cs.AI cs.CL cs.SE 81%

NeuroSync: Intent-Aware Code-Based Problem Solving via Direct LLM Understanding Modification

Wenshuo Zhang, Leixian Shen, Shuchang Xu, Jindu Wang, Jian Zhao, Huamin Qu, Linping Yuan

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) University of Waterloo(滑铁卢大学)

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.CL、cs.AI

Comments Accepted in UIST 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03366 2025-08-06 cs.AI cs.CL cs.LG cs.SC 80%

A Comparative Study of Neurosymbolic AI Approaches to Interpretable Logical Reasoning

Michael K. Chen

机构 * Raffles Institution(拉夫斯学院)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to NeSy 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03686 2025-08-06 cs.CL cs.AI 79%

CompassVerifier: A Unified and Robust Verifier for LLMs Evaluation and Outcome Reward

Shudong Liu, Hongwei Liu, Junnan Liu, Linchen Xiao, Songyang Gao, Chengqi Lyu, Yuzhe Gu, Wenwei Zhang, Derek F. Wong, Songyang Zhang, Kai Chen

机构 * Shanghai AI Laboratory(上海人工智能实验室) NLP 2 CT Lab, University of Macau(澳门大学自然语言处理与计算机视觉实验室) University of Macau(澳门大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Technical Report; 31 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01263 2025-08-06 cs.CL cs.AI cs.LO 79%

Bridging LLMs and Symbolic Reasoning in Educational QA Systems: Insights from the XAI Challenge at IJCNN 2025

Long S. T. Nguyen, Khang H. N. Vo, Thu H. A. Nguyen, Tuan C. Bui, Duc Q. Nguyen, Thanh-Tung Tran, Anh D. Nguyen, Minh L. Nguyen, Fabien Baldacci, Thang H. Bui, Emanuel Di Nardo, Angelo Ciaramella, Son H. Le, Ihsan Ullah, Lorenzo Di Rocco, Tho T. Quan

机构 * URA Research Group, Ho Chi Minh City University of Technology (HCMUT), Vietnam Ho Chi Minh City International University (HCMIU), Vietnam University of South-Eastern Norway, Norway Japan Advanced Institute of Science Univ. Bordeaux, CNRS, Bordeaux INP, LaBRI, UMR 5800, F-33400 Talence, France University of Naples Parthenope, Italy VNU Information Technology Institute, Vietnam National University, Vietnam Visual Intelligence Lab, School of Computer Science \& Insight Center for Data Analyitcs, University of Galway, Ireland Sapienza University of Rome, Italy

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments The XAI Challenge @ TRNS-AI Workshop, IJCNN 2025: Explainable AI for Educational Question Answering. Website: https://sites.google.com/view/trns-ai/challenge/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03444 2025-08-06 cs.LG 77%

An Auditable Agent Platform For Automated Molecular Optimisation

Atabey Ünlü, Phil Rohr, Ahmet Celebi

机构 * DeltaWave

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02789 2025-08-06 cs.AI 77%

Cognitive Loop via In-Situ Optimization: Self-Adaptive Reasoning for Science

Newman Cheng, Gordon Broadbent, William Chappell

机构 * Microsoft Discovery and Quantum, Office of the Chief Technology Officer(微软发现与量子,首席技术官办公室)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03560 2025-08-06 cs.SE 75%

LaTCoder: Converting Webpage Design to Code with Layout-as-Thought

Yi Gui, Zhen Li, Zhongyi Zhang, Guohao Wang, Tianpeng Lv, Gaoyang Jiang, Yi Liu, Dongping Chen, Yao Wan, Hongyu Zhang, Wenbin Jiang, Xuanhua Shi, Hai Jin

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract)

Comments KDD 2025 v2

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03680 2025-08-06 cs.AI cs.LG 73%

Agent Lightning: Train ANY AI Agents with Reinforcement Learning

Xufang Luo, Yuge Zhang, Zhiyuan He, Zilong Wang, Siyun Zhao, Dongsheng Li, Luna K. Qiu, Yuqing Yang

机构 * Microsoft Research(微软研究院)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03173 2025-08-06 cs.AI 70%

Geoint-R1: Formalizing Multimodal Geometric Reasoning with Dynamic Auxiliary Constructions

Jingxuan Wei, Caijun Jia, Qi Chen, Honghao He, Linzhuang Sun, Conghui He, Lijun Wu, Bihui Yu, Cheng Tan

机构 * Shenyang institute of computing technology, Chinese academy of sciences(沈阳计算技术研究所,中国科学院) Shanghai AI Laboratory(上海人工智能实验室) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03054 2025-08-06 cs.AI 70%

Beyond Surface-Level Detection: Towards Cognitive-Driven Defense Against Jailbreak Attacks via Meta-Operations Reasoning

Rui Pu, Chaozhuo Li, Rui Ha, Litian Zhang, Lirong Qiu, Xi Zhang

机构 * Key Laboratory of Trustworthy Distributed Computing and Service (MoE)(可信分布式计算与服务重点实验室)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18337 2025-08-06 cs.AI 70%

The AlphaPhysics Term Rewriting System for Marking Algebraic Expressions in Physics Exams

Peter Baumgartner, Lachlan McGinness

机构 * CSIRO/Data61 and Australian National University(CSIRO/Data61和澳大利亚国立大学) Australian National University and CSIRO/Data61(澳大利亚国立大学和CSIRO/Data61)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03232 2025-08-06 cs.RO 67%

CookBench: A Long-Horizon Embodied Planning Benchmark for Complex Cooking Scenarios

Muzhen Cai, Xiubo Chen, Yining An, Jiaxin Zhang, Xuesong Wang, Wang Xu, Weinan Zhang, Ting Liu

专题命中 推理与问题求解 :large language model(abstract);language model(abstract)

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02962 2025-08-06 cs.RO 67%

Robot builds a robot's brain: AI generated drone command and control station hosted in the sky

Peter Burke

机构 * Department of Electrical Engineering and Computer Science, University of California, Irvine(电气工程与计算机科学系,加州大学伊文斯顿分校)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03613 2025-08-06 cs.LG cs.AI 62%

Goedel-Prover-V2: Scaling Formal Theorem Proving with Scaffolded Data Synthesis and Self-Correction

Yong Lin, Shange Tang, Bohan Lyu, Ziran Yang, Jui-Hui Chung, Haoyu Zhao, Lai Jiang, Yihan Geng, Jiawei Ge, Jingruo Sun, Jiayun Wu, Jiri Gesi, Ximing Lu, David Acuna, Kaiyu Yang, Hongzhou Lin, Yejin Choi, Danqi Chen, Sanjeev Arora, Chi Jin

专题命中 推理与问题求解 :language model(abstract);分类 cs.AI、cs.LG

Comments 24 pages, 10 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14821 2025-08-06 cs.LG cs.AI cs.CV 62%

Reinforcing VLMs to Use Tools for Detailed Visual Reasoning Under Resource Constraints

Sunil Kumar, Bowen Zhao, Leo Dirac, Paulina Varshavskaya

专题命中 推理与问题求解 :language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 评测与基准 55 篇

2502.09053 2025-08-06 cs.AI cs.GT cs.LG 90%

Game Theory Meets Large Language Models: A Systematic Survey with Taxonomy and New Frontiers

Haoran Sun, Yusen Wu, Peng Wang, Wei Chen, Yukun Cheng, Xiaotie Deng, Xu Chu

机构 * CFCS, School of Computer Science, Peking University(计算机科学系,北京大学) School of Business, Jiangnan University(商学院,江南大学) Microsoft Research Asia(微软亚洲研究院)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

Comments A shorter conference version is published in IJCAI 2025, titled 'Game Theory Meets Large Language Models: A Systematic Survey'

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03470 2025-08-06 cs.SE 90%

On the Evaluation of Large Language Models in Multilingual Vulnerability Repair

Dong wang, Junji Yu, Honglin Shu, Michael Fu, Chakkrit Tantithamthavorn, Yasutaka Kamei, Junjie Chen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03406 2025-08-06 cs.AI 89%

Multi-Objective Infeasibility Diagnosis for Routing Problems Using Large Language Models

Kai Li, Ruihao Zheng, Xinye Hao, Zhenkun Wang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.05286 2025-08-06 cs.PL cs.CL 89%

LLM4Decompile: Decompiling Binary Code with Large Language Models

Hanzhuo Tan, Qi Luo, Jing Li, Yuqun Zhang

机构 * Department of Computer Science and Engineering, Southern University of Science and Technology, Shenzhen, China(南方科技大学计算机科学与工程系) Department of Computing, The Hong Kong Polytechnic University, HKSAR, China(香港理工大学计算机系) Research Centre for Data Science & Artificial Intelligence(数据科学与人工智能研究中心)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Journal ref Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04543 2025-08-06 cs.HC 89%

The Impostor is Among Us: Can Large Language Models Capture the Complexity of Human Personas?

Christopher Lazik, Christopher Katins, Charlotte Kauter, Jonas Jakob, Caroline Jay, Lars Grunske, Thomas Kosch

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03558 2025-08-06 cs.PL 87%

SAGE-HLS: Syntax-Aware AST-Guided LLM for High-Level Synthesis Code Generation

M Zafir Sadik Khan, Nowfel Mashnoor, Mohammad Akyash, Kimia Azar, Hadi Kamali

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted to the IEEE International Conference on Computer Design (ICCD 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏