arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-07-29 至 2025-07-29 共收录 242 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 24 篇

2507.19766 2025-07-29 cs.CL cs.AI 88%

UloRL:An Ultra-Long Output Reinforcement Learning Approach for Advancing Large Language Models' Reasoning Abilities

Dong Du, Shulin Liu, Tao Yang, Shaohua Chen, Yang Li

机构 * Tencent Hunyuan Team(腾讯文言团队)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13940 2025-07-29 cs.AI q-bio.BM 85%

DrugPilot: LLM-based Parameterized Reasoning Agent for Drug Discovery

Kun Li, Zhennan Wu, Shoupeng Wang, Jia Wu, Shirui Pan, Wenbin Hu

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 29 pages, 8 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20870 2025-07-29 cs.RO 85%

A Human-in-the-loop Approach to Robot Action Replanning through LLM Common-Sense Reasoning

Elena Merlo, Marta Lagomarsino, Arash Ajoudani

机构 * Human-Robot Interfaces and Interaction (HRII) Laboratory, Istituto Italiano di Tecnologia(人机交互(HRII)实验室,意大利技术研究院) Dept. of Informatics, Bioengineering, Robotics, and Systems Engineering, University of Genoa(信息学、生物工程、机器人学和系统工程系,热那亚大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11150 2025-07-29 eess.IV cs.CV 85%

ADAgent: LLM Agent for Alzheimer's Disease Analysis with Collaborative Coordinator

Wenlong Hou, Guangqian Yang, Ye Du, Yeung Lau, Lihao Liu, Junjun He, Ling Long, Shujun Wang

机构 * 1 Department of Biomedical Engineering, The Hong Kong Polytechnic University, Hong Kong SAR, China 2 Amazon, USA 3 Shanghai Artificial Intelligence Laboratory, China 4 Department of Geriatrics, Third Affiliated Hospital of Sun Yat-sen University, China 5 Research Institute for Smart Ageing, The Hong Kong Polytechnic University, Hong Kong SAR, China

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20342 2025-07-29 cs.AI cs.RO 83%

VLMPlanner: Integrating Visual Language Models with Motion Planning

Zhipeng Tang, Sha Zhang, Jiajun Deng, Chenjie Wang, Guoliang You, Yuting Huang, Xinrui Lin, Yanyong Zhang

机构 * University of Science and Technology of China(科学技术大学) University of Adelaide(阿德莱德大学) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合性国家科学中心人工智能研究院)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.AI

Comments 8 pages, 3 figures, this paper has been accepted by ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20622 2025-07-29 cs.RO 82%

FMimic: Foundation Models are Fine-grained Action Learners from Human Videos

Guangyan Chen, Meiling Wang, Te Cui, Yao Mu, Haoyang Lu, Zicai Peng, Mengxiao Hu, Tianxing Zhou, Mengyin Fu, Yi Yang, Yufeng Yue

机构 * Beijing Institute of Technology, Beijing, P. R. China(北京理工大学) The University of Hong Kong, Hong Kong, P. R. China(香港大学)

专题命中 推理与问题求解 :foundation model(title,abstract);language model(abstract)

Comments accepted to International Journal of Robotics Research(IJRR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09884 2025-07-29 cs.AI 81%

VerifyBench: A Systematic Benchmark for Evaluating Reasoning Verifiers Across Domains

Xuzhao Li, Xuchen Li, Shiyu Hu, Yongzhen Guo, Wentao Zhang

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Preprint, Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19849 2025-07-29 cs.LG cs.AI cs.CL 80%

Agentic Reinforced Policy Optimization

Guanting Dong, Hangyu Mao, Kai Ma, Licheng Bao, Yifei Chen, Zhongyuan Wang, Zhongxia Chen, Jiazhen Du, Huiyang Wang, Fuzheng Zhang, Guorui Zhou, Yutao Zhu, Ji-Rong Wen, Zhicheng Dou

机构 * Renmin University of China(中国人民大学) Kuaishou Technology(快手科技)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Working on progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20278 2025-07-29 cs.CL 77%

MoL-RL: Distilling Multi-Step Environmental Feedback into LLMs for Feedback-Independent Reasoning

Kang Yang, Jingxue Chen, Qingkun Tang, Tianxiang Zhang, Qianchun Lu

机构 * Dalian University of Technology(大连理工大学) Wired Product Operation Division, ZTE Corporation(中兴通讯无线产品运营部)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.CL

Comments 12pages,3figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19902 2025-07-29 cs.SE cs.AI 77%

AgentMesh: A Cooperative Multi-Agent Generative AI Framework for Software Development Automation

Sourena Khanzadeh

机构 * Toronto Metropolitan University(多伦多 Metropolitan 大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15865 2025-07-29 cs.AI 77%

From Reasoning to Super-Intelligence: A Search-Theoretic Perspective

Shai Shalev-Shwartz, Amnon Shashua

机构 * AA-I, July 2025(AA-I)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12145 2025-07-29 cs.IR cs.AI 77%

Fast or Better? Balancing Accuracy and Cost in Retrieval-Augmented Generation with Flexible User Control

Jinyan Su, Jennifer Healey, Preslav Nakov, Claire Cardie

机构 * Cornell University(康奈尔大学) Adobe Research(Adobe研究) Mohamed bin Zayed University of Artificial Intelligence(Mohamed bin Zayed人工智能大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20370 2025-07-29 cs.RO 75%

Advancing Shared and Multi-Agent Autonomy in Underwater Missions: Integrating Knowledge Graphs and Retrieval-Augmented Generation

Michele Grimaldi, Carlo Cernicchiaro, Sebastian Realpe Rua, Alaaeddine El-Masri-El-Chaarani, Markus Buchholz, Loizos Michael, Pere Ridao Rodriguez, Ignacio Carlucho, Yvan R. Petillot

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02984 2025-07-29 cs.CL 70%

From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought

Wentao Tan, Qiong Cao, Yibing Zhan, Chao Xue, Changxing Ding

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19599 2025-07-29 cs.CV 67%

Object-centric Video Question Answering with Visual Grounding and Referring

Haochen Wang, Qirui Chen, Cilin Yan, Jiayin Cai, Xiaolong Jiang, Yao Hu, Weidi Xie, Stratis Gavves

机构 * University of Amsterdam(阿姆斯特丹大学) SAI, Shanghai Jiao Tong University(上海交通大学SAI研究所) Xiaohongshu Inc(小红书公司)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20960 2025-07-29 cs.AI 57%

On the Limits of Hierarchically Embedded Logic in Classical Neural Networks

Bill Cochran

机构 * Bill Cochran

专题命中 推理与问题求解 :language model(abstract);分类 cs.AI

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20913 2025-07-29 cs.CV cs.AI 57%

HAMLET-FFD: Hierarchical Adaptive Multi-modal Learning Embeddings Transformation for Face Forgery Detection

Jialei Cui, Jianwei Du, Yanzhe Li, Lei Gao, Hui Jiang, Chenfu Bao

机构 * Baidu Inc.(百度公司) Southeast University(东南大学) Tsinghua University(清华大学)

专题命中 推理与问题求解 :language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20529 2025-07-29 cs.CV cs.AI 57%

Enhancing Spatial Reasoning through Visual and Textual Thinking

Xun Liang, Xin Guo, Zhongming Jin, Weihang Pan, Penghui Shang, Deng Cai, Binbin Lin, Jieping Ye

专题命中 推理与问题求解 :language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13082 2025-07-29 cs.RO cs.AI cs.CV 57%

Free-form language-based robotic reasoning and grasping

Runyu Jiao, Alice Fasoli, Francesco Giuliari, Matteo Bortolon, Sergio Povoli, Guofeng Mei, Yiming Wang, Fabio Poiesi

机构 * Fondazione Bruno Kessler(布鲁诺·科塞拉基金会) University of Trento(特伦托大学) Istituto Italiano di Tecnologia(意大利技术研究院)

专题命中 推理与问题求解 :language model(abstract);分类 cs.AI

Comments Accepted to IROS 2025. Project website: https://tev-fbk.github.io/FreeGrasp/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16466 2025-07-29 cs.HC 50%

SceneLoom: Communicating Data with Scene Context

Lin Gao, Leixian Shen, Yuheng Zhao, Jiexiang Lan, Huamin Qu, Siming Chen

专题命中 推理与问题求解 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 评测与基准 67 篇

2504.07840 2025-07-29 cs.HC cs.AI cs.CL 91%

Understanding Learner-LLM Chatbot Interactions and the Impact of Prompting Guidelines

Cansu Koyuturk, Emily Theophilou, Sabrina Patania, Gregor Donabauer, Andrea Martinenghi, Chiara Antico, Alessia Telari, Alessia Testa, Sathya Bursic, Franca Garzotto, Davinia Hernandez-Leo, Udo Kruschwitz, Davide Taibi, Simona Amenta, Martin Ruskov, Dimitri Ognibene

专题命中 评测与基准 :LLM(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)

Comments Long paper accepted for AIED 2025, the 26th International Conference on Artificial Intelligence in Education, July 22 - 26, 2025, Palermo, Italy

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20762 2025-07-29 cs.IR 90%

Watermarking Large Language Model-based Time Series Forecasting

Wei Yuan, Chaoqun Yang, Yu Xing, Tong Chen, Nguyen Quoc Viet Hung, Hongzhi Yin

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18784 2025-07-29 cs.SE 90%

Secret Breach Detection in Source Code with Large Language Models

Md Nafiu Rahman, Sadif Ahmed, Zahin Wahab, S M Sohan, Rifat Shahriyar

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 19th ACM/IEEE International Symposium on Empirical Software Engineering and Measurement (ESEM 2025) cameraready

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19771 2025-07-29 cs.LG cs.AI 90%

Large Language Model Agent for Structural Drawing Generation Using ReAct Prompt Engineering and Retrieval Augmented Generation

Xin Zhang, Lissette Iturburu, Juan Nicolas Villamizar, Xiaoyu Liu, Manuel Salmeron, Shirley J. Dyke, Julio Ramirez

机构 * Lyles School of Civil and Construction Engineering(莱尔斯土木与建设工程学院) Purdue University(普渡大学) School of Mechanical Engineering(机械工程学院)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19904 2025-07-29 cs.SE cs.AI 89%

CrossPL: Evaluating Large Language Models on Cross Programming Language Code Generation

Zhanhang Xiong, Dongxia Wang, Yuekang Li, Xinyuan An, Wenhai Wang

机构 * Zhejiang University(浙江大学) The University of New South Wales(新南威尔士大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10271 2025-07-29 cs.CL 89%

Benchmarking Linguistic Diversity of Large Language Models

Yanzhu Guo, Guokan Shang, Chloé Clavel

机构 * Inria Paris(巴黎国家信息与自动化研究所) MBZUAI(穆斯林人工智能研究所) École Polytechnique(巴黎高等理工学院)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20163 2025-07-29 cs.CV 89%

Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning

Zeyu Xi, Haoying Sun, Yaofei Wu, Junchi Yan, Haoran Zhang, Lifang Wu, Liang Wang, Changwen Chen

机构 * Beijing University of Technology(北京理工大学) Shanghai Jiao Tong University(上海交通大学) Chinese Academy of Sciences(中国科学院) The Hong Kong Polytechnic University(香港理工大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted by ICCV 2025 (Poster)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20700 2025-07-29 cs.CL 89%

When Scale Meets Diversity: Evaluating Language Models on Fine-Grained Multilingual Claim Verification

Hanna Shcharbakova, Tatiana Anikina, Natalia Skachkova, Josef van Genabith

专题命中 评测与基准 :language model(title,abstract);LLM(abstract);large language model(abstract);small language model(abstract)

Comments Published at the FEVER Workshop, ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12327 2025-07-29 cs.CL cs.AI 88%

Intersectional Bias in Japanese Large Language Models from a Contextualized Perspective

Hitomi Yanaka, Xinqi He, Jie Lu, Namgi Han, Sunjin Oh, Ryoma Kumon, Yuma Matsuoka, Katsuhiko Watabe, Yuko Itatsu

机构 * The University of Tokyo(东京大学) Riken(理化学研究所) Rikkyo University(立命馆大学) Softbank corp.(软银公司)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to the 6th Workshop on Gender Bias in Natural Language Processing (GeBNLP2025) at ACL2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20995 2025-07-29 cs.CY cs.SY eess.SY 88%

VArsity: Can Large Language Models Keep Power Engineering Students in Phase?

Samuel Talkington, Daniel K. Molzahn

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏