arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-03 至 2025-10-03 共收录 222 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 38 篇

2506.01804 2025-10-03 cs.AI 79%

A Study on the MCP x A2A Framework for Enhancing Interoperability of LLM-based Autonomous Agents

Cheonsu Jeong

专题命中 效率与部署 :LLM(title,abstract);分类 cs.AI

Journal ref Journal of Intelligence and Information Systems, 31(3), 141-170 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01910 2025-10-03 cs.LG cs.AI 79%

Are LLMs Better GNN Helpers? Rethinking Robust Graph Learning under Deficiencies with Iterative Refinement

Zhaoyan Wang, Zheng Gao, Arogya Kharel, In-Young Ko

机构 * School of Computing KAIST Daejeon Republic of Korea(韩国国立庆尚大学计算机科学学院) School of Computer Science(计算机科学学院) School of Computing KAIST(韩国国立庆尚大学计算机科学学院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01272 2025-10-03 cs.AI cs.LG 79%

Modeling Others' Minds as Code

Kunal Jha, Aydan Yuenan Huang, Eric Ye, Natasha Jaques, Max Kleiman-Weiner

机构 * Department of Computer Science, University of Washington(华盛顿大学计算机科学系) Department of Computer Science, Johns Hopkins University(约翰霍普金斯大学计算机科学系)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01270 2025-10-03 cs.CL cs.AI 79%

Think Twice, Generate Once: Safeguarding by Progressive Self-Reflection

Hoang Phan, Victor Li, Qi Lei

机构 * New York University(纽约大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01257 2025-10-03 cs.CL cs.AI 79%

RJE: A Retrieval-Judgment-Exploration Framework for Efficient Knowledge Graph Question Answering with LLMs

Can Lin, Zhengwang Jiang, Ling Zheng, Qi Zhao, Yuhang Zhang, Qi Song, Wangqiu Zhou

机构 * University of Science and Technology of China(中国科学技术大学) City University of Hong Kong(香港城市大学) Deqing Alpha Innovation Institute(德清Alpha创新研究院) Hefei University of Technology(合肥工业大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 18 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11305 2025-10-03 cs.LG cs.AI 79%

QSpec: Speculative Decoding with Complementary Quantization Schemes

Juntao Zhao, Wenhao Lu, Sheng Wang, Lingpeng Kong, Chuan Wu

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Journal ref Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing (EMNLP 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14497 2025-10-03 cs.CV cs.CL 77%

Efficient Whole Slide Pathology VQA via Token Compression

Weimin Lyu, Qingqiao Hu, Kehan Qi, Zhan Shi, Wentao Huang, Saumya Gupta, Chao Chen

机构 * Stony Brook University(石溪大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01670 2025-10-03 cs.AI cs.CL cs.CR cs.CY cs.LG 75%

Just Do It!? Computer-Use Agents Exhibit Blind Goal-Directedness

Erfan Shayegani, Keegan Hines, Yue Dong, Nael Abu-Ghazaleh, Roman Lutz, Spencer Whitehead, Vidhisha Balachandran, Besmira Nushi, Vibhav Vineet

机构 * Microsoft Research AI Frontiers(微软研究院人工智能前沿) Microsoft AI Red Team(微软AI红色团队) University of California, Riverside(加州大学河滨分校) NVIDIA(英伟达)

专题命中 效率与部署 :LLM(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02128 2025-10-03 cs.CL cs.AI 73%

The Disparate Impacts of Speculative Decoding

Jameson Sandler, Ahmet Üstün, Marco Romanelli, Sara Hooker, Ferdinando Fioretto

机构 * University of Virginia(弗吉尼亚大学) Cohere Hofstra University(霍夫斯特大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00499 2025-10-03 cs.CL cs.AI 73%

MOSS-Speech: Towards True Speech-to-Speech Models Without Text Guidance

Xingjian Zhao, Zhe Xu, Qinyuan Cheng, Zhaoye Fei, Luozhijie Jin, Yang Wang, Hanfu Chen, Yaozhou Jiang, Qinghui Gao, Ke Chen, Ruixiao Li, Mingshu Chen, Ruiming Wang, Wenbo Zhang, Yiyang Zhang, Donghua Yu, Yang Gao, Xiaogui Yang, Yitian Gong, Yuanfan Xu, Yaqian Zhou, Xuanjing Huang, Xipeng Qiu

机构 * SII OpenMOSS Team(SII开放MOSS团队) Shanghai Innovation Institute(上海创新研究院) Fudan University(复旦大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23990 2025-10-03 cs.CL cs.AI 73%

The Hidden Costs of Translation Accuracy: Distillation, Quantization, and Environmental Impact

Dhaathri Vijay, Anandaswarup Vadapalli

机构 * University of California, Santa Cruz(加州大学圣克鲁兹分校) Research Spark Hub Inc(Research Spark Hub公司)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18216 2025-10-03 cs.AI cs.LG 73%

nDNA -- the Semantic Helix of Artificial Cognition

Amitava Das

机构 * BITS Pilani, Goa, India(印度戈阿学院)

专题命中 效率与部署 :foundation model(abstract);pretraining(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14620 2025-10-03 cs.LG cs.CL 73%

Enhancing Learned Knowledge in LoRA Adapters Through Efficient Contrastive Decoding on Ascend NPUs

Morgan Lindsay Heisler, Linzi Xing, Ge Shi, Hanieh Sadri, Gursimran Singh, Weiwei Zhang, Tao Ye, Ying Xiong, Yong Zhang, Zhenan Fan

机构 * Huawei Technologies Canada(华为技术加拿大公司) Huawei Technologies(华为技术)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted at ACM KDD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10940 2025-10-03 cs.LG cs.AI 73%

CoLA: Compute-Efficient Pre-Training of LLMs via Low-Rank Activation

Ziyue Liu, Ruijie Zhang, Zhengyang Wang, Mingsong Yan, Zi Yang, Paul Hovland, Bogdan Nicolae, Franck Cappello, Sui Tang, Zheng Zhang

机构 * University of California at Santa Barbara(加州大学圣巴巴拉分校) University at Albany, SUNY(阿尔巴尼大学,SUNY) Argonne National Laboratory(阿贡国家实验室)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01598 2025-10-03 cs.LG cond-mat.mtrl-sci physics.data-an 70%

Securing generative artificial intelligence with parallel magnetic tunnel junction true randomness

Youwei Bao, Shuhan Yang, Hyunsoo Yang

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

Comments 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01248 2025-10-03 cs.CL 70%

SSTAG: Structure-Aware Self-Supervised Learning Method for Text-Attributed Graphs

Ruyue Liu, Rong Yin, Xiangzhen Bo, Xiaoshuai Hao, Yong Liu, Jinwen Zhong, Can Ma, Weiping Wang

机构 * Institute of Information Engineering, CAS(信息工程研究所,中国科学院) School of Cyberspace Security, UCAS(网络安全学院,中国科学院大学) Wuhan University of Technology(武汉理工大学) Xiaomi EV(小米汽车) Renmin University of China(中国人民大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25779 2025-10-03 cs.AI 70%

Planner-R1: Reward Shaping Enables Efficient Agentic RL with Smaller LLMs

Siyu Zhu, Yanbin Jiang, Hejian Sang, Shao Tang, Qingquan Song, Biao He, Rohit Jain, Zhipeng Wang, Alborz Geramifard

机构 * LinkedIn Corporation(LinkedIn公司)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23500 2025-10-03 cs.LG 70%

Beyond Outliers: A Study of Optimizers Under Quantization

Georgios Vlassis, Saleh Ashkboos, Alexandra Volkova, Torsten Hoefler, Dan Alistarh

机构 * ETH Zurich(苏黎世联邦理工学院) ISTA(信息科技学院) Red Hat AI(红帽人工智能)

专题命中 效率与部署 :pretraining(abstract);post-training(abstract);分类 cs.LG

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02104 2025-10-03 cs.RO 67%

LangGrasp: Leveraging Fine-Tuned LLMs for Language Interactive Robot Grasping with Ambiguous Instructions

Yunhan Lin, Wenqi Wu, Zhijie Zhang, Huasong Min

机构 * School of Computer Science and Technology(计算机科学与技术学院) Hubei Province Key Laboratory of Intelligent Information Processing and Real-time Industrial System(湖北省智能信息处理与实时工业系统重点实验室) Institute of Robotics and Intelligent Systems(机器人与智能系统研究院) Wuhan University of Science and Technology(武汉理工大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01581 2025-10-03 cs.LG cs.AI cs.CL 67%

Think Right: Learning to Mitigate Under-Over Thinking via Adaptive, Attentive Compression

Joykirat Singh, Justin Chih-Yao Chen, Archiki Prasad, Elias Stengel-Eskin, Akshay Nambi, Mohit Bansal

机构 * UNC Chapel Hill(北卡罗来纳大学教堂山分校) The University of Texas at Austin(德克萨斯大学奥斯汀分校) Microsoft Research(微软研究院)

专题命中 效率与部署 :post-training(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Code: https://github.com/joykirat18/TRAAC

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17098 2025-10-03 cs.CV 67%

DreamOmni: Unified Image Generation and Editing

Bin Xia, Yuechen Zhang, Jingyao Li, Chengyao Wang, Yitong Wang, Xinglong Wu, Bei Yu, Jiaya Jia

机构 * CUHK(香港中文大学) ByteDance Inc(字节跳动公司) HKUST(香港科技大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01256 2025-10-03 cs.DC cs.AI cs.IT cs.LG math.IT 62%

Kant: An Efficient Unified Scheduling System for Large-Scale AI Clusters

Lingling Zeng, Gen Zhang, Jialin Peng, Xiang Xu, Yuan Xu, Lijun Ma

专题命中 效率与部署 :LLM(abstract);分类 cs.AI、cs.LG

Comments 25 pages,15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01549 2025-10-03 cs.LG 57%

MIRA: Towards Mitigating Reward Hacking in Inference-Time Alignment of T2I Diffusion Models

Kevin Zhai, Utsav Singh, Anirudh Thatipelli, Souradip Chakraborty, Anit Kumar Sahu, Furong Huang, Amrit Singh Bedi, Mubarak Shah

机构 * University of Central Florida(中央佛罗里达大学) University of Maryland, College Park(马里兰大学学院公园分校) Oracle(Oracle公司)

专题命中 效率与部署 :preference optimization(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26399 2025-10-03 cs.AI 57%

Communication-Efficient and Accurate Approach for Aggregation in Federated Low-Rank Adaptation

Le-Tuan Nguyen, Minh-Duong Nguyen, Seon-Geun Jeong, Dung D. Le, Quoc-Viet Pham

机构 * VinUniversity(文大学) Trinity College Dublin(三一学院都柏林) Pusan National University(釜山国立大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI

Comments 34 pages, 4 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17506 2025-10-03 cs.LG cs.CV cs.NE 57%

Subspace Node Pruning

Joshua Offergeld, Marcel van Gerven, Nasir Ahmad

机构 * Department of Machine Learning and Neural Computing(机器学习与神经计算系) Donders Institute for Brain, Cognition and Behaviour(大脑、认知与行为研究所) Radboud University(拉德堡德大学)

专题命中 效率与部署 :LLM(abstract);分类 cs.LG

Comments 18 pages, 10 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02298 2025-10-03 cs.RO 50%

ARMADA: Autonomous Online Failure Detection and Human Shared Control Empower Scalable Real-world Deployment and Adaptation

Wenye Yu, Jun Lv, Zixi Ying, Yang Jin, Chuan Wen, Cewu Lu

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) Noematrix Ltd.(诺玛特公司)

专题命中 效率与部署 :post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00320 2025-10-03 cs.CV 50%

TrimTokenator: Towards Adaptive Visual Token Pruning for Large Multimodal Models

Hao Zhang, Mengsi Lyu, Chenrui He, Yulong Ao, Yonghua Lin

机构 * Beijing Academy of Artificial Intelligence (BAAI)(北京人工智能研究院)

专题命中 效率与部署 :language model(abstract)

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 领域大模型 16 篇

2510.01622 2025-10-03 cs.IR cs.AI cs.CL 88%

LLM4Rec: Large Language Models for Multimodal Generative Recommendation with Causal Debiasing

Bo Ma, Hang Li, ZeHua Hu, XiaoFan Gui, LuYao Liu, Simon Lau

机构 * Department of Software \& Microelectronics Peking University Beijing, China Department of Software \& Microelectronics Peking University Beijing, China hangli\ Department of Software \& Microelectronics Peking University Beijing, China zehua\ Department of Software \& Microelectronics Peking University Beijing, China xiaofan\ Economic Law School China University of Political Science Peking University Changsha, China

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02200 2025-10-03 cs.CL cs.AI 86%

ARUQULA -- An LLM based Text2SPARQL Approach using ReAct and Knowledge Graph Exploration Utilities

Felix Brei, Lorenz Bühmann, Johannes Frey, Daniel Gerber, Lars-Peter Meyer, Claus Stadler, Kirill Bulert

机构 * Institute for Applied Informatics at Leipzig University(莱比锡大学应用信息学院) Leipzig University(莱比锡大学) Chemnitz Technical University(Chemnitz技术大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments peer reviewed publication at Text2SPARQL Workshop @ ESWC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01363 2025-10-03 cs.AI 85%

Retrieval-Augmented Framework for LLM-Based Clinical Decision Support

Leon Garza, Anantaa Kotal, Michael A. Grasso, Emre Umucu

机构 * Dept. of Computer Science, The University of Texas at El Paso, USA(计算机科学系,德克萨斯大学埃尔帕索分校) Dept. of Emergency Medicine, University of Maryland School of Medicine, USA(急诊医学系,马里兰大学医学院) Dept. of Public Health Sciences, The University of Texas at El Paso, USA(公共卫生科学系,德克萨斯大学埃尔帕索分校)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏