arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-10 至 2025-10-10 共收录 42 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 42 篇

2501.15081 2025-10-10 cs.NE cs.AI 89%

Can Large Language Models Be Trusted as Evolutionary Optimizers for Network-Structured Combinatorial Problems?

Jie Zhao, Tao Wen, Kang Hao Cheong

机构 * Division of Mathematical Sciences, School of Physical and Mathematical Sciences, Nanyang Technological University(数学科学系,物理与数学科学学院,南洋理工大学) School of Computer Science and Engineering, Nanyang Technological University(计算机科学与工程学院,南洋理工大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06223 2025-10-10 cs.CL cs.AI cs.LG 87%

Efficiency-Effectiveness Reranking FLOPs for LLM-based Rerankers

Zhiyuan Peng, Ting-ruen Wei, Tingyu Song, Yilun Zhao

机构 * Santa Clara University(圣克拉拉大学) Yale University(耶鲁大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by EMNLP Industry Track 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17753 2025-10-10 cs.CL cs.AI 86%

Building Resource-Constrained Language Agents: A Korean Case Study on Chemical Toxicity Information

Hojun Cho, Donghu Kim, Soyoung Yang, Chan Lee, Hunjoo Lee, Jaegul Choo

专题命中 效率与部署 :language agent(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2025 Industry track

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08544 2025-10-10 cs.AR cs.DC cs.LG 85%

SPAD: Specialized Prefill and Decode Hardware for Disaggregated LLM Inference

Hengrui Zhang, Pratyush Patel, August Ning, David Wentzlaff

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04596 2025-10-10 cs.SE cs.AI 85%

LLM Applications: Current Paradigms and the Next Frontier

Xinyi Hou, Yanjie Zhao, Haoyu Wang

机构 * Huazhong University of Science and Technology(华中科技大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08034 2025-10-10 cs.AI 84%

AILoRA: Function-Aware Asymmetric Initialization for Low-Rank Adaptation of Large Language Models

Xiaoshuang Ji, Zhendong Zhao, Xiaoyan Gu, Xiaojun Chen, Xin Zhao, Zeyao Liu

专题命中 效率与部署 :large language model(title);language model(title);分类 cs.AI

Comments Submitted to AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07614 2025-10-10 cs.AI cs.SE 83%

Traceability and Accountability in Role-Specialized Multi-Agent LLM Pipelines

Amine Barrak

机构 * Department of Computer Science and Engineering(计算机科学与工程系) Oakland University(奥克兰大学)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

Journal ref 2025 40th ACM/IEEE International Conference on Automated Software Engineering Workshops

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19740 2025-10-10 cs.CL 83%

Spotlight Attention: Towards Efficient LLM Generation via Non-linear Hashing-based KV Cache Retrieval

Wenhao Li, Yuxin Zhang, Gen Luo, Haiyuan Wan, Ziyang Gong, Fei Chao, Rongrong Ji

机构 * Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(中国教育部多媒体可信感知与高效计算重点实验室,厦门大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07467 2025-10-10 cs.SE 82%

LLM meets ML: Data-efficient Anomaly Detection on Unstable Logs

Fatemeh Hadadi, Qinghua Xu, Domenico Bianculli, Lionel Briand

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract)

Comments Accepted by ACM Transactions on Software Engineering and Methodology (TOSEM) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17531 2025-10-10 cs.AI cs.HC 81%

Towards Machine-Generated Code for the Resolution of User Intentions

Justus Flerlage, Ilja Behnke, Odej Kao

机构 * Technische Universität Berlin(柏林技术大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Journal ref Frontiers in Artificial Intelligence and Applications, Vol. 408: HHAI 2025, pp. 169-178

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10190 2025-10-10 cs.LG cs.AI 81%

Language Model Embeddings Can Be Sufficient for Bayesian Optimization

Tung Nguyen, Qiuyi Zhang, Bangding Yang, Chansoo Lee, Jorg Bornschein, Yingjie Miao, Sagi Perel, Yutian Chen, Xingyou Song

机构 * UCLA(加州大学洛杉矶分校) Google(谷歌) DeepMind(深度Mind)

专题命中 效率与部署 :language model(title);LLM(abstract);分类 cs.AI、cs.LG

Comments Code can be found in https://github.com/google-research/optformer/tree/main/optformer/embed_then_regress

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18952 2025-10-10 cs.LG cs.AI cs.CL 80%

LLMs on a Budget? Say HOLA

Zohaib Hasan Siddiqui, Jiechao Gao, Ebad Shabbir, Mohammad Anas Azeez, Rafiq Ali, Gautam Siddharth Kashyap, Usman Naseem

机构 * Jamia Hamdard(贾迈亚哈马达尔大学) Center for SDGC, Stanford University(SDGC研究中心,斯坦福大学) DSEU-Okhla Macquarie University(麦考瑞大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at EMNLP 2025 (Industry Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16067 2025-10-10 physics.comp-ph cs.LG 79%

Training a Foundation Model for Materials on a Budget

Teddy Koker, Mit Kotak, Tess Smidt

机构 * Department of Electrical Engineering and Computer Science(电气工程与计算机科学系)

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.LG

Comments To appear at the NeurIPS 2025 Workshop on AI for Accelerated Materials Discovery

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21467 2025-10-10 cs.CL 79%

FlashDLM: Accelerating Diffusion Language Model Inference via Efficient KV Caching and Guided Diffusion

Zhanqiu Hu, Jian Meng, Yash Akhauri, Mohamed S. Abdelfattah, Jae-sun Seo, Zhiru Zhang, Udit Gupta

机构 * Cornell University(康奈尔大学)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04768 2025-10-10 cs.CL cs.CY cs.HC 79%

DiMA: An LLM-Powered Ride-Hailing Assistant at DiDi

Yansong Ning, Shuowei Cai, Wei Li, Jun Fang, Naiqiang Tan, Hua Chai, Hao Liu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Didichuxing Co. Ltd(滴滴出行有限公司)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.CL

Comments KDD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07684 2025-10-10 astro-ph.GA 78%

Multi-modal Foundation Model for Cosmological Simulation Data

Bin Xia, Nesar Ramachandra, Azton I. Wells, Salman Habib, John Wise

专题命中 效率与部署 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07567 2025-10-10 cs.CV 78%

Cross-Modal Attention Guided Unlearning in Vision-Language Models

Karuna Bhaila, Aneesh Komanduri, Minh-Hao Van, Xintao Wu

专题命中 效率与部署 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.10126 2025-10-10 cs.CV 78%

I&S-ViT: An Inclusive & Stable Method for Pushing the Limit of Post-Training ViTs Quantization

Yunshan Zhong, Jiawei Hu, Mingbao lin, Mengzhao Chen, Rongrong Ji

机构 * Institute of Artificial Intelligence, Xiamen University(厦门大学人工智能学院) MAC Lab, Department of Artificial Intelligence, School of Informatics, Xiamen University(厦门大学信息学院人工智能系) Rakuten Peng Cheng Laboratory(鹏城实验室)

专题命中 效率与部署 :post-training(title,abstract)

Comments This paper has been accepted by TPAMI2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08365 2025-10-10 cs.CL 77%

Two-Stage Voting for Robust and Efficient Suicide Risk Detection on Social Media

Yukai Song, Pengfei Zhou, César Escobar-Viera, Candice Biernesser, Wei Huang, Jingtong Hu

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系) Department of Informatics and Networked Systems(信息与网络系统系) University of Pittsburgh(匹兹堡大学) Department of Psychiatry(精神病学系) Tandon School of Engineering(塔能工程学院) New York University(纽约大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07475 2025-10-10 cs.CL 77%

MAPRO: Recasting Multi-Agent Prompt Optimization as Maximum a Posteriori Inference

Zheyuan Zhang, Lin Ge, Hongjiang Li, Weicheng Zhu, Chuxu Zhang, Yanfang Ye

机构 * University of Notre Dame(诺丁汉大学) University of Connecticut(康奈尔大学) Amazon(亚马逊)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07429 2025-10-10 cs.LG 77%

Learning to Route LLMs from Bandit Feedback: One Policy, Many Trade-offs

Wang Wei, Tiankai Yang, Hongjie Chen, Yue Zhao, Franck Dernoncourt, Ryan A. Rossi, Hoda Eldardiry

机构 * Virginia Tech(弗吉尼亚理工大学) University of Southern California(南加州大学) Dolby Labs(杜比实验室) Adobe Research(Adobe研究)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 16 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18344 2025-10-10 cs.CL 77%

Speculate Deep and Accurate: Lossless and Training-Free Acceleration for Offloaded LLMs via Substitute Speculative Decoding

Pei-Shuo Wang, Jian-Jia Chen, Chun-Che Yang, Chi-Chih Chang, Ning-Chi Huang, Mohamed S. Abdelfattah, Kai-Chiang Wu

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19102 2025-10-10 cs.IR cs.AI cs.CL cs.LG 75%

Distilling a Small Utility-Based Passage Selector to Enhance Retrieval-Augmented Generation

Hengran Zhang, Keping Bi, Jiafeng Guo, Jiaming Zhang, Shuaiqiang Wang, Dawei Yin, Xueqi Cheng

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(人工智能安全国家重点实验室,计算技术研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Baidu Inc(百度公司)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by SIGIR-AP25

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02886 2025-10-10 cs.CL cs.AI cs.LG 75%

TokenSelect: Efficient Long-Context Inference and Length Extrapolation for LLMs via Dynamic Token-Level KV Cache Selection

Wei Wu, Zhuoshi Pan, Chao Wang, Liyi Chen, Yunchu Bai, Tianfu Wang, Kun Fu, Zheng Wang, Hui Xiong

机构 * University of Science and Technology of China(中国科学技术大学) Tsinghua University(清华大学) Alibaba Cloud Computing(阿里云计算) Xiaohongshu Inc.(小红书公司) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by EMNLP2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11112 2025-10-10 cs.CL cs.CR cs.LG 73%

Multi-Trigger Poisoning Amplifies Backdoor Vulnerabilities in LLMs

Sanhanat Sivapiromrat, Caiqi Zhang, Marco Basaldella, Nigel Collier

机构 * University of Cambridge(剑桥大学) Trismik

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.03585 2025-10-10 cs.LG cs.AI math.OC 73%

RouteExplainer: An Explanation Framework for Vehicle Routing Problem

Daisuke Kikuta, Hiroki Ikeuchi, Kengo Tajiri, Yuusuke Nakano

机构 * NTT Corporation(NTT公司)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted at PAKDD 2024. This extended version includes more comprehensive explanations and appendices

Journal ref PAKDD 2024, Lecture Notes in Computer Science (LNAI, vol. 14647), Springer, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08464 2025-10-10 cs.RO cs.LG 70%

Don't Run with Scissors: Pruning Breaks VLA Models but They Can Be Recovered

Jason Jabbour, Dong-Ki Kim, Max Smith, Jay Patrikar, Radhika Ghosal, Youhui Wang, Ali Agha, Vijay Janapa Reddi, Shayegan Omidshafiei

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07778 2025-10-10 cs.RO cs.AI cs.CV 70%

IntentionVLA: Generalizable and Efficient Embodied Intention Reasoning for Human-Robot Interaction

Yandu Chen, Kefan Gu, Yuqing Wen, Yucheng Zhao, Tiancai Wang, Liqiang Nie

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Nanjing University(南京大学) University of Science and Technology of China(中国科学技术大学) Dexmal

专题命中 效率与部署 :language model(abstract);pretraining(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07736 2025-10-10 cs.CL 70%

Multilingual Knowledge Graph Completion via Efficient Multilingual Knowledge Sharing

Cunli Mao, Xiaofei Gao, Ran Song, Shizhu He, Shengxiang Gao, Kang Liu, Zhengtao Yu

机构 * Faculty of Information Engineering and Automation, Kunming University of Science and Technology(昆明理工大学信息工程与自动化学院) Yunnan Key Laboratory of Artificial Intelligence(云南人工智能重点实验室) The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(复杂系统认知与决策智能重点实验室,中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Science(中国科学院大学人工智能学院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

Comments EMNLP 2025, Findings, Long Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05582 2025-10-10 cs.LG 70%

(Token-Level) InfoRMIA: Stronger Membership Inference and Memorization Assessment for LLMs

Jiashu Tao, Reza Shokri

机构 * National University of Singapore(国立新加坡大学) Google Research(谷歌研究)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏