arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-04 至 2025-11-04 共收录 368 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 64 篇

2511.00086 2025-11-04 cs.LG cs.AI cs.CL 80%

Generalizing Test-time Compute-optimal Scaling as an Optimizable Graph

Fali Wang, Jihai Chen, Shuhua Yang, Runxue Bao, Tianxiang Zhao, Zhiwei Zhang, Xianfeng Tang, Hui Liu, Qi He, Suhang Wang

机构 * The Pennsylvania State University(宾夕法尼亚州立大学) University of Pittsburgh(匹兹堡大学) Amazon(亚马逊) Microsoft(微软)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23603 2025-11-04 cs.CV 80%

PixelRefer: A Unified Framework for Spatio-Temporal Object Referring with Arbitrary Granularity

Yuqian Yuan, Wenqiao Zhang, Xin Li, Shihao Wang, Kehan Li, Wentong Li, Jun Xiao, Lei Zhang, Beng Chin Ooi

机构 * Zhejiang University(浙江大学) DAMO Academy, Alibaba Group(阿里云图研究院) Hupan Lab(鸿篇实验室) The Hong Kong Polytechnic University(香港理工大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments 22 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00203 2025-11-04 cs.LG stat.ML 79%

Diffusion LLMs are Natural Adversaries for any LLM

David Lüdke, Tom Wollschläger, Paul Ungermann, Stephan Günnemann, Leo Schwinn

机构 * Department of Computer Science \& Munich Data Science Institute Technical University of Munich, Germany

专题命中 效率与部署 :LLM(title);prompting(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21344 2025-11-04 cs.CV cs.AI q-bio.QM 79%

Vision-Language Model-Based Semantic-Guided Imaging Biomarker for Lung Nodule Malignancy Prediction

Luoting Zhuang, Seyed Mohammad Hossein Tabatabaei, Ramin Salehi-Rad, Linh M. Tran, Denise R. Aberle, Ashley E. Prosper, William Hsu

机构 * organization= Medical \& Imaging Informatics, Department of Radiological Sciences, David Geffen School of Medicine at UCLA , city= Los Angeles , postcode= 90095 , state= CA , country= USA organization= Department of Medicine, Division of Pulmonology Critical Care, David Geffen School of Medicine at UCLA , city= Los Angeles , postcode= 90095 , state= CA , country= USA

专题命中 效率与部署 :language model(title);pretraining(abstract);分类 cs.AI

Journal ref Journal of Biomedical Informatics 172 (2025) 104947

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01282 2025-11-04 cs.CL cs.AI 79%

When, What, and How: Rethinking Retrieval-Enhanced Speculative Decoding

Min Fang, Zhihui Fu, Qibin Zhao, Jun Wang

机构 * OPPO Research Institute(OPPO研究院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00682 2025-11-04 cs.CV 78%

Outlier-Aware Post-Training Quantization for Image Super-Resolution

Hailing Wang, jianglin Lu, Yitian Zhang, Yun Fu

机构 * Northeastern University, USA(东北大学)

专题命中 效率与部署 :post-training(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20190 2025-11-04 cs.CR cs.AI 77%

STAF: Leveraging LLMs for Automated Attack Tree-Based Security Test Generation

Tanmay Khule, Stefan Marksteiner, Jose Alguindigue, Hannes Fuchs, Sebastian Fischmeister, Apurva Narayan

机构 * Department of Systems Design Engineering, University of Waterloo, ON Canada(滑铁卢大学系统设计工程系) Smart Calibration and Virtual Testing Department, AVL List GmbH, Graz, Austria(AVL List GmbH智能校准与虚拟测试部门) Department of Computer Science, Western University, London, ON, Canada(温哥华大学计算机科学系)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 18 pages, 2 figures, accepted for 23rd escar Europe (Nov 05-06, 2025, Frankfurt, Germany)

Journal ref 23rd escar Europe : The World's Leading Automotive Cyber Security Conference 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02112 2025-11-04 cs.LG 77%

PolyG: Adaptive Graph Traversal for Diverse GraphRAG Questions

Renjie Liu, Haitian Jiang, Xiao Yan, Bo Tang, Jinyang Li

机构 * Southern University of Science and Technology(南方科技大学) New York University(纽约大学) Wuhan University(武汉大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00576 2025-11-04 cs.CL cs.AI 76%

FlashEVA: Accelerating LLM inference via Efficient Attention

Juan Gabriel Kostelec, Qinghai Guo

机构 * Huawei Technologies(华为技术)

专题命中 效率与部署 :LLM(title);分类 cs.CL、cs.AI

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00330 2025-11-04 cs.MA cs.SE 75%

Sherlock: Reliable and Efficient Agentic Workflow Execution

Yeonju Ro, Haoran Qiu, Íñigo Goiri, Rodrigo Fonseca, Ricardo Bianchini, Aditya Akella, Zhangyang Wang, Mattan Erez, Esha Choukse

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01643 2025-11-04 cs.CL cs.AI cs.IR 73%

A Graph-based RAG for Energy Efficiency Question Answering

Riccardo Campi, Nicolò Oreste Pinciroli Vago, Mathyas Giudici, Pablo Barrachina Rodriguez-Guisado, Marco Brambilla, Piero Fraternali

机构 * Politecnico di Milano, DEIB Department(米兰Politecnico大学DEIB部门) Voltiva Energy(Voltiva能源公司)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Journal ref Verma, H., Bozzon, A., Mauri, A., Yang, J. (eds) Web Engineering. ICWE 2025. Lecture Notes in Computer Science, vol 15749. Springer, Cham

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09338 2025-11-04 cs.AI cs.LG 73%

Localist LLMs -- A Mathematical Framework for Dynamic Locality Control

Joachim Diederich

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01181 2025-11-04 cs.CL cs.LG 73%

Learning When to Quit in Sales Conversations

Emaad Manzoor, Eva Ascarza, Oded Netzer

机构 * Cornell University(康奈尔大学) Harvard Business School(哈佛商学院) Columbia Business School(哥伦比亚商学院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00411 2025-11-04 cs.LG cs.AI cs.CV 73%

Enhancing Adversarial Transferability by Balancing Exploration and Exploitation with Gradient-Guided Sampling

Zenghao Niu, Weicheng Xie, Siyang Song, Zitong Yu, Feng Liu, Linlin Shen

机构 * School of Computer Science & Software Engineering, Shenzhen University, China(深圳大学计算机科学与软件工程学院) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ), Shenzhen, China(广东省人工智能与数字经济发展实验室(深圳)) Guangdong Provincial Key Laboratory of Intelligent Information Processing, Shenzhen University, China(广东省智能信息处理省级重点实验室) School of Computer Science, University of Exeter, U.K.(埃克塞特大学计算机科学学院) Department of Computing and Information Technology, Great Bay University, China(大鹏大学计算与信息技术系) Computer Vision Institute, School of Artificial Intelligence, Shenzhen University, China(人工智能学院计算机视觉研究所)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments accepted by iccv 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00050 2025-11-04 cs.LG cs.AI 73%

FLoRA: Fused forward-backward adapters for parameter efficient fine-tuning and reducing inference-time latencies of LLMs

Dhananjaya Gowda, Seoha Song, Junhyun Lee, Harshith Goka

机构 * Samsung Research(三星研究院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14622 2025-11-04 cs.CR cs.AI cs.LG 73%

Adversarial Distilled Retrieval-Augmented Guarding Model for Online Malicious Intent Detection

Yihao Guo, Haocheng Bian, Liutong Zhou, Ze Wang, Zhaoyi Zhang, Francois Kawala, Milan Dean, Ian Fischer, Yuantao Peng, Noyan Tokgozoglu, Ivan Barrientos, Riyaaz Shaik, Rachel Li, Chandru Venkataraman, Reza Shifteh Far, Moses Pawar, Venkat Sundaranatha, Michael Xu, Frank Chu

机构 * Apple(苹果公司) Cohere(Cohere公司) DeepMind(深度思维公司) Meta MongoDB(MongoDB公司)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01422 2025-11-04 cs.CL cs.AI 73%

Sampling-Efficient Test-Time Scaling: Self-Estimating the Best-of-N Sampling in Early Decoding

Yiming Wang, Pei Zhang, Siyuan Huang, Baosong Yang, Zhuosheng Zhang, Fei Huang, Rui Wang

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) Tongyi Lab, Alibaba Group(阿里集团通义实验室)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by NeurIPS 2025 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01268 2025-11-04 cs.CR cs.AI cs.IR 70%

Rescuing the Unpoisoned: Efficient Defense against Knowledge Corruption Attacks on RAG Systems

Minseok Kim, Hankook Lee, Hyungjoon Koo

机构 * Sungkyunkwan University(成均馆大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 15 pages, 7 figures, 10 tables. To appear in the Proceedings of the 2025 Annual Computer Security Applications Conference (ACSAC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01077 2025-11-04 cs.LG stat.CO 70%

AI Progress Should Be Measured by Capability-Per-Resource, Not Scale Alone: A Framework for Gradient-Guided Resource Allocation in LLMs

David McCoy, Yulun Wu, Zachary Butzin-Dozier

机构 * Division of Biostatistics University of California, Berkeley(生物统计学系加州大学伯克利分校) Capital One(Capital One公司)

专题命中 效率与部署 :LLM(abstract);pretraining(abstract);分类 cs.LG

Comments 9 pages (main) + appendix, 3 figures. Accepted at NeurIPS 2025 (Position Paper Track), submission #491. OpenReview: https://openreview.net/forum?id=6plSmhBI33&noteId=KP5ZqY7JLg

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01059 2025-11-04 cs.AI 70%

Efficient Test-Time Retrieval Augmented Generation

Hailong Yin, Bin Zhu, Jingjing Chen, Chong-Wah Ngo

机构 * Fudan University(复旦大学) Singapore Management University(新加坡国立大学) Institute for Clarity in Documentation(文档清晰研究所) Inria Paris-Rocquencourt(巴黎-罗quentourt研究所) Rajiv Gandhi University(拉贾·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒实验室)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00796 2025-11-04 cs.DC cs.LG 70%

AReaL-Hex: Accommodating Asynchronous RL Training over Heterogeneous GPUs

Ran Yan, Youhe Jiang, Tianyuan Wu, Jiaxuan Gao, Zhiyu Mei, Wei Fu, Haohui Mai, Wei Wang, Yi Wu, Binhang Yuan

机构 * HKUST(香港科技大学) Tsinghua University(清华大学) Ant Group(蚂蚁集团)

专题命中 效率与部署 :LLM(abstract);pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00603 2025-11-04 cs.DC cs.AI cs.NI 70%

EPARA: Parallelizing Categorized AI Inference in Edge Clouds

Yubo Wang, Yubo Cui, Tuo Shi, Danyang Li, Wenxin Li, Lide Suo, Tao Wang, Xin Xie

机构 * Tianjin Key Laboratory of Advanced Networking, Tianjin University(天津先进网络重点实验室,天津大学) Department of Computer Science, Aalto University(阿尔托大学计算机科学系) College of Computer Science, Nankai University(南开大学计算机科学学院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 15 pages,20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00543 2025-11-04 cs.LG cs.CV stat.ML 70%

Learning an Efficient Optimizer via Hybrid-Policy Sub-Trajectory Balance

Yunchuan Guan, Yu Liu, Ke Zhou, Hui Li, Sen Jia, Zhiqi Shen, Ziyang Wang, Xinglin Zhang, Tao Chen, Jenq-Neng Hwang, Lei Li

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.24086 2025-11-04 cs.CV cs.CL 70%

MotionGPT3: Human Motion as a Second Modality

Bingfan Zhu, Biao Jiang, Sunyi Wang, Shixiang Tang, Tao Chen, Linjie Luo, Youyi Zheng, Xin Chen

机构 * Zhejiang University(浙江大学) Fudan University(复旦大学) ByteDance(字节跳动) The Chinese University of HongKong(香港中文大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 26 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01341 2025-11-04 cs.CL 70%

AlignVLM: Bridging Vision and Language Latent Spaces for Multimodal Document Understanding

Ahmed Masry, Juan A. Rodriguez, Tianyu Zhang, Suyuchen Wang, Chao Wang, Aarash Feizi, Akshay Kalkunte Suresh, Abhay Puri, Xiangru Jian, Pierre-André Noël, Sathwik Tejaswi Madhusudhan, Marco Pedersoli, Bang Liu, Nicolas Chapados, Yoshua Bengio, Enamul Hoque, Christopher Pal, Issam H. Laradji, David Vazquez, Perouz Taslakian, Spandana Gella, Sai Rajeswar

机构 * ServiceNow York University(约克大学) Mila – Quebec AI Institute(魁北克人工智能研究院) École de Technologie Supérieure(魁北克高等技术学院) Université de Montréal(蒙特利尔大学) McGill University(麦吉尔大学) University of Waterloo(滑铁卢大学) CIFAR AI Chair(CIFAR人工智能 chair) Polytechnique Montréal(蒙特利尔理工学院) University of British Columbia(不列颠哥伦比亚大学)

专题命中 效率与部署 :LLM(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13918 2025-11-04 cs.CR cs.AI 70%

FTSmartAudit: A Knowledge Distillation-Enhanced Framework for Automated Smart Contract Auditing Using Fine-Tuned LLMs

Zhiyuan Wei, Jing Sun, Zijian Zhang, Xianhao Zhang, Zhe Hou

机构 * School of Computer Science and Technology(计算机科学与技术学院) Beijing Institute of Technology(北京理工大学) School of Computer Science(计算机科学学院) University of Auckland(奥克兰大学) School of Cyberspace Science and Technology(网络空间科学与技术学院) School of Information and Communication Technology(信息与通信技术学院) Griffith Univerity(格里菲斯大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 18 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10886 2025-11-04 cs.CR cs.LG stat.ML 70%

SLIP: Securing LLMs IP Using Weights Decomposition

Yehonathan Refael, Adam Hakim, Lev Greenberg, Satya Lokam, Tal Aviv, Ben Fishman, Shachar Seidman, Racchit Jain, Jay Tenenbaum

机构 * Microsoft(微软)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00074 2025-11-04 cs.SE 67%

ScaleCall -- Agentic Tool Calling at Scale for Fintech: Challenges, Methods, and Deployment Insights

Richard Osuagwu, Thomas Cook, Maraim Masoud, Koustav Ghosal, Riccardo Mattivi

专题命中 效率与部署 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00248 2025-11-04 cs.CV cs.GR 67%

Object-Aware 4D Human Motion Generation

Shurui Gui, Deep Anil Patel, Xiner Li, Martin Renqiang Min

机构 * Texas A&M University(德克萨斯A&M大学) NEC Laboratories America(NEC美国实验室)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16251 2025-11-04 cs.GT 67%

A QoE-Driven Personalized Incentive Mechanism Design for AIGC Services in Resource-Constrained Edge Networks

Hongjia Wu, Minrui Xu, Zehui Xiong, Lin Gao, Haoyuan Pan, Dusit Niyato, Tse-Tin Chan

专题命中 效率与部署 :large language model(abstract);language model(abstract)

Journal ref IEEE Transactions on Mobile Computing, early access, Oct. 2025

详情

展开后加载摘要…

URL PDF HTML 收藏