arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22497 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22497 篇

2510.12041 2025-10-16 cs.CL 81%

Improving Text-to-Image Generation with Input-Side Inference-Time Scaling

Ruibo Chen, Jiacheng Pan, Heng Huang, Zhenheng Yang

机构 * TikTok University of Maryland, College Park(马里兰大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);preference optimization(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10885 2025-10-14 cs.CL cs.DB 81%

Rethinking Agentic Workflows: Evaluating Inference-Based Test-Time Scaling Strategies in Text2SQL Tasks

Jiajing Guo, Kenil Patel, Jorge Piazentin Ono, Wenbin He, Liu Ren

机构 * Bosch Research North America, USA(博世美国研究北美洲) Bosch Center for Artificial Intelligence (BCAI)(博世人工智能中心)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted at COLM 2025 SCALR Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15260 2025-10-13 cs.CL 81%

LightMamba: Efficient Mamba Acceleration on FPGA with Quantization and Hardware Co-design

Renjie Wei, Songqiang Xu, Linfeng Zhong, Zebin Yang, Qingyu Guo, Yuan Wang, Runsheng Wang, Meng Li

机构 * Institute for Artificial Intelligence(人工智能研究院) School of Integrated Circuits(集成电路学院) Beijing Advanced Innovation Center for Integrated Circuits(北京集成电路先进创新中心) Institute of Electronic Design Automation(电子设计自动化研究院) School of Software and Microelectronics(软件与微电子学院) School of Electronic and Computer Engineering(电子与计算机工程学院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments Accepted by DATE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17531 2025-10-10 cs.AI cs.HC 81%

Towards Machine-Generated Code for the Resolution of User Intentions

Justus Flerlage, Ilja Behnke, Odej Kao

机构 * Technische Universität Berlin(柏林技术大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Journal ref Frontiers in Artificial Intelligence and Applications, Vol. 408: HHAI 2025, pp. 169-178

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01705 2025-09-30 cs.LG 81%

Progressive Binarization with Semi-Structured Pruning for LLMs

Xianglong Yan, Tianao Zhang, Zhiteng Li, Haotong Qin, Yulun Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) ETH Zürich(苏黎世联邦理工学院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21801 2025-09-29 cs.CL 81%

Redefining Machine Simultaneous Interpretation: From Incremental Translation to Human-Like Strategies

Qianen Zhang, Satoshi Nakamura

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Nara Institute of Science and Technology, Japan(日本奈良科学技术大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23621 2025-09-29 cs.CL 81%

Table-R1: Inference-Time Scaling for Table Reasoning

Zheyuan Yang, Lyuhao Chen, Arman Cohan, Yilun Zhao

机构 * Yale NLP Lab(耶鲁大学自然语言处理实验室) Carnegie Mellon University(卡内基梅隆大学)

专题命中 效率与部署 :LLM(abstract);instruction tuning(abstract);post-training(abstract);SFT(abstract)

Comments EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15044 2025-09-24 cs.CL 81%

Reward-Shifted Speculative Sampling Is An Efficient Test-Time Weak-to-Strong Aligner

Bolian Li, Yanran Wu, Xinyu Luo, Ruqi Zhang

机构 * Department of Computer Science, Purdue University(计算机科学系,普渡大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);RLHF(abstract)

Comments EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15097 2025-09-19 cs.LG 81%

The Energy-Efficient Hierarchical Neural Network with Fast FPGA-Based Incremental Learning

Mohammad Saleh Vahdatpour, Huaiyuan Chu, Yanqing Zhang

机构 * Department of Computer Science Georgia State University Atlanta, GA 30302-5060, USA(计算机科学系 佐治亚州立大学 阿拉巴马州亚特兰大 30302-5060, 美国)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

Comments Published at IJCNN 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06631 2025-09-09 cs.CL 81%

Guided Decoding and Its Critical Role in Retrieval-Augmented Generation

Özgür Uğur, Musa Yılmaz, Esra Şavirdi, Özay Ezerceli, Mahmut El Huseyni, Selva Taş, Reyhan Bayraktar

机构 * Newmind AI Istanbul, Türkiye(新 mind AI 伊斯坦布尔,土耳其)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08297 2025-07-22 cs.CL 81%

KAT-V1: Kwai-AutoThink Technical Report

Zizheng Zhan, Ken Deng, Huaixi Tang, Wen Xiang, Kun Wu, Weihao Li, Wenqiang Zhu, Jingxuan Xu, Lecheng Huang, Zongxian Feng, Shaojie Wang, Shangpeng Yan, Xuxing Chen, Jiaheng Liu, Zhongyuan Peng, Zuchen Gao, Haoyang Huang, Xiaojiang Zhang, Jinghui Wang, Zheng Lin, Mengtong Li, Huiming Wang, Ziqi Zhan, Yanan Wu, Yuanxing Zhang, Jian Yang, Guang Chen, Haotian Zhang, Bin Chen, Bing Yu

机构 * Kuaishou(快手)

专题命中 效率与部署 :large language model(abstract);language model(abstract);pretraining(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05617 2025-07-09 cs.CL 81%

Flipping Knowledge Distillation: Leveraging Small Models' Expertise to Enhance LLMs in Text Matching

Mingzhe Li, Jing Xiang, Qishen Zhang, Kaiyang Wan, Xiuying Chen

机构 * ByteDance, Beijing, China(字节跳动,北京,中国) Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(Mohamed bin Zayed人工智能大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);SLM(abstract)

Comments Accepted by ACL 2025 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13596 2025-07-08 cs.CL cs.SD eess.AS 81%

Qwen vs. Gemma Integration with Whisper: A Comparative Study in Multilingual SpeechLLM Systems

Tuan Nguyen, Long-Vu Hoang, Huy-Dat Tran

机构 * Institute for Infocomm Research (I$^{2}$R), A$^{\ast}$STAR, Singapore(信息与通信研究所(I²R)、A*STAR、新加坡) SoICT, Hanoi University of Science and Technology, Vietnam(河内科学技术大学SoICT、越南)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);SLM(abstract)

Comments Accepted to Interspeech MLCSLM-2025 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16196 2025-06-23 cs.LG 81%

Efficient and Privacy-Preserving Soft Prompt Transfer for LLMs

Xun Wang, Jing Xu, Franziska Boenisch, Michael Backes, Christopher A. Choquette-Choo, Adam Dziedzic

机构 * CISPA Helmholtz Center for Information Security(信息安全研究中心) Google DeepMind(谷歌DeepMind)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted at ICML2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14728 2025-06-18 cs.AI 81%

AgentDistill: Training-Free Agent Distillation with Generalizable MCP Boxes

Jiahao Qiu, Xinzhe Juan, Yimin Wang, Ling Yang, Xuan Qi, Tongcheng Zhang, Jiacheng Guo, Yifu Lu, Zixin Yao, Hongru Wang, Shilong Liu, Xun Jiang, Liu Leqi, Mengdi Wang

机构 * AI Lab, Princeton University(普林斯顿大学人工智能实验室) University of Michigan(密歇根大学) IIIS, Tsinghua University(清华大学人工智能研究院) Shanghai Jiao Tong University(上海交通大学) Columbia University(哥伦比亚大学) The Chinese University of Hong Kong(香港中文大学) Tianqiao and Chrissy Chen Institute(田桥和克里斯蒂·陈研究所) University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);small language model(abstract)

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14887 2025-06-09 cs.IR cs.LG 81%

Pseudo Relevance Feedback is Enough to Close the Gap Between Small and Large Dense Retrieval Models

Hang Li, Xiao Wang, Bevan Koopman, Guido Zuccon

机构 * The University of Queensland(昆士兰大学) University of International Business and Economics(国际商务经济大学) CSIRO(澳大利亚联邦科学与工业研究组织)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03099 2025-06-04 cs.SD cs.AI cs.GR 81%

TalkingMachines: Real-Time Audio-Driven FaceTime-Style Video via Autoregressive Diffusion Models

Chetwin Low, Weimin Wang

机构 * Character AI

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23387 2025-06-04 cs.SE cs.AI 81%

Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization

Mingzhe Du, Luu Anh Tuan, Yue Liu, Yuhao Qing, Dong Huang, Xinyi He, Qian Liu, Zejun Ma, See-kiong Ng

专题命中 效率与部署 :large language model(abstract);language model(abstract);SFT(abstract);preference optimization(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00066 2025-06-03 cs.MA cs.AI 81%

Literature Review Of Multi-Agent Debate For Problem-Solving

Arne Tillmann

机构 * University of Göttingen(哥廷根大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);language agent(abstract)

Comments 11 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11270 2025-05-19 cs.DB cs.AI 81%

TAIJI: MCP-based Multi-Modal Data Analytics on Data Lakes

Chao Zhang, Shaolei Zhang, Quehuan Liu, Sibei Chen, Tong Li, Ju Fan

机构 * Renmin University of China(中国人民大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02214 2025-05-06 cs.LG 81%

An Empirical Study of Qwen3 Quantization

Xingyu Zheng, Yuye Li, Haoran Chu, Yue Feng, Xudong Ma, Jie Luo, Jinyang Guo, Haotong Qin, Michele Magno, Xianglong Liu

机构 * Beihang University(北航大学) Xidian University(西安电子科技大学) ETH Zürich(苏黎世联邦理工学院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09818 2025-04-25 cs.CL 81%

Transferable text data distillation by trajectory matching

Rong Yao, Hailin Hu, Yifei Fu, Hanting Chen, Wenyi Fang, Fanyi Du, Kai Han, Yunhe Wang

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15930 2025-04-23 cs.LG cs.DC 81%

StreamRL: Scalable, Heterogeneous, and Elastic RL for LLMs with Disaggregated Stream Generation

Yinmin Zhong, Zili Zhang, Xiaoniu Song, Hanpeng Hu, Chao Jin, Bingyang Wu, Nuo Chen, Yukun Chen, Yu Zhou, Changyi Wan, Hongyu Zhou, Yimin Jiang, Yibo Zhu, Daxin Jiang

机构 * School of Computer Science, Peking University(北京大学计算机学院) StepFun

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07878 2025-04-11 cs.CL cs.DC 81%

Token Level Routing Inference System for Edge Devices

Jianshu She, Wenhao Zheng, Zhengzhong Liu, Hongyi Wang, Eric Xing, Huaxiu Yao, Qirong Ho

机构 * Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(穆罕默德·本·扎耶德人工智能大学(MBZUAI)) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Rutgers University(罗格斯大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);small language model(abstract)

Comments 6 pages, 8 figures, under review of ACL system demo

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18942 2025-04-02 cs.CV cs.AI 81%

Video-T1: Test-Time Scaling for Video Generation

Fangfu Liu, Hanyang Wang, Yimo Cai, Kaiyan Zhang, Xiaohang Zhan, Yueqi Duan

机构 * Tsinghua University(清华大学) Tencent(腾讯)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

Comments Project page: https://liuff19.github.io/Video-T1

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15807 2025-03-21 cs.AI 81%

Video-VoT-R1: An efficient video inference model integrating image packing and AoE architecture

Cheng Li, Jiexiong Liu, Yixuan Chen, Yanqin Jia

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09536 2025-03-10 cs.RO cs.AI 81%

VernaCopter: Disambiguated Natural-Language-Driven Robot via Formal Specifications

Teun van de Laar, Zengjie Zhang, Shuhao Qi, Sofie Haesaert, Zhiyong Sun

机构 * Eindhoven University of Technology(埃因霍温理工大学) Peking University(北京大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18822 2025-02-27 cs.AI cs.MA 81%

Data-Efficient Multi-Agent Spatial Planning with LLMs

Huangyuan Su, Aaron Walsman, Daniel Garces, Sham Kakade, Stephanie Gil

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12325 2025-02-19 cs.CL 81%

From Dense to Dynamic: Token-Difficulty Driven MoEfication of Pre-Trained LLMs

Kumari Nishu, Sachin Mehta, Samira Abnar, Mehrdad Farajtabar, Maxwell Horton, Mahyar Najibi, Moin Nabi, Minsik Cho, Devang Naik

机构 * Apple(苹果公司)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11493 2025-02-18 cs.CL 81%

DAST: Context-Aware Compression in LLMs via Dynamic Allocation of Soft Tokens

Shaoshen Chen, Yangning Li, Zishan Xu, Yinghui Li, Xin Su, Zifei Shan, Hai-tao Zheng

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Peng Cheng Laboratory(鹏城实验室)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏