arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-12 至 2025-08-12 共收录 282 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 45 篇

2412.16633 2025-08-12 cs.RO cs.AI cs.CY 79%

POEX: Towards Policy Executable Jailbreak Attacks Against the LLM-based Robots

Xuancun Lu, Zhengxian Huang, Xinfeng Li, Chi Zhang, Xiaoyu ji, Wenyuan Xu

专题命中 效率与部署 :LLM(title,abstract);分类 cs.AI

Comments Homepage: https://poex-jailbreak.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06621 2025-08-12 cs.CL 79%

Train It and Forget It: Merge Lists are Unnecessary for BPE Inference in Language Models

Tomohiro Sawada, Kartik Goyal

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL

Comments Submitted to EMNLP

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07247 2025-08-12 cs.LG 79%

Resource-efficient Inference with Foundation Model Programs

Lunyiu Nie, Zhimin Ding, Kevin Yu, Marco Cheung, Chris Jermaine, Swarat Chaudhuri

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) Rice University(里奇大学)

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.LG

Comments COLM 2025 Main Conference Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19115 2025-08-12 cs.LG cs.AI 79%

FP4 All the Way: Fully Quantized Training of LLMs

Brian Chmiel, Maxim Fishman, Ron Banner, Daniel Soudry

机构 * Intel, Israel(英特尔(以色列)) Nvidia, Israel(英伟达(以色列)) Department of Electrical and Computer Engineering - Technion, Haifa, Israel(技术学院电子与计算机工程系 - 哈ifa, 以色列)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06781 2025-08-12 cs.IR cs.AI cs.LG 79%

BiXSE: Improving Dense Retrieval via Probabilistic Graded Relevance Distillation

Christos Tsirigotis, Vaibhav Adlakha, Joao Monteiro, Aaron Courville, Perouz Taslakian

机构 * Université de Montéal(蒙特阿尔大学) Mila - Quebec AI Institute(魁北克AI研究院) McGill University(麦吉尔大学) Apple MLR(苹果机器学习研究部) IVADO, Canada(加拿大IVADO研究所) CIFAR AI Chair(CIFAR人工智能主席) ServiceNow Research(ServiceNow研究)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 22 pages, 5 figures, accepted at COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07878 2025-08-12 cs.CV 78%

TAP: Parameter-efficient Task-Aware Prompting for Adverse Weather Removal

Hanting Wang, Shengpeng Ji, Shulei Wang, Hai Huang, Xiao Jin, Qifei Zhang, Tao Jin

机构 * Zhejiang University(浙江大学)

专题命中 效率与部署 :prompting(title);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07778 2025-08-12 cs.NI 78%

An Experimental Reservoir-Augmented Foundation Model: 6G O-RAN Case Study

Farhad Rezazadeh, Raymond Zhao, Jiongyu Dai, Amir Ashtari Gargari, Hatim Chergui, Lingjia Liu

专题命中 效率与部署 :foundation model(title,abstract)

Comments 5 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07658 2025-08-12 cs.HC 78%

Through Their Eyes: User Perceptions on Sensitive Attribute Inference of Social Media Videos by Visual Language Models

Shuning Zhang, Gengrui Zhang, Yibo Meng, Ziyi Zhang, Hantao Zhao, Xin Yi, Hewu Li

专题命中 效率与部署 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08140 2025-08-12 cs.CL 77%

Data-Efficient Biomedical In-Context Learning: A Diversity-Enhanced Submodular Perspective

Jun Wang, Zaifu Zhan, Qixin Zhang, Mingquan Lin, Meijia Song, Rui Zhang

机构 * Division of Computational Health Sciences, Department of Surgery(计算健康科学系,外科系) School of Nursing(护理学院) College of Computing and Data Science(计算与数据科学学院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08029 2025-08-12 cs.CR cs.ET cs.LG 77%

Robust Anomaly Detection in O-RAN: Leveraging LLMs against Data Manipulation Attacks

Thusitha Dayaratne, Ngoc Duy Pham, Viet Vo, Shangqi Lai, Sharif Abuadbba, Hajime Suzuki, Xingliang Yuan, Carsten Rudolph

机构 * Monash University(墨尔本大学) Swinburne University of Technology(斯威本技术大学) The University of Melbourne(墨尔本大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07785 2025-08-12 cs.CL 77%

Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts

Haoyuan Wu, Haoxing Chen, Xiaodong Chen, Zhanchao Zhou, Tieyuan Chen, Yihong Zhuang, Guoshan Lu, Zenan Huang, Junbo Zhao, Lin Liu, Zhenzhong Lan, Bei Yu, Jianguo Li

机构 * The Chinese University of Hong Kong(香港中文大学) Renmin University of China(中国人民大学) Zhejiang University(浙江大学) Shanghai Jiao Tong University(上海交通大学) Westlake University(西湖大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06917 2025-08-12 q-bio.QM cs.AI 77%

CROP: Integrating Topological and Spatial Structures via Cross-View Prefixes for Molecular LLMs

Jianting Tang, Yubo Wang, Haoyu Cao, Linli Xu

机构 * University of Science and Technology of China(科学技术大学) State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted to ACMMM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.13621 2025-08-12 cs.CV 75%

EA-KD: Entropy-based Adaptive Knowledge Distillation

Chi-Ping Su, Ching-Hsun Tseng, Bin Pu, Lei Zhao, Jiewen Yang, Zhuangzhuang Chen, Shin-Jye Lee

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06948 2025-08-12 cs.DC 75%

Kairos: Low-latency Multi-Agent Serving with Shared LLMs and Excessive Loads in the Public Cloud

Jinyuan Chen, Jiuchen Shi, Quan Chen, Minyi Guo

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.24152 2025-08-12 cs.RO 75%

Language-Driven Policy Distillation for Cooperative Driving in Multi-Agent Reinforcement Learning

Jiaqi Liu, Chengkai Xu, Peng Hang, Jian Sun, Wei Zhan, Masayoshi Tomizuka, Mingyu Ding

机构 * Department of Computer Science at University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校计算机科学系) College of Transportation and Key Laboratory of Road and Traffic Engineering, Ministry of Education, Tongji University(同济大学交通学院及交通工程教育部重点实验室) Department of Mechanical Engineering at the University of California, Berkeley(加州大学伯克利分校机械工程系)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07329 2025-08-12 cs.LG cs.AI 73%

Efficient Edge LLMs Deployment via HessianAware Quantization and CPU GPU Collaborative

Tuo Zhang, Ning Li, Xin Yuan, Wenchao Xu, Quan Chen, Song Guo, Haijun Zhang

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19952 2025-08-12 cs.CL cs.AI 73%

CycleDistill: Bootstrapping Machine Translation using LLMs with Cyclical Distillation

Deepon Halder, Thanmay Jayakumar, Raj Dabre

机构 * Nilekani Centre at AI4Bharat(AI4Bharat的Nilekani中心) Indian Institute of Technology(印度理工学院) Indian Institute of Technology Bombay(印度理工学院孟买分校) Indian Institute of Engineering Science and Technology Shibpur(Shibpur的印度工程科学与技术学院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08192 2025-08-12 cs.CL 70%

Efficient Speculative Decoding for Llama at Scale: Challenges and Solutions

Bangsheng Tang, Carl Chengyan Fu, Fei Kou, Grigory Sizov, Haoci Zhang, Jason Park, Jiawen Liu, Jie You, Qirui Yang, Sachin Mehta, Shengyong Cai, Xiaodong Wang, Xingyu Liu, Yunlu Li, Yanjun Zhou, Wei Wei, Zhiwei Zhao, Zixi Qi, Adolfo Victoria, Aya Ibrahim, Bram Wasti, Changkyu Kim, Daniel Haziza, Fei Sun, Giancarlo Delfin, Emily Guo, Jialin Ouyang, Jaewon Lee, Jianyu Huang, Jeremy Reizenstein, Lu Fang, Quinn Zhu, Ria Verma, Vlad Mihailescu, Xingwen Guo, Yan Cui, Ye Hu, Yejin Lee

机构 * GenAI and Infra Teams at Meta(Meta 生成AI与基础设施团队)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07434 2025-08-12 cs.CL 70%

Let's Revise Step-by-Step: A Unified Local Search Framework for Code Generation with LLMs

Zhiyi Lyu, Jianguo Huang, Yanchen Deng, Steven Hoi, Bo An

机构 * Nanyang Technological University(南洋理工大学) Alibaba Group(阿里巴巴集团)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07017 2025-08-12 cs.CL 70%

Vec2Summ: Text Summarization via Probabilistic Sentence Embeddings

Mao Li, Fred Conrad, Johann Gagnon-Bartsch

专题命中 效率与部署 :LLM(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07431 2025-08-12 hep-ph 67%

Investigating 1-Bit Quantization in Transformer-Based Top Tagging

Saurabh Rai, Prisha, Jitendra Kumar

专题命中 效率与部署 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04305 2025-08-12 eess.IV 67%

Edge2Prompt: Modality-Agnostic Model for Out-of-Distribution Liver Segmentation

Nathan Hollet, Oumeymah Cherkaoui, Philippe C. Cattin, Sidaty El Hadramy

专题命中 效率与部署 :foundation model(abstract);prompting(abstract)

Comments 8 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06134 2025-08-12 cs.CV 67%

X2I: Seamless Integration of Multimodal Understanding into Diffusion Transformer via Attention Distillation

Jian Ma, Qirong Peng, Xu Guo, Chen Chen, Haonan Lu, Zhenyu Yang

机构 * OPPO AI Center(OPPO人工智能中心) Tsinghua University(清华大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.13171 2025-08-12 cs.LG cs.AI cs.CL 67%

ComPEFT: Compression for Communicating Parameter Efficient Updates via Sparsification and Quantization

Prateek Yadav, Leshem Choshen, Colin Raffel, Mohit Bansal

机构 * UNC-Chapel Hill(北卡罗来纳州立大学切尔希尔分校) MIT(麻省理工学院) MIT-IBM Watson AI Lab(麻省理工-IBM沃森人工智能实验室) University of Toronto(多伦多大学) Vector Institue(向量研究所)

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 25 Pages, 6 Figures, 16 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07648 2025-08-12 cs.RO cs.AI cs.LG 62%

Grasp-HGN: Grasping the Unexpected

Mehrshad Zandigohar, Mallesham Dasari, Gunar Schirner

专题命中 效率与部署 :language model(abstract);分类 cs.AI、cs.LG

Comments Paper accepted at ACM Transactions on Embedded Computing Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20208 2025-08-12 cs.RO cs.AI cs.LG 62%

Learning Adaptive Dexterous Grasping from Single Demonstrations

Liangzhi Shi, Yulin Liu, Lingqi Zeng, Bo Ai, Zhengdong Hong, Hao Su

机构 * University of California, San Diego(加州大学圣地亚哥分校) Tsinghua University(清华大学) Hillbot

专题命中 效率与部署 :language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02122 2025-08-12 cs.CL 57%

Overcoming Vocabulary Constraints with Pixel-level Fallback

Jonas F. Lotz, Hendra Setiawan, Stephan Peitz, Yova Kementchedjhieva

专题命中 效率与部署 :language model(abstract);分类 cs.CL

Comments COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20263 2025-08-12 cs.RO cs.AI cs.CV 57%

EfficientEQA: An Efficient Approach to Open-Vocabulary Embodied Question Answering

Kai Cheng, Zhengyuan Li, Xingpeng Sun, Byung-Cheol Min, Amrit Singh Bedi, Aniket Bera

机构 * Purdue University(普渡大学) University of Central Florida(中央佛罗里达大学)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

Comments IROS 2025 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.01775 2025-08-12 cs.CL 57%

UP4LS: User Profile Constructed by Multiple Attributes for Enhancing Linguistic Steganalysis

Yihao Wang, Ruiqi Song, Lingxiao Li, Yifan Tang, Ru Zhang, Jianyi Liu

机构 * School of Cyberspace Security, Beijing University of Posts and Telecommunications, China(网络安全学院,北京邮电大学)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

Comments 15 pages, 7 figures, 14 tables

Journal ref Expert Systems With Applications, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07573 2025-08-12 cs.ET cs.NI 50%

Enhancing Mega-Satellite Networks with Generative Semantic Communication: A Networking Perspective

Binquan Guo, Wanting Yang, Zehui Xiong, Zhou Zhang, Baosheng Li, Zhu Han, Rahim Tafazolli, Tony Q. S. Quek

专题命中 效率与部署 :foundation model(abstract)

Comments Accepted paper to be published in IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏