arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-12 至 2025-08-12 共收录 45 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 45 篇

2502.00425 2025-08-12 cs.CV cs.AI 90%

MQuant: Unleashing the Inference Potential of Multimodal Large Language Models via Full Static Quantization

JiangYong Yu, Sifan Zhou, Dawei Yang, Shuo Wang, Shuoyu Li, Xing Hu, Chen Xu, Zukang Xu, Changyong Shu, Zhihang Yuan

机构 * Southeast University(东南大学) Xi'an Jiaotong University(西安交通大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);post-training(abstract);分类 cs.AI

Comments Accepted by ACM MM 2025. First PTQ solution for Multimodal large language models applicable to 5 mainstream MLLMs

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08137 2025-08-12 cs.LG cs.AI cs.SY eess.SY 90%

MuaLLM: A Multimodal Large Language Model Agent for Circuit Design Assistance with Hybrid Contextual Retrieval-Augmented Generation

Pravallika Abbineni, Saoud Aldowaish, Colin Liechty, Soroosh Noorzad, Ali Ghazizadeh, Morteza Fayazi

机构 * University of Utah(犹他大学) University of Michigan(密歇根大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07932 2025-08-12 cs.AI 89%

\(X\)-evolve: Solution space evolution powered by large language models

Yi Zhai, Zhiqiang Wei, Ruohan Li, Keyu Pan, Shuo Liu, Lu Zhang, Jianmin Ji, Wuyang Zhang, Yu Zhang, Yanyong Zhang

机构 * University of Science and Technology of China(中国科学技术大学) ByteDance Ltd.(字节跳动有限公司) Institute of Artificial Intelligence(人工智能研究院) Hefei Comprehensive National Science Center(合肥综合性国家科学中心)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08101 2025-08-12 cs.HC cs.AI cs.SE 86%

ChatGPT on the Road: Leveraging Large Language Model-Powered In-vehicle Conversational Agents for Safer and More Enjoyable Driving Experience

Yeana Lee Bond, Mungyeong Choe, Baker Kasim Hasan, Arsh Siddiqui, Myounghoon Jeon

机构 * Computer Science, Virginia Tech, Blacksburg, Virginia, USA(计算机科学,弗吉尼亚理工学院,弗吉尼亚州黑斯堡,美国;弗吉尼亚理工学院黑斯堡弗吉尼亚美国) Virginia Tech Blacksburg Virginia USA

专题命中 效率与部署 :large language model(title);language model(title);LLM(abstract);分类 cs.AI

Comments Submitted to International Journal of Human-Computer Studies. Bond and Choe: Drafting, Review, Editing, Validation, Software, Methodology, Investigation, Data Analysis, Conceptualization, Experiment training. Hasan and Siddiqui: Experimental and Data Analysis Support. Jeon: Supervision, Review, Resources, Project Admin, Methodology, Conceptualization. Total 34 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07221 2025-08-12 cs.LG cs.AI cs.MA stat.AP stat.ME 86%

LLM-based Agents for Automated Confounder Discovery and Subgroup Analysis in Causal Inference

Po-Han Lee, Yu-Cheng Lin, Chan-Tung Ku, Chan Hsu, Pei-Cing Huang, Ping-Hsun Wu, Yihuang Kang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09426 2025-08-12 cs.CL cs.LG 86%

FlatQuant: Flatness Matters for LLM Quantization

Yuxuan Sun, Ruikang Liu, Haoli Bai, Han Bao, Kang Zhao, Yuening Li, Jiaxin Hu, Xianzhi Yu, Lu Hou, Chun Yuan, Xin Jiang, Wulong Liu, Jun Yao

机构 * Huawei Noah's Ark Lab(华为诺亚实验室) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) The Chinese University of Hong Kong(香港中文大学)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);post-training(abstract)

Comments 27 pages, accepted to ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07054 2025-08-12 cs.LG cs.AI 86%

Membership and Memorization in LLM Knowledge Distillation

Ziqi Zhang, Ali Shahin Shamsabadi, Hanxiao Lu, Yifeng Cai, Hamed Haddadi

机构 * Peking University(北京大学) Brave Software(Brave软件公司) Purdue University(普渡大学) Imperial College London(伦敦帝国理工学院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08147 2025-08-12 cs.AI 85%

From Natural Language to Solver-Ready Power System Optimization: An LLM-Assisted, Validation-in-the-Loop Framework

Yunkai Hu, Tianqiao Zhao, Meng Yue

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系) University of Southern California(南加州大学) Department of Electrical Engineering(电气工程系) University of Texas at Arlington(德克萨斯大学阿灵顿分校) Interdisciplinary Science Department(跨学科科学系) Brookhaven National Laboratory(布鲁赫斯国家实验室)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06978 2025-08-12 cs.AR 85%

SSD Offloading for LLM Mixture-of-Experts Weights Considered Harmful in Energy Efficiency

Kwanhee Kyung, Sungmin Yun, Jung Ho Ahn

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 4 pages, 6 figures, accepted at IEEE Computer Architecture Letters

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06554 2025-08-12 cs.RO 85%

AquaChat++: LLM-Assisted Multi-ROV Inspection for Aquaculture Net Pens with Integrated Battery Management and Thruster Fault Tolerance

Abdelhaleem Saad, Waseem Akram, Irfan Hussain

机构 * Khalifa University Center for Autonomous Robotic Systems (KUCARS), Khalifa University, United Arab Emirates(卡利法大学自主机器人系统中心(KUCARS)、卡利法大学、阿拉伯联合酋长国)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05855 2025-08-12 cs.RO cs.CV 85%

DexVLA: Vision-Language Model with Plug-In Diffusion Expert for General Robot Control

Junjie Wen, Yichen Zhu, Jinming Li, Zhibin Tang, Chaomin Shen, Feifei Feng

专题命中 效率与部署 :language model(title,abstract);post-training(abstract);prompting(abstract)

Comments The webpage is at https://dex-vla.github.io/. DexVLA is accepted by CoRL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20756 2025-08-12 cs.CV cs.CL 83%

SynthVLM: Towards High-Quality and Efficient Synthesis of Image-Caption Datasets for Vision-Language Models

Zheng Liu, Hao Liang, Bozhou Li, Wentao Xiong, Chong Chen, Conghui He, Wentao Zhang, Bin Cui

机构 * Peking University Beijing China Huawei Technologies Ltd. Beijing China Shanghai AI Laboratory Shanghai China Peking University Center for Machine Learning Research Beijing China Peking University School of Computer Science \& Key Lab of High Confidence Software Technologies (MOE) Beijing China Peking University Huawei Technologies Ltd. Shanghai AI Laboratory

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06591 2025-08-12 cs.LG cond-mat.dis-nn cond-mat.mtrl-sci cond-mat.other cs.AI cs.CL 80%

Generative Artificial Intelligence Extracts Structure-Function Relationships from Plants for New Materials

Rachel K. Luu, Jingyu Deng, Mohammed Shahrudin Ibrahim, Nam-Joon Cho, Ming Dao, Subra Suresh, Markus J. Buehler

机构 * Department of Materials Science and Engineering(材料科学与工程系) Laboratory for Atomistic and Molecular Mechanics (LAMM)(原子分子力学实验室) Massachusetts Institute of Technology(麻省理工学院) School of Materials Science and Engineering(材料科学与工程学院) Centre for Cross Economy Global(跨经济全球中心) Nanyang Technological University(南洋理工大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06548 2025-08-12 cs.CL cs.AI cs.LG stat.ML 80%

Factor Augmented Supervised Learning with Text Embeddings

Zhanye Luo, Yuefeng Han, Xiufan Yu

机构 * University of Chicago(芝加哥大学) University of Notre Dame(圣约翰大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16633 2025-08-12 cs.RO cs.AI cs.CY 79%

POEX: Towards Policy Executable Jailbreak Attacks Against the LLM-based Robots

Xuancun Lu, Zhengxian Huang, Xinfeng Li, Chi Zhang, Xiaoyu ji, Wenyuan Xu

专题命中 效率与部署 :LLM(title,abstract);分类 cs.AI

Comments Homepage: https://poex-jailbreak.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06621 2025-08-12 cs.CL 79%

Train It and Forget It: Merge Lists are Unnecessary for BPE Inference in Language Models

Tomohiro Sawada, Kartik Goyal

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL

Comments Submitted to EMNLP

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07247 2025-08-12 cs.LG 79%

Resource-efficient Inference with Foundation Model Programs

Lunyiu Nie, Zhimin Ding, Kevin Yu, Marco Cheung, Chris Jermaine, Swarat Chaudhuri

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) Rice University(里奇大学)

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.LG

Comments COLM 2025 Main Conference Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19115 2025-08-12 cs.LG cs.AI 79%

FP4 All the Way: Fully Quantized Training of LLMs

Brian Chmiel, Maxim Fishman, Ron Banner, Daniel Soudry

机构 * Intel, Israel(英特尔(以色列)) Nvidia, Israel(英伟达(以色列)) Department of Electrical and Computer Engineering - Technion, Haifa, Israel(技术学院电子与计算机工程系 - 哈ifa, 以色列)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06781 2025-08-12 cs.IR cs.AI cs.LG 79%

BiXSE: Improving Dense Retrieval via Probabilistic Graded Relevance Distillation

Christos Tsirigotis, Vaibhav Adlakha, Joao Monteiro, Aaron Courville, Perouz Taslakian

机构 * Université de Montéal(蒙特阿尔大学) Mila - Quebec AI Institute(魁北克AI研究院) McGill University(麦吉尔大学) Apple MLR(苹果机器学习研究部) IVADO, Canada(加拿大IVADO研究所) CIFAR AI Chair(CIFAR人工智能主席) ServiceNow Research(ServiceNow研究)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 22 pages, 5 figures, accepted at COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07878 2025-08-12 cs.CV 78%

TAP: Parameter-efficient Task-Aware Prompting for Adverse Weather Removal

Hanting Wang, Shengpeng Ji, Shulei Wang, Hai Huang, Xiao Jin, Qifei Zhang, Tao Jin

机构 * Zhejiang University(浙江大学)

专题命中 效率与部署 :prompting(title);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07778 2025-08-12 cs.NI 78%

An Experimental Reservoir-Augmented Foundation Model: 6G O-RAN Case Study

Farhad Rezazadeh, Raymond Zhao, Jiongyu Dai, Amir Ashtari Gargari, Hatim Chergui, Lingjia Liu

专题命中 效率与部署 :foundation model(title,abstract)

Comments 5 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07658 2025-08-12 cs.HC 78%

Through Their Eyes: User Perceptions on Sensitive Attribute Inference of Social Media Videos by Visual Language Models

Shuning Zhang, Gengrui Zhang, Yibo Meng, Ziyi Zhang, Hantao Zhao, Xin Yi, Hewu Li

专题命中 效率与部署 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08140 2025-08-12 cs.CL 77%

Data-Efficient Biomedical In-Context Learning: A Diversity-Enhanced Submodular Perspective

Jun Wang, Zaifu Zhan, Qixin Zhang, Mingquan Lin, Meijia Song, Rui Zhang

机构 * Division of Computational Health Sciences, Department of Surgery(计算健康科学系,外科系) School of Nursing(护理学院) College of Computing and Data Science(计算与数据科学学院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08029 2025-08-12 cs.CR cs.ET cs.LG 77%

Robust Anomaly Detection in O-RAN: Leveraging LLMs against Data Manipulation Attacks

Thusitha Dayaratne, Ngoc Duy Pham, Viet Vo, Shangqi Lai, Sharif Abuadbba, Hajime Suzuki, Xingliang Yuan, Carsten Rudolph

机构 * Monash University(墨尔本大学) Swinburne University of Technology(斯威本技术大学) The University of Melbourne(墨尔本大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07785 2025-08-12 cs.CL 77%

Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts

Haoyuan Wu, Haoxing Chen, Xiaodong Chen, Zhanchao Zhou, Tieyuan Chen, Yihong Zhuang, Guoshan Lu, Zenan Huang, Junbo Zhao, Lin Liu, Zhenzhong Lan, Bei Yu, Jianguo Li

机构 * The Chinese University of Hong Kong(香港中文大学) Renmin University of China(中国人民大学) Zhejiang University(浙江大学) Shanghai Jiao Tong University(上海交通大学) Westlake University(西湖大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06917 2025-08-12 q-bio.QM cs.AI 77%

CROP: Integrating Topological and Spatial Structures via Cross-View Prefixes for Molecular LLMs

Jianting Tang, Yubo Wang, Haoyu Cao, Linli Xu

机构 * University of Science and Technology of China(科学技术大学) State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted to ACMMM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.13621 2025-08-12 cs.CV 75%

EA-KD: Entropy-based Adaptive Knowledge Distillation

Chi-Ping Su, Ching-Hsun Tseng, Bin Pu, Lei Zhao, Jiewen Yang, Zhuangzhuang Chen, Shin-Jye Lee

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06948 2025-08-12 cs.DC 75%

Kairos: Low-latency Multi-Agent Serving with Shared LLMs and Excessive Loads in the Public Cloud

Jinyuan Chen, Jiuchen Shi, Quan Chen, Minyi Guo

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.24152 2025-08-12 cs.RO 75%

Language-Driven Policy Distillation for Cooperative Driving in Multi-Agent Reinforcement Learning

Jiaqi Liu, Chengkai Xu, Peng Hang, Jian Sun, Wei Zhan, Masayoshi Tomizuka, Mingyu Ding

机构 * Department of Computer Science at University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校计算机科学系) College of Transportation and Key Laboratory of Road and Traffic Engineering, Ministry of Education, Tongji University(同济大学交通学院及交通工程教育部重点实验室) Department of Mechanical Engineering at the University of California, Berkeley(加州大学伯克利分校机械工程系)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07329 2025-08-12 cs.LG cs.AI 73%

Efficient Edge LLMs Deployment via HessianAware Quantization and CPU GPU Collaborative

Tuo Zhang, Ning Li, Xin Yuan, Wenchao Xu, Quan Chen, Song Guo, Haijun Zhang

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏