arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-07-28 至 2025-07-28 共收录 23 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 23 篇

2502.20268 2025-07-28 cs.LG cs.AI 90%

Large Language Models as Attribution Regularizers for Efficient Model Training

Davor Vukadin, Marin Šilić, Goran Delač

机构 * University of Zagreb Faculty of Electrical Engineering and Computing(Zagreb 大学电气工程与计算学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19142 2025-07-28 cs.AR 89%

A3D-MoE: Acceleration of Large Language Models with Mixture of Experts via 3D Heterogeneous Integration

Wei-Hsing Huang, Janak Sharda, Cheng-Jhih Shih, Yuyao Kong, Faaiq Waqar, Pin-Jun Chen, Yingyan, Lin, Shimeng Yu

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19050 2025-07-28 cs.NI 89%

Large Language Model-Based Task Offloading and Resource Allocation for Digital Twin Edge Computing Networks

Qiong Wu, Yu Xie, Pingyi Fan, Dong Qin, Kezhi Wang, Nan Cheng, Khaled B. Letaief

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments This paper has been submitted to IEEE TMC

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19628 2025-07-28 cs.CV cs.CL cs.LG cs.MM 88%

Accelerating Multimodal Large Language Models via Dynamic Visual-Token Exit and the Empirical Findings

Qiong Wu, Wenhao Lin, Yiyi Zhou, Weihao Ye, Zhanpeng Zen, Xiaoshuai Sun, Rongrong Ji

机构 * Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(中国教育部多媒体可信感知与高效计算重点实验室,厦门大学) Institute of Artificial Intelligence, Xiamen University(厦门大学人工智能研究院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18945 2025-07-28 cs.HC cs.AI cs.CL 84%

TreeReader: A Hierarchical Academic Paper Reader Powered by Language Models

Zijian Zhang, Pan Chen, Fangshi Du, Runlong Ye, Oliver Huang, Michael Liut, Alán Aspuru-Guzik

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.06270 2025-07-28 cs.LG cs.AI cs.CL 80%

XAI4LLM. Let Machine Learning Models and LLMs Collaborate for Enhanced In-Context Learning in Healthcare

Fatemeh Nazary, Yashar Deldjoo, Tommaso Di Noia, Eugenio di Sciascio

机构 * Polytechnic University of Bari(巴里理工大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18897 2025-07-28 cs.SD cs.AI eess.AS 79%

HH-Codec: High Compression High-fidelity Discrete Neural Codec for Spoken Language Modeling

Rongkun Xue, Yazhe Niu, Shuai Hu, Zixin Yin, Yongqiang Yao, Jing Yang

机构 * The School of Automation Science and Engineering, Xi'an Jiaotong University, Xi'an, China(自动化科学与工程学院,西安交通大学) Shanghai AI Laboratory, Shanghai, China(上海人工智能实验室) SenseTime Research, Shanghai, China(商汤研究) Shanghai Jiao Tong University, Shanghai, China(上海交通大学) The Chinese University of Hong Kong, Hong Kong SAR, China(香港中文大学)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15670 2025-07-28 cs.CL cs.SD eess.AS 79%

SALM-Duplex: Efficient and Direct Duplex Modeling for Speech-to-Speech Language Model

Ke Hu, Ehsan Hosseini-Asl, Chen Chen, Edresson Casanova, Subhankar Ghosh, Piotr Żelasko, Zhehuai Chen, Jason Li, Jagadeesh Balam, Boris Ginsburg

机构 * NVIDIAUSA(NVIDIA美国)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL

Comments Accepted to Interspeech 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01986 2025-07-28 cs.CV cs.AI 79%

FrameFusion: Combining Similarity and Importance for Video Token Reduction on Large Vision Language Models

Tianyu Fu, Tengxuan Liu, Qinghao Han, Guohao Dai, Shengen Yan, Huazhong Yang, Xuefei Ning, Yu Wang

机构 * Tsinghua University(清华大学) Infinigence-AI Peking University(北京大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19427 2025-07-28 cs.LG cs.AI 79%

Step-3 is Large yet Affordable: Model-system Co-design for Cost-effective Decoding

StepFun, :, Bin Wang, Bojun Wang, Changyi Wan, Guanzhe Huang, Hanpeng Hu, Haonan Jia, Hao Nie, Mingliang Li, Nuo Chen, Siyu Chen, Song Yuan, Wuxun Xie, Xiaoniu Song, Xing Chen, Xingping Yang, Xuelin Zhang, Yanbo Yu, Yaoyu Wang, Yibo Zhu, Yimin Jiang, Yu Zhou, Yuanwei Lu, Houyi Li, Jingcheng Hu, Ka Man Lo, Ailin Huang, Binxing Jiao, Bo Li, Boyu Chen, Changxin Miao, Chang Lou, Chen Hu, Chen Xu, Chenfeng Yu, Chengyuan Yao, Daokuan Lv, Dapeng Shi, Deshan Sun, Ding Huang, Dingyuan Hu, Dongqing Pang, Enle Liu, Fajie Zhang, Fanqi Wan, Gulin Yan, Han Zhang, Han Zhou, Hanghao Wu, Hangyu Guo, Hanqi Chen, Hanshan Zhang, Hao Wu, Haocheng Zhang, Haolong Yan, Haoran Lv, Haoran Wei, Hebin Zhou, Heng Wang, Heng Wang, Hongxin Li, Hongyu Zhou, Hongyuan Wang, Huiyong Guo, Jia Wang, Jiahao Gong, Jialing Xie, Jian Zhou, Jianjian Sun, Jiaoren Wu, Jiaran Zhang, Jiayu Liu, Jie Cheng, Jie Luo, Jie Yan, Jie Yang, Jieyi Hou, Jinguang Zhang, Jinlan Cao, Jisheng Yin, Junfeng Liu, Junhao Huang, Junzhe Lin, Kaijun Tan, Kaixiang Li, Kang An, Kangheng Lin, Kenkun Liu, Lei Yang, Liang Zhao, Liangyu Chen, Lieyu Shi, Liguo Tan, Lin Lin, Lin Zhang, Lina Chen, Liwen Huang, Liying Shi, Longlong Gu, Mei Chen, Mengqiang Ren, Ming Li, Mingzhe Chen, Na Wang, Nan Wu, Qi Han, Qian Zhao, Qiang Zhang, Qianni Liu, Qiaohui Chen, Qiling Wu, Qinglin He, Qinyuan Tan, Qiufeng Wang, Qiuping Wu, Qiuyan Liang, Quan Sun, Rui Li, Ruihang Miao, Ruosi Wan, Ruyan Guo, Shangwu Zhong, Shaoliang Pang, Shengjie Fan, Shijie Shang, Shilei Jiang, Shiliang Yang, Shiming Hao, Shuli Gao, Siming Huang, Siqi Liu, Tiancheng Cao, Tianhao Cheng, Tianhao Peng, Wang You, Wei Ji, Wen Sun, Wenjin Deng, Wenqing He, Wenzhen Zheng, Xi Chen, Xiangwen Kong, Xianzhen Luo, Xiaobo Yang, Xiaojia Liu, Xiaoxiao Ren, Xin Han, Xin Li, Xin Wu, Xu Zhao, Yanan Wei, Yang Li, Yangguang Li, Yangshijie Xu, Yanming Xu, Yaqiang Shi, Yeqing Shen, Yi Yang, Yifei Yang, Yifeng Gong, Yihan Chen, Yijing Yang, Yinmin Zhang, Yizhuang Zhou, Yuanhao Ding, Yuantao Fan, Yuanzhen Yang, Yuchu Luo, Yue Peng, Yufan Lu, Yuhang Deng, Yuhe Yin, Yujie Liu, Yukun Chen, Yuling Zhao, Yun Mou, Yunlong Li, Yunzhou Ju, Yusheng Li, Yuxiang Yang, Yuxiang Zhang, Yuyang Chen, Zejia Weng, Zhe Xie, Zheng Ge, Zheng Gong, Zhenyi Lu, Zhewei Huang, Zhichao Chang, Zhiguo Huang, Zhirui Wang, Zidong Yang, Zili Wang, Ziqi Wang, Zixin Zhang, Binxing Jiao, Daxin Jiang, Heung-Yeung Shum, Xiangyu Zhang

机构 * StepFun Inc(StepFun公司)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18997 2025-07-28 cs.CV 78%

UPP: Unified Point-Level Prompting for Robust Point Cloud Analysis

Zixiang Ai, Zhenyu Cui, Yuxin Peng, Jiahuan Zhou

机构 * Wangxuan Institute of Computer Technology, Peking University(计算机技术研究院,北京大学)

专题命中 效率与部署 :prompting(title,abstract)

Comments Accepted by ICCV 2025 as a Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16229 2025-07-28 cs.AI cs.CY cs.ET cs.HC cs.SE 77%

Voice-based AI Agents: Filling the Economic Gaps in Digital Health Delivery

Bo Wen, Chen Wang, Qiwei Han, Raquel Norel, Julia Liu, Thaddeus Stappenbeck, Jeffrey L. Rogers

机构 * 1 Digital Health, IBM T.J. Watson Research Center, Yorktown Heights, NY USA 2 AI Cloud Platform, IBM T.J. Watson Research Center, Yorktown Heights, NY USA 3 Nova School of Business Economics, Carcavelos, Portugal 4 Gastroenterology, Morehouse School of Medicine, Atlanta, GA USA 5 Inflammation

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments IEEE International Conference on Digital Health (ICDH) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14641 2025-07-28 cs.SE cs.SY eess.SY 75%

HLSTester: Efficient Testing of Behavioral Discrepancies with LLMs for High-Level Synthesis

Kangwei Xu, Bing Li, Grace Li Zhang, Ulf Schlichtmann

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

Comments arXiv admin note: text overlap with arXiv:2407.03889

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10519 2025-07-28 cs.AI cs.CL cs.LG cs.MA 75%

Toward Super Agent System with Hybrid AI Routers

Yuhang Yao, Haixin Wang, Yibo Chen, Jiawen Wang, Min Chang Jordan Ren, Bosheng Ding, Salman Avestimehr, Chaoyang He

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19017 2025-07-28 cs.LG cs.AI 73%

MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster

Laingjun Feng, Chenyi Pan, Xinjie Guo, Fei Mei, Benzhe Ning, Jianxiang Zhang, Xinyang Liu, Beirong Zhou, Zeng Shu, Chang Liu, Guang Yang, Zhenyu Han, Jiangben Wang, Bo Wang

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18910 2025-07-28 cs.CL cs.LG 73%

A Systematic Review of Key Retrieval-Augmented Generation (RAG) Systems: Progress, Gaps, and Future Directions

Agada Joseph Oche, Ademola Glory Folashade, Tirthankar Ghosal, Arpan Biswas

机构 * Bredesen Center for Interdisciplinary Research, University of Tennessee, Knoxville, USA(跨学科研究中心,田纳西大学,肯塔基州 Knoxville) National Center for Computational Sciences, Oak Ridge National Laboratory, Oak Ridge, USA(计算科学国家中心,橡树岭国家实验室,橡树岭) University of Tennessee-Oak Ridge Innovation Institute, University of Tennessee, Knoxville, USA(田纳西大学橡树岭创新研究所,田纳西大学,肯塔基州 Knoxville)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 33 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18377 2025-07-28 cs.LG cs.AI 73%

Maximum Redundancy Pruning: A Principle-Driven Layerwise Sparsity Allocation for LLMs

Chang Gao, Kang Zhao, Runqi Wang, Jianfei Chen, Liping Jing

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19227 2025-07-28 cs.CL 70%

Jailbreaking Large Language Diffusion Models: Revealing Hidden Safety Flaws in Diffusion-Based Text Generation

Yuanhe Zhang, Fangzhou Xie, Zhenhong Zhou, Zherui Li, Hao Chen, Kun Wang, Yufei Guo

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14554 2025-07-28 cs.SE 67%

Emerging Trends in Software Architecture from the Practitioners Perspective: A Five Year Review

Ruoyu Su, Noman Ahmad, Matteo Esposito, Andrea Janes, Davide Taibi, Valentina Lenarduzzi

专题命中 效率与部署 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19372 2025-07-28 cs.AI cs.LG 62%

Learning neuro-symbolic convergent term rewriting systems

Flavio Petruzzellis, Alberto Testolin, Alessandro Sperduti

机构 * Department One(部门一) Department Two(部门二) Department of Mathematics, University of Padova(帕多瓦大学数学系) Department of General Psychology, University of Padova(帕多瓦大学普通心理学系) Augmented Intelligence Center, Fondazione Bruno Kessler(布鲁诺·凯塞勒基金会增强智能中心)

专题命中 效率与部署 :language model(abstract);分类 cs.AI、cs.LG

Comments 48 pages, 31 figures. Submitted for review by Artificial Intelligence Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18742 2025-07-28 cs.CL cs.AI 62%

Specification Self-Correction: Mitigating In-Context Reward Hacking Through Test-Time Refinement

Víctor Gallego

机构 * Komorebi AI Technologies(Komorebi人工智能技术)

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to SCALR Workshop @ COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19131 2025-07-28 cs.CV 50%

MixA-Q: Revisiting Activation Sparsity for Vision Transformers from a Mixed-Precision Quantization Perspective

Weitian Wang, Rai Shubham, Cecilia De La Parra, Akash Kumar

机构 * Robert Bosch GmbH(博世公司) Ruhr University Bochum(博尔塔尔大学波恩)

专题命中 效率与部署 :post-training(abstract)

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15300 2025-07-28 cs.AR 50%

GCC: A 3DGS Inference Architecture with Gaussian-Wise and Cross-Stage Conditional Processing

Minnan Pei, Gang Li, Junwen Si, Zeyu Zhu, Zitao Mo, Peisong Wang, Zhuoran Song, Xiaoyao Liang, Jian Cheng

专题命中 效率与部署 :prompting(abstract)

Comments Accepted to MICRO 2025

详情

展开后加载摘要…

URL PDF HTML 收藏