arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-10 至 2025-09-10 共收录 28 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 28 篇

2509.07594 2025-09-10 cs.IR 89%

ELEC: Efficient Large Language Model-Empowered Click-Through Rate Prediction

Rui Dong, Wentao Ouyang, Xiangzheng Liu

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments SIGIR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04416 2025-09-10 cs.CL cs.AI cs.CR cs.LG 89%

OBLIVIATE: Robust and Practical Machine Unlearning for Large Language Models

Xiaoyu Xu, Minxin Du, Qingqing Ye, Haibo Hu

机构 * The Hong Kong Polytechnic University(香港理工大学) The State Key Laboratory of Blockchain and Data Security, Zhejiang University(浙江大学区块链与数据安全国家重点实验室)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments To appear at EMNLP 25 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07492 2025-09-10 cs.NI 86%

Constraint-Compliant Network Optimization through Large Language Models

Youngjin Song, Wookjin Lee, Hong Ki Kim, Sang Hyun Lee

专题命中 效率与部署 :large language model(title);language model(title);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07445 2025-09-10 cs.RO cs.AI 85%

Text2Touch: Tactile In-Hand Manipulation with LLM-Designed Reward Functions

Harrison Field, Max Yang, Yijiong Lin, Efi Psomopoulou, David Barton, Nathan F. Lepora

机构 * School of Computer Science, University of Bristol, 2 Bristol Robotics Laboratory 3 School of Engineering Mathematics and Technology, University of Bristol(1 计算机科学学院,布里斯托尔大学 2 布里斯托尔机器人实验室 3 工程数学与技术学院,布里斯托尔大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted at CoRL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07287 2025-09-10 cs.CR cs.AI 85%

Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm

Yan Pang, Wenlong Meng, Xiaojing Liao, Tianhao Wang

机构 * University of Virginia(弗吉尼亚大学) Indiana University Bloomington(印第安纳大学布卢明顿分校)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04518 2025-09-10 cs.CL 85%

Advancing SLM Tool-Use Capability using Reinforcement Learning

Dhruvi Paprunia, Vansh Kharidia, Pankti Doshi

机构 * Dept. of Computer Engineering MPSTME, NMIMS(计算机工程系 MPSTME、NMIMS)

专题命中 效率与部署 :SLM(title);large language model(abstract);language model(abstract);small language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21141 2025-09-10 cs.LG 85%

Adaptive LLM Routing under Budget Constraints

Pranoy Panda, Raghav Magazine, Chaitanya Devaguptapu, Sho Takemori, Vishal Sharma

机构 * Fujitsu Research(富士通研究所) Microsoft Research(微软研究院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments Accepted at EMNLP 2025 (findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07642 2025-09-10 cs.CL 85%

TreeReview: A Dynamic Tree of Questions Framework for Deep and Efficient LLM-based Scientific Peer Review

Yuan Chang, Ziyue Li, Hengyuan Zhang, Yuanbo Kong, Yanru Wu, Hayden Kwok-Hay So, Zhijiang Guo, Liya Zhu, Ngai Wong

机构 * National Science Library, Chinese Academy of Sciences(中国科学院国家科学图书馆) Department of Information Resources Management, School of Economics and Management, University of Chinese Academy of Sciences(中国科学院大学经济与管理学院信息资源管理系) The University of Hong Kong(香港大学) Tsinghua University(清华大学) Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to EMNLP2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07034 2025-09-10 physics.chem-ph 83%

A large language model system for the field of chemical engineering technology

Heng Zhang, Jibin Zhou, Feiyang Xu, Jian Cui, Yi Li, Fan Yang, Hao Wang, Xin Li, Mao Ye

专题命中 效率与部署 :large language model(title);language model(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18934 2025-09-10 cs.CL 83%

Dovetail: A CPU/GPU Heterogeneous Speculative Decoding for LLM inference

Libo Zhang, Zhaoning Zhang, Baizhou Xu, Rui Li, Zhiliang Tian, Songzhu Mei, Dongsheng Li

机构 * National Key Laboratory of Parallel and Distributed Computing(并行与分布式计算国家重点实验室) College of Computer Science and Technology(计算机科学与技术学院) National University of Defense Technology(国防科技大学)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07436 2025-09-10 eess.SP 82%

SA-OOSC: A Multimodal LLM-Distilled Semantic Communication Framework for Enhanced Coding Efficiency with Scenario Understanding

Feifan Zhang, Yuyang Du, Yifan Xiang, Xiaoyan Liu, Soung Chang Liew

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16833 2025-09-10 cs.SD cs.AI cs.CL cs.CY eess.AS 81%

The Model Hears You: Audio Language Model Deployments Should Consider the Principle of Least Privilege

Luxi He, Xiangyu Qi, Michel Liao, Inyoung Cheong, Prateek Mittal, Danqi Chen, Peter Henderson

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI

Comments Published at AIES 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07846 2025-09-10 cs.AI 77%

Aligning LLMs for the Classroom with Knowledge-Based Retrieval -- A Comparative RAG Study

Amay Jain, Liu Cui, Si Chen

机构 * Student(学生) Downingtown STEM Academy Department of Computer Science(计算机科学系) West Chester University of Pennsylvania(宾夕法尼亚州韦斯特切斯特大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07022 2025-09-10 cs.CY cs.AI 77%

Preventing Another Tessa: Modular Safety Middleware For Health-Adjacent AI Assistants

Pavan Reddy, Nithin Reddy

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 7 pages content, 1 page reference, 1 figure, Accepted at AAAI Fall Symposium Series

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00949 2025-09-10 cs.CL cs.AI cs.LG 75%

Llama-Nemotron: Efficient Reasoning Models

Akhiad Bercovich, Itay Levy, Izik Golan, Mohammad Dabbah, Ran El-Yaniv, Omri Puny, Ido Galil, Zach Moshe, Tomer Ronen, Najeeb Nabwani, Ido Shahaf, Oren Tropp, Ehud Karpas, Ran Zilberstein, Jiaqi Zeng, Soumye Singhal, Alexander Bukharin, Yian Zhang, Tugrul Konuk, Gerald Shen, Ameya Sunil Mahabaleshwarkar, Bilal Kartal, Yoshi Suhara, Olivier Delalleau, Zijia Chen, Zhilin Wang, David Mosallanezhad, Adi Renduchintala, Haifeng Qian, Dima Rekesh, Fei Jia, Somshubra Majumdar, Vahid Noroozi, Wasi Uddin Ahmad, Sean Narenthiran, Aleksander Ficek, Mehrzad Samadi, Jocelyn Huang, Siddhartha Jain, Igor Gitman, Ivan Moshkov, Wei Du, Shubham Toshniwal, George Armstrong, Branislav Kisacanin, Matvei Novikov, Daria Gitman, Evelina Bakhturina, Prasoon Varshney, Makesh Narsimhan, Jane Polak Scowcroft, John Kamalu, Dan Su, Kezhi Kong, Markus Kliegl, Rabeeh Karimi Mahabadi, Ying Lin, Sanjeev Satheesh, Jupinder Parmar, Pritam Gundecha, Brandon Norick, Joseph Jennings, Shrimai Prabhumoye, Syeda Nahida Akter, Mostofa Patwary, Abhinav Khattar, Deepak Narayanan, Roger Waleffe, Jimmy Zhang, Bor-Yiing Su, Guyue Huang, Terry Kong, Parth Chadha, Sahil Jain, Christine Harvey, Elad Segal, Jining Huang, Sergey Kashirsky, Robert McQueen, Izzy Putterman, George Lam, Arun Venkatesan, Sherry Wu, Vinh Nguyen, Manoj Kilaru, Andrew Wang, Anna Warno, Abhilash Somasamudramath, Sandip Bhaskar, Maka Dong, Nave Assaf, Shahar Mor, Omer Ullman Argov, Scot Junkin, Oleksandr Romanenko, Pedro Larroy, Monika Katariya, Marco Rovinelli, Viji Balas, Nicholas Edelman, Anahita Bhiwandiwalla, Muthu Subramaniam, Smita Ithape, Karthik Ramamoorthy, Yuting Wu, Suguna Varshini Velury, Omri Almog, Joyjit Daw, Denys Fridman, Erick Galinkin, Michael Evans, Shaona Ghosh, Katherine Luna, Leon Derczynski, Nikki Pope, Eileen Long, Seth Schneider, Guillermo Siman, Tomasz Grzegorzek, Pablo Ribalta, Monika Katariya, Chris Alexiuk, Joey Conway, Trisha Saar, Ann Guan, Krzysztof Pawelec, Shyamala Prayaga, Oleksii Kuchaiev, Boris Ginsburg, Oluwatobi Olabiyi, Kari Briski, Jonathan Cohen, Bryan Catanzaro, Jonah Alben, Yonatan Geifman, Eric Chung

机构 * NVIDIA

专题命中 效率与部署 :pretraining(abstract);post-training(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06982 2025-09-10 cs.LG cs.AI cs.CL 75%

CARE: Decoding Time Safety Alignment via Rollback and Introspection Intervention

Xiaomeng Hu, Fei Huang, Chenhan Yuan, Junyang Lin, Tsung-Yi Ho

机构 * Alibaba Group(阿里巴巴集团) The Chinese University of Hong Kong(香港中文大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07025 2025-09-10 cs.LG cs.AI 73%

1 bit is all we need: binary normalized neural networks

Eduardo Lobo Lustoda Cabral, Paulo Pirozelli, Larissa Driemeier

机构 * Mauá Institute of Technology(马瑙理工学院) Nuclear and Energy Research Institute(核能与能源研究所) Polytechnic School – University of São Paulo(圣保罗理工学院 – 圣保罗大学)

专题命中 效率与部署 :language model(abstract);prompting(abstract);分类 cs.AI、cs.LG

Comments 14 pages; 2 figures; 5 tables; 8 algorithms

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07889 2025-09-10 cs.CL 70%

From Detection to Mitigation: Addressing Gender Bias in Chinese Texts via Efficient Tuning and Voting-Based Rebalancing

Chengyan Wu, Yiqiang Cai, Yufei Cheng, Yun Xue

机构 * Guangdong Provincial Key Laboratory of Quantum Engineering and Quantum Materials(广东省量子工程与量子材料重点实验室) School of Electronic Science and Engineering (School of Microelectronics)(电子科学与工程学院(微电子学院)) South China Normal University(华南师范大学) Guangdong Provincial Key Laboratory of Intelligent Information Processing(广东省智能信息处理重点实验室) School of Business(商学院) Yangzhou University(扬州大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

Comments NLPCC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07858 2025-09-10 cs.AI 70%

SCoder: Iterative Self-Distillation for Bootstrapping Small-Scale Data Synthesizers to Empower Code LLMs

Xinyu Zhang, Changzhi Zhou, Linmei Hu, Luhao Zhang, Xiancai Chen, Haomin Fu, Yang Yang, Mengdi Zhang

机构 * School of Computer Science, Beijing Institute of Technology(北京理工大学计算机科学学院) School of Computer Science, Peking University(北京大学计算机科学学院) Meituan(美团)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07666 2025-09-10 cs.CL cs.IR 70%

MoLoRAG: Bootstrapping Document Understanding via Multi-modal Logic-aware Retrieval

Xixi Wu, Yanchao Tan, Nan Hou, Ruiyang Zhang, Hong Cheng

机构 * The Chinese University of Hong Kong(香港中文大学) Fuzhou University(福州大学) University of Macau(澳门大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

Comments EMNLP Main 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13209 2025-09-10 cs.IR cs.AI cs.SI 70%

Research on Conversational Recommender System Considering Consumer Types

Yaying Luo, Hui Fang, Zhu Sun

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

Comments The tables Recommendation strategies for different consumer types need to be modified. Correspondence of Recommendation strategies are incorrect

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10559 2025-09-10 cs.CV cs.AI cs.ET 70%

From Images to Insights: Explainable Biodiversity Monitoring with Plain Language Habitat Explanations

Yutong Zhou, Masahiro Ryo

机构 * Leibniz Centre for Agricultural Landscape Research (ZALF)(莱比锡农业景观研究中心(ZALF)) Brandenburg University of Technology Cottbus–Senftenberg(勃兰登堡技术大学科特博斯-森芬根堡)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

Comments AISE workshop camera-ready version @ ECAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07003 2025-09-10 cs.PL cs.DC cs.LG 70%

veScale: Consistent and Efficient Tensor Programming with Eager-Mode SPMD

Youjie Li, Cheng Wan, Zhiqi Lin, Hongyu Zhu, Jiacheng Yang, Ziang Song, Xinyi Di, Jiawei Wu, Huiyao Shu, Wenlei Bao, Yanghua Peng, Haibin Lin, Li-Wen Chang

机构 * ByteDance Seed(字节跳动种子)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

Comments 21 pages, 16 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18407 2025-09-10 cs.GR cs.CV 67%

IntuiTF: MLLM-Guided Transfer Function Optimization for Direct Volume Rendering

Yiyao Wang, Bo Pan, Ke Wang, Han Liu, Jinyuan Mao, Yuxin Liu, Minfeng Zhu, Xiuqi Huang, Weifeng Chen, Bo Zhang, Wei Chen

机构 * State Key Lab of CAD&CG, Zhejiang University(浙江大学CAD与CG国家重点实验室) Laboratory of Art and Archaeology Image (Zhejiang University), Ministry of Education, China(浙江大学艺术与考古图像实验室(教育部,中国)) Zhejiang University of Finance&Economics(浙江财经大学) Zhejiang University(浙江大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07324 2025-09-10 cs.CL cs.AI 62%

Mitigating Attention Localization in Small Scale: Self-Attention Refinement via One-step Belief Propagation

Nakyung Lee, Yeongoon Kim, Minhae Oh, Suhwan Kim, Jin Woo Koo, Hyewon Jo, Jungwoo Lee

机构 * Seoul National University(首尔国立大学)

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07727 2025-09-10 cs.LG cs.DC 57%

MoE-Compression: How the Compression Error of Experts Affects the Inference Accuracy of MoE Model?

Songkai Ma, Zhaorui Zhang, Sheng Di, Benben Liu, Xiaodong Yu, Xiaoyi Lu, Dan Wang

机构 * Department of Computing(计算系) Hong Kong Polytechnic University(香港理工大学) Mathematics and Computer Science Division(数学与计算机科学 division) Argonne National Laboratory(阿贡国家实验室) The University of Hong Kong(香港大学) Stevens Institute of Technology(史蒂文斯理工学院) Department of Computer Science and Engineering(计算机科学与工程系) University of California, Merced(加州大学默塞德分校)

专题命中 效率与部署 :LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07391 2025-09-10 cs.CV cs.LG 57%

A Data-Free Analytical Quantization Scheme for Deep Learning Models

Ahmed Luqman, Khuzemah Qazi, Murray Patterson, Malik Jahan Khan, Imdadullah Khan

机构 * Georgia State University(佐治亚州立大学)

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

Comments Accepted for publication in IEEE International Conference on Data Mining (ICDM 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00969 2025-09-10 cs.CV 50%

Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors

Xiangchen Wang, Jinrui Zhang, Teng Wang, Haigang Zhang, Feng Zheng

机构 * Southern University of Science and Technology(南方科技大学) The University of Hong Kong(香港大学) Shenzhen Polytechnic University(深圳职业技术大学)

专题命中 效率与部署 :language model(abstract)

Comments 17 pages, 8 figures, EMNLP2025

详情

展开后加载摘要…

URL PDF HTML 收藏