arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-22 至 2025-09-22 共收录 35 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 35 篇

2509.07485 2025-09-22 cs.IR 89%

Multi-view-guided Passage Reranking with Large Language Models

Jeongwoo Na, Jun Kwon, Eunseong Choi, Jongwuk Lee

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13452 2025-09-22 cs.PL 89%

Large Language Model Powered Symbolic Execution

Yihe Li, Ruijie Meng, Gregory J. Duck

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 29 pages, 6 figures, 7 tables, published in "Object-Oriented Programming, Systems, Languages & Applications" (OOPSLA), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15361 2025-09-22 cs.CL cs.AI cs.MM 88%

Beyond Spurious Signals: Debiasing Multimodal Large Language Models via Counterfactual Inference and Adaptive Expert Routing

Zichen Wu, Hsiu-Yuan Huang, Yunfang Wu

机构 * School of Computer Science, Peking University(北京大学计算机科学学院) MOE Key Laboratory of Computational Linguistics, Peking University(北京大学教育部计算语言学重点实验室) National Key Laboratory for Multimedia Information Processing, Peking University(北京大学国家多媒体信息处理重点实验室)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07820 2025-09-22 cs.CL cs.IR 88%

Query Optimization for Parametric Knowledge Refinement in Retrieval-Augmented Large Language Models

Youan Cong, Pritom Saha Akash, Cheng Wang, Kevin Chen-Chuan Chang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15518 2025-09-22 cs.CL cs.AI cs.LG 87%

How do Language Models Generate Slang: A Systematic Comparison between Human and Machine-Generated Slang Usages

Siyang Wu, Zhewei Sun

机构 * Data Science Institute University of Chicago(芝加哥大学数据科学研究所) Toyota Technological Institute at Chicago(芝加哥丰田技术研究所)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07824 2025-09-22 cs.CL cs.AI cs.LG 87%

Efficient Real-time Refinement of Language Model Text Generation

Joonho Ko, Jinheon Baek, Sung Ju Hwang

机构 * KAIST(韩国科学技术院)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15915 2025-09-22 cs.LG cs.AI 86%

Foundation Models as World Models: A Foundational Study in Text-Based GridWorlds

Remo Sasso, Michelangelo Conserva, Dominik Jeurissen, Paulo Rauber

机构 * School of Electronic Engineering and Computer Science(电子工程与计算机科学学院)

专题命中 效率与部署 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 20 pages, 9 figures. Accepted for presentation at the 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop on Embodied World Models for Decision Making

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09627 2025-09-22 cs.CL 86%

Benchmarking Debiasing Methods for LLM-based Parameter Estimates

Nicolas Audinet de Pieuchon, Adel Daoud, Connor T. Jerzak, Moa Johansson, Richard Johansson

机构 * Chalmers University of Technology(查尔姆斯理工大学) Linköping University(林肯大学) University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Gothenburg(哥德堡大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments To appear as: Nicolas Audinet de Pieuchon, Adel Daoud, Connor T. Jerzak, Moa Johansson, Richard Johansson. Benchmarking Debiasing Methods for LLM-based Parameter Estimates. In: Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing (EMNLP), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01322 2025-09-22 cs.CL cs.AI cs.DC cs.LG 80%

LongCat-Flash Technical Report

Meituan LongCat Team, Bayan, Bei Li, Bingye Lei, Bo Wang, Bolin Rong, Chao Wang, Chao Zhang, Chen Gao, Chen Zhang, Cheng Sun, Chengcheng Han, Chenguang Xi, Chi Zhang, Chong Peng, Chuan Qin, Chuyu Zhang, Cong Chen, Congkui Wang, Dan Ma, Daoru Pan, Defei Bu, Dengchang Zhao, Deyang Kong, Dishan Liu, Feiye Huo, Fengcun Li, Fubao Zhang, Gan Dong, Gang Liu, Gang Xu, Ge Li, Guoqiang Tan, Guoyuan Lin, Haihang Jing, Haomin Fu, Haonan Yan, Haoxing Wen, Haozhe Zhao, Hong Liu, Hongmei Shi, Hongyan Hao, Hongyin Tang, Huantian Lv, Hui Su, Jiacheng Li, Jiahao Liu, Jiahuan Li, Jiajun Yang, Jiaming Wang, Jian Yang, Jianchao Tan, Jiaqi Sun, Jiaqi Zhang, Jiawei Fu, Jiawei Yang, Jiaxi Hu, Jiayu Qin, Jingang Wang, Jiyuan He, Jun Kuang, Junhui Mei, Kai Liang, Ke He, Kefeng Zhang, Keheng Wang, Keqing He, Liang Gao, Liang Shi, Lianhui Ma, Lin Qiu, Lingbin Kong, Lingtong Si, Linkun Lyu, Linsen Guo, Liqi Yang, Lizhi Yan, Mai Xia, Man Gao, Manyuan Zhang, Meng Zhou, Mengxia Shen, Mingxiang Tuo, Mingyang Zhu, Peiguang Li, Peng Pei, Peng Zhao, Pengcheng Jia, Pingwei Sun, Qi Gu, Qianyun Li, Qingyuan Li, Qiong Huang, Qiyuan Duan, Ran Meng, Rongxiang Weng, Ruichen Shao, Rumei Li, Shizhe Wu, Shuai Liang, Shuo Wang, Suogui Dang, Tao Fang, Tao Li, Tefeng Chen, Tianhao Bai, Tianhao Zhou, Tingwen Xie, Wei He, Wei Huang, Wei Liu, Wei Shi, Wei Wang, Wei Wu, Weikang Zhao, Wen Zan, Wenjie Shi, Xi Nan, Xi Su, Xiang Li, Xiang Mei, Xiangyang Ji, Xiangyu Xi, Xiangzhou Huang, Xianpeng Li, Xiao Fu, Xiao Liu, Xiao Wei, Xiaodong Cai, Xiaolong Chen, Xiaoqing Liu, Xiaotong Li, Xiaowei Shi, Xiaoyu Li, Xili Wang, Xin Chen, Xing Hu, Xingyu Miao, Xinyan He, Xuemiao Zhang, Xueyuan Hao, Xuezhi Cao, Xunliang Cai, Xurui Yang, Yan Feng, Yang Bai, Yang Chen, Yang Yang, Yaqi Huo, Yerui Sun, Yifan Lu, Yifan Zhang, Yipeng Zang, Yitao Zhai, Yiyang Li, Yongjing Yin, Yongkang Lv, Yongwei Zhou, Yu Yang, Yuchen Xie, Yueqing Sun, Yuewen Zheng, Yuhuai Wei, Yulei Qian, Yunfan Liang, Yunfang Tai, Yunke Zhao, Zeyang Yu, Zhao Zhang, Zhaohua Yang, Zhenchao Zhang, Zhikang Xia, Zhiye Zou, Zhizhao Zeng, Zhongda Su, Zhuofan Chen, Zijian Zhang, Ziwen Wang, Zixu Jiang, Zizhe Zhao, Zongyu Wang, Zunhai Su

机构 * Meituan LongCat Team(美团LongCat团队)

专题命中 效率与部署 :language model(abstract);foundation model(abstract);post-training(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15515 2025-09-22 cs.CL 79%

LLM Cache Bandit Revisited: Addressing Query Heterogeneity for Cost-Effective LLM Inference

Hantao Yang, Hong Xie, Defu Lian, Enhong Chen

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04462 2025-09-22 cs.LG 79%

CARD: A Cache-Assisted Parallel Speculative Decoding Framework via Query-and-Correct Paradigm for Accelerating LLM Inference

Enyu Zhou, Kai Sheng, Hao Chen, Xin He

专题命中 效率与部署 :LLM(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16017 2025-09-22 cs.CV 78%

DistillMatch: Leveraging Knowledge Distillation from Vision Foundation Model for Multimodal Image Matching

Meng Yang, Fan Fan, Zizhuo Li, Songchu Deng, Yong Ma, Jiayi Ma

专题命中 效率与部署 :foundation model(title,abstract)

Comments 10 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06275 2025-09-22 eess.SP 78%

Efficient Deep Neural Receiver with Post-Training Quantization

SaiKrishna Saketh Yellapragada, Esa Ollila, Mario Costa

专题命中 效率与部署 :post-training(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19390 2025-09-22 eess.SP 78%

A Unified Foundation Model for Wireless Technology Recognition and Localization

Mohammad Cheraghinia, Eli De Poorter, Jaron Fontaine, Merouane Debbah, Adnan Shahid

专题命中 效率与部署 :foundation model(title,abstract)

Comments 18 pages, 10 Figures, 6 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10371 2025-09-22 cs.DC cs.LG 77%

Characterizing the Efficiency of Distributed Training: A Power, Performance, and Thermal Perspective

Seokjin Go, Joongun Park, Spandan More, Hanjiang Wu, Irene Wang, Aaron Jezghani, Tushar Krishna, Divya Mahajan

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05165 2025-09-22 cs.LG 77%

KVCompose: Efficient Structured KV Cache Compression with Composite Tokens

Dmitry Akulov, Mohamed Sana, Antonio De Domenico, Tareq Si Salem, Nicola Piovesan, Fadhel Ayed

机构 * Paris Research Center, Huawei Technologies(巴黎研究中心、华为技术)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15940 2025-09-22 cs.DC 75%

Efficient Pre-Training of LLMs via Topology-Aware Communication Alignment on More Than 9600 GPUs

Guoliang He, Youhe Jiang, Wencong Xiao, Kaihua Jiang, Shuguang Wang, Jun Wang, Zixian Du, Zhuo Jiang, Xinlei Zhang, Binhang Yuan, Eiko Yoneki

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15289 2025-09-22 cs.HC cs.AI 74%

Collective Voice: Recovered-Peer Support Mediated by An LLM-Based Chatbot for Eating Disorder Recovery

Ryuhaerang Choi, Taehan Kim, Subin Park, Seohyeon Yoo, Jennifer G. Kim, Sung-Ju Lee

机构 * Hanyang University(翰阳大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 效率与部署 :LLM(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16028 2025-09-22 cs.CL cs.AI 73%

Think, Verbalize, then Speak: Bridging Complex Thoughts and Comprehensible Speech

Sang Hoon Woo, Sehun Lee, Kang-wook Kim, Gunhee Kim

机构 * Seoul National University(首尔国立大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2025 Main. Project page: https://yhytoto12.github.io/TVS-ReVerT

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15568 2025-09-22 cs.CL cs.AI 73%

LiteLong: Resource-Efficient Long-Context Data Synthesis for LLMs

Junlong Jia, Xing Wu, Chaochen Gao, Ziyang Chen, Zijia Lin, Zhongzhi Li, Weinong Wang, Haotian Xu, Donghui Jin, Debing Zhang, Binghui Guo

机构 * School of Artificial Intelligence, Beihang University(北航人工智能学院) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) Tsinghua University(清华大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13759 2025-09-22 cs.LG cs.AI 73%

Discrete Diffusion in Large Language and Multimodal Models: A Survey

Runpeng Yu, Qi Li, Xinchao Wang

专题命中 效率与部署 :LLM(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15763 2025-09-22 cs.CL 70%

UniGist: Towards General and Hardware-aligned Sequence-level Long Context Compression

Chenlong Deng, Zhisong Zhang, Kelong Mao, Shuaiyi Li, Tianqing Fang, Hongming Zhang, Haitao Mi, Dong Yu, Zhicheng Dou

机构 * Renmin University of China(中国人民大学) Tencent AI Lab(腾讯AI实验室) City University of Hong Kong(香港城市大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 15 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09853 2025-09-22 cs.SE cs.AI 70%

SWE-Effi: Re-Evaluating Software AI Agent System Effectiveness Under Resource Constraints

Zhiyu Fan, Kirill Vasilevski, Dayi Lin, Boyuan Chen, Yihao Chen, Zhiqing Zhong, Jie M. Zhang, Pinjia He, Ahmed E. Hassan

机构 * Huawei(华为) Huawei Canada(华为加拿大) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) King’s College London(伦敦国王学院) Queen’s University(皇后大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08415 2025-09-22 cs.CL cs.LO 70%

FSLI: An Interpretable Formal Semantic System for One-Dimensional Ordering Inference

Maha Alkhairy, Vincent Homer, Brendan O'Connor

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校)

专题命中 效率与部署 :LLM(abstract);language model(abstract);分类 cs.CL

Comments 3 figures, 9 pages main paper and 8 pages references and appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15241 2025-09-22 cs.CV cs.CL 70%

M-PACE: Mother Child Framework for Multimodal Compliance

Shreyash Verma, Amit Kesari, Vinayak Trivedi, Anupam Purwar, Ratnesh Jamidar

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

Comments The M-PACE framework uses a "mother-child" AI model system to automate and unify compliance checks for ads, reducing costs while maintaining high accuracy

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15608 2025-09-22 cs.CV 67%

Enhancing WSI-Based Survival Analysis with Report-Auxiliary Self-Distillation

Zheng Wang, Hong Liu, Zheng Wang, Danyi Li, Min Cen, Baptiste Magnier, Li Liang, Liansheng Wang

机构 * School of Informatics, Xiamen University, Xiamen, China(厦门大学信息学院) Shanghai Innovation Institution, Shanghai, China(上海创新机构) Nanfang Hospital, Southern Medical University, Guangzhou, China(南方医科大学珠江医院) School of Artificial Intelligence and Data Science, University of Science and Technology of China, Hefei, China(中国科学技术大学人工智能与数据科学学院) EuroMov Digital Health in Motion, Univ Montpellier, IMT Mines Ales, Ales, France(EuroMov数字健康运动) Service de Médecine Nucléaire, Centre Hospitalier Universitaire de Nîmes, Université de Montpellier, Nîmes, France(蒙彼利埃大学尼姆大学医院核医学服务)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04881 2025-09-22 cs.LG cs.AI cs.CL 67%

ConCISE: Confidence-guided Compression in Step-by-step Efficient Reasoning

Ziqing Qiao, Yongheng Deng, Jiali Zeng, Dong Wang, Lai Wei, Guanbo Wang, Fandong Meng, Jie Zhou, Ju Ren, Yaoxue Zhang

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Pattern Recognition Center, WeChat AI, Tencent Inc.(腾讯人工智能研究院)

专题命中 效率与部署 :prompting(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14033 2025-09-22 cs.CV 67%

SAIL-VL2 Technical Report

Weijie Yin, Yongjie Ye, Fangxun Shu, Yue Liao, Zijian Kang, Hongyuan Dong, Haiyang Yu, Dingkang Yang, Jiacong Wang, Han Wang, Wenzhuo Liu, Xiao Liang, Shuicheng Yan, Chao Feng

机构 * Douyin SAIL Team(字节跳动 SAIL 团队) LV-NUS Lab(NUS 实验室)

专题命中 效率与部署 :foundation model(abstract);SFT(abstract)

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15230 2025-09-22 cs.LG cs.AI 62%

Pre-Forgettable Models: Prompt Learning as a Native Mechanism for Unlearning

Rutger Hendrix, Giovanni Patanè, Leonardo G. Russo, Simone Carnemolla, Giovanni Bellitto, Federica Proietto Salanitri, Concetto Spampinato, Matteo Pennisi

机构 * University of Catania(卡塔尼亚大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI、cs.LG

Comments Accepted at ACM multimedia 2025 BNI track

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15859 2025-09-22 cs.LG cs.CV 57%

Efficient Long-Tail Learning in Latent Space by sampling Synthetic Data

Nakul Sharma

机构 * Independent Researcher(独立研究者)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

Comments Accepted to Curated Data for Efficient Learning Workshop at ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏