arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-10 至 2025-10-10 共收录 247 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 66 篇

2510.08214 2025-10-10 cs.CL 57%

SenWave: A Fine-Grained Multi-Language Sentiment Analysis Dataset Sourced from COVID-19 Tweets

Qiang Yang, Xiuying Chen, Changsheng Ma, Rui Yin, Xin Gao, Xiangliang Zhang

机构 * King Abdullah University of Science and Technology(国王阿卜杜勒·阿齐兹科技大学) University Of Florida(佛罗里达大学) University of Notre Dame(诺特丹大学)

专题命中 评测与基准 :language model(abstract);分类 cs.CL

Comments 13 pages, 13 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01616 2025-10-10 cs.DC cs.LG cs.PF 57%

Phantora: Maximizing Code Reuse in Simulation-based Machine Learning System Performance Estimation

Jianxing Qin, Jingrong Chen, Xinhao Kong, Yongji Wu, Tianjun Yuan, Liang Luo, Zhaodong Wang, Ying Zhang, Tingjun Chen, Alvin R. Lebeck, Danyang Zhuo

机构 * Duke University(杜克大学) Meta University of California, Berkeley(加州大学伯克利分校)

专题命中 评测与基准 :LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07861 2025-10-10 cs.AI 57%

Understanding DeepResearch via Reports

Tianyu Fan, Xinyao Niu, Yuxiang Zheng, Fengji Zhang, Chengen Huang, Bei Chen, Junyang Lin, Chao Huang

专题命中 评测与基准 :LLM(abstract);分类 cs.AI

Comments 22 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06274 2025-10-10 cs.LG 57%

IPR: Intelligent Prompt Routing with User-Controlled Quality-Cost Trade-offs

Aosong Feng, Balasubramaniam Srinivasan, Yun Zhou, Zhichao Xu, Kang Zhou, Sheng Guan, Yueyan Chen, Xian Wu, Ninad Kulkarni, Yi Zhang, Zhengyuan Shen, Dmitriy Bespalov, Soumya Smruti Mishra, Yifei Teng, Darren Yow-Bang Wang, Haibo Ding, Lin Lee Cheong

机构 * AWS AI(AWS人工智能)

专题命中 评测与基准 :LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16592 2025-10-10 cs.CL cs.MM 57%

What Media Frames Reveal About Stance: A Dataset and Study about Memes in Climate Change Discourse

Shijia Zhou, Siyao Peng, Simon M. Luebke, Jörg Haßler, Mario Haim, Saif M. Mohammad, Barbara Plank

机构 * MaiNLP & MCML, LMU Munich, Germany(LMU慕尼黑媒体与传播系) Department of Media and Communication, LMU Munich, Germany(LMU慕尼黑媒体与传播系) National Research Council Canada, Ottawa, Canada(加拿大国家研究委员会)

专题命中 评测与基准 :LLM(abstract);分类 cs.CL

Comments 20 pages, 9 figures, EMNLP Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07665 2025-10-10 cs.CV 50%

Automatic Text Box Placement for Supporting Typographic Design

Jun Muraoka, Daichi Haraguchi, Naoto Inoue, Wataru Shimoda, Kota Yamaguchi, Seiichi Uchida

机构 * Kyushu University(九州大学) CyberAgent

专题命中 评测与基准 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 42 篇

2501.15081 2025-10-10 cs.NE cs.AI 89%

Can Large Language Models Be Trusted as Evolutionary Optimizers for Network-Structured Combinatorial Problems?

Jie Zhao, Tao Wen, Kang Hao Cheong

机构 * Division of Mathematical Sciences, School of Physical and Mathematical Sciences, Nanyang Technological University(数学科学系,物理与数学科学学院,南洋理工大学) School of Computer Science and Engineering, Nanyang Technological University(计算机科学与工程学院,南洋理工大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06223 2025-10-10 cs.CL cs.AI cs.LG 87%

Efficiency-Effectiveness Reranking FLOPs for LLM-based Rerankers

Zhiyuan Peng, Ting-ruen Wei, Tingyu Song, Yilun Zhao

机构 * Santa Clara University(圣克拉拉大学) Yale University(耶鲁大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by EMNLP Industry Track 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17753 2025-10-10 cs.CL cs.AI 86%

Building Resource-Constrained Language Agents: A Korean Case Study on Chemical Toxicity Information

Hojun Cho, Donghu Kim, Soyoung Yang, Chan Lee, Hunjoo Lee, Jaegul Choo

专题命中 效率与部署 :language agent(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2025 Industry track

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08544 2025-10-10 cs.AR cs.DC cs.LG 85%

SPAD: Specialized Prefill and Decode Hardware for Disaggregated LLM Inference

Hengrui Zhang, Pratyush Patel, August Ning, David Wentzlaff

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04596 2025-10-10 cs.SE cs.AI 85%

LLM Applications: Current Paradigms and the Next Frontier

Xinyi Hou, Yanjie Zhao, Haoyu Wang

机构 * Huazhong University of Science and Technology(华中科技大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08034 2025-10-10 cs.AI 84%

AILoRA: Function-Aware Asymmetric Initialization for Low-Rank Adaptation of Large Language Models

Xiaoshuang Ji, Zhendong Zhao, Xiaoyan Gu, Xiaojun Chen, Xin Zhao, Zeyao Liu

专题命中 效率与部署 :large language model(title);language model(title);分类 cs.AI

Comments Submitted to AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07614 2025-10-10 cs.AI cs.SE 83%

Traceability and Accountability in Role-Specialized Multi-Agent LLM Pipelines

Amine Barrak

机构 * Department of Computer Science and Engineering(计算机科学与工程系) Oakland University(奥克兰大学)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

Journal ref 2025 40th ACM/IEEE International Conference on Automated Software Engineering Workshops

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19740 2025-10-10 cs.CL 83%

Spotlight Attention: Towards Efficient LLM Generation via Non-linear Hashing-based KV Cache Retrieval

Wenhao Li, Yuxin Zhang, Gen Luo, Haiyuan Wan, Ziyang Gong, Fei Chao, Rongrong Ji

机构 * Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(中国教育部多媒体可信感知与高效计算重点实验室,厦门大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07467 2025-10-10 cs.SE 82%

LLM meets ML: Data-efficient Anomaly Detection on Unstable Logs

Fatemeh Hadadi, Qinghua Xu, Domenico Bianculli, Lionel Briand

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract)

Comments Accepted by ACM Transactions on Software Engineering and Methodology (TOSEM) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17531 2025-10-10 cs.AI cs.HC 81%

Towards Machine-Generated Code for the Resolution of User Intentions

Justus Flerlage, Ilja Behnke, Odej Kao

机构 * Technische Universität Berlin(柏林技术大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Journal ref Frontiers in Artificial Intelligence and Applications, Vol. 408: HHAI 2025, pp. 169-178

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10190 2025-10-10 cs.LG cs.AI 81%

Language Model Embeddings Can Be Sufficient for Bayesian Optimization

Tung Nguyen, Qiuyi Zhang, Bangding Yang, Chansoo Lee, Jorg Bornschein, Yingjie Miao, Sagi Perel, Yutian Chen, Xingyou Song

机构 * UCLA(加州大学洛杉矶分校) Google(谷歌) DeepMind(深度Mind)

专题命中 效率与部署 :language model(title);LLM(abstract);分类 cs.AI、cs.LG

Comments Code can be found in https://github.com/google-research/optformer/tree/main/optformer/embed_then_regress

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18952 2025-10-10 cs.LG cs.AI cs.CL 80%

LLMs on a Budget? Say HOLA

Zohaib Hasan Siddiqui, Jiechao Gao, Ebad Shabbir, Mohammad Anas Azeez, Rafiq Ali, Gautam Siddharth Kashyap, Usman Naseem

机构 * Jamia Hamdard(贾迈亚哈马达尔大学) Center for SDGC, Stanford University(SDGC研究中心,斯坦福大学) DSEU-Okhla Macquarie University(麦考瑞大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at EMNLP 2025 (Industry Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16067 2025-10-10 physics.comp-ph cs.LG 79%

Training a Foundation Model for Materials on a Budget

Teddy Koker, Mit Kotak, Tess Smidt

机构 * Department of Electrical Engineering and Computer Science(电气工程与计算机科学系)

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.LG

Comments To appear at the NeurIPS 2025 Workshop on AI for Accelerated Materials Discovery

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21467 2025-10-10 cs.CL 79%

FlashDLM: Accelerating Diffusion Language Model Inference via Efficient KV Caching and Guided Diffusion

Zhanqiu Hu, Jian Meng, Yash Akhauri, Mohamed S. Abdelfattah, Jae-sun Seo, Zhiru Zhang, Udit Gupta

机构 * Cornell University(康奈尔大学)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04768 2025-10-10 cs.CL cs.CY cs.HC 79%

DiMA: An LLM-Powered Ride-Hailing Assistant at DiDi

Yansong Ning, Shuowei Cai, Wei Li, Jun Fang, Naiqiang Tan, Hua Chai, Hao Liu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Didichuxing Co. Ltd(滴滴出行有限公司)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.CL

Comments KDD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07684 2025-10-10 astro-ph.GA 78%

Multi-modal Foundation Model for Cosmological Simulation Data

Bin Xia, Nesar Ramachandra, Azton I. Wells, Salman Habib, John Wise

专题命中 效率与部署 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07567 2025-10-10 cs.CV 78%

Cross-Modal Attention Guided Unlearning in Vision-Language Models

Karuna Bhaila, Aneesh Komanduri, Minh-Hao Van, Xintao Wu

专题命中 效率与部署 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.10126 2025-10-10 cs.CV 78%

I&S-ViT: An Inclusive & Stable Method for Pushing the Limit of Post-Training ViTs Quantization

Yunshan Zhong, Jiawei Hu, Mingbao lin, Mengzhao Chen, Rongrong Ji

机构 * Institute of Artificial Intelligence, Xiamen University(厦门大学人工智能学院) MAC Lab, Department of Artificial Intelligence, School of Informatics, Xiamen University(厦门大学信息学院人工智能系) Rakuten Peng Cheng Laboratory(鹏城实验室)

专题命中 效率与部署 :post-training(title,abstract)

Comments This paper has been accepted by TPAMI2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08365 2025-10-10 cs.CL 77%

Two-Stage Voting for Robust and Efficient Suicide Risk Detection on Social Media

Yukai Song, Pengfei Zhou, César Escobar-Viera, Candice Biernesser, Wei Huang, Jingtong Hu

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系) Department of Informatics and Networked Systems(信息与网络系统系) University of Pittsburgh(匹兹堡大学) Department of Psychiatry(精神病学系) Tandon School of Engineering(塔能工程学院) New York University(纽约大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07475 2025-10-10 cs.CL 77%

MAPRO: Recasting Multi-Agent Prompt Optimization as Maximum a Posteriori Inference

Zheyuan Zhang, Lin Ge, Hongjiang Li, Weicheng Zhu, Chuxu Zhang, Yanfang Ye

机构 * University of Notre Dame(诺丁汉大学) University of Connecticut(康奈尔大学) Amazon(亚马逊)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07429 2025-10-10 cs.LG 77%

Learning to Route LLMs from Bandit Feedback: One Policy, Many Trade-offs

Wang Wei, Tiankai Yang, Hongjie Chen, Yue Zhao, Franck Dernoncourt, Ryan A. Rossi, Hoda Eldardiry

机构 * Virginia Tech(弗吉尼亚理工大学) University of Southern California(南加州大学) Dolby Labs(杜比实验室) Adobe Research(Adobe研究)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 16 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18344 2025-10-10 cs.CL 77%

Speculate Deep and Accurate: Lossless and Training-Free Acceleration for Offloaded LLMs via Substitute Speculative Decoding

Pei-Shuo Wang, Jian-Jia Chen, Chun-Che Yang, Chi-Chih Chang, Ning-Chi Huang, Mohamed S. Abdelfattah, Kai-Chiang Wu

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19102 2025-10-10 cs.IR cs.AI cs.CL cs.LG 75%

Distilling a Small Utility-Based Passage Selector to Enhance Retrieval-Augmented Generation

Hengran Zhang, Keping Bi, Jiafeng Guo, Jiaming Zhang, Shuaiqiang Wang, Dawei Yin, Xueqi Cheng

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(人工智能安全国家重点实验室,计算技术研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Baidu Inc(百度公司)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by SIGIR-AP25

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02886 2025-10-10 cs.CL cs.AI cs.LG 75%

TokenSelect: Efficient Long-Context Inference and Length Extrapolation for LLMs via Dynamic Token-Level KV Cache Selection

Wei Wu, Zhuoshi Pan, Chao Wang, Liyi Chen, Yunchu Bai, Tianfu Wang, Kun Fu, Zheng Wang, Hui Xiong

机构 * University of Science and Technology of China(中国科学技术大学) Tsinghua University(清华大学) Alibaba Cloud Computing(阿里云计算) Xiaohongshu Inc.(小红书公司) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by EMNLP2025

详情

展开后加载摘要…

URL PDF HTML 收藏