arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-07 至 2025-10-07 共收录 382 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 82 篇

2310.12150 2025-10-07 cs.CL 57%

Understanding Retrieval Augmentation for Long-Form Question Answering

Hung-Ting Chen, Fangyuan Xu, Shane Arora, Eunsol Choi

机构 * Department of Computer Science University of Texas at Austin(计算机科学系 德克萨斯大学奥斯汀分校)

专题命中 评测与基准 :language model(abstract);分类 cs.CL

Comments COLM 2024 Camera Ready Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04794 2025-10-07 cs.CV 50%

A Comparative Study of Vision Transformers and CNNs for Few-Shot Rigid Transformation and Fundamental Matrix Estimation

Alon Kaya, Igal Bilik, Inna Stainvas

机构 * Department of Computer Science, Ben-Gurion University of the Negev(本·古里安大学内盖夫分校计算机科学系) School of Electrical and Computer Engineering, Ben-Gurion University of the Negev(本·古里安大学内盖夫分校电气与计算机工程学院) GE Healthcare Science and Technology(通用电气医疗科技)

专题命中 评测与基准 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07596 2025-10-07 cs.CV 50%

Bias in Gender Bias Benchmarks: How Spurious Features Distort Evaluation

Yusuke Hirota, Ryo Hachiuma, Boyi Li, Ximing Lu, Michael Ross Boone, Boris Ivanovic, Yejin Choi, Marco Pavone, Yu-Chiang Frank Wang, Noa Garcia, Yuta Nakashima, Chao-Han Huck Yang

机构 * NVIDIA Osaka University(大阪大学) UC Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

专题命中 评测与基准 :foundation model(abstract)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04312 2025-10-07 cs.CV 50%

CARE-PD: A Multi-Site Anonymized Clinical Dataset for Parkinson's Disease Gait Assessment

Vida Adeli, Ivan Klabucar, Javad Rajabi, Benjamin Filtjens, Soroush Mehraban, Diwei Wang, Hyewon Seo, Trung-Hieu Hoang, Minh N. Do, Candice Muller, Claudia Oliveira, Daniel Boari Coelho, Pieter Ginis, Moran Gilat, Alice Nieuwboer, Joke Spildooren, Lucas Mckay, Hyeokhyen Kwon, Gari Clifford, Christine Esper, Stewart Factor, Imari Genias, Amirhossein Dadashzadeh, Leia Shum, Alan Whone, Majid Mirmehdi, Andrea Iaboni, Babak Taati

机构 * University of Toronto(多伦多大学) Vector Institute(向量研究所) KITE Research Institute-UHN(KITE研究 institute-UHN) University of Strasbourg(斯特拉斯堡大学) University Hospitals of Strasbourg(斯特拉斯堡大学医院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Federal University of ABC(巴西ABC联邦大学) KU Leuven(鲁文大学) Hasselt University(哈瑟尔特大学) Emory University(埃默里大学) University of Bristol(布里斯托尔大学)

专题命中 评测与基准 :pretraining(abstract)

Comments Accepted at the Thirty-Ninth Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03874 2025-10-07 cs.CV 50%

DHQA-4D: Perceptual Quality Assessment of Dynamic 4D Digital Human

Yunhao Li, Sijing Wu, Yucheng Zhu, Huiyu Duan, Zicheng Zhang, Guangtao Zhai

机构 * Institute of Image Communication and Network Engineering(图像通信与网络工程研究所) Shanghai Jiao Tong University(上海交通大学) USC-SJTU Institute of Cultural and Creative Industry(USC-SJTU文化产业与创意产业研究院)

专题命中 评测与基准 :instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03540 2025-10-07 cs.CV 50%

Domain Generalization for Semantic Segmentation: A Survey

Manuel Schwonberg, Hanno Gottschalk

机构 * TU Berlin(柏林技术大学) Mathematical Modeling of Industrial Life Cycles Group(工业生命周期数学建模组) CARIAD SE(CARIAD公司)

专题命中 评测与基准 :foundation model(abstract)

Comments Accepted to CVPR2025W

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21427 2025-10-07 cs.SE 50%

Extracting Conceptual Knowledge to Locate Software Issues

Ying Wang, Wenjun Mao, Chong Wang, Zhenhao Zhou, Yicheng Zhou, Wenyun Zhao, Yiling Lou, Xin Peng

专题命中 评测与基准 :LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18743 2025-10-07 cs.CV 50%

SAR-TEXT: A Large-Scale SAR Image-Text Dataset Built with SAR-Narrator and A Progressive Learning Strategy for Downstream Tasks

Yiguo He, Xinjun Cheng, Junjie Zhu, Chunping Qiu, Jun Wang, Xichuan Zhang, Qiangjuan Huang, Ke Yang

机构 * Intelligent Game and Decision Lab(智能游戏与决策实验室)

专题命中 评测与基准 :language model(abstract)

Comments IEEE Submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09255 2025-10-07 cs.CV 50%

FVQ: A Large-Scale Dataset and an LMM-based Method for Face Video Quality Assessment

Sijing Wu, Yunhao Li, Ziwen Xu, Yixuan Gao, Huiyu Duan, Wei Sun, Guangtao Zhai

机构 * Shanghai Jiao Tong University(上海交通大学) East China Normal University(华东师范大学)

专题命中 评测与基准 :instruction tuning(abstract)

Comments Accepted by ACM MM 2025. Project page: https://github.com/wsj-sjtu/FVQ

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15778 2025-10-07 cs.CV cs.RO 50%

AutoDrive-QA: A Multiple-Choice Benchmark for Vision-Language Evaluation in Urban Autonomous Driving

Boshra Khalili, Andrew W. Smyth

机构 * Columbia University(哥伦比亚大学)

专题命中 评测与基准 :language model(abstract)

Comments Updated results with larger dataset experiments and expanded discussion

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07048 2025-10-07 cs.CV 50%

Comprehensive Evaluation of Large Multimodal Models for Nutrition Analysis: A New Benchmark Enriched with Contextual Metadata

Bruce Coburn, Jiangpeng He, Megan E. Rollo, Satvinder S. Dhaliwal, Deborah A. Kerr, Fengqing Zhu

机构 * Purdue University(普渡大学) Indiana University(印第安纳大学) Curtin University(Curtin大学)

专题命中 评测与基准 :prompting(abstract)

Comments The extended full version of the accepted paper in 2025 IEEE BHI conference with title: Evaluating Large Multimodal Models for Nutrition Analysis: A New Benchmark Enriched with Contextual Metadata. Dataset is available at: https://skynet.ecn.purdue.edu/~coburn6/ACETADA/

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 63 篇

2510.03274 2025-10-07 cs.LG cs.AI 92%

Quant-dLLM: Post-Training Extreme Low-Bit Quantization for Diffusion Large Language Models

Tianao Zhang, Zhiteng Li, Xianglong Yan, Haotong Qin, Yong Guo, Yulun Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) ETH Zürich(苏黎世联邦理工学院) South China University of Technology(华南理工大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);post-training(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03847 2025-10-07 cs.AI cs.LG 91%

Small Language Models for Agentic Systems: A Survey of Architectures, Capabilities, and Deployment Trade offs

Raghav Sharma, Manan Mehta

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);LLM(abstract);SLM(abstract)

Comments 9 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08825 2025-10-07 cs.CL cs.AI cs.LG 91%

Large Language Model Hacking: Quantifying the Hidden Risks of Using LLMs for Text Annotation

Joachim Baumann, Paul Röttger, Aleksandra Urman, Albert Wendsjö, Flor Miriam Plaza-del-Arco, Johannes B. Gruber, Dirk Hovy

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25622 2025-10-07 cs.LG 90%

Layer-wise dynamic rank for compressing large language models

Zhendong Mi, Bian Sun, Grace Li Zhang, Shaoyi Huang

机构 * Stevens Institute of Technology(史蒂文斯理工学院) Carnegie Mellon University(卡内基梅隆大学) Technical University of Darmstadt(达姆施塔特技术大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03760 2025-10-07 cs.LG cs.AI 90%

EvoEngineer: Mastering Automated CUDA Kernel Code Evolution with Large Language Models

Ping Guo, Chenyu Zhu, Siyuan Chen, Fei Liu, Xi Lin, Zhichao Lu, Qingfu Zhang

机构 * Department of Computer Science(计算机科学系) City University of Hong Kong(香港城市大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

Comments Under Review of ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03662 2025-10-07 cs.LG cs.AI 88%

Operationalizing Data Minimization for Privacy-Preserving LLM Prompting

Jijie Zhou, Niloofar Mireshghallah, Tianshi Li

机构 * Northeastern University(东北大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 效率与部署 :LLM(title);prompting(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04147 2025-10-07 cs.CL 88%

Self Speculative Decoding for Diffusion Large Language Models

Yifeng Gao, Ziang Ji, Yuxuan Wang, Biqing Qi, Hanlin Xu, Linfeng Zhang

机构 * School of AI, Shanghai Jiao Tong University(上海交通大学人工智能学院) University of Science and Technology of China(中国科学技术大学) Xidian University(西安电子科技大学) Shanghai AI Laboratory(上海人工智能实验室) Huawei Technologies Ltd.(华为技术有限公司)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03515 2025-10-07 cs.LG 88%

RAPID: An Efficient Reinforcement Learning Algorithm for Small Language Models

Lianghuan Huang, Sagnik Anupam, Insup Lee, Shuo Li, Osbert Bastani

机构 * University of Pennsylvania(宾夕法尼亚大学)

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04605 2025-10-07 cs.SE 88%

Exploring the Power of Diffusion Large Language Models for Software Engineering: An Empirical Investigation

Jingyao Zhang, Tianlin Li, Xiaoyu Zhang, Qiang Hu, Bin Shi

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03541 2025-10-07 cs.CL 87%

What is a protest anyway? Codebook conceptualization is still a first-order concern in LLM-era classification

Andrew Halterman, Katherine A. Keith

机构 * Michigan State University(密歇根州立大学) Williams College(威廉姆斯学院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18350 2025-10-07 cs.LG cs.AI cs.CL 87%

How Many Parameters Does Your Task Really Need? Task Specific Pruning with LLM-Sieve

Waleed Reda, Abhinav Jangda, Krishna Chintalapudi

机构 * Microsoft(微软)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03283 2025-10-07 cs.LG cs.AI cs.CL cs.DC 87%

MACE: A Hybrid LLM Serving System with Colocated SLO-aware Continuous Retraining Alignment

Yufei Li, Yu Fu, Yue Dong, Cong Liu

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 14 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04980 2025-10-07 cs.AI cs.CL 86%

LLM-Hanabi: Evaluating Multi-Agent Gameplays with Theory-of-Mind and Rationale Inference in Imperfect Information Collaboration Game

Fangzhou Liang, Tianshi Zheng, Chunkit Chan, Yauwai Yim, Yangqiu Song

机构 * Department of Computer Science and Engineering, HKUST, Hong Kong SAR, China(计算机科学与工程系,香港科技大学,香港特别行政区,中国)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2025 Wordplay

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03275 2025-10-07 cs.LG cs.AI cs.CV 86%

SDQ-LLM: Sigma-Delta Quantization for 1-bit LLMs of any size

Junhao Xia, Ming Zhao, Limin Xiao, Xiujun Zhang

机构 * Dept of Electronic Engineering, Tsinghua University, Beijing, China(电子工程系,清华大学,北京,中国) Beijing National Research Center for Information Science and Technology, Beijing, China(北京信息科学与技术国家研究中心,北京,中国)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04724 2025-10-07 cs.MA cs.AI 85%

Who's the Mole? Modeling and Detecting Intention-Hiding Malicious Agents in LLM-Based Multi-Agent Systems

Yizhe Xie, Congcong Zhu, Xinyue Zhang, Tianqing Zhu, Dayong Ye, Minghao Wang, Chi Liu

机构 * Faculty of Data Science, City University of Macau(数据科学学院,澳门城市大学) Minzu University of China(民族大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09071 2025-10-07 cs.DC cs.AI 85%

Elastic On-Device LLM Service

Wangsong Yin, Rongjie Yi, Daliang Xu, Gang Huang, Mengwei Xu, Xuanzhe Liu

机构 * Peking University, Beijing, China(北京大学) Beijing University of Posts(北京邮电大学) Beiyou Shenzhen Institute, Shenzhen, China(贝友深圳研究所)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments MobiCom'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04076 2025-10-07 cs.RO cs.SY eess.SY 85%

From Shadow to Light: Toward Safe and Efficient Policy Learning Across MPC, DeePC, RL, and LLM Agents

Amin Vahidi-Moghaddam, Sayed Pedram Haeri Boroujeni, Iman Jebellat, Ehsan Jebellat, Niloufar Mehrabi, Zhaojian Li

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03561 2025-10-07 cs.CL cs.AI cs.LG 85%

Reactive Transformer (RxT) -- Stateful Real-Time Processing for Event-Driven Reactive Language Models

Adam Filipek

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 25 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05370 2025-10-07 cs.LG cs.AI cs.DC 84%

Taming Latency-Memory Trade-Off in MoE-Based LLM Serving via Fine-Grained Expert Offloading

Hanfei Yu, Xingqi Cui, Hong Zhang, Hao Wang, Hao Wang

机构 * Stevens Institute of Technology(史蒂文斯理工学院) Rice University(Rice大学) University of Waterloo(多伦多大学) Rutgers University(罗格斯大学)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏