arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-17 至 2025-10-17 共收录 228 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 53 篇

2510.02535 2025-10-17 cs.CY cs.AI 57%

PHORECAST: Enabling AI Understanding of Public Health Outreach Across Populations

Rifaa Qadri, Anh Nhat Nhu, Swati Ramnath, Laura Yu Zheng, Raj Bhansali, Sylvette La Touche-Howard, Tracy Marie Zeeger, Tom Goldstein, Ming Lin

机构 * University of Maryland(马里兰大学)

专题命中 评测与基准 :language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23584 2025-10-17 eess.IV cs.AI cs.CV 57%

A Clinically-Grounded Two-Stage Framework for Renal CT Report Generation

Renjie Liang, Zhengkang Fan, Jinqian Pan, Chenkun Sun, Bruce Daniel Steinberg, Russell Terry, Jie Xu

机构 * Department of Health Outcomes and Biomedical Informatics, University of Florida(健康结果与生物医学信息学系,佛罗里达大学) Department of Urology, University of Florida(泌尿外科系,佛罗里达大学)

专题命中 评测与基准 :language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18668 2025-10-17 cs.CV cs.CL 57%

ChartGalaxy: A Dataset for Infographic Chart Understanding and Generation

Zhen Li, Duan Li, Yukai Guo, Xinyuan Guo, Bowen Li, Lanxi Xiao, Shenyu Qiao, Jiashu Chen, Zijian Wu, Hui Zhang, Xinhuan Shu, Shixia Liu

机构 * Tsinghua University(清华大学) Newcastle University(新castle大学)

专题命中 评测与基准 :language model(abstract);分类 cs.CL

Comments 58 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14339 2025-10-17 cs.SE 50%

A Systematic Study of Time Limit Exceeded Errors in Online Programming Assignments

Jialu Zhang, Jialiang Gu, Wangmeiyu Zhang, José Pablo Cambronero, John Kolesar, Ruzica Piskac, Daming Li, Hanyuan Shi

专题命中 评测与基准 :LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22642 2025-10-17 cs.RO cs.CV cs.MM 50%

WoW: Towards a World omniscient World model Through Embodied Interaction

Xiaowei Chi, Peidong Jia, Chun-Kai Fan, Xiaozhu Ju, Weishi Mi, Kevin Zhang, Zhiyuan Qin, Wanxin Tian, Kuangzhi Ge, Hao Li, Zezhong Qian, Anthony Chen, Qiang Zhou, Yueru Jia, Jiaming Liu, Yong Dai, Qingpo Wuwu, Chengyu Bai, Yu-Kai Wang, Ying Li, Lizhang Chen, Yong Bao, Zhiyuan Jiang, Jiacheng Zhu, Kai Tang, Ruichuan An, Yulin Luo, Qiuxuan Feng, Siyuan Zhou, Chi-min Chan, Chengkai Hou, Wei Xue, Sirui Han, Yike Guo, Shanghang Zhang, Jian Tang

机构 * Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心) State Key Laboratory of Multimedia Information Processing(国家多媒体信息处理重点实验室) School of Computer Science, Peking University(北京大学计算机学院) Hong Kong University of Science and Technology(香港科技大学)

专题命中 评测与基准 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.13305 2025-10-17 cs.SI 50%

Multilevel User Credibility Assessment in Social Networks

Mohammad Moradi, Mostafa Haghir Chehreghani

专题命中 评测与基准 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 34 篇

2505.04141 2025-10-17 cs.RO 91%

NAMO-LLM: Efficient Navigation Among Movable Obstacles with Large Language Model Guidance

Yuqing Zhang, Yiannis Kantaros

机构 * Department of Electrical and Systems Engineering, McKelvey School of Engineering, Washington University in St.Louis(电气与系统工程系,麦凯利工程学院,华盛顿大学圣路易斯分校)

专题命中 效率与部署 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract)

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14557 2025-10-17 cs.LG cs.AR 89%

MX+: Pushing the Limits of Microscaling Formats for Efficient Large Language Model Serving

Jungi Lee, Junyong Park, Soohyun Cha, Jaehoon Cho, Jaewoong Sim

机构 * Seoul National University(首尔国立大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

Comments To appear at the 58th International Symposium on Microarchitecture (MICRO 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10597 2025-10-17 cs.CR cs.AI 89%

SoK: Evaluating Jailbreak Guardrails for Large Language Models

Xunguang Wang, Zhenlan Ji, Wenxuan Wang, Zongjie Li, Daoyuan Wu, Shuai Wang

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) Renmin University of China(中国人民大学) Lingnan University(岭南大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments Accepted by IEEE S&P 2026 Cycle 1

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13883 2025-10-17 q-bio.NC cs.MA 89%

Large Language Model Agents Enable Autonomous Design and Image Analysis of Microwell Microfluidics

Dinh-Nguyen Nguyen, Sadia Shakil, Raymond Kai-Yu Tong, Ngoc-Duy Dinh

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14392 2025-10-17 cs.DC cs.AI 85%

FairBatching: Fairness-Aware Batch Formation for LLM Inference

Hongtao Lyu, Boyue Liu, Mingyu Wu, Haibo Chen

机构 * Institute of Parallel and Distributed Systems, Shanghai Jiao Tong University(并行与分布式系统研究所,上海交通大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13918 2025-10-17 cs.CL 85%

Optimal Aggregation of LLM and PRM Signals for Efficient Test-Time Scaling

Peng Kuang, Yanli Wang, Xiaoyu Han, Yaowenqi Liu, Kaidi Xu, Haohan Wang

机构 * Zhejiang University(浙江大学) Imperial College London(伦敦帝国理工学院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Drexel University(德雷塞尔大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14961 2025-10-17 cs.LG cs.CL 84%

Efficient Parallel Samplers for Recurrent-Depth Models and Their Connection to Diffusion Language Models

Jonas Geiping, Xinyu Yang, Guinan Su

机构 * ELLIS Institute Tübingen & Max-Planck Institute for Intelligent Systems, Tübingen AI Center(图宾根ELLIS研究所及图宾根马克斯·普朗克智能系统研究所AI中心)

专题命中 效率与部署 :language model(title,abstract);pretraining(abstract,comments);分类 cs.CL、cs.LG

Comments Code can be found at https://github.com/seal-rg/recurrent-pretraining

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11550 2025-10-17 cs.CL cs.AI 84%

Ada-KV: Optimizing KV Cache Eviction by Adaptive Budget Allocation for Efficient LLM Inference

Yuan Feng, Junlin Lv, Yukun Cao, Xike Xie, S. Kevin Zhou

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24842 2025-10-17 cs.LG cs.CR 83%

Cascading Adversarial Bias from Injection to Distillation in Language Models

Harsh Chaudhari, Jamie Hayes, Matthew Jagielski, Ilia Shumailov, Milad Nasr, Alina Oprea

机构 * Northeastern University(东北大学) Google Deepmind(谷歌DeepMind)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13993 2025-10-17 cs.CV cs.AI cs.LG 81%

Efficient Few-Shot Learning in Remote Sensing: Fusing Vision and Vision-Language Models

Jia Yun Chua, Argyrios Zolotas, Miguel Arana-Catania

机构 * Cranfield University(克兰菲尔德大学) University of Oxford(牛津大学)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI、cs.LG

Comments 11 pages, 7 figures, 8 tables. To be published in Applied AI Letters

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14337 2025-10-17 cs.LG cs.AI 80%

Stop-RAG: Value-Based Retrieval Control for Iterative RAG

Jaewan Park, Solbee Cho, Jay-Yoon Lee

机构 * Seoul National University(首尔国立大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2025 MTI-LLM Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14254 2025-10-17 cs.LG 79%

Generalist vs Specialist Time Series Foundation Models: Investigating Potential Emergent Behaviors in Assessing Human Health Using PPG Signals

Saurabh Kataria, Yi Wu, Zhaoliang Chen, Hyunjung Gloria Kwak, Yuhao Xu, Lovely Yeswanth Panchumarthi, Ran Xiao, Jiaying Lu, Ayca Ermis, Anni Zhao, Runze Yan, Alex Federov, Zewen Liu, Xu Wu, Wei Jin, Carl Yang, Jocelyn Grunwell, Stephanie R. Brown, Amit Shah, Craig Jabaley, Tim Buchman, Sivasubramanium V Bhavani, Randall J. Lee, Xiao Hu

机构 * Nell Hodgson Woodruff School of Nursing(Nell Hodgson Woodruff护理学院) School of Computer Science(计算机科学学院) Department of Pediatrics(儿科系) Department of Computer Science(计算机科学系) Department of Epidemiology(流行病学系) Department of Anesthesiology(麻醉学系) Department of Surgery(外科系) Department of Medicine(医学系) School of Medicine(医学院)

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14223 2025-10-17 cs.IR cs.AI 79%

Large Scale Retrieval for the LinkedIn Feed using Causal Language Models

Sudarshan Srinivasa Ramanujam, Antonio Alonso, Saurabh Kataria, Siddharth Dangi, Akhilesh Gupta, Birjodh Singh Tiwana, Manas Somaiya, Luke Simon, David Byrne, Sojeong Ha, Sen Zhou, Andrei Akterskii, Zhanglong Liu, Samira Sriram, Crescent Xiong, Zhoutao Pei, Angela Shao, Alex Li, Annie Xiao, Caitlin Kolb, Thomas Kistler, Zach Moore, Hamed Firooz

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01411 2025-10-17 cs.CV cs.AI 79%

ViTA-PAR: Visual and Textual Attribute Alignment with Attribute Prompting for Pedestrian Attribute Recognition

Minjeong Park, Hongbeen Park, Jinkyu Kim

机构 * Department of Computer Science and Engineering, Korea University, Seoul 02841, Korea(计算机科学与工程系,韩国大学,首尔02841,韩国)

专题命中 效率与部署 :prompting(title,abstract);分类 cs.AI

Comments Accepted to IEEE ICIP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16411 2025-10-17 cs.CV cs.LG 79%

Mitigating Hallucinations in Vision-Language Models through Image-Guided Head Suppression

Sreetama Sarkar, Yue Che, Alex Gavin, Peter A. Beerel, Souvik Kundu

机构 * University of Southern California(美国南加州大学) Intel Labs(英特尔实验室) Harvard-Westlake School(哈佛-韦斯利学校)

专题命中 效率与部署 :language model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11401 2025-10-17 cs.CL 79%

Following the Autoregressive Nature of LLM Embeddings via Compression and Alignment

Jingcheng Deng, Zhongtao Jiang, Liang Pang, Liwei Chen, Kun Xu, Zihao Wei, Huawei Shen, Xueqi Cheng

机构 * Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院人工智能安全重点实验室,计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) Kuaishou Technology(快手科技)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14024 2025-10-17 cs.DC 78%

Efficiently Executing High-throughput Lightweight LLM Inference Applications on Heterogeneous Opportunistic GPU Clusters with Pervasive Context Management

Thanh Son Phung, Douglas Thain

专题命中 效率与部署 :LLM(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13193 2025-10-17 cs.IR 78%

ReMindRAG: Low-Cost LLM-Guided Knowledge Graph Traversal for Efficient RAG

Yikuan Hu, Jifeng Zhu, Lanrui Tang, Chen Huang

专题命中 效率与部署 :LLM(title,abstract)

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14276 2025-10-17 cs.CL 77%

Qwen3Guard Technical Report

Haiquan Zhao, Chenhan Yuan, Fei Huang, Xiaomeng Hu, Yichang Zhang, An Yang, Bowen Yu, Dayiheng Liu, Jingren Zhou, Junyang Lin, Baosong Yang, Chen Cheng, Jialong Tang, Jiandong Jiang, Jianwei Zhang, Jijie Xu, Ming Yan, Minmin Sun, Pei Zhang, Pengjun Xie, Qiaoyu Tang, Qin Zhu, Rong Zhang, Shibin Wu, Shuo Zhang, Tao He, Tianyi Tang, Tingyu Xia, Wei Liao, Weizhou Shen, Wenbiao Yin, Wenmeng Zhou, Wenyuan Yu, Xiaobin Wang, Xiaodong Deng, Xiaodong Xu, Xinyu Zhang, Yang Liu, Yeqiu Li, Yi Zhang, Yong Jiang, Yu Wan, Yuxin Zhou

机构 * Qwen Team(通义实验室)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14624 2025-10-17 cs.CV 75%

Efficient Video Sampling: Pruning Temporally Redundant Tokens for Faster VLM Inference

Natan Bagrov, Eugene Khvedchenia, Borys Tymchenko, Shay Aharon, Lior Kadoch, Tomer Keren, Ofri Masad, Yonatan Geifman, Ran Zilberstein, Tuomas Rintamaki, Matthieu Le, Andrew Tao

机构 * NVIDIA

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14341 2025-10-17 cs.SE 75%

PathFix: Automated Program Repair with Expected Path

Xu He, Shu Wang, Kun Sun

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

Comments This is the author's version of a paper accepted at SecDev 2025 (IEEE)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05043 2025-10-17 cs.DC 75%

MoLink: Distributed and Efficient Serving Framework for Large Models

Lewei Jin, Yongqi Chen, Kui Zhang, Yifan Zhuo, Yi Gao, Bowei Yang, Zhengong Cai, Wei Dong

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14660 2025-10-17 cs.CL cs.AI cs.IR 73%

An Efficient Rubric-based Generative Verifier for Search-Augmented LLMs

Linyue Ma, Yilong Xu, Xiang Long, Zhi Zheng

机构 * ModelBest Inc.(ModelBest公司) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13831 2025-10-17 cs.CL cs.AI 73%

Informed Routing in LLMs: Smarter Token-Level Computation for Faster Inference

Chao Han, Yijuan Liang, Zihao Xuan, Daokuan Wu, Wei Zhang, Xiaoyu Shen

机构 * Institute of Digital Twin, Eastern Institute of Technology(数字孪生研究所、东部技术研究院) University of Science and Technology of China(中国科学技术大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏