arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-28 至 2025-10-28 共收录 412 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 88 篇

2505.23671 2025-10-28 cs.SE cs.AI cs.CL cs.LG 67%

GSO: Challenging Software Optimization Tasks for Evaluating SWE-Agents

Manish Shetty, Naman Jain, Jinjian Liu, Vijay Kethanaboyina, Koushik Sen, Ion Stoica

机构 * UC Berkeley(伯克利大学)

专题命中 评测与基准 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Website: https://gso-bench.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17895 2025-10-28 stat.ML cs.AI cs.LG 62%

DataRater: Meta-Learned Dataset Curation

Dan A. Calian, Gregory Farquhar, Iurii Kemaev, Luisa M. Zintgraf, Matteo Hessel, Jeremy Shar, Junhyuk Oh, András György, Tom Schaul, Jeffrey Dean, Hado van Hasselt, David Silver

机构 * Google(谷歌) DeepMind

专题命中 评测与基准 :foundation model(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22333 2025-10-28 cs.AI cs.LG 62%

LIFT: Interpretable truck driving risk prediction with literature-informed fine-tuned LLMs

Xiao Hu, Yuansheng Lian, Ke Zhang, Yunxuan Li, Yuelong Su, Meng Li

机构 * Department of Civil Engineering, Tsinghua University, Beijing, China(清华大学土木工程系) College of Traffic Management, People's Public Security University of China, Beijing, China(中国人民公安大学交通管理学院) Beijing Key Laboratory of Traffic Engineering, Beijing University of Technology, Beijing, China(北京理工大学交通工程重点实验室) State Key Laboratory of Intelligent Green Vehicle and Mobility, Tsinghua University, Beijing, China(清华大学智能绿色车辆与移动国家重点实验室)

专题命中 评测与基准 :LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13227 2025-10-28 cs.AI cs.CL cs.CV cs.HC 62%

Scaling Computer-Use Grounding via User Interface Decomposition and Synthesis

Tianbao Xie, Jiaqi Deng, Xiaochuan Li, Junlin Yang, Haoyuan Wu, Jixuan Chen, Wenjing Hu, Xinyuan Wang, Yuhui Xu, Zekun Wang, Yiheng Xu, Junli Wang, Doyen Sahoo, Tao Yu, Caiming Xiong

机构 * The University of Hong Kong(香港大学) Salesforce AI Research(Salesforce AI研究院)

专题命中 评测与基准 :foundation model(abstract);分类 cs.CL、cs.AI

Comments 49 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22045 2025-10-28 cs.CV cs.AI 61%

VLM-SlideEval: Evaluating VLMs on Structured Comprehension and Perturbation Sensitivity in PPT

Hyeonsu Kang, Emily Bao, Anjan Goswami

专题命中 评测与基准 :language model(abstract);分类 cs.AI;LLM(comments)

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop: Evaluating the Evolving LLM Lifecycle - Benchmarks, Emergent Abilities, and Scaling

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22237 2025-10-28 eess.AS cs.LG 57%

Bridging the Perceptual-Statistical Gap in Dysarthria Assessment: Why Machine Learning Still Falls Short

Krishna Gurugubelli

机构 * Samsung Research \& Development Institute Bengaluru, India\ .

专题命中 评测与基准 :pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16343 2025-10-28 cs.SD cs.AI eess.AS 57%

Detect Any Sound: Open-Vocabulary Sound Event Detection with Multi-Modal Queries

Pengfei Cai, Yan Song, Qing Gu, Nan Jiang, Haoyu Song, Ian McLoughlin

机构 * University of Science and Technology of China(科学技术大学) Singapore Institute of Technology(新加坡理工学院)

专题命中 评测与基准 :language model(abstract);分类 cs.AI

Comments Accepted by MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22702 2025-10-28 cs.AI cs.CV cs.ET eess.IV 57%

Atlas Urban Index: A VLM-Based Approach for Spatially and Temporally Calibrated Urban Development Monitoring

Mithul Chander, Sai Pragnya Ranga, Prathamesh Mayekar

机构 * Propheus

专题命中 评测与基准 :language model(abstract);分类 cs.AI

Comments An abridged version of this paper will be presented at and appear in the Proceedings of ACM IKDD CODS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22527 2025-10-28 astro-ph.IM astro-ph.GA cs.LG 57%

Multi-Modal Masked Autoencoders for Learning Image-Spectrum Associations for Galaxy Evolution and Cosmology

Morgan Himes, Samiksha Krishnamurthy, Andrew Lizarraga, Srinath Saikrishnan, Vikram Seenivasan, Jonathan Soriano, Ying Nian Wu, Tuan Do

专题命中 评测与基准 :foundation model(abstract);分类 cs.LG

Comments 8 pages, 3 figures, 1 table, accepted to NeurIPS 2025 Workshop ML4PS

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20759 2025-10-28 cs.CV cs.AI 57%

PARTONOMY: Large Multimodal Models with Part-Level Visual Understanding

Ansel Blume, Jeonghwan Kim, Hyeonjeong Ha, Elen Chatikyan, Xiaomeng Jin, Khanh Duy Nguyen, Nanyun Peng, Kai-Wei Chang, Derek Hoiem, Heng Ji

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of California Los Angeles(加州大学洛杉矶分校)

专题命中 评测与基准 :pretraining(abstract);分类 cs.AI

Comments NeurIPS 2025 Spotlight; project page: https://wjdghks950.github.io/partonomy.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18087 2025-10-28 cs.CV cs.AI 57%

CXReasonBench: A Benchmark for Evaluating Structured Diagnostic Reasoning in Chest X-rays

Hyungyung Lee, Geon Choi, Jung-Oh Lee, Hangyul Yoon, Hyuk Gi Hong, Edward Choi

机构 * KAIST(韩国国立科学技术院) Seoul National University Hospital(首尔国立大学医院) Seoul Medical Center(首尔医疗中心)

专题命中 评测与基准 :language model(abstract);分类 cs.AI

Comments Accepted at NeurIPS 2025 Datasets and Benchmarks Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21774 2025-10-28 cs.CV cs.AI 57%

OCR-Quality: A Human-Annotated Dataset for OCR Quality Assessment

Yulong Zhang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 评测与基准 :language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21761 2025-10-28 cs.RO cs.AI cs.CV 57%

J-ORA: A Framework and Multimodal Dataset for Japanese Object Identification, Reference, Action Prediction in Robot Perception

Jesse Atuhurra, Hidetaka Kamigaito, Taro Watanabe, Koichiro Yoshino

机构 * Division of Information Science, NAIST(NAIST信息科学系) Guardian Robot Project, RIKEN(RIKEN守护机器人项目)

专题命中 评测与基准 :language model(abstract);分类 cs.AI

Comments Accepted to IROS2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17313 2025-10-28 cs.LG 57%

Disentanglement Beyond Static vs. Dynamic: A Benchmark and Evaluation Framework for Multi-Factor Sequential Representations

Tal Barami, Nimrod Berman, Ilan Naiman, Amos H. Hason, Rotem Ezra, Omri Azencot

机构 * Faculty of Computer and Information Science(计算机与信息科学学院) Ben-Gurion University of the Negev(贝加尔-内盖夫大学)

专题命中 评测与基准 :language model(abstract);分类 cs.LG

Comments Accepted for the Thirty-ninth Annual Conference on Neural Information Processing Systems Datasets and Benchmarks Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11147 2025-10-28 cs.CV 50%

3D-RAD: A Comprehensive 3D Radiology Med-VQA Dataset with Multi-Temporal Analysis and Diverse Diagnostic Tasks

Xiaotang Gai, Jiaxiang Liu, Yichen Li, Zijie Meng, Jian Wu, Zuozhu Liu

机构 * ZJU-Angelalign R&D Center for Intelligence Healthcare(浙江大学智能医疗研发中心) Zhejiang University(浙江大学) Zhejiang Key Laboratory of Medical Imaging Artificial Intelligence(浙江省医学影像人工智能重点实验室) Guangdong Institute of Intelligence Science and Technology(广东省智能科学与技术研究院)

专题命中 评测与基准 :language model(abstract)

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20625 2025-10-28 cs.CV 50%

T2ICount: Enhancing Cross-modal Understanding for Zero-Shot Counting

Yifei Qian, Zhongliang Guo, Bowen Deng, Chun Tong Lei, Shuai Zhao, Chun Pong Lau, Xiaopeng Hong, Michael P. Pound

机构 * University of Nottingham(诺丁汉大学) University of St Andrews(圣安德鲁大学) City University of Hong Kong(香港城市大学) Nanyang Technology University(南洋理工大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 评测与基准 :language model(abstract)

Comments Accepted by CVPR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22119 2025-10-28 cs.CV 50%

CogStereo: Neural Stereo Matching with Implicit Spatial Cognition Embedding

Lihuang Fang, Xiao Hu, Yuchen Zou, Hong Zhang

机构 * Robotics and Computer Vision (RCV) Laboratory, Southern University of Science and Technology (SUSTech)(机器人与计算机视觉实验室,南方科技大学) International Digital Economy Academy (IDEA)(国际数字经济学院) School of Automation Science and Engineering, Xi’an Jiaotong University (XJTU)(自动化科学与工程学院,西安交通大学)

专题命中 评测与基准 :foundation model(abstract)

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03610 2025-10-28 cs.CV 50%

Learning Knowledge-based Prompts for Robust 3D Mask Presentation Attack Detection

Fangling Jiang, Qi Li, Bing Liu, Weining Wang, Caifeng Shan, Zhenan Sun, Ming-Hsuan Yang

机构 * School of Computer Science, University of South China(南方大学计算机科学学院) New Laboratory of Pattern Recognition, MAIS, CASIA(模式识别新实验室,MAIS,CASIA) School of Intelligence Science and Technology, Nanjing University(智能科学与技术学院,南京大学) Department of Computer Science and Engineering, University of California, Merced(加州大学默塞德分校计算机科学与工程系) Department of Computer Science and Engineering, Yonsei University(延世大学计算机科学与工程系)

专题命中 评测与基准 :language model(abstract)

Comments Accepted by TPAMI

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 82 篇

2506.11044 2025-10-28 cs.LG 92%

Boost Post-Training Quantization via Null Space Optimization for Large Language Models

Jiaqi Zhao, Miao Zhang, Deng Xiang, Ming Li, Weili Guan, Liqiang Nie

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);post-training(title,abstract);分类 cs.LG

Comments 17 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22101 2025-10-28 cs.IR cs.LG 90%

Scaling Up Efficient Small Language Models Serving and Deployment for Semantic Job Search

Kayhan Behdin, Qingquan Song, Sriram Vasudevan, Jian Sheng, Xiaojing Ma, Z Zhou, Chuanrui Zhu, Guoyao Li, Chanh Nguyen, Sayan Ghosh, Hejian Sang, Ata Fatahi Baarzi, Sundara Raman Ramachandran, Xiaoqing Wang, Qing Lan, Vinay Y S, Qi Guo, Caleb Johnson, Zhipeng Wang, Fedor Borisyuk

机构 * Anonymous Authors(匿名作者)

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);large language model(abstract);SLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05314 2025-10-28 cs.CL cs.AI cs.LG 90%

Constrained Entropic Unlearning: A Primal-Dual Framework for Large Language Models

Taha Entesari, Arman Hatami, Rinat Khaziev, Anil Ramakrishna, Mahyar Fazlyab

机构 * Johns Hopkins University(约翰霍普金斯大学) Amazon(亚马逊)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments The Thirty-Ninth Annual Conference on Neural Information Processing Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22489 2025-10-28 cs.CL cs.LG 90%

Frustratingly Easy Task-aware Pruning for Large Language Models

Yuanhe Tian, Junjie Liu, Xican Yang, Haishan Ye, Yan Song

机构 * Zhongguancun Institute of Artificial Intelligence(中关村人工智能研究院) University of Science and Technology of China(中国科学技术大学) Xi’an Jiaotong University(西安交通大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21970 2025-10-28 cs.AI cs.CL 90%

Performance Trade-offs of Optimizing Small Language Models for E-Commerce

Josip Tomo Licardo, Nikola Tankovic

机构 * Faculty of Informatics(信息学院) Juraj Dobrila University of Pula(朱拉·多布里拉大学)

专题命中 效率与部署 :language model(title,abstract);small language model(title);large language model(abstract);post-training(abstract)

Comments 15 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11654 2025-10-28 cs.LG cs.AI eess.SP 88%

R-SFLLM: Jamming Resilient Framework for Split Federated Learning with Large Language Models

Aladin Djuhera, Vlad C. Andrei, Xinyang Li, Ullrich J. Mönich, Holger Boche, Walid Saad

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Journal ref IEEE Transactions on Information Forensics and Security (Volume: 20), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14595 2025-10-28 cs.CL cs.LG 88%

EchoAtt: Attend, Copy, then Adjust for More Efficient Large Language Models

Hossein Rajabzadeh, Aref Jafari, Aman Sharma, Benyamin Jami, Hyock Ju Kwon, Ali Ghodsi, Boxing Chen, Mehdi Rezagholizadeh

机构 * University of Waterloo(滑铁卢大学) Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24680 2025-10-28 cs.CL 88%

A Simple Linear Patch Revives Layer-Pruned Large Language Models

Xinrui Chen, Haoli Bai, Tao Yuan, Ruikang Liu, Kang Zhao, Xianzhi Yu, Lu Hou, Tian Guan, Yonghong He, Chun Yuan

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Huawei Technologies(华为技术)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments 26 pages, accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21844 2025-10-28 cs.LG quant-ph 88%

KARIPAP: Quantum-Inspired Tensor Network Compression of Large Language Models Using Infinite Projected Entangled Pair States and Tensor Renormalization Group

Azree Nazri

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

Comments 28 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21834 2025-10-28 cs.LG 88%

Restoring Pruned Large Language Models via Lost Component Compensation

Zijian Feng, Hanzhang Zhou, Zixiao Zhu, Tianjiao Li, Jia Jim Deryl Chua, Lee Onn Mak, Gee Wah Ng, Kezhi Mao

机构 * School of Electrical and Electronic Engineering, Nanyang Technological University, Singapore(电子与电气工程学院,南洋理工大学,新加坡) Home Team Science and Technology Agency (HTX), Singapore(科技局(HTX),新加坡)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

Comments NeurIPS 2025 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22691 2025-10-28 cs.CL cs.LG 88%

SALSA: Single-pass Autoregressive LLM Structured Classification

Ruslan Berdichevsky, Shai Nahum-Gefen, Elad Ben Zaken

机构 * Dream Security Ltd.(Dream Security有限公司)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23334 2025-10-28 cs.CL 86%

Adaptive Blockwise Search: Inference-Time Alignment for Large Language Models

Mohammad Atif Quamar, Mohammad Areeb, Nishant Sharma, Ananth Shreekumar, Jonathan Rosenthal, Muslum Ozgur Ozmen, Mikhail Kuznetsov, Z. Berkay Celik

机构 * Purdue University(普渡大学) Arizona State University(亚利桑那州立大学) Amazon(亚马逊)

专题命中 效率与部署 :large language model(title);language model(title);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏