arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-27 至 2025-10-27 共收录 214 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 46 篇

2510.20928 2025-10-27 stat.ME 71%

Handling Missing Responses under Cluster Dependence with Applications to Language Model Evaluation

Zhenghao Zeng, David Arbour, Avi Feller, Ishita Dasgupta, Atanu R Sinha, Edward H. Kennedy

专题命中 评测与基准 :language model(title)

Comments 27 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21133 2025-10-27 cs.CR cs.AI 70%

Quantifying CBRN Risk in Frontier Models

Divyanshu Kumar, Nitin Aravind Birur, Tanay Baswa, Sahil Agarwal, Prashanth Harshangi

机构 * Enkrypt AI

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21955 2025-10-27 cs.CV cs.AI 70%

Towards Comprehensive Scene Understanding: Integrating First and Third-Person Views for LVLMs

Insu Lee, Wooje Park, Jaeyun Jang, Minyoung Noh, Kyuhong Shim, Byonghyo Shim

专题命中 评测与基准 :language model(abstract);prompting(abstract);分类 cs.AI

Comments Accepted to NeurIPS 2025 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11546 2025-10-27 cs.CL 70%

DCAD-2000: A Multilingual Dataset across 2000+ Languages with Data Cleaning as Anomaly Detection

Yingli Shen, Wen Lai, Shuo Wang, Xueren Zhang, Kangyang Luo, Alexander Fraser, Maosong Sun

机构 * Dept. of Comp. Sci. & Tech., Tsinghua University(清华大学计算机科学与技术系) Technical University of Munich(慕尼黑技术大学) Munich Center for Machine Learning(慕尼黑机器学习中心) ModelBest Inc.(ModelBest公司) BNRist Center, Institute for AI, Tsinghua University(清华大学人工智能研究院脑神经与认知科学中心) Jiangsu Collaborative Innovation Center for Language Ability, Jiangsu Normal University(江苏省语言能力协同创新中心,江苏师范大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

Comments NeurIPS 2025 Datasets and Benchmarks Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.04656 2025-10-27 cs.DC cs.LG 70%

Lazarus: Resilient and Elastic Training of Mixture-of-Experts Models

Yongji Wu, Wenjie Qu, Xueshen Liu, Tianyang Tao, Yifan Qiao, Zhuang Wang, Wei Bai, Yuan Tian, Jiaheng Zhang, Z. Morley Mao, Matthew Lentz, Danyang Zhuo, Ion Stoica

机构 * UC Berkeley(伯克利大学) NUS(新加坡国立大学) UMich(密歇根大学) AWS(亚马逊云科技) NVIDIA(英伟达) UCLA(加州大学洛杉矶分校) Duke(杜克大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21214 2025-10-27 cs.CR 67%

Enhanced MLLM Black-Box Jailbreaking Attacks and Defenses

Xingwei Zhong, Kar Wai Fok, Vrizlynn L. L. Thing

专题命中 评测与基准 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11325 2025-10-27 cs.CR 67%

Revealing the True Indicators: Understanding and Improving IoC Extraction From Threat Reports

Evangelos Froudakis, Athanasios Avgetidis, Sean Tyler Frankum, Roberto Perdisci, Manos Antonakakis, Angelos D. Keromytis

专题命中 评测与基准 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18972 2025-10-27 cs.LG cs.AI 62%

Deep Insights into Cognitive Decline: A Survey of Leveraging Non-Intrusive Modalities with Deep Learning Techniques

David Ortiz-Perez, Manuel Benavent-Lledo, Jose Garcia-Rodriguez, David Tomás, M. Flores Vizcaya-Moreno

机构 * Dept. of Computer Science and Technology(计算机科学与技术系) University of Alicante(阿尔瓦登特大学) Unit of Clinical Nursing Research(临床护理研究单位) Faculty of Health Sciences(健康科学学院)

专题命中 评测与基准 :foundation model(abstract);分类 cs.AI、cs.LG

Journal ref Applied Soft Computing, Vol. 184, 2025, Article 113787

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21679 2025-10-27 cs.AI 57%

A Multimodal Benchmark for Framing of Oil & Gas Advertising and Potential Greenwashing Detection

Gaku Morio, Harri Rowlands, Dominik Stammbach, Christopher D. Manning, Peter Henderson

机构 * Hitachi, Ltd.(日立公司) Stanford University(斯坦福大学) Centre for the Acceleration of Social Technology(社会技术加速中心) Princeton University(普林斯顿大学)

专题命中 评测与基准 :language model(abstract);分类 cs.AI

Comments Forthcoming in NeurIPS 2025 Datasets and Benchmarks Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21436 2025-10-27 cs.AI 57%

AutoOpt: A Dataset and a Unified Framework for Automating Optimization Problem Solving

Ankur Sinha, Shobhit Arora, Dhaval Pujara

机构 * Brij Disa Centre for Data Science and AI(Brij Disa 数据科学与人工智能中心) Indian Institute of Management Ahmedabad(印度管理学院阿赫迈德亚德)

专题命中 评测与基准 :LLM(abstract);分类 cs.AI

Comments NeurIPS 2025, 28 pages, 11 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15583 2025-10-27 cs.CL 57%

DiscoSG: Towards Discourse-Level Text Scene Graph Parsing through Iterative Graph Refinement

Shaoqing Lin, Chong Teng, Fei Li, Donghong Ji, Lizhen Qu, Zhuang Li

专题命中 评测与基准 :language model(abstract);分类 cs.CL

Comments EMNLP 2025 (oral), 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20749 2025-10-27 cs.AI cs.SE 57%

Can Agents Fix Agent Issues?

Alfin Wijaya Rahardja, Junwei Liu, Weitong Chen, Zhenpeng Chen, Yiling Lou

专题命中 评测与基准 :LLM(abstract);分类 cs.AI

Comments Accepted by the 39th Annual Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21317 2025-10-27 eess.AS cs.SD 50%

Are These Even Words? Quantifying the Gibberishness of Generative Speech Models

Danilo de Oliveira, Tal Peer, Jonas Rochdi, Timo Gerkmann

机构 * Signal Processing, University of Hamburg, Germany(信号处理,汉堡大学,德国)

专题命中 评测与基准 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21160 2025-10-27 cs.CV 50%

Towards Physics-informed Spatial Intelligence with Human Priors: An Autonomous Driving Pilot Study

Guanlin Wu, Boyan Su, Yang Zhao, Pu Wang, Yichen Lin, Hao Frank Yang

机构 * Johns Hopkins University(约翰霍普金斯大学)

专题命中 评测与基准 :foundation model(abstract)

Comments NeurIPS 2025 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21120 2025-10-27 cs.CV 50%

SafetyPairs: Isolating Safety Critical Image Features with Counterfactual Image Generation

Alec Helbling, Shruti Palaskar, Kundan Krishna, Polo Chau, Leon Gatys, Joseph Yitan Cheng

机构 * Georgia Tech(佐治亚理工学院) Apple(苹果公司)

专题命中 评测与基准 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21115 2025-10-27 cs.SD 50%

Robust Distortion-Free Watermark for Autoregressive Audio Generation Models

Yihan Wu, Georgios Milis, Ruibo Chen, Heng Huang

机构 * Department of Computer Science University of Maryland, College Park(计算机科学系美国马里兰大学)

专题命中 评测与基准 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05051 2025-10-27 cs.CV 50%

SegMASt3R: Geometry Grounded Segment Matching

Rohit Jayanti, Swayam Agrawal, Vansh Garg, Siddharth Tourani, Muhammad Haris Khan, Sourav Garg, Madhava Krishna

机构 * IIIT Hyderabad(海得拉巴印度理工学院) University of Heidelberg(海德堡大学) MBZUAI

专题命中 评测与基准 :foundation model(abstract)

Comments Accepted to The 39th Annual Conference on Neural Information Processing Systems (NeurIPS 2025) as a Spotlight (top 3.5%)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 36 篇

2510.21258 2025-10-27 cs.CL cs.AI nlin.CD 90%

Correlation Dimension of Auto-Regressive Large Language Models

Xin Du, Kumiko Tanaka-Ishii

机构 * Waseda University(早稻田大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.AI

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02720 2025-10-27 cs.AI cs.CL 88%

LocalGPT: Benchmarking and Advancing Large Language Models for Local Life Services in Meituan

Xiaochong Lan, Jie Feng, Jiahuan Lei, Xinlei Shi, Yong Li

机构 * Department of Electronic\ , BNRist,\ University Beijing, China Department of Electronic\ , BNRist,\ University

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments KDD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21604 2025-10-27 cs.CL 88%

RETuning: Upgrading Inference-Time Scaling for Stock Movement Prediction with Large Language Models

Xueyuan Lin, Cehao Yang, Ye Ma, Ming Li, Rongjunchen Zhang, Yang Ni, Xiaojun Wu, Chengjin Xu, Jian Guo, Hui Xiong

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) IDEA Research(IDEA研究院) Hithink RoyalFlush Information Network Co., Ltd(慧思皇家Flush信息网络有限公司) DataArc Tech Ltd(DataArc科技有限公司)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01420 2025-10-27 cs.CL cs.LG 88%

Self-Refining Language Model Anonymizers via Adversarial Distillation

Kyuyoung Kim, Hyunjun Jeon, Jinwoo Shin

机构 * KAIST AI(韩国科学技术院人工智能研究所)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);small language model(abstract)

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21425 2025-10-27 cs.AI 86%

Advancing Symbolic Integration in Large Language Models: Beyond Conventional Neurosymbolic AI

Maneeha Rani, Bhupesh Kumar Mishra, Dhavalkumar Thakker

机构 * Data Science, AI & Modelling Centre (DAIM)(数据科学、人工智能与建模中心) School of Digital and Physical Sciences(数字与物理科学学院) University of Hull(霍尔大学)

专题命中 效率与部署 :large language model(title);language model(title);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19947 2025-10-27 cs.LG cs.AI cs.SY eess.SY 86%

MESS+: Dynamically Learned Inference-Time LLM Routing in Model Zoos with Service Level Guarantees

Herbert Woisetschläger, Ryan Zhang, Shiqiang Wang, Hans-Arno Jacobsen

机构 * Technical University of Munich(慕尼黑技术大学) Horace Greeley High School(霍雷肖·格里利高中) IBM Research(IBM研究院) University of Toronto(多伦多大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2025. Code: https://github.com/laminair/mess-plus

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.18789 2025-10-27 cs.DC cs.CL cs.LG 86%

FlexLLM: Token-Level Co-Serving of LLM Inference and Finetuning with SLO Guarantees

Gabriele Oliaro, Xupeng Miao, Xinhao Cheng, Vineeth Kada, Mengdi Wu, Ruohan Gao, Yingyi Huang, Remi Delacourt, April Yang, Yingcheng Wang, Colin Unger, Zhihao Jia

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments NSDI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13665 2025-10-27 cs.LG cs.AI 84%

Axial Neural Networks for Dimension-Free Foundation Models

Hyunsu Kim, Jonggeon Park, Joan Bruna, Hongseok Yang, Juho Lee

机构 * KAIST(韩国科学技术院) New York University(纽约大学)

专题命中 效率与部署 :foundation model(title,abstract);pretraining(abstract);分类 cs.AI、cs.LG

Journal ref NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21184 2025-10-27 cs.LG cs.AI cs.CL stat.ML 82%

Reducing the Probability of Undesirable Outputs in Language Models Using Probabilistic Inference

Stephen Zhao, Aidan Li, Rob Brekelmans, Roger Grosse

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01637 2025-10-27 cs.CL cs.LG 81%

Scaling Embedding Layers in Language Models

Da Yu, Edith Cohen, Badih Ghazi, Yangsibo Huang, Pritish Kamath, Ravi Kumar, Daogao Liu, Chiyuan Zhang

机构 * Google(谷歌)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

Comments NeurIPS 2025 camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17495 2025-10-27 cs.LG cs.AI cs.CL 80%

ProxySPEX: Inference-Efficient Interpretability via Sparse Feature Interactions in LLMs

Landon Butler, Abhineet Agarwal, Justin Singh Kang, Yigit Efe Erginbas, Bin Yu, Kannan Ramchandran

机构 * Department of EECS UC Berkeley(电子工程与计算机科学系,伯克利大学) Department of Statistics UC Berkeley(统计学系,伯克利大学) Departments of Statistics and EECS UC Berkeley(统计学系和电子工程与计算机科学系,伯克利大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Algorithm available at: https://github.com/mmschlk/shapiq

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18522 2025-10-27 cs.CL 79%

How Does Sequence Modeling Architecture Influence Base Capabilities of Pre-trained Language Models? Exploring Key Architecture Design Principles to Avoid Base Capabilities Degradation

Xin Lu, Yanyan Zhao, Si Wei, Shijin Wang, Bing Qin, Ting Liu

机构 * Research Center for Social Computing and Interactive Robotics(社会计算与交互机器人研究中心) Harbin Institute of Technology(哈尔滨工业大学) iFLYTEK Co., Ltd(iFLYTEK公司)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13866 2025-10-27 cs.CL 79%

Reasoning Path Compression: Compressing Generation Trajectories for Efficient LLM Reasoning

Jiwon Song, Dongwon Jo, Yulhwa Kim, Jae-Joon Kim

机构 * Seoul National University(首尔国立大学) Sungkyunkwan University(成均馆大学)

专题命中 效率与部署 :LLM(title);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏