arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-10 至 2025-11-10 共收录 32 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 32 篇

2402.03299 2025-11-10 cs.LG cs.CL cs.CV 90%

GUARD: Role-playing to Generate Natural-language Jailbreakings to Test Guideline Adherence of Large Language Models

Haibo Jin, Ruoxi Chen, Peiyan Zhang, Andy Zhou, Haohan Wang

机构 * School of Information Sciences University of Illinois at Urbana-Champaign(信息科学学院伊利诺伊大学厄巴纳-香槟分校) Independent Researcher, Starc Institute(Starc研究所独立研究者) Computer Science and Engineering HKUST(HKUST计算机科学与工程学院) Computer Science Lapis Labs University of Illinois Urbana-Champaign(计算机科学Lapis Labs伊利诺伊大学厄巴纳-香槟分校) School of Information Sciences University of Illinois Urbana-Champaign(信息科学学院伊利诺伊大学厄巴纳-香槟分校)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

Comments 28 papges

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04703 2025-11-10 cs.CL cs.AI 90%

Measuring what Matters: Construct Validity in Large Language Model Benchmarks

Andrew M. Bean, Ryan Othniel Kearns, Angelika Romanou, Franziska Sofia Hafner, Harry Mayne, Jan Batzner, Negar Foroutan, Chris Schmitz, Karolina Korgul, Hunar Batra, Oishi Deb, Emma Beharry, Cornelius Emde, Thomas Foster, Anna Gausen, María Grandury, Simeng Han, Valentin Hofmann, Lujain Ibrahim, Hazel Kim, Hannah Rose Kirk, Fangru Lin, Gabrielle Kaili-May Liu, Lennart Luettgau, Jabez Magomere, Jonathan Rystrøm, Anna Sotnikova, Yushi Yang, Yilun Zhao, Adel Bibi, Antoine Bosselut, Ronald Clark, Arman Cohan, Jakob Foerster, Yarin Gal, Scott A. Hale, Inioluwa Deborah Raji, Christopher Summerfield, Philip H. S. Torr, Cozmin Ududec, Luc Rocher, Adam Mahdi

机构 * University of Oxford(牛津大学) EPFL(苏黎世联邦理工学院) Weizenbaum Institute Berlin(柏林Weizenbaum研究所) Technical University Munich(慕尼黑技术大学) Centre for Digital Governance, Hertie School(赫尔姆霍兹学院数字治理中心) Stanford University(斯坦福大学) UK AI Security Institute(英国人工智能安全研究所) SomosNLP Universdad Politécnica de Madrid(马德里理工大学) Yale University(耶鲁大学) Allen Institute for AI(人工智能研究所) University of Washington(华盛顿大学) Meedan UC Berkeley(加州大学伯克利分校)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Track on Datasets and Benchmarks

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05085 2025-11-10 cs.CL cs.LG 88%

Iterative Layer-wise Distillation for Efficient Compression of Large Language Models

Grigory Kovalev, Mikhail Tikhomirov

机构 * Lomonosov Moscow State University, Russia(莫斯科罗蒙诺夫国立大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02421 2025-11-10 cs.CL cs.AI 88%

Activation-Informed Merging of Large Language Models

Amin Heyrani Nobari, Kaveh Alim, Ali ArjomandBigdeli, Akash Srivastava, Faez Ahmed, Navid Azizan

机构 * Massachusetts Institute of Technology(麻省理工学院) Stony Brook University(石溪大学) MIT-IBM Watson AI Lab & Red Hat AI Innovation(MIT-IBM Watson AI实验室及Red Hat AI创新)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04952 2025-11-10 cs.CL 88%

LoPT: Lossless Parallel Tokenization Acceleration for Long Context Inference of Large Language Model

Wei Shao, Lingchao Zheng, Pengyu Wang, Peizhen Zheng, Jun Li, Yuwei Fan

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04849 2025-11-10 cs.SE cs.AI 87%

Software Defined Vehicle Code Generation: A Few-Shot Prompting Approach

Quang-Dung Nguyen, Tri-Dung Tran, Thanh-Hieu Chu, Hoang-Loc Tran, Xiangwei Cheng, Dirk Slama

机构 * University of Information Technology VNUHCM(信息技术大学 VNUHCM)

专题命中 效率与部署 :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments 6 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01602 2025-11-10 cs.DB cs.LG 85%

L2T-Tune:LLM-Guided Hybrid Database Tuning with LHS and TD3

Xinyue Yang, Chen Zheng, Yaoyang Hou, Renhao Zhang, Yinyan Zhang, Yanjun Wu, Heng Zhang

机构 * University of Chinese Academy of Sciences(中国科学院大学) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) Hangzhou Institute for Advanced Study, UCAS(杭州高等研究院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10816 2025-11-10 cs.IR cs.CL 85%

CSPLADE: Learned Sparse Retrieval with Causal Language Models

Zhichao Xu, Aosong Feng, Yijun Tian, Haibo Ding, Lin Lee Cheong

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

Comments IJCNLP-AACL 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04576 2025-11-10 eess.SP 85%

Communication-Efficient Collaborative LLM Inference via Distributed Speculative Decoding

Ce Zheng, Tingting Yang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted in the Seventeenth International Conference on Wireless Communications and Signal Processing Oct. 23-25, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24095 2025-11-10 cs.DC 85%

SkyWalker: A Locality-Aware Cross-Region Load Balancer for LLM Inference

Tian Xia, Ziming Mao, Jamison Kerney, Ethan J. Jackson, Zhifei Li, Jiarong Xing, Scott Shenker, Ion Stoica

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01930 2025-11-10 cs.LG 83%

Efficient LLM Context Distillation

Rajesh Upadhayaya, Manish Raj Osti, Zachary Smith, Chritopher Kottmyer

机构 * School of Computer Science, Georgia Institute of Technology(计算机科学学院,佐治亚理工学院)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04412 2025-11-10 cs.AI 83%

Wider or Deeper? Scaling LLM Inference-Time Compute with Adaptive Branching Tree Search

Yuichi Inoue, Kou Misaki, Yuki Imajuku, So Kuroki, Taishi Nakamura, Takuya Akiba

机构 * Sakana AI, Japan(日本Sakana AI)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted as a spotlight at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05404 2025-11-10 cs.CV cs.AI 79%

Multi-modal Loop Closure Detection with Foundation Models in Severely Unstructured Environments

Laura Alejandra Encinar Gonzalez, John Folkesson, Rudolph Triebel, Riccardo Giubilato

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.AI

Comments Under review for ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19215 2025-11-10 cs.LG 79%

PPG-Distill: Efficient Photoplethysmography Signals Analysis via Foundation Model Distillation

Juntong Ni, Saurabh Kataria, Shengpu Tang, Carl Yang, Xiao Hu, Wei Jin

机构 * Department of Computer Science, Emory University(计算机科学系,埃默里大学) Nell Hodgson Woodruff School of Nursing, Emory University(Nell Hodgson Woodruff护理学院,埃默里大学)

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.LG

Comments Accepted at NeurIPS 2025 TS4H, we release our code publicly at https://github.com/LingFengGold/PPG-Distill

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04766 2025-11-10 cs.CV 78%

DARN: Dynamic Adaptive Regularization Networks for Efficient and Robust Foundation Model Adaptation

Dhenenjay Yadav, Rohan Sawai

机构 * AxionOrbital Space(AxionOrbital空间) Virginia Tech(弗吉尼亚理工学院)

专题命中 效率与部署 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16601 2025-11-10 cs.CV 78%

SelaVPR++: Towards Seamless Adaptation of Foundation Models for Efficient Place Recognition

Feng Lu, Tong Jin, Xiangyuan Lan, Lijun Zhang, Yunpeng Liu, Yaowei Wang, Chun Yuan

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University, Shenzhen, China(清华大学深圳国际研究生院,清华大学,深圳,中国) Pengcheng Laboratory, Shenzhen, China(鹏城实验室,深圳,中国) Shenyang Institute of Automation, Chinese Academy of Sciences, Shenyang, China(沈阳自动化研究所,中国科学院,沈阳,中国) Chongqing Institute of Green and Intelligent Technology, Chinese Academy of Sciences, Chongqing, China(重庆绿色智能技术研究所,中国科学院,重庆,中国) Pazhou Laboratory (Huangpu), Guangzhou, China(琶洲实验室(黄埔),广州,中国)

专题命中 效率与部署 :foundation model(title,abstract)

Comments accepted by T-PAMI

Journal ref IEEE Transactions on Pattern Analysis and Machine Intelligence, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04643 2025-11-10 cs.CL 77%

When retrieval outperforms generation: Dense evidence retrieval for scalable fake news detection

Alamgir Munir Qazi, John P. McCrae, Jamal Abdul Nasir

机构 * School of Computer Science, University of Galway, Ireland(Galway大学计算机科学学院) Research Ireland Insight Centre and ADAPT Centre, University of Galway, Ireland(Galway大学爱尔兰研究洞察中心和ADAPT研究中心)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Journal ref Proceedings of the 5th Conference on Language, Data and Knowledge, pages 255-265, Naples, Italy. Unior Press, September 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14450 2025-11-10 cs.SE cs.DC 75%

LLM4FaaS: No-Code Application Development using LLMs and FaaS

Minghe Wang, Tobias Pfandzelter, Trever Schirmer, David Bermbach

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted for publication in 2025 IEEE/ACM 18th International Conference on Utility and Cloud Computing

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04696 2025-11-10 cs.CL cs.AI cs.IR 73%

EncouRAGe: Evaluating RAG Local, Fast, and Reliable

Jan Strich, Adeline Scharfenberg, Chris Biemann, Martin Semmann

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Currently under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03265 2025-11-10 cs.LG cs.AI 73%

Cognitive Edge Computing: A Comprehensive Survey on Optimizing Large Models and AI Agents for Pervasive Deployment

Xubin Wang, Qing Li, Weijia Jia

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05325 2025-11-10 cs.LG 70%

Turning Adversaries into Allies: Reversing Typographic Attacks for Multimodal E-Commerce Product Retrieval

Janet Jenq, Hongda Shen

机构 * PitchBook USA(PitchBook美国公司)

专题命中 效率与部署 :language model(abstract);foundation model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05299 2025-11-10 cs.CV cs.AI 70%

LiveStar: Live Streaming Assistant for Real-World Online Video Understanding

Zhenyu Yang, Kairui Zhang, Yuhang Hu, Bing Wang, Shengsheng Qian, Bin Wen, Fan Yang, Tingting Gao, Weiming Dong, Changsheng Xu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) ShanghaiTech University(上海科技大学) Kuaishou Technology(快手科技) Peng Cheng Laboratory(鹏城实验室)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

Comments NeurIPS 2025 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05077 2025-11-10 math.ST stat.ME stat.TH 67%

Nonparametric Inference on Unlabeled Histograms

Yun Ma, Pengkun Yang

专题命中 效率与部署 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05028 2025-11-10 cs.LG cs.AI 62%

OvA-LP: A Simple and Efficient Framework for Federated Learning on Non-IID Data

Dongjin Park, Hasung Yeo, Joon-Woo Lee

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04798 2025-11-10 cs.AR cs.AI cs.ET cs.LG 62%

MDM: Manhattan Distance Mapping of DNN Weights for Parasitic-Resistance-Resilient Memristive Crossbars

Matheus Farias, Wanghley Martins, H. T. Kung

机构 * Harvard University(哈佛大学) Duke University(杜克大学)

专题命中 效率与部署 :post-training(abstract);分类 cs.AI、cs.LG

Comments 5 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03929 2025-11-10 cs.LG cs.AI cs.CV 62%

NVIDIA Nemotron Nano V2 VL

NVIDIA, :, Amala Sanjay Deshmukh, Kateryna Chumachenko, Tuomas Rintamaki, Matthieu Le, Tyler Poon, Danial Mohseni Taheri, Ilia Karmanov, Guilin Liu, Jarno Seppanen, Guo Chen, Karan Sapra, Zhiding Yu, Adi Renduchintala, Charles Wang, Peter Jin, Arushi Goel, Mike Ranzinger, Lukas Voegtle, Philipp Fischer, Timo Roman, Wei Ping, Boxin Wang, Zhuolin Yang, Nayeon Lee, Shaokun Zhang, Fuxiao Liu, Zhiqi Li, Di Zhang, Greg Heinrich, Hongxu Yin, Song Han, Pavlo Molchanov, Parth Mannan, Yao Xu, Jane Polak Scowcroft, Tom Balough, Subhashree Radhakrishnan, Paris Zhang, Sean Cha, Ratnesh Kumar, Zaid Pervaiz Bhat, Jian Zhang, Darragh Hanley, Pritam Biswas, Jesse Oliver, Kevin Vasques, Roger Waleffe, Duncan Riach, Oluwatobi Olabiyi, Ameya Sunil Mahabaleshwarkar, Bilal Kartal, Pritam Gundecha, Khanh Nguyen, Alexandre Milesi, Eugene Khvedchenia, Ran Zilberstein, Ofri Masad, Natan Bagrov, Nave Assaf, Tomer Asida, Daniel Afrimi, Amit Zuker, Netanel Haber, Zhiyu Cheng, Jingyu Xin, Di Wu, Nik Spirin, Maryam Moosaei, Roman Ageev, Vanshil Atul Shah, Yuting Wu, Daniel Korzekwa, Unnikrishnan Kizhakkemadam Sreekumar, Wanli Jiang, Padmavathy Subramanian, Alejandra Rico, Sandip Bhaskar, Saeid Motiian, Kedi Wu, Annie Surla, Chia-Chih Chen, Hayden Wolff, Matthew Feinberg, Melissa Corpuz, Marek Wawrzos, Eileen Long, Aastha Jhunjhunwala, Paul Hendricks, Farzan Memarian, Benika Hall, Xin-Yu Wang, David Mosallanezhad, Soumye Singhal, Luis Vega, Katherine Cheung, Krzysztof Pawelec, Michael Evans, Katherine Luna, Jie Lou, Erick Galinkin, Akshay Hazare, Kaustubh Purandare, Ann Guan, Anna Warno, Chen Cui, Yoshi Suhara, Shibani Likhite, Seph Mard, Meredith Price, Laya Sleiman, Saori Kaji, Udi Karpas, Kari Briski, Joey Conway, Michael Lightstone, Jan Kautz, Mohammad Shoeybi, Mostofa Patwary, Jonathen Cohen, Oleksii Kuchaiev, Andrew Tao, Bryan Catanzaro

机构 * NVIDIA

专题命中 效率与部署 :LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21005 2025-11-10 cs.LG stat.ML 57%

Efficient and Unbiased Sampling from Boltzmann Distributions via Variance-Tuned Diffusion Models

Fengzhe Zhang, Laurence I. Midgley, José Miguel Hernández-Lobato

机构 * University of Cambridge(剑桥大学) Ångström AI(安格斯特罗姆人工智能)

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05025 2025-11-10 cs.HC cs.AI 57%

8bit-GPT: Exploring Human-AI Interaction on Obsolete Macintosh Operating Systems

Hala Sheta

机构 * Department of Computer Science University of Waterloo(计算机科学系大学水力学院)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

Comments NeurIPS Creative AI Track 2025: Humanity

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04880 2025-11-10 cs.AI 57%

DMA: Online RAG Alignment with Human Feedback

Yu Bai, Yukai Miao, Dawei Wang, Li Chen, Fei Long, Rundi Zhai, Dan Li, Yanyu Ren, Tianfeng Liu, Hongtao Xie, Ce Yang, Xuhui Cai

机构 * Zhongguancun Laboratory(中关村实验室) Tsinghua University(清华大学) China Mobile Communications Group Co., Ltd.(中国移动通信集团有限公司) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 效率与部署 :LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05320 2025-11-10 q-bio.NC cs.LG 57%

Generalizable, real-time neural decoding with hybrid state-space models

Avery Hee-Woon Ryoo, Nanda H. Krishna, Ximeng Mao, Mehdi Azabou, Eva L. Dyer, Matthew G. Perich, Guillaume Lajoie

专题命中 效率与部署 :pretraining(abstract);分类 cs.LG

Comments NeurIPS 2025

Journal ref The Thirty-ninth Annual Conference on Neural Information Processing Systems, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏