arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-07 至 2025-10-07 共收录 382 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 63 篇

2510.03727 2025-10-07 cs.AI cs.CL cs.CV cs.LG 82%

Bridging the Gap Between Multimodal Foundation Models and World Models

Xuehai He

机构 * Computer Science and Engineering University of California, Santa Cruz(计算机科学与工程大学加州大学圣克ruz分校)

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments PhD thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16724 2025-10-07 cs.LG cs.AI cs.HC 81%

Advancing Brainwave Modeling with a Codebook-Based Foundation Model

Konstantinos Barmpas, Na Lee, Yannis Panagakis, Dimitrios A. Adamos, Nikolaos Laskaris, Stefanos Zafeiriou

机构 * Imperial College London(帝国理工学院伦敦分校) Cogitat National and Kapodistrian University of Athens(国家与资本主义大学雅典分校) Archimedes Research Unit(阿奇米德研究单位) Aristotle University of Thessaloniki(亚里士多德大学塞萨洛尼基分校)

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14794 2025-10-07 cs.DC cs.AI cs.LG 81%

Characterizing Mobile SoC for Accelerating Heterogeneous LLM Inference

Le Chen, Dahu Feng, Erhu Feng, Yingrui Wang, Rong Zhao, Yubin Xia, Pinjie Xu, Haibo Chen

机构 * Institute of Parallel and Distributed Systems, Shanghai Jiao Tong University(并行与分布式系统研究所,上海交通大学) Tsinghua University(清华大学) SenseTime Research(商汤科技研究院)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17322 2025-10-07 cs.CL cs.AI cs.LG 80%

From Compression to Expression: A Layerwise Analysis of In-Context Learning

Jiachen Jiang, Yuxin Dong, Jinxin Zhou, Zhihui Zhu

机构 * The corresponding author.(通讯作者)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04577 2025-10-07 cs.SD cs.LG cs.MM eess.AS 79%

Language Model Based Text-to-Audio Generation: Anti-Causally Aligned Collaborative Residual Transformers

Juncheng Wang, Chao Xu, Cheng Yu, Zhe Hu, Haoyu Xie, Guoqi Yu, Lei Shang, Shujun Wang

机构 * The Hong Kong Polytechnic University(香港理工大学) Alibaba Group(阿里巴巴集团)

专题命中 效率与部署 :language model(title,abstract);分类 cs.LG

Comments Accepted to EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04071 2025-10-07 cs.CL 79%

What Makes Diffusion Language Models Super Data Learners?

Zitian Gao, Haoming Luo, Lynx Chen, Jason Klein Liu, Ran Tao, Joey Zhou, Bryan Dai

机构 * Ubiquant

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL

Comments Technical report, work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03555 2025-10-07 cs.CV cs.AI 79%

GAS-MIL: Group-Aggregative Selection Multi-Instance Learning for Ensemble of Foundation Models in Digital Pathology Image Analysis

Peiran Quan, Zifan Gu, Zhuo Zhao, Qin Zhou, Donghan M. Yang, Ruichen Rong, Yang Xie, Guanghua Xiao

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03962 2025-10-07 cs.LG cs.AI 79%

SPEAR: Soft Prompt Enhanced Anomaly Recognition for Time Series Data

Hanzhe Wei, Jiajun Wu, Jialin Yang, Henry Leung, Steve Drew

机构 * Department of Electrical and Software Engineering(电气与软件工程系)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted to 2025 IEEE International Conference on Autonomous and Trusted Computing (ATC 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10714 2025-10-07 cs.CL cs.AI 79%

ZSMerge: Zero-Shot KV Cache Compression for Memory-Efficient Long-Context LLMs

Xin Liu, Xudong Wang, Pei Liu, Guoming Tang

机构 * Information Hub, The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学信息中心) School of Data Science, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)数据科学学院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05606 2025-10-07 cs.IR cs.AI cs.LG math.OC 79%

Exploring Applications of State Space Models and Advanced Training Techniques in Sequential Recommendations: A Comparative Study on Efficiency and Performance

Mark Obozov, Makar Baderko, Stepan Kulibaba, Nikolay Kutuzov, Alexander Gasnikov

机构 * Phystech(菲斯特技术)

专题命中 效率与部署 :large language model(abstract);language model(abstract);preference optimization(abstract);分类 cs.AI、cs.LG

Comments arXiv admin note: text overlap with arXiv:2403.07691 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16706 2025-10-07 cs.LG cs.AI cs.CL cs.SE 78%

DISC: Dynamic Decomposition Improves LLM Inference Scaling

Jonathan Light, Wei Cheng, Benjamin Riviere, Wu Yue, Masafumi Oyamada, Mengdi Wang, Yisong Yue, Santiago Paternain, Haifeng Chen

机构 * Rensselaer Polytechnic Institute(拉特克利夫理工学院) NEC Laboratories America(NEC美洲实验室) Princeton University(普林斯顿大学) California Institute of Technology(加州理工学院) NEC Corporation(NEC公司)

专题命中 效率与部署 :LLM(title);分类 cs.CL、cs.AI、cs.LG

Comments 10 pages, Accepted to NeurIPS 2025 (Conference on Neural Information Processing Systems)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04206 2025-10-07 cs.AI 77%

AgentRL: Scaling Agentic Reinforcement Learning with a Multi-Turn, Multi-Task Framework

Hanchen Zhang, Xiao Liu, Bowen Lv, Xueqiao Sun, Bohao Jing, Iat Long Iong, Zhenyu Hou, Zehan Qi, Hanyu Lai, Yifan Xu, Rui Lu, Hongning Wang, Jie Tang, Yuxiao Dong

机构 * Tsinghua University(清华大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04261 2025-10-07 cs.CR 75%

VortexPIA: Indirect Prompt Injection Attack against LLMs for Efficient Extraction of User Privacy

Yu Cui, Sicheng Pan, Yifei Liu, Haibin Zhang, Cong Zuo

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04136 2025-10-07 eess.AS cs.CV cs.SD 75%

MoME: Mixture of Matryoshka Experts for Audio-Visual Speech Recognition

Umberto Cappellazzo, Minsu Kim, Pingchuan Ma, Honglie Chen, Xubo Liu, Stavros Petridis, Maja Pantic

机构 * Imperial College London(伦敦帝国学院) Meta AI NatWest AI Research(NatWest人工智能研究)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01238 2025-10-07 cs.CL cs.LG 74%

Silent Tokens, Loud Effects: Padding in LLMs

Rom Himelstein, Amit LeVi, Yonatan Belinkov, Avi Mendelson

机构 * Department of Data and Decision Science, Technion - Israel Institute of Technology(数据与决策科学系,技术离子理工学院) Department of Computer Science, Technion - Israel Institute of Technology(计算机科学系,技术离子理工学院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG;LLM(comments)

Comments Accepted to NeurIPS 2025 Workshop on Evaluating the Evolving LLM Lifecycle: Benchmarks, Emergent Abilities, and Scaling

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04166 2025-10-07 cs.SE cs.AI 74%

Multi Language Models for On-the-Fly Syntax Highlighting

Marco Edoardo Palma, Pooja Rani, Harald C. Gall

专题命中 效率与部署 :language model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00955 2025-10-07 cs.CL cs.AI 73%

SemViQA: A Semantic Question Answering System for Vietnamese Information Fact-Checking

Dien X. Tran, Nam V. Nguyen, Thanh T. Tran, Anh T. Hoang, Tai V. Duong, Di T. Le, Phuc-Lu Le

机构 * Industrial University of Ho Chi Minh City(胡志明市工业大学) University of Science VNU-HCM(VNU-HCM大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03246 2025-10-07 cs.LG cs.AI 73%

StructPrune: Structured Global Pruning asymptotics with $\mathcal{O}(\sqrt{N})$ GPU Memory

Xinyuan Song, Guangji Bai, Liang Zhao

机构 * Emory University(埃默里大学) Amazon(亚马逊)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16901 2025-10-07 cs.CL cs.AI 73%

Char-mander Use mBackdoor! A Study of Cross-lingual Backdoor Attacks in Multilingual LLMs

Himanshu Beniwal, Sailesh Panda, Birudugadda Srivibhav, Mayank Singh

机构 * Indian Institute of Technology Gandhinagar(印度理工学院加尔各答分校)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05059 2025-10-07 cs.AI 70%

Staircase Streaming for Low-Latency Multi-Agent Inference

Junlin Wang, Jue Wang, Zhen, Xu, Ben Athiwaratkun, Bhuwan Dhingra, Ce Zhang, James Zou

机构 * Duke University(杜克大学) Together AI University of Chicago(芝加哥大学) Stanford University(斯坦福大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04717 2025-10-07 cs.CL 70%

JSON Whisperer: Efficient JSON Editing with LLMs

Sarel Duanis, Asnat Greenstein-Messica, Eliya Habba

机构 * Lightricks The Hebrew University of Jerusalem(耶路撒冷希伯来大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04710 2025-10-07 cs.LG 70%

ViTs: Teaching Machines to See Time Series Anomalies Like Human Experts

Zexin Wang, Changhua Pei, Yang Liu, Hengyue Jiang, Quan Zhou, Haotian Si, Hang Cui, Jianhui Li, Gaogang Xie, Jingjing Li, Dan Pei

机构 * Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心) Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(中国科学院大学杭州先进研究所) Tsinghua University(清华大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07634 2025-10-07 cs.RO cs.AI cs.CV 70%

Neural Brain: A Neuroscience-inspired Framework for Embodied Agents

Jian Liu, Xiongtao Shi, Thai Duy Nguyen, Haitian Zhang, Tianxiang Zhang, Wei Sun, Yanjie Li, Athanasios V. Vasilakos, Giovanni Iacca, Arshad Ali Khan, Arvind Kumar, Jae Won Cho, Ajmal Mian, Lihua Xie, Erik Cambria, Lin Wang

机构 * School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电子与电气工程学院) School of Artificial Intelligence and Robotics, Hunan University(湖南大学人工智能与机器人学院) School of Intelligence Science and Engineering, Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)智能科学与工程学院) Department of Information and Communication Technology, University of Agder(阿格德大学信息与通信技术系) Department of Information Engineering and Computer Science, University of Trento(特伦特大学信息工程与计算机科学系) Elm Company(Elm公司) Division of Computational Science and Technology, KTH Royal Institute of Technology(皇家理工学院计算科学与技术系) School of Artificial Intelligence and Data Science, Sejong University(世宗大学人工智能与数据科学学院) Department of Computer Science of the University of Western Australia(西澳大学计算机科学系) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 51 pages, 17 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04528 2025-10-07 cs.CR cs.AI 70%

Unified Threat Detection and Mitigation Framework (UTDMF): Combating Prompt Injection, Deception, and Bias in Enterprise-Scale Transformers

Santhosh KumarRavindran

机构 * Microsoft Corporation(微软公司)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04162 2025-10-07 eess.AS cs.LG cs.SD 70%

Drax: Speech Recognition with Discrete Flow Matching

Aviv Navon, Aviv Shamsian, Neta Glazer, Yael Segal-Feldman, Gill Hetz, Joseph Keshet, Ethan Fetaya

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03808 2025-10-07 cs.CL 70%

Annotate Rhetorical Relations with INCEpTION: A Comparison with Automatic Approaches

Mehedi Hasan Emon

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18564 2025-10-07 cs.CR cs.AI 70%

DualBreach: Efficient Dual-Jailbreaking via Target-Driven Initialization and Multi-Target Optimization

Xinzhe Huang, Kedong Xiu, Tianhang Zheng, Churui Zeng, Wangze Ni, Zhan Qin, Kui Ren, Chun Chen

机构 * State Key Laboratory of Blockchain and Data Security, Zhejiang University, Hangzhou, China(区块链与数据安全国家重点实验室,浙江大学,杭州,中国) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security, Hangzhou, China(杭州高新技术区(滨江)区块链与数据安全研究院,杭州,中国)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 20 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12887 2025-10-07 cs.CL 70%

Enhancing Unsupervised Sentence Embeddings via Knowledge-Driven Data Augmentation and Gaussian-Decayed Contrastive Learning

Peichao Lai, Zhengfeng Zhang, Wentao Zhang, Fangcheng Fu, Bin Cui

机构 * School of Computer Science, Peking University(北京大学计算机科学学院) College of Computer and Data Science, Fuzhou University(福州大学计算机与数据科学学院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04286 2025-10-07 cs.CL cs.AI cs.LG 67%

SliceMoE: Routing Embedding Slices Instead of Tokens for Fine-Grained and Balanced Transformer Scaling

Harshil Vejendla

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2025 Main, 8 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16322 2025-10-07 cs.LG cs.AI cs.CL 67%

AdaSTaR: Adaptive Data Sampling for Training Self-Taught Reasoners

Woosung Koh, Wonbeen Oh, Jaein Jang, MinHyung Lee, Hyeongjin Kim, Ah Yeon Kim, Joonkee Kim, Junghyun Lee, Taehyeon Kim, Se-Young Yun

机构 * KAIST AI(韩国科学技术院人工智能研究所) LG AI Research(LG人工智能研究)

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏