arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-03 至 2026-02-03 共收录 608 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 146 篇

2505.10860 2026-02-03 cs.LG stat.ML 70%

On DeepSeekMoE: Statistical Benefits of Shared Experts and Normalized Sigmoid Gating

关于DeepSeekMoE:共享专家和规范化Sigmoid门控的统计收益

Huy Nguyen, Thong T. Doan, Quang Pham, Nghi D. Q. Bui, Nhat Ho, Alessandro Rinaldo

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 DeepSeekMoE通过共享专家策略和规范化Sigmoid门控机制提升模型效率和性能。

Comments 97 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19420 2026-02-03 cs.LG 70%

UniGAP: A Universal and Adaptive Graph Upsampling Approach to Mitigate Over-Smoothing in Node Classification Tasks

UniGAP: 一种通用且自适应的图上采样方法以缓解节点分类任务中的过平滑问题

Xiaotang Wang, Yun Zhu, Haizhou Shi, Yongchao Liu, Yongqi Zhang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Rutgers University(罗格斯大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 UniGAP通过自适应图上采样缓解节点分类任务中的过平滑问题,提升模型性能并启发进一步研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00182 2026-02-03 cs.CR cs.AI 70%

EigenAI: Deterministic Inference, Verifiable Results

EigenAI:确定性推理,可验证结果

David Ribeiro Alves, Vishnu Patankar, Matheus Pereira, Jamie Stephens, Nima Vaziri, Sreeram Kannan

机构 * EigenAI

专题命中 效率与部署 :LLM(abstract);language model(abstract);分类 cs.AI

AI总结 EigenAI 是一个基于 EigenLayer 构建的可验证 AI 平台,结合确定性推理引擎和加密经济安全协议,实现可审计、可重现的 AI 推理结果,支持主权代理在安全性和性能上取得突破。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00014 2026-02-03 cs.DC cs.AI 70%

What Artificial Intelligence can do for High-Performance Computing systems?

人工智能能为高性能计算系统带来什么?

Pierrick Pochelu, Hyacinthe Cartiaux, Julien Schleich

机构 * University of Luxembourg(卢森堡大学)

专题命中 效率与部署 :LLM(abstract);language model(abstract);分类 cs.AI

AI总结 本文探讨人工智能在提升高性能计算系统效率中的作用,涵盖调度、性能优化、故障检测等六个应用领域,并指出LLM在自动化任务中的优势及MLOps的发展需求。

Journal ref Engineering Applications of Artificial Intelligence, Volume 164, Part B, 15 January 2026, 113248

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01836 2026-02-03 cs.CV 67%

Efficient Cross-Country Data Acquisition Strategy for ADAS via Street-View Imagery

通过街景影像实现ADAS的高效跨国数据采集策略

Yin Wu, Daniel Slieter, Carl Esselborn, Ahmed Abouelazm, Tsung Yuan Tseng, J. Marius Zöllner

机构 * CARIAD SE Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) Esslingen University of Applied Sciences(埃森哲应用科学大学) FZI Research Center for Information Technology(弗劳恩霍夫信息技术研究中心)

专题命中 效率与部署 :language model(abstract);foundation model(abstract)

AI总结 本文提出基于街景影像的高效跨国ADAS数据采集策略,通过两种POI评分方法提升数据采集效率,实验表明在使用较少数据的情况下能实现与随机采样相当的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21770 2026-02-03 cs.IR 67%

OneMall: One Architecture, More Scenarios -- End-to-End Generative Recommender Family at Kuaishou E-Commerce

OneMall: 一个架构,更多场景 -- 快手电商的端到端生成推荐系统

Kun Zhang, Jingming Zhang, Wei Cheng, Yansong Cheng, Jiaqi Zhang, Hao Lu, Xu Zhang, Haixiang Gan, Jiangxia Cao, Tenglong Wang, Ximing Zhang, Boyang Xia, Kuo Cai, Shiyao Wang, Hongjian Dou, Jinkai Yu, Mingxing Wen, Qiang Luo, Dongxu Liang, Chenyi Lei, Jun Wang, Runan Liu, Zhaojie Liu, Ruiming Tang, Tingting Gao, Shaoguo Liu, Yuqing Ding, Hui Kong, Han Li, Guorui Zhou, Wenwu Ou, Kun Gai

专题命中 效率与部署 :LLM(abstract);post-training(abstract)

AI总结 OneMall通过统一的架构提升电商多场景推荐效果,利用Transformer和强化学习技术实现端到端生成推荐系统。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09260 2026-02-03 cs.NE 67%

From Forecast to Action: Uncertainty-Aware UAV Deployment for Ocean Drifter Recovery

从预测到行动:面向海洋漂流体回收的不确定性感知无人机部署

Jingeun Kim, Yong-Hyuk Kim, Yourim Yoon

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 本文提出一种结合轨迹预测与空间优化的无人机部署方法,通过动态调整探测半径和元启发式算法提升海洋漂流体回收效率。

Comments This paper has been accepted by CIKM 2025 STIntelligence Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02486 2026-02-03 cs.CL cs.AI 62%

RE-TRAC: REcursive TRAjectory Compression for Deep Search Agents

RE-TRAC: 递归轨迹压缩用于深度搜索代理

Jialiang Zhu, Gongrui Zhang, Xiaolong Ma, Lin Xu, Miaosen Zhang, Ruiqi Yang, Song Wang, Kai Qiu, Zhirong Wu, Qi Dai, Ruichun Ma, Bei Liu, Yifan Yang, Chong Luo, Zhengyuan Yang, Linjie Li, Lijuan Wang, Weizhu Chen, Xin Geng, Baining Guo

机构 * Southeast University(东南大学) Waseda University(早稻田大学) Tsinghua University(清华大学) Brown University(布朗大学) Zhejiang University(浙江大学) Microsoft(微软)

专题命中 效率与部署 :LLM(abstract);分类 cs.CL、cs.AI

AI总结 Re-TRAC通过递归轨迹压缩提升深度搜索代理的效率,实现跨轨迹探索与全局规划,显著优于ReAct框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22563 2026-02-03 cs.LG cs.AI 62%

EUGens: Efficient, Unified, and General Dense Layers

EUGens: 高效、统一和通用的密集层

Sang Min Kim, Byeongchan Kim, Arijit Sehanobish, Somnath Basu Roy Chowdhury, Rahul Kidambi, Dongseok Shim, Avinava Dubey, Snigdha Chaturvedi, Min-hwan Oh, Krzysztof Choromanski

专题命中 效率与部署 :language model(abstract);分类 cs.AI、cs.LG

AI总结 EUGens通过引入随机特征和输入范数依赖,实现高效、统一且通用的密集层,提升模型推断速度和内存效率。

Comments We want to update 2410.09771 with this submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22037 2026-02-03 cs.AI cs.LG 62%

Optimizing Agentic Workflows using Meta-tools

利用元工具优化代理工作流

Sami Abuzakuk, Anne-Marie Kermarrec, Rishi Sharma, Rasmus Moorits Veski, Martijn de Vos

机构 * EPFL, Switzerland(瑞士联邦理工学院)

专题命中 效率与部署 :LLM(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出AWO框架,通过识别并优化重复的工具执行模式,减少LLM调用次数并提高代理工作流的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18877 2026-02-03 cs.IR cs.AI cs.LG 62%

Optimization of Latent-Space Compression using Game-Theoretic Techniques for Transformer-Based Vector Search

基于博弈论技术的Transformer向量搜索中潜在空间压缩优化

Kushagra Agrawal, Nisharg Nargund, Oishani Banerjee

机构 * School of Computer Engineering, KIIT Deemed to be University, Bhubaneswar, Odisha - India(计算机工程学院,KIIT大学,巴胡瓦斯瓦尔,奥里萨-印度)

专题命中 效率与部署 :LLM(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于博弈论的潜在空间压缩优化方法,通过平衡检索准确性和存储效率,提升Transformer向量搜索的效率和语义效用。

Journal ref In: Proceedings of the International Conference on Distributed Computing and Intelligent Technology (ICDCIT), Springer, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01459 2026-02-03 cs.CV cs.AI cs.LG 62%

Understanding vision transformer robustness through the lens of out-of-distribution detection

通过分布外检测视角理解视觉变换器的鲁棒性

Joey Kuang, Alexander Wong

机构 * Vision and Image Processing Research Group, Department of Systems Design Engineering University of Waterloo(图像与图像处理研究组,系统设计工程系,滑铁卢大学)

专题命中 效率与部署 :pretraining(abstract);分类 cs.AI、cs.LG

AI总结 研究通过分析不同视觉变换器在分布外检测中的表现,发现大规模预训练可能降低低比特量化鲁棒性,数据增强更具优势。

Comments Accepted to JCVIS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01217 2026-02-03 cs.LG cs.AI cs.CR cs.DB 62%

Learning from Anonymized and Incomplete Tabular Data

从匿名和不完整表格数据中学习

Lucas Lange, Adrian Böttinger, Victor Christen, Anushka Vidanage, Peter Christen, Erhard Rahm

机构 * Leipzig University \& ScaDS.AI Leipzig Germany The Australian National University Canberra Australia Leipzig University \& ScaDS.AI The Australian National University

专题命中 效率与部署 :LLM(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种新的数据转换策略,用于处理包含匿名和缺失值的表格数据,通过实验表明一致的数据表示对保持下游实用性至关重要。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00792 2026-02-03 cs.LG cs.AI 62%

Latent Shadows: The Gaussian-Discrete Duality in Masked Diffusion

潜在阴影:掩码扩散中的高斯-离散对偶性

Guinan Chen, Xunpeng Huang, Ying Sun, Shijin Wang, Yanyong Zhang, Chao Wang

机构 * University of Science The Hong Kong University of Science State Key Laboratory of Cognitive Intelligence \& iFLYTEK AI Research, Hefei, China

专题命中 效率与部署 :language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出掩码扩散对偶性及MCD框架,通过高斯过程投影和确定性轨迹构建,实现16倍推理加速且不降低生成质量。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14027 2026-02-03 cs.LG cs.AI 62%

Context-Selective State Space Models: Feedback is All You Need

基于上下文的选择性状态空间模型:反馈就是一切

Riccardo Zattra, Giacomo Baggio, Umberto Casti, Augusto Ferrante, Francesco Ticozzi

机构 * Department of Information Engineering University of Padova(信息工程系帕多瓦大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 COFFEE通过引入状态反馈机制,实现基于上下文的选择性状态空间模型,显著提升了长距离依赖捕捉能力,参数效率高,适用于序列建模任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13192 2026-02-03 cs.LG cs.AI math.DS nlin.CD 62%

True Zero-Shot Inference of Dynamical Systems Preserving Long-Term Statistics

动态系统长期统计的真正零样本推断

Christoph Jürgen Hemmer, Daniel Durstewitz

机构 * Dept. of Theoretical Neuroscience, Central Institute of Mental Health, Medical Faculty Mannheim, Heidelberg University, Mannheim, Germany(理论神经科学系,心理健康中央研究所,曼海姆医学系,海德堡大学,曼海姆,德国) Interdisciplinary Center for Scientific Computing (IWR), Heidelberg University, Germany(跨学科科学计算中心(IWR),海德堡大学,德国) Faculty of Physics and Astronomy, Heidelberg University, Heidelberg, Germany(物理和天文学学院,海德堡大学,海德堡,德国)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 DynaMix是一种预训练的多变量ALRNN混合架构,能够实现动态系统长期统计的零样本推断,显著优于现有时间序列基础模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00476 2026-02-03 cs.LG cs.CL 62%

Diffusion LMs Can Approximate Optimal Infilling Lengths Implicitly

扩散语言模型可以隐式地近似最优填充长度

Hengchang Liu, Zhao Yang, Bing Su

机构 * ruc(中国人民大学)

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.LG

AI总结 CAL方法通过隐式近似最优填充长度,提升代码和文本填充任务的性能,无需额外训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02338 2026-02-03 cs.IR cs.AI 57%

Rethinking Generative Recommender Tokenizer: Recsys-Native Encoding and Semantic Quantization Beyond LLMs

重新思考生成推荐器分词器:面向Recsys的原生编码和语义量化超越LLMs

Yu Liang, Zhongjin Zhang, Yuxuan Zhu, Kerui Zhang, Zhiluohan Guo, Wenhang Zhou, Zonqi Yang, Kangle Wu, Yabo Ni, Anxiang Zeng, Cong Fu, Jianxin Wang, Jiazhi Xia

机构 * Central South University, Changsha, China(中南大学) Shopee Pte. Ltd., Shanghai, China(Shopee(上海)有限公司) Shopee Pte. Ltd., Singapore, Singapore(Shopee(新加坡)有限公司) Nanyang Technological University, Singapore, Singapore(南洋理工大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI

AI总结 ReSID通过原生编码和语义量化提升推荐系统性能,实现比现有方法高超10%的准确率并大幅降低分词成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02110 2026-02-03 cs.LG cs.CV 57%

An Empirical Study of World Model Quantization

世界模型量化经验研究

Zhongqian Fu, Tianyi Zhao, Kai Han, Hang Zhou, Xinghao Chen, Yunhe Wang

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

AI总结 本研究通过DINO-WM案例系统探讨世界模型量化的影响,发现量化方法对模型稳定性、精度和任务成功率有显著影响,揭示了不同量化策略下的失败模式及部署指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02071 2026-02-03 cs.LG 57%

BAPS: A Fine-Grained Low-Precision Scheme for Softmax in Attention via Block-Aware Precision reScaling

BAPS: 一种针对注意力机制中softmax的细粒度低精度方案 via 块意识精度重标定

Zisheng Ye, Xiaoyu He, Maoyuan Song, Guoliang Qiu, Chao Liao, Chen Wu, Yonggang Sun, Zhichun Li, Xiaoru Xie, Yuanyong Luo, Hu Liu, Pinyan Lu, Heng Liao

机构 * Taylor Lab, Huawei(华为塔利实验室) HiSilicon, Huawei(华为海思) Key Laboratory of Interdisciplinary Research of Computation and Economics(计算与经济学交叉研究重点实验室)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 BAPS提出了一种细粒度低精度方案,通过块意识精度重标定和HiF8格式实现高效softmax,减少数据带宽和指数运算单元面积,提升Transformer推理吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01466 2026-02-03 stat.ML cs.LG 57%

Rethinking Multinomial Logistic Mixture of Experts with Sigmoid Gating Function

重新思考带有Sigmoid门函数的多项逻辑混合专家模型

Tuan Minh Pham, Thinh Cao, Viet Nguyen, Huy Nguyen, Nhat Ho, Alessandro Rinaldo

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) Purdue University(普渡大学) Hanoi University of Science and Technology(河内科学技术大学)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 本文重新思考了带有Sigmoid门函数的多项逻辑混合专家模型,通过分析和改进门控函数,提高了模型的样本效率和收敛性。

Comments Tuan Minh Pham, Thinh Cao, and Viet Nguyen contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01271 2026-02-03 cs.LG 57%

From Intents to Actions: Agentic AI in Autonomous Networks

从意图到动作:自主网络中的代理AI

Burak Demirel, Pablo Soldati, Yu Wang

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 本文提出一种代理AI系统,用于自主网络中将高层意图转化为具体控制动作,通过三个专门代理实现意图解析、优化和控制,以满足多样化的网络需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01008 2026-02-03 eess.AS cs.CL cs.SD 57%

Adapting Where It Matters: Depth-Aware Adaptation for Efficient Multilingual Speech Recognition in Low-Resource Languages

适应关键领域:面向低资源语言的深度感知适应以实现高效的多语言语音识别

Yang Xiao, Eun-Jung Holden, Ting Dang

机构 * The University of Melbourne(墨尔本大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.CL

AI总结 DAMA通过深度感知适应框架,针对不同层的适应需求优化参数,实现低资源语言高效多语言语音识别。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01000 2026-02-03 cs.CV cs.LG 57%

CortiNet: A Physics-Perception Hybrid Cortical-Inspired Dual-Stream Network for Gallbladder Disease Diagnosis from Ultrasound

CortiNet:一种融合物理感知的类人双流网络用于从超声波诊断胆囊疾病

Vagish Kumar, Souvik Chakraborty

机构 * Department of Applied Mechanics(应用力学系) Yardi School of Artificial Intelligence (ScAI)(人工智能学院) Indian Institute of Technology Delhi(德里印度理工学院)

专题命中 效率与部署 :prompting(abstract);分类 cs.LG

AI总结 CortiNet通过融合物理感知的类人双流网络,实现高精度胆囊疾病诊断,具有轻量级和高效特征学习的特点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00852 2026-02-03 cs.LG 57%

Investigating the Robustness of Subtask Distillation under Spurious Correlation

探究在虚假相关性下的子任务蒸馏鲁棒性

Pattarawat Chormai, Klaus-Robert Müller, Grégoire Montavon

机构 * 1Machine Learning Group, Technische Universit\" a t Berlin (TU Berlin), 10587 Berlin, Germany 2Konrad Zuse School of Excellence in Learning Intelligent Systems (ELIZA), 64289 Darmstadt, Germany 3BIFOLD\,--\,Berlin Institute for the Foundations of Learning Data, 10587 Berlin, Germany 4Department of Artificial Intelligence, Korea University, Seoul 136-713, Korea 5Max Planck Institute for Informatics, 66123 Saarbr \"u cken, Germany 6Institute for AI in Medicine, Charit\'e\,--\,Universit\"atsmedizin Berlin, 10115 Berlin, Germany

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 本文研究了在存在虚假相关性的数据下,子任务蒸馏方法的鲁棒性,发现先进方法如SubDistill仍保持稳健,而基础方法性能显著下降。

Comments 7 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00534 2026-02-03 cs.LG cs.SY eess.SY 57%

AIRE-Prune: Asymptotic Impulse-Response Energy for State Pruning in State Space Models

AIRE-Prune:用于状态空间模型中状态剪枝的渐近脉冲响应能量

Apurba Prasad Padhy, Fernando Camacho, Saibal Mukhopadhyay

机构 * Georgia Institute of Technology(佐治亚理工学院) Laboratory for Physical Sciences(物理科学实验室)

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

AI总结 AIRE-Prune通过渐近脉冲响应能量评分实现状态空间模型的状态剪枝,有效降低计算成本并保持高精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19149 2026-02-03 cs.LG q-bio.QM 57%

GPCR-Filter: a deep learning framework for efficient and precise GPCR modulator discovery

GPCR-Filter: 一种用于高效且精确发现GPCR调节剂的深度学习框架

Jingjie Ning, Xiangzhen Shen, Li Hou, Shiyi Shen, Jiahao Yang, Junrui Li, Hong Shan, Sanan Wu, Sihan Gao, H. Eric Xu, Xinheng He

机构 * The State Key Laboratory of Drug Research, Shanghai Institute of Materia Medica, Chinese Academy of Sciences, Shanghai, China(中国科学院上海药物研究所国家药物研究重点实验室) School of Computer Science, Carnegie Mellon University, Pittsburgh, PA 15213, USA(卡内基梅隆大学计算机科学学院) College of Computer Science and Electronic Engineering, Hunan University, Changsha, Hunan(湖南大学计算机科学与电子工程学院) Lingang Laboratory, Shanghai, China(上海灵冈实验室) Research Center for Medicinal Structural Biology, National Research Center for Translational Medicine at Shanghai, State Key Laboratory of Medical Genomics, Ruijin Hospital, Shanghai Jiao Tong University School of Medicine, Shanghai, China(上海 translational 医学研究中心,国家医学基因组学重点实验室,瑞金医院,上海交通大学医学院,上海,中国) School of Pharmacy, Fudan University, Shanghai 201203, China(复旦大学药学院)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 GPCR-Filter通过深度学习框架高效精准发现GPCR调节剂,结合蛋白质语言模型和图神经网络,实现对受体-配体功能关系的学习,提升药物开发效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12638 2026-02-03 cs.CV cs.AI 57%

Mixed Precision PointPillars for Efficient 3D Object Detection with TensorRT

混合精度PointPillars用于基于TensorRT的高效3D目标检测

Ninnart Fuengfusin, Keisuke Yoneda, Naoki Suganuma

机构 * Advanced Mobility Research Institute(先进移动研究院) Kanazawa University(金泽大学)

专题命中 效率与部署 :post-training(abstract);分类 cs.AI

AI总结 本文提出混合精度PointPillars框架,结合TensorRT实现高效3D目标检测,通过量化感知训练和贪心搜索优化模型性能,降低延迟达2.538倍。

Comments 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20677 2026-02-03 cs.LG 57%

Stability of In-Context Learning: A Spectral Coverage Perspective

上下文学习的稳定性:从谱覆盖视角出发

Tongxi Wang, Zhuoyang Xia

机构 * School of Future Technology, Southeast University, Nanjing, China(未来技术学院,东南大学,南京,中国)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 本文从谱覆盖视角提出可计算的充分条件,通过非渐近样本大小要求和两阶段估计器,为上下文学习的提示长度设计提供保守且可验证的指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02204 2026-02-03 cs.DC 50%

vLLM-Omni: Fully Disaggregated Serving for Any-to-Any Multimodal Models

vLLM-Omni: 任何到任何多模态模型的完全解耦服务

Peiqi Yin, Jiangyun Zhu, Han Gao, Chenguang Zheng, Yongxiang Huang, Taichang Zhou, Ruirui Yang, Weizhi Liu, Weiqing Chen, Canlin Guo, Didan Deng, Zifeng Mo, Cong Wang, James Cheng, Roger Wang, Hongsheng Liu

专题命中 效率与部署 :LLM(abstract)

AI总结 vLLM-Omni通过解耦服务系统优化多模态模型的高效服务,显著提升作业完成时间效率。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏