arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-06-02 至 2026-06-02 共收录 832 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 151 篇

2505.12741 2026-06-02 cs.AI 83%

Language Model Networks: Supervision-Efficient Learning through Dense Communication

语言模型网络:通过密集通信实现监督高效学习

Shiguang Wu, Yaqing Wang, Quanming Yao

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract_cn);分类 cs.AI

AI总结 提出LMNet,一种密集可微的语言模型网络,通过可训练的序列到序列模块作为通信边,实现节点间密集向量交换,支持端到端梯度优化和高效信息传递,在有限监督下实现有效适应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09566 2026-06-02 cs.CV cs.AI 83%

Hot-Start Chinese Language Modeling:Visual Glyphs Accelerate Sample-Efficient Learning

热启动中文语言建模:视觉字形加速样本高效学习

Shuyang Xiang, Hao Guan

机构 * Independent Researcher(独立研究者) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract_cn);分类 cs.AI

AI总结 本文通过将汉字渲染为视觉字形图像,研究其对字符级语言建模的归纳偏置,发现视觉输入产生显著的热启动效应,但最终精度与基于索引的方法一致。

Comments 15 pages, 5 figures, submitted to ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01723 2026-06-02 cs.LG cs.AI 82%

Shortcut to Nowhere: Demystifying Deep Spurious Regression

捷径通往虚无:揭秘深度虚假回归

Guanrong Xu, Jessica Li, Hao Wang, Yuzhe Yang

机构 * University of California, Los Angeles(加州大学洛杉矶分校) Rutgers University(罗格斯大学) Yang AI Lab(杨人工智能实验室)

专题命中 效率与部署 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 针对连续预测中的虚假相关性,提出利用标签和特征空间中虚假属性的相似性来校准分布,从而提升模型在分布偏移下的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01640 2026-06-02 cs.AI cs.CL 82%

MobEvolve: An Agentic Self-Evolving Heuristic System for Interpretable Human Mobility Generation

MobEvolve:用于可解释人类移动性生成的智能体自进化启发式系统

Junlin He, Yihong Tang, Tong Nie, Ao Qu, Yuebing Liang, Hamzeh Alizadeh, Bang Liu, Wei Ma, Lijun Sun

机构 * The Hong Kong Polytechnic University(香港理工大学) McGill University(麦吉尔大学) MIT(麻省理工学院) Tsinghua University(清华大学) Autorité régionale de transport métropolitain(大都会交通地区管理局) Université de Montréal(蒙特利尔大学) Mila – Quebec AI Institute(魁北克人工智能研究所)

专题命中 效率与部署 :LLM(summary_cn,abstract);分类 cs.CL、cs.AI

AI总结 提出MobEvolve,首个智能体自进化启发式框架,通过LLM代理迭代演化内部逻辑,在保持可解释性和推理效率的同时,在个体轨迹保真度、群体分布对齐和行为合理性上超越现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01617 2026-06-02 cs.CL cs.AI 82%

EvoPool: Evolutionary Programmatic Annotation for Label-Efficient Specialized Supervision

EvoPool: 面向标签高效专业监督的进化式程序化标注

Tianyi Xu, Yaolun Zhang, Xuan Ouyang, Huazheng Wang

机构 * Oregon State University(俄勒冈州立大学) University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

专题命中 效率与部署 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出进化多智能体框架EvoPool,通过程序化标注器迭代进化与投票聚合,在低标注成本下显著提升专业领域监督性能。

Comments 39 pages, 7 figures. Code: https://github.com/tianyi0216/EvoPool

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01019 2026-06-02 cs.CL cs.AI 82%

Hybrid Verified Decoding: Learning to Allocate Verification in Speculative Decoding

混合验证解码:在推测解码中学习分配验证

Xin Su, Dawid Majchrowski, Fangyuan Yu, Vanshil Atul Shah, Sebastian Rogawski, Pawel Morkisz, Anahita Bhiwandiwalla, Phillip Howard

机构 * Thoughtworks Nvidia

专题命中 效率与部署 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出混合验证解码方法,通过预测缓存草稿的接受长度并在缓存验证与模型草稿之间动态选择,在代理工作流中平均加速2.73倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23881 2026-06-02 cs.LG cs.CL 82%

LK Losses: Direct Acceptance Rate Optimization for Speculative Decoding

LK损失:用于推测解码的直接接受率优化

Alexander Samarin, Sergei Krutikov, Anton Shevtsov, Sergei Skvortsov, Filipp Fisin, Alexander Golubev

专题命中 效率与部署 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 针对推测解码中标准KL散度训练不能最大化接受率的问题,提出LK损失直接优化接受率,实验表明在多种架构和模型上一致提升接受指标。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14849 2026-06-02 cs.LG cs.AI cs.DC cs.MA 82%

Atomix: Timely, Transactional Tool Use for Reliable Agentic Workflows

Atomix: 用于可靠智能体工作流的及时事务性工具使用

Bardia Mohammadi, Nearchos Potamitis, Lars Klein, Akhil Arora, Laurent Bindschaedler

机构 * Max Planck Institute for Software Systems(马克斯·普朗克软件系统研究所) Aarhus University(奥胡斯大学) EPFL(苏黎世联邦理工学院)

专题命中 效率与部署 :LLM(summary_cn,abstract);分类 cs.AI、cs.LG

AI总结 针对LLM智能体多步工作流中因故障、推测和并发导致的状态不一致问题,提出Atomix系统,通过进度感知事务将效果分组与冲突解决分离,实现可靠提交与回滚。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00966 2026-06-02 cs.MA 82%

Symphony-Coord: Adaptive Routing for Multi-Agent LLM Systems

Symphony-Coord:多智能体大语言模型系统的自适应路由

Zhaoyang Guan, Huixi Cao, Ming Zhong, Yin Wang, Guanyu Liu, Eric Yang, Lynn Ai, Yongxin Ni, Bill Shi

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract)

AI总结 针对多智能体大语言模型系统中静态路由和集中控制导致的低效与脆弱性问题,提出基于在线多臂赌博机的去中心化协调框架Symphony-Coord,通过两阶段动态信标协议和自适应LinUCB选择器实现子任务路由,并证明亚线性遗憾界。

Comments 41 pages,15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23351 2026-06-02 cs.CV 82%

CountGD++: Generalized Prompting for Open-World Counting

CountGD++: 面向开放世界计数的通用提示

Niki Amini-Naieni, Andrew Zisserman

机构 * Visual Geometry Group (VGG)(视觉几何组(VGG)) University of Oxford, UK(牛津大学,英国)

专题命中 效率与部署 :prompting(title);LLM(abstract,abstract_cn)

AI总结 提出CountGD++模型,通过扩展提示方式(包括负样本描述、伪示例自动标注和外部图像示例)提升开放世界计数的灵活性、准确性和泛化能力。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02100 2026-06-02 cs.CL 81%

PortBERT: Navigating the Depths of Portuguese Language Models

PortBERT:探索葡萄牙语语言模型的深度

Raphael Scheible-Schmitt, Henry He, Armando B. Mendes

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL;large language model(journal_ref)

AI总结 本文提出PortBERT,一种基于RoBERTa的葡萄牙语语言模型家族,通过字节级BPE分词和稳定预训练在超过450GB数据上训练,在ExtraGLUE基准上达到竞争性能,并重点分析了训练和推理效率。

Journal ref Proceedings of the Workshop on Beyond English: Natural Language Processing for all Languages in an Era of Large Language Models, 2025, pp. 59-71

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00953 2026-06-02 cs.LG cs.MA 81%

When Parallelism Pays Off: Cohesion-Aware Task Partitioning for Multi-Agent Coding

当并行性有回报时:面向多智能体编码的凝聚力感知任务划分

Xu Yang, Lunyiu Nie, Ethan Chandra, Stanislav Gannutin, Fangru Lin, Swarat Chaudhuri

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Oxford(牛津大学)

专题命中 效率与部署 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 提出Co-Coder方法,通过静态分析构建依赖图、社区检测划分图及依赖感知调度,在仓库级软件工程中平衡通信与计算开销,实现多智能体并行编码的效率和成本优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25246 2026-06-02 cs.AI 81%

FrontierOR: Benchmarking LLMs' Capacity for Efficient Algorithm Design in Large-Scale Optimization

FrontierOR:基准测试大语言模型在大规模优化中高效算法设计的能力

Minwei Kong, Chonghe Jiang, Ao Qu, Wenbin Ouyang, Zhaoming Zeng, Xiaotong Guo, Zhekai Li, Junyi Li, Yi Fan, Xinshou Zheng, Xi Jing, Yikai Zhang, Zhiwei Liang, Seonghoo Kim, Runqing Yang, Zijian Zhou, Sirui Li, Han Zheng, Wangyang Ying, Ou Zheng, Chonghuan Wang, Jinglong Zhao, Hanzhang Qin, Cathy Wu, Paul Pu Liang, Jinhua Zhao, Hai Wang

机构 * Singapore-MIT Alliance for Research and Technology(新加坡-麻省理工联盟研究技术) Massachusetts Institute of Technology(麻省理工学院) Northeastern University(东北大学) Uber Shanghai Jiaotong University(上海交通大学) Boston University(波士顿大学) Emory University(埃默里大学) Northwestern University(西北大学) National University of Singapore(国立新加坡大学) Microsoft(微软) University of Texas at Dallas(德克萨斯大学达拉斯分校) Singapore Management University(新加坡管理学院)

专题命中 效率与部署 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出FrontierOR基准,系统评估大语言模型在现实大规模优化问题中设计可扩展算法(而非仅生成求解器代码)的能力,发现最强模型仅在31%案例中优于Gurobi。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07223 2026-06-02 cs.LG 81%

Vegas: Self-Speculative Decoding with Verification-Guided Sparse Attention

Vegas: 验证引导稀疏注意力的自推测解码

Yikang Yue, Yuqi Xue, Jian Huang

机构 * National University of Singapore(新加坡国立大学)

专题命中 效率与部署 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 提出Vegas方法,利用验证过程自然识别关键KV缓存条目,并仅对这些条目进行稀疏注意力计算,从而提升自推测解码的吞吐量。

Comments Accepted to ICML'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05871 2026-06-02 cs.AI 81%

Agent Guide: A Simple Agent Behavioral Watermarking Framework

Agent Guide:一种简单的智能体行为水印框架

Kaibo Huang, Zipei Zhang, Zhongliang Yang, Linna Zhou

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 效率与部署 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对智能体行为难以标记和转换的问题,提出Agent Guide框架,通过概率偏差引导智能体高层决策嵌入水印,并利用z统计量检测,实现低误报率的水印嵌入与提取。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02511 2026-06-02 cs.AI cs.MA 81%

Stop Wandering, Find the Keys: LLMs Discriminate Key States for Efficient Multi-Agent Exploration

停止徘徊,找到关键:LLMs 辨别关键状态以实现高效多智能体探索

Yun Qu, Boyuan Wang, Yuhang Jiang, Jianzhun Shao, Yixiu Mao, Heming Zou, Chang Liu, Cheems Wang, Meiqin Liu, Xiangyang Ji

机构 * Department of Automation, Tsinghua University, Beijing 100084, China(清华大学自动化系) College of Electrical Engineering, Zhejiang University, Hangzhou 310027, China(浙江大学电气工程学院) National Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Xi’an Jiaotong University, Xi’an 710049, China(西安交通大学人机混合增强智能国家级重点实验室)

专题命中 效率与部署 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出 LEMAE 方法,利用大语言模型辨别关键状态并设计子空间内在奖励和关键状态记忆树,引导多智能体高效探索,在 SMAC 和 MPE 基准上显著超越现有方法,实现 10 倍加速。

Journal ref SCIENCE CHINA Information Sciences 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00722 2026-06-02 cs.CL cs.AI 81%

EPIC: Efficient and Parallel Inference under CFG Constraints for Diffusion Language Models

EPIC: 扩散语言模型在上下文无关文法约束下的高效并行推理

Hyundong Jin, Yo-Sub Han

机构 * Yonsei University(延世大学)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 提出EPIC框架,通过词法记忆化、Earley解析验证和松弛兼容子集选择,解决扩散语言模型在CFG约束解码中的低效和并行性损失问题,推理时间降低67.5%,额外开销减少90.5%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29233 2026-06-02 cs.LG cs.AI 81%

BlockBatch: Multi-Scale Consensus Decoding for Efficient Diffusion Language Model Inference

BlockBatch: 面向高效扩散语言模型推理的多尺度共识解码

Xiaoyou Wu, Cheng-Jhih Shih, Binfei Ji, Yong Liu, Yingyan Celine Lin

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI、cs.LG

AI总结 提出BlockBatch框架,通过多分支并行解码和置信度门控合并,在不训练的情况下加速扩散语言模型推理,平均减少26.6%的去噪步数并实现1.33倍端到端加速。

Comments 23 pages, including references and appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19066 2026-06-02 cs.LG cs.AI 81%

IDLM: Inverse-distilled Diffusion Language Models

IDLM:逆蒸馏扩散语言模型

David Li, Nikita Gushchin, Dmitry Abulkhanov, Eric Moulines, Ivan Oseledets, Maxim Panov, Alexander Korotin

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI、cs.LG

AI总结 针对扩散语言模型推理慢的问题,提出逆蒸馏方法(IDLM),通过理论保证唯一解和梯度稳定松弛,实现4倍至64倍推理加速并保持生成质量。

Comments ICML 2026. We provide the code at: https://david-cripto.github.io/idlm-project-page

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00928 2026-06-02 cs.CV cs.LG 79%

Single-Channel Tissue Segmentation via Cross-Modal Distillation from Foundation Models

基于基础模型跨模态蒸馏的单通道组织分割

Sakib Mohammad, Jarin Ritu, Md Sakhawat Hossain

机构 * Department of Engineering Technology(工程技术系) Department of Electrical and Computer Engineering(电气与计算机工程系) Department of Mechanical Engineering(机械工程系)

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.LG

AI总结 提出跨模态知识蒸馏框架,将多通道输入的基础模型教师知识迁移到仅使用核通道的轻量级学生网络,实现单通道组织分割性能大幅提升。

Comments 6 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00573 2026-06-02 cs.LG 79%

LASER: Loss-Aware Singular-value Decomposition and Rank Allocation for Efficient Low-Precision Vision-Language Models

LASER: 面向高效低精度视觉-语言模型的损失感知奇异值分解与秩分配

Haiyu Wang, Yutong Wang, Leshu Li, Yihui Ren, Sai Qian Zhang

机构 * Tandon School of Engineering, New York University(纽约大学工程学院) Courant Institute of Mathematical Sciences, New York University(纽约大学数学科学学院) Brookhaven National Laboratory(布鲁克海文国家实验室)

专题命中 效率与部署 :language model(title,abstract);分类 cs.LG

AI总结 提出LASER框架,通过损失感知的奇异值分解和跨层秩分配,结合混合量化方案,实现视觉-语言模型在低精度推理下的高效压缩与加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00156 2026-06-02 eess.IV cs.AI 79%

A physics-informed foundation model for quantitative diffusion MRI

一种用于定量扩散MRI的物理信息基础模型

Zihan Li, Jialan Zheng, Ziyu Li, Xun Yuan, Kasidit Anmahapong, Ziang Wang, Mingxuan Liu, Hongjia Yang, Yifei Chen, Zhuhao Wang, Yuhang He, Fang Chen, Rui Li, Huaiqiang Sun, Yi Liao, Congyu Liao, Yang Yang, Haibo Qu, Xue Zhang, Hongen Liao, Qiyuan Tian

机构 * School of Biomedical Engineering, Tsinghua University(清华大学生物医学工程系) Oxford Centre for Integrative Neuroimaging, FMRIB, Nuffield Department of Clinical Neurosciences, University of Oxford(牛津大学整合神经影像中心、FMRIB、临床神经科学系) Department of Radiology, West China Second University Hospital, Sichuan University(四川大学华西第二医院放射科) School of Biomedical Engineering and the Institute of Medical Robotics, Shanghai Jiaotong University(上海交通大学生物医学工程学院和医学机器人研究院) Department of Radiology, Institution of Radiology and Medical Imaging, West China Hospital, Sichuan University(四川大学华西医院放射科、放射医学与影像研究所) Department of Radiology and Biomedical Imaging, University of California San Francisco(加州大学旧金山分校放射科和生物医学影像系) Department of Psychiatry and Behavioral Sciences, Stanford University School of Medicine(斯坦福大学医学院精神病学与行为科学系)

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.AI

AI总结 提出物理信息生成微结构网络(PIGMENT),通过零样本适应实现从稀疏数据中恢复可靠的定量扩散MRI参数映射。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13178 2026-06-02 cs.CV cs.AI 79%

CLIP Tricks You: Training-free Token Pruning for Efficient Pixel Grounding in Large VIsion-Language Models

CLIP Tricks You: 面向大型视觉-语言模型中高效像素定位的无训练令牌剪枝

Sangin Lee, Yukyung Choi

机构 * KAIST(韩国科学技术院)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI

AI总结 提出LiteLVLM,一种无需训练、文本引导的令牌剪枝策略,通过反转CLIP视觉-文本相似度排序,保留指代区域令牌并恢复上下文令牌,实现高效像素定位推理,在多种令牌预算下性能提升超5%,保持90%原始性能同时加速22%并减少2.3倍内存。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00161 2026-06-02 cs.LG 79%

Consistent Diffusion Language Models

一致性扩散语言模型

Hasan Amin, Yuan Gao, Yaser Souri, Subhojit Som, Ming Yin, Rajiv Khanna, Xia Song

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 效率与部署 :language model(title,abstract);分类 cs.LG

AI总结 提出多路径离散一致性(MPDC)原则,通过训练去噪器在随机桥上的路径不变性,实现单阶段训练的一致性扩散语言模型(CDLM),在文本生成中达到最先进性能。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15278 2026-06-02 cs.CV cs.AI 79%

Visual Persuasion: What Influences Decisions of Vision-Language Models?

视觉说服:什么影响了视觉语言模型的决策?

Manuel Cherep, Pranav M R, Pattie Maes, Nikhil Singh

机构 * Massachusetts Institute of Technology(麻省理工学院) MIT Media Lab(MIT媒体实验室)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI

AI总结 提出一个框架,通过控制图像选择任务并系统性地扰动输入,利用视觉提示优化方法推断视觉语言模型的潜在视觉效用,揭示影响模型决策的视觉偏好。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03018 2026-06-02 cs.LG 79%

From Zero to Hero: Advancing Zero-Shot Foundation Models for Tabular Outlier Detection

从零到英雄:推进表格异常检测的零样本基础模型

Xueying Ding, Haomin Wen, Simon Klüttermann, Leman Akoglu

机构 * Xueying Ding(丁雪莹) Haomin Wen(文浩明) Simon Klüttermann(西蒙·克吕特曼) Leman Akoglu(拉曼·阿科格卢)

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.LG

AI总结 提出OUTFORMER模型,通过混合合成先验和自演化课程训练,实现零样本表格异常检测,在AdBench及新基准上达到最优性能。

Comments 41 Pages, ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01923 2026-06-02 cs.CL cs.LG 79%

Resonant Context Anchoring: Decoupling Attention Routing and Signal Gain at Inference Time

共振上下文锚定:推理时解耦注意力路由与信号增益

Mingkuan Zhao, Yide Gao, Wentao Hu, Suquan Chen, Tianchen Huang, Zhenhua An, Zetao Chang, Xiayu Sun, Yuheng Min

机构 * Xi’an Jiaotong University(西安交通大学) University of Science and Technology of China(中国科学技术大学) Tongji University(同济大学) Tsinghua University(清华大学)

专题命中 效率与部署 :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 提出共振上下文锚定(RCA)方法,通过解耦自注意力中的路由逻辑与信息幅度,在推理时动态增强上下文令牌的信号,有效抑制大语言模型的参数化幻觉,提升事实一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01065 2026-06-02 cs.DC cs.AI cs.LG 79%

Leyline: KV Cache Directives for Agentic Inference

Leyline:用于智能推理的 KV 缓存指令

Bole Ma, Jan Eitzinger, Harald Koestler

机构 * Erlangen National High Performance Computing Center(埃朗根国家高性能计算中心)

专题命中 效率与部署 :LLM(summary_cn,abstract_cn);分类 cs.AI、cs.LG

AI总结 针对智能体 LLM 中策略驱动的缓存编辑需求,提出 Leyline 服务端原语,通过声明式指令四元组和架构无关接口实现缓存拼接与截断,提升缓存命中率和求解率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02551 2026-06-02 cs.RO cs.CV 78%

AFUN: Towards an Affordance Foundation Model for Functionality Understanding

AFUN:迈向用于功能理解的可供性基础模型

Zhaoning Wang, Yi Zhong, Jiawei Fu, Henrik I. Christensen, Jun Gao

机构 * University of Michigan(密歇根大学) University of California, San Diego(加州大学圣地亚哥分校) NVIDIA(英伟达)

专题命中 效率与部署 :foundation model(title,abstract)

AI总结 提出AFUN模型,从单张RGB-D图像和语言任务描述中预测任务条件功能掩码和3D接触后运动曲线,通过大规模标准化数据流水线实现开放世界泛化,在多项基准测试中显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01945 2026-06-02 cs.CV 78%

Beyond Low-Rank: Low-Rank Sparse Prompting via Spiking Neural Network and Prompt Factorization

超越低秩:通过脉冲神经网络和提示分解实现低秩稀疏提示

Yumiao Zhao, Bo Jiang, Beibei Wang, Xixi Wan, Xiao Wang, Jin Tang

机构 * Information Materials and Intelligent Sensing Laboratory of Anhui Province(安徽省信息材料与智能感知实验室) Anhui Provincial Key Laboratory of Multimodal Cognitive Computation(安徽省多模态认知计算重点实验室) School of Computer Science and Technology, Anhui University(安徽大学计算机科学与技术学院)

专题命中 效率与部署 :prompting(title,abstract)

AI总结 提出LoRSP框架,利用脉冲神经元的稀疏发放机制和低秩分解,生成实例特定的稀疏视觉提示,实现高效且鲁棒的视觉提示学习。

详情

展开后加载摘要…

URL PDF HTML 收藏