arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Huawei(华为)

2026-04-14 至 2026-04-14 共收录 14
2604.11302 2026-04-14 cs.RO cs.AI

3D-Anchored Lookahead Planning for Persistent Robotic Scene Memory via World-Model-Based MCTS

基于世界模型的MCTS的3D锚定前瞻性规划用于持久性机器人场景记忆

Bronislav Sidik, Dror Mizrahi

机构 * Huawei Technologies, Israel R&D Center(华为技术有限公司以色列研发中心)

AI总结 本文提出3D-Anchored Lookahead Planning,结合MCTS与3D一致的世界模型,通过持续的相机到世界锚点实现精准重规划,提升了机器人在需要空间记忆任务中的成功率。

Comments 5 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11188 2026-04-14 cs.CL cs.AI

MathAgent: Adversarial Evolution of Constraint Graphs for Mathematical Reasoning Data Synthesis

MathAgent: 基于约束图的对抗进化用于数学推理数据合成

Zixiong Yu, Jun Rao, Guhan Chen, Songtao Tian, Bohan Li, Jiansheng Wei, Min Zhang, Xiaojun Meng

机构 * Huawei Large Model Data Technology Lab(华为大模型数据技术实验室) Tsinghua University(清华大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Kyoto University(京都大学)

AI总结 本文提出MathAgent框架,通过约束图的对抗进化生成高质量数学推理数据,提升模型在八个数学基准上的泛化能力。

Comments Accepted by ACL 2026 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11144 2026-04-14 cs.CV cs.CL cs.MM

Hierarchical Textual Knowledge for Enhanced Image Clustering

层次化文本知识用于增强图像聚类

Yijie Zhong, Yunfan Gao, Weipeng Jiang, Haofen Wang

机构 * Tongji University(同济大学) Huawei Technologies Ltd.(华为技术有限公司)

AI总结 本文提出KEC方法,通过大语言模型构建层次化概念-属性知识,提升图像聚类的准确性与鲁棒性。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22241 2026-04-14 cs.CL

MemDLM: Memory-Enhanced DLM Training

MemDLM:增强记忆的DLM训练

Zehua Pei, Hui-Ling Zhen, Weizhe Lin, Sinno Jialin Pan, Yunhe Wang, Mingxuan Yuan, Bei Yu

机构 * The Chinese University of Hong Kong(香港中文大学) Huawei Technologies Co., Ltd(华为技术有限公司)

AI总结 MemDLM通过引入双通道记忆机制,利用Bi-level优化在训练中嵌入模拟去噪轨迹,提升长上下文表示和训练效率,同时在推理时启用内循环实现特定提示适应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10420 2026-04-14 cs.LG cs.IT eess.IV eess.SP math.IT

Binary Flow Matching: Prediction-Loss Space Alignment for Robust Learning

二进制流匹配:用于鲁棒学习的预测-损失空间对齐

Jiadong Hong, Lei Liu, Xinyu Bian, Wenjie Wang, Zhaoyang Zhang

机构 * Zhejiang University(浙江大学) Huawei Technologies Co., Ltd(华为技术有限公司)

AI总结 本文研究了二进制流匹配在离散数据生成建模中的应用,提出通过信号空间对齐消除奇异加权,从而实现鲁棒训练。

Comments 15 pages, 3 tables, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17934 2026-04-14 cs.CL cs.AI

AtlasKV: Augmenting LLMs with Billion-Scale Knowledge Graphs in 20GB VRAM

AtlasKV:在20GB VRAM中通过十亿级知识图谱增强大语言模型

Haoyu Huang, Hong Ting Tsang, Jiaxin Bai, Xi Peng, Gong Zhang, Yangqiu Song

机构 * The Hong Kong University of Science and Technology(香港科技大学) Theory Lab, Huawei(华为理论实验室)

AI总结 本文提出AtlasKV,一种通过十亿级知识图谱增强大语言模型的方法,利用子线性时间与内存复杂度实现高效知识整合,无需外部检索模块或长上下文先验。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12694 2026-04-14 cs.LG cs.IT eess.SP math.IT

Soft Graph Transformer for MIMO Detection

用于MIMO检测的软图变换器

Jiadong Hong, Lei Liu, Xinyu Bian, Wenjie Wang, Zhaoyang Zhang

机构 * College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息与电子工程学院) Theory Lab, Central Research Institute, 2012 Labs, Huawei Technologies Co., Ltd.(华为技术有限公司2012实验室中央研究院理论实验室)

AI总结 本文提出软图变换器(SGT),结合自注意力和图感知交叉注意力,解决MIMO检测中传统方法复杂度高和信息利用不足的问题,实现近似最大似然性能。

Comments 5 pages with 3 figures and 2 tables, Accepted by IEEE ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11004 2026-04-14 cs.CV cs.AI cs.LG

Panoptic Pairwise Distortion Graph

全景成对失真图

Muhammad Kamran Janjua, Abdul Wahab, Bahador Rashidi

机构 * Huawei Technologies(华为技术有限公司)

AI总结 本文提出全景成对失真图任务,通过区域结构化组成图像对,改进现有方法对整体图像分析的局限性,构建PandaSet数据集、PandaBench基准和Panda架构,揭示多模态大语言模型在区域级失真理解上的不足。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10954 2026-04-14 cs.CV

FineEdit: Fine-Grained Image Edit with Bounding Box Guidance

FineEdit: 基于边界框引导的细粒度图像编辑

Haohang Xu, Lin Liu, Zhibo Zhang, Rong Cong, Xiaopeng Zhang, Qi Tian

机构 * Huawei Inc(华为公司)

AI总结 本文提出FineEdit,通过多级边界框注入方法提升图像编辑的精确度与背景一致性,结合120万对精细标注图像数据集和FineEdit-Bench基准测试,验证其在指令遵循和背景保留方面的优越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10604 2026-04-14 cs.IR cs.AI cs.CL cs.LG

NSFL: A Post-Training Neuro-Symbolic Fuzzy Logic Framework for Boolean Operators in Neural Embeddings

NSFL:一种用于神经嵌入中布尔运算的后训练神经符号模糊逻辑框架

Vladi Vexler, Ofer Idan, Gil Lederman, Dima Sivov

机构 * Huawei Tel-Aviv Research Center(华为特拉维夫研究中心)

AI总结 NSFL框架通过适应形式t-范数和t-余范数,为神经嵌入空间提供多原子逻辑约束的计算方法,提升检索性能,实现高达81%的mAP提升。

Comments 23 pages (16 main + 7 appendix), 2 figures, 10 tables, 1 algorithm

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10436 2026-04-14 cs.CV

SignReasoner: Compositional Reasoning for Complex Traffic Sign Understanding via Functional Structure Units

SignReasoner:通过功能结构单元实现复杂交通标志理解的组合推理

Ruibin Wang, Zhenyu Lin, Xinhai Zhao

机构 * Huawei Noah’s Ark Lab(华为诺亚方舟实验室)

AI总结 本文提出SignReasoner,通过功能结构单元实现复杂交通标志的组合推理,提升自动驾驶安全。核心方法是功能结构单元,通过分解标志为基本功能块,增强模型对未知配置的泛化能力。

Comments CVPRF 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09815 2026-04-14 cs.AI

EE-MCP: Self-Evolving MCP-GUI Agents via Automated Environment Generation and Experience Learning

EE-MCP:通过自动环境生成和经验学习的自进化MCP-GUI代理

Tiantian He, Yihang Chen, Keyue Jiang, Ka Yiu Lee, Kaiwen Zhou, Kun Shao, Shuai Wang

机构 * University College London(伦敦大学学院) Huawei Noah’s Ark Lab(华为诺亚方舟实验室) The Chinese University of Hong Kong(香港中文大学)

AI总结 本文提出EE-MCP框架,通过自动环境生成和经验学习实现MCP-GUI代理的自进化,通过跨应用分析证明其在MCP主导任务和GUI密集任务中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09748 2026-04-14 cs.CR cs.AI

Backdoors in RLVR: Jailbreak Backdoors in LLMs From Verifiable Reward

在RLVR中存在后门:从可验证奖励中对LLM的后门攻击

Weiyang Guo, Zesheng Shi, Zeen Zhu, Yuan Zhou, Min Zhang, Jing Li

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Huawei Technologies Co., Ltd.(华为技术有限公司)

AI总结 本文提出了一种在RLVR框架中通过注入污染数据植入后门的新方法,展示了该攻击在不同模型规模上高效且具有泛化能力,导致安全性能下降73%。

Comments 20 pages,8 figures, publish in acl2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09742 2026-04-14 cs.LG cs.CV

Efficient Matrix Implementation for Rotary Position Embedding

旋转位置嵌入的高效矩阵实现

Chen Minqi, Zhongqi Yue, Shihao Zhang, Yun Xu, Peng Wu, kaixiang Xu, Zeyi Huang, Hanwang Zhang

机构 * Huawei Technologies(华为技术有限公司) Nanyang Technological University(南洋理工大学)

AI总结 本文提出RoME,通过矩阵变换替代向量操作,提升旋转位置嵌入的计算效率,实现跨Cube和Vector单元的并行执行。

详情

展开后加载摘要…

URL PDF HTML 收藏