arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Beihang University(北京航空航天大学)

2026-08-26 至 2026-08-26 共收录 12
2608.24882 2026-08-26 cs.RO 新提交

Latent Action as Intention Enables Efficient Future Imagination for World Action Models

作为意图的隐式动作:为世界动作模型实现高效的未来想象

Xiang Li, Yupeng Zheng, Songen Gu, Huailiang Ma, Feng Yu, Xian Nie, Shanshuai Yuan, Yujie Zang, Weize Li, Shuai Tian, Moyang Liu, Ya-Qin Zhang, Wenchao Ding

机构 * CollegeAI, THU(清华大学CollegeAI) AIR, THU(清华大学AIR) CASIA(中国科学院自动化研究所) TARS Robotics(TARS机器人公司) FDU(复旦大学) Southeast University(东南大学) SJTU(上海交通大学) NUS(新加坡国立大学) BUAA(北京航空航天大学)

AI总结 本文提出名为 LAWA 的 WAM 架构,以紧凑隐式动作作为未来意图实现高效未来想象,在 RoboCasa 等数据集上优于 Fast-WAM,延迟更低且性能更优,兼顾性能、泛化性与延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24777 2026-08-26 cs.AI cs.CR 新提交

StepGuard: Learning Step-Level Guardrails with Scalable Supervision and Safety-Utility Balancing

StepGuard:利用可扩展监督与安全-效用平衡学习步骤级护栏

Zhijie Zheng, Yu Li, Chen Qian, Yuqian Fu, Yanwei Fu, Lu Sheng, Jing Shao, Dongrui Liu

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Beihang University(北京航空航天大学) Fudan University(复旦大学) Renmin University of China(中国人民大学) KAUST(阿卜杜拉国王科技大学)

AI总结 该研究针对LLM智能体交互的安全风险,提出步骤级护栏模型StepGuard,通过自动数据引擎StepGen与动态平衡学习方法Balance-GRPO训练,在降低攻击成功率的同时仅小幅影响效用。

Comments Accepted by EMNLP 2026. Project page: this https URL (https://zheng977.github.io/StepGuard/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24696 2026-08-26 cs.LG cs.AI 新提交

On-policy Distillation with Verifiable Reward

结合可验证奖励的在线蒸馏

Wenze Lin, Jiale Zhao, Xitai Jiang, Songde Rao, Yining Li, Shenzhi Wang, Bingxiang He, Gao Huang

机构 * LeapLab, Tsinghua University(清华大学LeapLab) Beihang University(北京航空航天大学) SMS, Peking University(北京大学SMS) NLPLab, Tsinghua University(清华大学NLPLab)

AI总结 本研究提出OPDVR方法,无缝结合OPD与RLVR且不增加超参数,经六个推理基准实验验证其性能优于标准OPD。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24618 2026-08-26 cs.RO 新提交

VIP: Variation-based Iterative-learning Planning for Robotic Navigation

VIP:面向机器人导航的基于变分的迭代学习规划

Shuli Lv, Pengda Mao, Chen Min, Li Hong, Runxiao Liu, Shuai Wang, Quan Quan

机构 * School of Automation Science and Electrical Engineering, Beihang University(北京航空航天大学自动化科学与电气工程学院) Tianmushan Laboratory, Beihang University(北京航空航天大学天目山实验室)

AI总结 该研究针对机器人导航规划的计算成本问题,提出VIP框架,通过变分迭代学习优化规划命令,在单/多机器人场景中高效生成并改进运动规划,兼具有效性与可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24541 2026-08-26 cs.CV 新提交

Hierarchical Prototype-Memory Adaptation of SAM for Surgical Instrument Segmentation

用于手术器械分割的SAM分层原型-记忆适应方法

Xinning Yao, Jingjing Wang, Jinghua Yue, Xiaoyan Luo, Fugen Zhou, Bo Liu

机构 * Beihang University(北京航空航天大学) Image Processing Center(图像处理中心)

AI总结 针对SAM适配手术器械分割时的鲁棒性与尺度耦合问题,本文提出HPMA框架,通过分层原型记忆与尺度匹配耦合机制,在EndoVis2017/2018数据集上取得最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24488 2026-08-26 cs.LG 新提交

Where Entropy Is Measured Matters: Policy Geometry in Bounded Continuous-Control PPO

熵的测量位置很重要:有界连续控制PPO中的策略几何

Yiyang He, Zhichun Zhou, Ziwei Wang, Tao Xue, Haolin Fei

机构 * Lancaster University(兰卡斯特大学) Beihang University(北京航空航天大学) Tsinghua University(清华大学)

AI总结 该研究发现熵的测量位置会影响PPO学习的有界连续控制策略几何,通过MyoLeg、Dog-Stand任务实验,表明熵测量空间是均值-方差耦合的设计选择,仅任务回报无法表征有界策略几何。

Comments 24 pages, 6 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24291 2026-08-26 cs.AI cs.SE 新提交

ReproAgent: Contract-Guided Paper-to-Code Reproduction

ReproAgent:基于合约引导的论文到代码复现

Xue Hu, Zewei Pan, Zhongyuan Wang, Zhou Liu, Zeli Su, Wentao Zhang

机构 * Beihang University(北京航空航天大学) Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学) Minzu University of China(中央民族大学) Zhongguancun Academy(中关村科学院)

AI总结 ReproAgent是基于合约引导的四阶段论文到代码复现流水线,在PaperBench Code-Dev基准上,其在两种骨干模型的同架构支架中取得最高平均得分,相关产物已公开。

Comments Accepted to Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24252 2026-08-26 cs.AI cs.SE 新提交

SA-Bench: Evaluating Semantic Alignment in LLM-Based Paper Reproduction

SA-Bench:评估基于大语言模型的论文复现中的语义对齐

Xue Hu, Zewei Pan, Zeli Su, Zhou Liu, Wentao Zhang

机构 * Beihang University(北京航空航天大学) Shanghai Jiao Tong University(上海交通大学) Minzu University of China(中央民族大学) Peking University(北京大学) Zhongguancun Academy(中关村科学院)

AI总结 本研究推出SA-Bench基准,评估LLM复现论文时的语义对齐,发现现有模型复现准确率低,需优化脚手架以提升语义规范验证能力。

Comments Accepted to Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24217 2026-08-26 cs.RO 新提交

CARO: Contact-Agnostic Residual Observation for Zero-Shot Robust Quadruped Locomotion

CARO:适用于零样本鲁棒四足运动的接触无关残差观测

Zihan Yang, Shixuan Han, Kexin Guo, Xiang Yu

机构 * School of Aeronautic Science and Engineering, Beihang University(北京航空航天大学航空科学与工程学院) School of Automation Science and Electrical Engineering, Beihang University(北京航空航天大学自动化科学与电气工程学院)

AI总结 该研究提出CARO框架,将固定基座欧拉-拉格朗日模型嵌入强化学习控制循环,无需额外传感器即可提升四足机器人零样本鲁棒性,在多项任务中表现出显著优势。

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24027 2026-08-26 cs.CV 新提交

Phase-Aligned Finite-Fourier Periodic Deformation for 4D Medical Image Interpolation

用于4D医学图像插值的相位对齐有限傅里叶周期变形

Haojin Li, Hengzhuo Wang, Zhiheng Ma, Mingyang Ou, Heng Li, Jiang Liu

机构 * Southern University of Science and Technology(南方科技大学) Shenzhen University of Advanced Technology(深圳理工大学) Shenzhen University Medical School(深圳大学医学院) Shenzhen University(深圳大学) Beihang University(北京航空航天大学)

AI总结 该研究针对4D医学图像插值中周期结构编码不足、运动非均匀的问题,提出相位对齐有限傅里叶周期变形方法,在ACDC和4D-Lung数据集上实现了优于现有基线的性能。

Comments ACMMM 2026 accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23746 2026-08-26 cs.CV 新提交

CRISP: Calibration-Aware Visual State Space Duality for Remote Sensing Semantic Segmentation

CRISP:面向遥感语义分割的校准感知视觉状态空间对偶模型

Kangning Wang, Haopeng Zhang, Zhiguo Jiang

机构 * Tianmushan Laboratory, Beihang University(北京航空航天大学天目山实验室) Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院) School of Astronautics, Beihang University(北京航空航天大学宇航学院)

AI总结 针对VSSD用于遥感语义分割时的边界平滑问题,提出含DCO与OMP头的CRISP框架,在约30M参数规模下提升了mF与mIoU,性能与SOTA相当。

Comments Accepted to ECCV 2026. 22 pages, including supplementary material; 9 figures. Code: this https URL (https://github.com/crazylifeha/CRISP)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24593 2026-08-26 cs.LG physics.comp-ph 新提交

Delayed Optimizer-State Transport Shapes Short-Horizon Training Decisions

延迟优化器状态传输塑造短程训练决策

Jinhui Guo

机构 * School of Physics, Beihang University(北京航空航天大学物理学院)

AI总结 该研究发现优化器状态与未来数据的延迟传输可改变Transformer短程训练决策,在Math--Code数据集上提升损失,为有限视野训练干预提供了机制依据。

Comments 24 pages, 14 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏