arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Beihang University(北京航空航天大学)

2026-08-26 至 2026-08-26 共收录 15
2608.24882 2026-08-26 cs.RO 新提交

Latent Action as Intention Enables Efficient Future Imagination for World Action Models

作为意图的隐式动作:为世界动作模型实现高效的未来想象

Xiang Li, Yupeng Zheng, Songen Gu, Huailiang Ma, Feng Yu, Xian Nie, Shanshuai Yuan, Yujie Zang, Weize Li, Shuai Tian, Moyang Liu, Ya-Qin Zhang, Wenchao Ding

机构 * CollegeAI, THU(清华大学CollegeAI) AIR, THU(清华大学AIR) CASIA(中国科学院自动化研究所) TARS Robotics(TARS机器人公司) FDU(复旦大学) Southeast University(东南大学) SJTU(上海交通大学) NUS(新加坡国立大学) BUAA(北京航空航天大学)

AI总结 本文提出名为 LAWA 的 WAM 架构,以紧凑隐式动作作为未来意图实现高效未来想象,在 RoboCasa 等数据集上优于 Fast-WAM,延迟更低且性能更优,兼顾性能、泛化性与延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24777 2026-08-26 cs.AI cs.CR 新提交

StepGuard: Learning Step-Level Guardrails with Scalable Supervision and Safety-Utility Balancing

StepGuard:利用可扩展监督与安全-效用平衡学习步骤级护栏

Zhijie Zheng, Yu Li, Chen Qian, Yuqian Fu, Yanwei Fu, Lu Sheng, Jing Shao, Dongrui Liu

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Beihang University(北京航空航天大学) Fudan University(复旦大学) Renmin University of China(中国人民大学) KAUST(阿卜杜拉国王科技大学)

AI总结 该研究针对LLM智能体交互的安全风险,提出步骤级护栏模型StepGuard,通过自动数据引擎StepGen与动态平衡学习方法Balance-GRPO训练,在降低攻击成功率的同时仅小幅影响效用。

Comments Accepted by EMNLP 2026. Project page: this https URL (https://zheng977.github.io/StepGuard/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24696 2026-08-26 cs.LG cs.AI 新提交

On-policy Distillation with Verifiable Reward

结合可验证奖励的在线蒸馏

Wenze Lin, Jiale Zhao, Xitai Jiang, Songde Rao, Yining Li, Shenzhi Wang, Bingxiang He, Gao Huang

机构 * LeapLab, Tsinghua University(清华大学LeapLab) Beihang University(北京航空航天大学) SMS, Peking University(北京大学SMS) NLPLab, Tsinghua University(清华大学NLPLab)

AI总结 本研究提出OPDVR方法,无缝结合OPD与RLVR且不增加超参数,经六个推理基准实验验证其性能优于标准OPD。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24618 2026-08-26 cs.RO 新提交

VIP: Variation-based Iterative-learning Planning for Robotic Navigation

VIP:面向机器人导航的基于变分的迭代学习规划

Shuli Lv, Pengda Mao, Chen Min, Li Hong, Runxiao Liu, Shuai Wang, Quan Quan

机构 * School of Automation Science and Electrical Engineering, Beihang University(北京航空航天大学自动化科学与电气工程学院) Tianmushan Laboratory, Beihang University(北京航空航天大学天目山实验室)

AI总结 该研究针对机器人导航规划的计算成本问题,提出VIP框架,通过变分迭代学习优化规划命令,在单/多机器人场景中高效生成并改进运动规划,兼具有效性与可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24541 2026-08-26 cs.CV 新提交

Hierarchical Prototype-Memory Adaptation of SAM for Surgical Instrument Segmentation

用于手术器械分割的SAM分层原型-记忆适应方法

Xinning Yao, Jingjing Wang, Jinghua Yue, Xiaoyan Luo, Fugen Zhou, Bo Liu

机构 * Beihang University(北京航空航天大学) Image Processing Center(图像处理中心)

AI总结 针对SAM适配手术器械分割时的鲁棒性与尺度耦合问题,本文提出HPMA框架,通过分层原型记忆与尺度匹配耦合机制,在EndoVis2017/2018数据集上取得最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24488 2026-08-26 cs.LG 新提交

Where Entropy Is Measured Matters: Policy Geometry in Bounded Continuous-Control PPO

熵的测量位置很重要:有界连续控制PPO中的策略几何

Yiyang He, Zhichun Zhou, Ziwei Wang, Tao Xue, Haolin Fei

机构 * Lancaster University(兰卡斯特大学) Beihang University(北京航空航天大学) Tsinghua University(清华大学)

AI总结 该研究发现熵的测量位置会影响PPO学习的有界连续控制策略几何,通过MyoLeg、Dog-Stand任务实验,表明熵测量空间是均值-方差耦合的设计选择,仅任务回报无法表征有界策略几何。

Comments 24 pages, 6 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24291 2026-08-26 cs.AI cs.SE 新提交

ReproAgent: Contract-Guided Paper-to-Code Reproduction

ReproAgent:基于合约引导的论文到代码复现

Xue Hu, Zewei Pan, Zhongyuan Wang, Zhou Liu, Zeli Su, Wentao Zhang

机构 * Beihang University(北京航空航天大学) Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学) Minzu University of China(中央民族大学) Zhongguancun Academy(中关村科学院)

AI总结 ReproAgent是基于合约引导的四阶段论文到代码复现流水线,在PaperBench Code-Dev基准上,其在两种骨干模型的同架构支架中取得最高平均得分,相关产物已公开。

Comments Accepted to Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24252 2026-08-26 cs.AI cs.SE 新提交

SA-Bench: Evaluating Semantic Alignment in LLM-Based Paper Reproduction

SA-Bench:评估基于大语言模型的论文复现中的语义对齐

Xue Hu, Zewei Pan, Zeli Su, Zhou Liu, Wentao Zhang

机构 * Beihang University(北京航空航天大学) Shanghai Jiao Tong University(上海交通大学) Minzu University of China(中央民族大学) Peking University(北京大学) Zhongguancun Academy(中关村科学院)

AI总结 本研究推出SA-Bench基准,评估LLM复现论文时的语义对齐,发现现有模型复现准确率低,需优化脚手架以提升语义规范验证能力。

Comments Accepted to Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24217 2026-08-26 cs.RO 新提交

CARO: Contact-Agnostic Residual Observation for Zero-Shot Robust Quadruped Locomotion

CARO:适用于零样本鲁棒四足运动的接触无关残差观测

Zihan Yang, Shixuan Han, Kexin Guo, Xiang Yu

机构 * School of Aeronautic Science and Engineering, Beihang University(北京航空航天大学航空科学与工程学院) School of Automation Science and Electrical Engineering, Beihang University(北京航空航天大学自动化科学与电气工程学院)

AI总结 该研究提出CARO框架,将固定基座欧拉-拉格朗日模型嵌入强化学习控制循环,无需额外传感器即可提升四足机器人零样本鲁棒性,在多项任务中表现出显著优势。

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24027 2026-08-26 cs.CV 新提交

Phase-Aligned Finite-Fourier Periodic Deformation for 4D Medical Image Interpolation

用于4D医学图像插值的相位对齐有限傅里叶周期变形

Haojin Li, Hengzhuo Wang, Zhiheng Ma, Mingyang Ou, Heng Li, Jiang Liu

机构 * Southern University of Science and Technology(南方科技大学) Shenzhen University of Advanced Technology(深圳理工大学) Shenzhen University Medical School(深圳大学医学院) Shenzhen University(深圳大学) Beihang University(北京航空航天大学)

AI总结 该研究针对4D医学图像插值中周期结构编码不足、运动非均匀的问题,提出相位对齐有限傅里叶周期变形方法,在ACDC和4D-Lung数据集上实现了优于现有基线的性能。

Comments ACMMM 2026 accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23746 2026-08-26 cs.CV 新提交

CRISP: Calibration-Aware Visual State Space Duality for Remote Sensing Semantic Segmentation

CRISP:面向遥感语义分割的校准感知视觉状态空间对偶模型

Kangning Wang, Haopeng Zhang, Zhiguo Jiang

机构 * Tianmushan Laboratory, Beihang University(北京航空航天大学天目山实验室) Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院) School of Astronautics, Beihang University(北京航空航天大学宇航学院)

AI总结 针对VSSD用于遥感语义分割时的边界平滑问题,提出含DCO与OMP头的CRISP框架,在约30M参数规模下提升了mF与mIoU,性能与SOTA相当。

Comments Accepted to ECCV 2026. 22 pages, including supplementary material; 9 figures. Code: this https URL (https://github.com/crazylifeha/CRISP)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24593 2026-08-26 cs.LG physics.comp-ph 新提交

Delayed Optimizer-State Transport Shapes Short-Horizon Training Decisions

延迟优化器状态传输塑造短程训练决策

Jinhui Guo

机构 * School of Physics, Beihang University(北京航空航天大学物理学院)

AI总结 该研究发现优化器状态与未来数据的延迟传输可改变Transformer短程训练决策,在Math--Code数据集上提升损失,为有限视野训练干预提供了机制依据。

Comments 24 pages, 14 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23329 2026-08-26 cs.CV cs.AI 版本更新

Thinking Beyond Videos: Unifying Video Reasoning and Deep Research for Open-World Video Agents

超越视频:统一视频推理与深度研究的开放世界视频智能体

Wenqi Liu, Shijie Ma, Yunxiao Wang, Meng Liu, Qile Su, Han Liu, Bohan Hou, Zeyu Wang, Xuanyu Zheng, Changyi Liu, Tianke Zhang, Haonan Fan, Kaiyu Jiang, Yingxin Li, Jiankang Chen, Xu Wang, Hongyi Fu, Jianxiong Wang, Bin Wen, Tingting Gao, Han Li, Jianhua Yin, Yinwei Wei, Xuemeng Song

机构 * Shandong University(山东大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Beihang University(北京航空航天大学) City University of Hong Kong(香港城市大学) Nanyang Technological University(南洋理工大学) Kuaishou Technology(快手科技) Southern University of Science and Technology(南方科技大学)

AI总结 本研究提出统一视频推理与深度研究的VideoRover框架,构建相关数据集与基准,其8B-RL模型在无工具直接回答场景性能接近专有模型,优于同工具套件的更大开源模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30972 2026-08-26 cs.CV 版本更新

BiSegMamba: Efficient Bidirectional Tri-Oriented Mamba for 3D Medical Image Segmentation

BiSegMamba: 用于3D医学图像分割的高效双向三向Mamba

Bakht Zada, Chao Tong, Qile Su, Shuai Zhang

机构 * School of Computer Science and Engineering, Beihang University(北航计算机科学与工程学院) State Key Laboratory of Virtual Reality Technology and Systems, Beihang University(北航虚拟现实技术与系统国家重点实验室)

AI总结 提出BiSegMamba,一种基于双向三向Mamba的高效3D医学图像分割网络,通过渐进压缩主干、多尺度空间混合器、双向正交Mamba块和自适应方向融合,在降低计算成本的同时提升分割精度。

Comments Code is available at: this https URL (https://github.com/bakhtzadaabshare/BiSegMamba)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20073 2026-08-26 cs.CL cs.AI cs.LG 版本更新

A Modular Multitask Reasoning Framework Integrating Spatio-temporal Models and LLMs

整合时空模型与大语言模型(LLMs)的模块化多任务推理框架

Kethmi Hirushini Hettige, Jiahao Ji, Cheng Long, Shili Xiang, Gao Cong, Jingyuan Wang

机构 * College of Computing and Data Science, Nanyang Technological University, Singapore(南洋理工大学计算机与数据科学学院) Institute for Infocomm Research, A*STAR, Singapore(资讯通信研究院) School of Computer Science and Engineering, Beihang University, China(北京航空航天大学计算机科学与工程学院)

AI总结 本研究提出整合时空模型与LLMs的STReason框架,通过上下文学习分解查询生成解释,在时空推理任务中显著优于LLM基线,可抑制幻觉并减少专家工作量。

详情

展开后加载摘要…

URL PDF HTML 收藏