arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The University of Hong Kong(香港大学)

2026-03-10 至 2026-03-10 共收录 12
2506.01941 2026-03-10 cs.RO

FreeTacMan: Robot-free Visuo-Tactile Data Collection System for Contact-rich Manipulation

FreeTacMan: 无需机器人的人工智能视觉-触觉数据采集系统用于接触密集的 manipulation

Longyan Wu, Checheng Yu, Jieji Ren, Li Chen, Yufei Jiang, Ran Huang, Guoying Gu, Hongyang Li

机构 * Shanghai Innovation Institute(上海创新研究院) The University of Hong Kong(香港大学) Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学) Shanghai University(上海大学)

AI总结 FreeTacMan 提出了一种无需机器人的视觉-触觉数据采集系统,通过可穿戴抓取器和高精度光学跟踪系统,实现了高效的数据收集和多模态数据集的构建,推动了机器人 manipulation 的研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08055 2026-03-10 cs.CV cs.AI

Speed3R: Sparse Feed-forward 3D Reconstruction Models

Speed3R: 稀疏前馈3D重建模型

Weining Ren, Xiao Tan, Kai Han

机构 * The University of Hong Kong(香港大学) Baidu AMU(百度AMU)

AI总结 Speed3R通过稀疏关键点匹配机制实现高效3D重建,以12.4倍速度提升推理效率,同时保持几何精度。

Comments CVPR 2026 Findings, project page: https://visual-ai.github.io/speed3r/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07787 2026-03-10 cs.LG

Vision Transformers that Never Stop Learning

永不停止学习的视觉变换器

Caihao Sun, Mingqi Yuan, Shiyuan Wang, Jiayu Chen

机构 * University of Hong Kong(香港大学) The Hong Kong Polytechnic University(香港理工大学) Technische Universität Dresden(德累斯顿理工大学) INFIFORCE

AI总结 本文提出ARROW优化器,通过自适应调整梯度方向,有效提升视觉变换器的持续学习能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07663 2026-03-10 cs.RO

DAISS: Phase-Aware Imitation Learning for Dual-Arm Robotic Ultrasound-Guided Interventions

DAISS:面向双臂机器人超声引导干预的相位感知模仿学习

Feng Li, Pei Liu, Shiting Wang, Ning Wang, Zhongliang Jiang, Nassir Navab, Yuan Bi

机构 * Chair for Computer Aided Medical Procedures(CAMP), Technical University of Munich(TUM)(计算机辅助医疗程序主席职位(CAMP),慕尼黑技术大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) The University of Hong Kong(HKU)(香港大学)

AI总结 DAISS通过相位感知模仿学习实现双臂机器人在超声引导干预中的精准操作,减少认知负担。

Comments 8 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07552 2026-03-10 cs.CV cs.RO

ReconDrive: Fast Feed-Forward 4D Gaussian Splatting for Autonomous Driving Scene Reconstruction

ReconDrive: 用于自动驾驶场景重建的快速前馈4D高斯点扩散

Haibao Yu, Kuntao Xiao, Jiahang Wang, Ruiyang Hao, Yuxin Huang, Guoran Hu, Haifang Qin, Bowen Jing, Yuntian Bo, Ping Luo

机构 * Tuojing Intelligence The University of Hong Kong(香港大学) King's College London(伦敦国王学院) The University of Sydney(悉尼大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

AI总结 ReconDrive通过改进的4D高斯点扩散方法,在自动驾驶场景重建中实现高效高保真生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07393 2026-03-10 cs.RO cs.SY eess.SY

Underwater Embodied Intelligence for Autonomous Robots: A Constraint-Coupled Perspective on Planning, Control, and Deployment

水下具身智能:一种约束耦合视角下的规划、控制与部署

Jingzehua Xu, Guanwen Xie, Jiwei Tang, Shuai Zhang, Xiaofan Li

机构 * Department of Mechanical Engineering, The University of Hong Kong(香港大学机械工程系) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生学院) Department of Data and Systems Engineering, The University of Hong Kong(香港大学数据与系统工程系) Department of Data Science, New Jersey Institute of Technology(新泽西理工学院数据科学系)

AI总结 本文提出一种约束耦合视角下的水下具身智能方法,探讨了规划、控制与部署中的紧密耦合约束,旨在实现更可靠和可扩展的自主性。

Comments This article is currently under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13810 2026-03-10 cs.LG cs.AI

Mean Flow Policy with Instantaneous Velocity Constraint for One-step Action Generation

具有瞬时速度约束的一步动作生成均流策略

Guojian Zhan, Letian Tao, Pengcheng Wang, Yixiao Wang, Yiheng Li, Yuxin Chen, Hongyang Li, Masayoshi Tomizuka, Shengbo Eben Li

机构 * School of Vehicle and Mobility & College of AI, Tsinghua University(车辆与移动学院及人工智能学院,清华大学) Berkeley AI Research (BAIR), UC Berkeley(伯克利人工智能研究(BAIR),加州大学伯克利分校) The University of Hong Kong(香港大学)

AI总结 本文提出均速度策略(MVP),通过引入瞬时速度约束来提升动作生成效率,实现高效的一步动作生成并在机器人操作任务中取得最佳性能。

Comments ICLR Oral Presentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23932 2026-03-10 cs.CL

SwingArena: Competitive Programming Arena for Long-context GitHub Issue Solving

SwingArena: 用于长上下文GitHub问题解决的竞争性编程竞技场

Wendong Xu, Jing Xiong, Chenyang Zhao, Qiujiang Chen, Haoran Wang, Hui Shen, Zhongwei Wan, Jianbo Dai, Taiqiang Wu, He Xiao, Chaofan Tao, Z. Morley Mao, Ying Sheng, Zhijiang Guo, Hongxia Yang, Bei Yu, Lingpeng Kong, Quanquan Gu, Ngai Wong

机构 * The University of Hong Kong(香港大学) University of California Los Angeles(加州大学洛杉矶分校) Tsinghua University(清华大学) University of Michigan Ann Arbor(密歇根大学安娜堡分校) The Ohio State University(俄亥俄州立大学) University of Edinburgh(爱丁堡大学) The Chinese University of Hong Kong(香港中文大学) The Hong Kong Polytechnic University(香港理工大学) Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) LMSYS Org(LMSYS组织)

AI总结 SwingArena是一个用于评估LLM在真实CI驱动软件开发环境中性能的竞争性编程竞技场,通过模拟软件迭代过程,结合检索增强型代码生成模块,实现对长上下文问题的高效处理。

Comments The paper has been accepted as an oral presentation at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19747 2026-03-10 cs.CL cs.AR

HaLoRA: Hardware-aware Low-Rank Adaptation for Large Language Models Based on Hybrid Compute-in-Memory Architecture

HaLoRA: 基于混合计算-内存架构的硬件感知低秩适应法用于大型语言模型

Taiqiang Wu, Chenchen Ding, Wenyong Zhou, Yuxin Cheng, Xincheng Feng, Shuqi Wang, Wendong Xu, Chufan Shi, Zhengwu Liu, Ngai Wong

机构 * The University of Hong Kong(香港大学) Tsinghua University(清华大学)

AI总结 HaLoRA通过在混合计算-内存架构中部署低秩适应,利用RRAM和SRAM实现高效能和高精度的LLM微调。

Comments 22 pages, Accepted by TODAES (ACM Transactions on Design Automation of Electronic Systems)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15163 2026-03-10 cs.LG stat.ML

The Exploration of Error Bounds in Classification with Noisy Labels

在噪声标签下分类中误差界限的探索

Haixia Liu, Boxiao Li, Can Yang, Yang Wang

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) School of Mathematics and Statistics(数学与统计学学院) Huazhong University of Science and Technology(华中科技大学) The University of Hong Kong(香港大学)

AI总结 本文研究了噪声标签下深度学习分类中的误差界限,通过分解统计误差和近似误差,提出理论分析方法以提高分类性能。

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00643 2026-03-10 cs.CV

Position: Evaluation of Visual Processing Should Be Human-Centered, Not Metric-Centered

位置:视觉处理的评估应以人类为中心,而非以指标为中心

Jinfan Hu, Fanghua Yu, Zhiyuan You, Xiang Yin, Hongyu An, Xinqi Lin, Chao Dong, Jinjin Gu

机构 * Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究院,中国科学院) The University of Hong Kong(香港大学) INSAIT, Sofia University ``St. Kliment Ohridski''(INSAIT,索菲亚大学『圣克莱孟·奥赫里迪斯』) Shenzhen Loop Area Institute(深圳河套学院) The Chinese University of Hong Kong(香港中文大学) University of the Chinese Academy of Sciences(中国科学院大学) Fudan University(复旦大学) Shenzhen University of Advanced Technology(深圳先进技术大学) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 本文主张视觉处理评估应转向以人类为中心的方法,强调情境感知和细致评估,以更准确反映人类感知和用户需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11165 2026-03-10 cs.CV

Traffic-MLLM: Curiosity-Regularized Supervised Learning for Traffic Scenario Case-Based Reasoning

Traffic-MLLM: 基于好奇心正则化的交通场景案例推理监督学习

Waikit Xiu, Qiang Lu, Bingchen Liu, Chen Sun, Xiying Li

机构 * The University of Hong Kong(香港大学) Sun Yat-sen University(中山大学) University of Bristol(布里斯托大学)

AI总结 Traffic-MLLM通过好奇心驱动的结构化案例学习,提升多模态交通场景推理的鲁棒性和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏