arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The University of Hong Kong(香港大学)

2026-01-30 至 2026-01-30 共收录 8
2601.21968 2026-01-30 cs.CL

OVD: On-policy Verbal Distillation

OVD:在线语言蒸馏

Jing Xiong, Hui Shen, Shansan Gong, Yuxin Cheng, Jianghan Shen, Chaofan Tao, Haochen Tan, Haoli Bai, Lifeng Shang, Ngai Wong

机构 * The University of Hong Kong, Hong Kong, China(香港大学) Nanjing University, Nanjing, China(南京大学) Huawei Technologies, China(华为技术)

AI总结 OVD通过离散语言分数替代token级对齐,实现高效在线蒸馏,提升Web问答和数学推理任务的性能与训练效率。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21821 2026-01-30 cs.CV

MMFineReason: Closing the Multimodal Reasoning Gap via Open Data-Centric Methods

MMFineReason: 通过以开放数据为中心的方法缩小多模态推理差距

Honglin Lin, Zheng Liu, Yun Zhu, Chonghan Qin, Juekai Lin, Xiaoran Shang, Conghui He, Wentao Zhang, Lijun Wu

机构 * Shanghai Artificial Intelligence Laboratory, OpenDataLab(上海人工智能实验室、OpenDataLab) Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学) The University of Hong Kong(香港大学)

AI总结 MMFineReason通过大规模多模态推理数据集和基于难度的过滤策略,提升模型推理能力与参数效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11004 2026-01-30 cs.CV cs.RO

EROAM: Event-based Camera Rotational Odometry and Mapping in Real-time

EROAM:基于事件相机的实时旋转里程计与建图

Wanli Xing, Shijie Lin, Linhan Yang, Zeqing Zhang, Yanjun Du, Maolin Lei, Yipeng Pan, Chen Wang, Jia Pan

机构 * Department of Computer Science, The University of Hong Kong(香港大学计算机科学系) Centre for Transformative Garment Production(转型服装生产中心) Department of Mechanical and Automation Engineering, The Chinese University of Hong Kong(香港中文大学机械与自动化工程系) Humanoids and Human Centered Mechatronics Research Line, Istituto Italiano Di Tecnologia (IIT)(人形与以人为核心机电系统研究组,意大利IIT)

AI总结 EROAM通过球形事件表示和ES-ICP框架,实现基于事件相机的实时高精度旋转里程计与建图,提升空间分辨率和计算效率,适用于高速和长序列场景。

Comments Accepted by IEEE Transactions on Robotics (T-RO), 2026. Project page: https://wlxing1901.github.io/eroam/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07042 2026-01-30 cs.HC cs.AI cs.CL cs.CY

Minion: A Technology Probe to Explore How Users Negotiate Harmful Value Conflicts with AI Companions

Minion:一种技术探测器,用于探索用户如何与AI伙伴协商有害的价值冲突

Xianzhe Fan, Qing Xiao, Xuhui Zhou, Yuran Su, Zhicong Lu, Maarten Sap, Hong Shen

机构 * The University of Hong Kong(香港大学) Human-Computer Interaction Institute, Carnegie Mellon University(人机交互研究所,卡内基梅隆大学) Language Technologies Institute, Carnegie Mellon University(语言技术研究所,卡内基梅隆大学) Tsinghua University(清华大学) Department of Computer Science, George Mason University(计算机科学系,乔治·马歇尔大学)

AI总结 Minion通过探测用户与AI伙伴协商有害价值冲突的过程,揭示了设计中需平衡用户责任与AI安全的挑战。

Comments 21 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21346 2026-01-30 cs.RO

HPTune: Hierarchical Proactive Tuning for Collision-Free Model Predictive Control

HPTune:用于无碰撞模型预测控制的分层前瞻性调优

Wei Zuo, Chengyang Li, Yikun Wang, Bingyang Cheng, Zeyi Ren, Shuai Wang, Derrick Wing Kwan Ng, Yik-Chung Wu

机构 * The University of Hong Kong(香港大学) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所) University of New South Wales(新南威尔士大学)

AI总结 HPTune通过分层前瞻性调优方法,结合快速和慢速调优策略,提升模型预测控制在复杂环境中的避障效率和适应性。

Comments Accepted by IEEE ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21208 2026-01-30 cs.AI cs.IR

When should I search more: Adaptive Complex Query Optimization with Reinforcement Learning

我应该何时搜索更多:基于强化学习的自适应复杂查询优化

Wei Wen, Sihang Deng, Tianjun Wei, Keyu Chen, Ruizhi Qiao, Xing Sun

机构 * Tencent Youtu Lab(腾讯云图实验室) The University of Hong Kong(香港大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出自适应复杂查询优化框架ACQO,通过强化学习解决复杂查询优化中的子查询数量确定、文档排序与合并问题,实现更稳定高效的查询处理。

Comments 16 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12142 2026-01-30 eess.AS cs.MM cs.RO

Listen, Look, Drive: Coupling Audio Instructions for User-aware VLA-based Autonomous Driving

Listen, Look, Drive: 通过用户意识的VLA基于自主驾驶的音频指令耦合

Ziang Guo, Feng Yang, Xuefeng Zhang, Jiaqi Guo, Kun Zhao, Yixiao Zhou, Peng Lu, Sifa Zheng, Zufeng Zhang

机构 * SuZhou Automotive Research Institute of Tsinghua University(清华大学苏州汽车研究院) Department of Electrical and Electronic Engineering, The University of Hong Kong(香港大学电子与电气工程系) Hyundai Motor Advanced Tech. R&D Center School of Vehicle and Mobility, Tsinghua University(清华大学车辆与移动系统学院)

AI总结 EchoVLA通过结合音频指令与视觉信息,提升自动驾驶对用户意图和情绪的感知能力,显著降低误差和碰撞率。

Comments Accepted by IV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01027 2026-01-30 cs.LG

DBellQuant: Breaking the Bell with Double-Bell Transformation for LLMs Post Training Binarization

DBellQuant: 通过双铃变换打破贝尔限制以实现LLMs预训练后二值化

Zijian Ye, Wei Huang, Yifei Yu, Tianhe Ren, Zhongrui Wang, Xiaojuan Qi

机构 * University of Hong Kong(香港大学) Southern University of Science and Technology(南方科技大学)

AI总结 DBellQuant通过双铃变换实现LLMs预训练后量化,显著提升压缩性能与模型效果。

Comments 19 pages; Appendix added

详情

展开后加载摘要…

URL PDF HTML 收藏