arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Harbin Institute of Technology(哈尔滨工业大学)

2026-01-15 至 2026-01-15 共收录 3
2510.00040 2026-01-15 cs.CV cs.AI

Uncovering Intrinsic Capabilities: A Paradigm for Data Curation in Vision-Language Models

揭示内在能力:一种用于视觉-语言模型数据整理的范式

Junjie Li, Ziao Wang, Jianghong Ma, Xiaofeng Zhang

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Hong Kong Baptist University, China(香港 Baptist大学) City University of Hong Kong, China(香港城市大学)

AI总结 CADC通过揭示视觉-语言模型的内在能力,提供了一种基于能力分析的数据整理范式,以提升指令微调的效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09230 2026-01-15 cs.CV

CLIDD: Cross-Layer Independent Deformable Description for Efficient and Discriminative Local Feature Representation

CLIDD: 跨层独立可变形描述用于高效且判别性的局部特征表示

Haodi Yao, Fenghua He, Ning Hao, Yao Su

机构 * School of Astronautics, Harbin Institute of Technology, China(航天学院,哈尔滨工业大学,中国) State Key Laboratory of General Artificial Intelligence, Beijing Institute for General Artificial Intelligence (BIGAI), China(通用人工智能国家重点实验室,北京通用人工智能研究院(BIGAI),中国)

AI总结 CLIDD通过跨层独立可变形描述实现高效且判别性的局部特征表示,提供高精度匹配与低计算开销的解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10570 2026-01-15 cs.RO

Virtual-force Based Visual Servo for Multiple Peg-in-Hole Assembly with Tightly Coupled Multi-Manipulator

基于虚拟力的多机械臂多插孔装配视觉伺服控制

Jiawei Zhang, Chengchao Bai, Wei Pan, Jifeng Guo

机构 * Harbin Institute of Technology, China(哈尔滨工业大学)

AI总结 本文提出基于虚拟力的多机械臂视觉伺服控制方法,通过整合多机械臂的视觉特征提升多插孔装配任务的精度与鲁棒性。

Comments 8 pages, 11 figures, this paper has been published by IEEE Robotics and Automation Letters

详情

展开后加载摘要…

URL PDF HTML 收藏