HOID-R1: Reinforcement Learning for Open-World Human-Object Interaction Detection Reasoning with Multimodal Large Language Model
专题命中 视觉空间推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract)
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
专题命中 视觉空间推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract)
机构 * Carnegie Mellon University, Robotics Institute(卡内基梅隆大学,机器人研究所)
专题命中 视觉空间推理 :reasoning(title,abstract);分类 cs.AI
Comments 8 pages, 6 figures, published in IROS 2025
机构 * Research Institute of Electronic Science and Technology, University of Electronic Science and Technology of China(电子科学与技术研究院,电子科技大学) ; School of Aeronautics and Astronautics, University of Electronic Science and Technology of China(航空航天学院,电子科技大学)
专题命中 视觉空间推理 :reasoning(title,abstract)
机构 * Korea University(韩国大学) ; KT (Korea Telecom) R&D Center(KT(韩国电信)研发中心)
专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI
机构 * University of Birmingham(伯明翰大学) ; Queen Mary University of London(伦敦大学女王学院) ; Aston University(阿斯顿大学) ; United Kingdom National Nuclear Laboratory Ltd.(英国国家核实验室有限公司)
专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI
Comments Accepted at Human-Centered Robot Autonomy for Human-Robot Teams (HuRoboT) at IEEE RO-MAN 2025, Eindhoven, the Netherlands