RoboGPT-R1: Enhancing Robot Task Planning with Reinforcement Learning
RoboGPT-R1: 通过强化学习增强机器人任务规划
Jinrui Liu, Bingyan Nie, Boyu Li, Yaran Chen, Yuze Wang, Shunsen He, Haoran Li
机构
*
Institute of Automation, CASIA(中国科学院自动化研究所)
;
School of Artificial Intelligence, UCAS(中国科学技术大学人工智能学院)
;
Huawei Cloud Technology Co., Ltd(华为云技术有限公司)
专题命中
视觉推理
:vision language model(abstract);分类 cs.AI
CommentsAccepted for publication in the Proceedings of the 30th International Conference on Knowledge-Based and Intelligent Information & Engineering Systems (KES 2026)
Han Huang, Hao Wang, Mengqi Zhang, Shu Wu, Qiang Liu, Liang Wang
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
New Laboratory of Pattern Recognition (NLPR), CASIA(中国科学院自动化研究所模式识别国家重点实验室)
;
Harbin Institute of Technology(哈尔滨工业大学)
;
Shandong University(山东大学)
专题命中
视觉推理
:multimodal large language model(abstract);分类 cs.CV
机构
*
State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学计算机学院多媒体信息处理国家重点实验室)
;
Central South University(中南大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Peking University(北京大学)
;
Huawei Technologies(华为技术有限公司)
NoisyGRPO: Incentivizing Multimodal CoT Reasoning via Noise Injection and Bayesian Estimation
NoisyGRPO:通过噪声注入和贝叶斯估计激励多模态Co T推理
Longtian Qiu, Shan Ning, Jiaxuan Sun, Xuming He
机构
*
ShanghaiTech University(上海科技大学)
;
Shanghai Engineering Research Center of Intelligent Vision and Imaging(上海智能视觉与成像工程研究中心)
;
Lingang Laboratory(临港实验室)
专题命中
视觉推理
:multimodal large language model(abstract);分类 cs.CV
机构
*
MMLab, The Chinese University of Hong Kong(中大香港实验室)
;
CPII under InnoHK(创新香港 CPII)
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
Shenzhen Loop Area Institute(深圳河套学院)
;
Shandong University(山东大学)
;
Huawei Technologies(华为技术)
PhotoCraft: Agentic Reasoning with Hierarchical Self-Evolving Memory for Deep Image Search
PhotoCraft: 具有层次自进化记忆的深度图像搜索代理推理
Kailin Lyu, Zhiqiang Yuan, Jianwei He, Qiwei Yan, Xuanbo Su, Nanxing Hu, Yang Liu, Ce Hao, Shengqian Qin, Lianyu Hu, Jinchao Zhang, Jie Zhou
机构
*
Pattern Recognition Center, WeChat AI, Tencent Inc.(微信AI模式识别中心,腾讯公司)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Zhongguancun Academy(中关村学院)
;
Nanyang Technological University(南洋理工大学)
;
Shanghai Jiao Tong University(上海交通大学)
UR$^2$: Unify RAG and Reasoning through Reinforcement Learning
UR$^2$:通过强化学习统一检索增强生成与推理
Weitao Li, Boran Xiang, Xiaolong Wang, Zhinan Gou, Weizhi Ma, Yang Liu
机构
*
Dept. of Comp. Sci. & Tech., Institute for AI, Tsinghua University, Beijing, China(计算机科学与技术系,人工智能研究院,清华大学,北京,中国)
;
Institute for AI Industry Research (AIR), Tsinghua University, Beijing, China(人工智能产业研究机构(AIR),清华大学,北京,中国)
;
School of Management Science & Information Engineering, Hebei University of Economics and Business, Hebei, China(管理科学与信息工程学院,河北经贸大学,河北,中国)
机构
*
Shenyang Institute of Automation, Chinese Academy of Sciences(中国科学院沈阳自动化研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Peking University(北京大学)
;
MMLab, CUHK(CUHK多模态实验室)
专题命中
视觉推理
:multimodal large language model(abstract);分类 cs.AI
Training-Free Composed Video Retrieval via Visual Representation-Guided Video-LLM Reasoning
基于视觉表示引导的视频-大语言模型推理的无训练组合视频检索
Yang Liu, Qianqian Xu, Peisong Wen, Siran Dai, Qingming Huang
机构
*
School of Computer Science and Technology, University of Chinese Academy of Sciences(中国科学院大学计算机科学与技术学院)
;
State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院人工智能安全国家重点实验室)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
;
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)
SafeMCP: Proactive Power Regulation for LLM Agent Defense via Environment-Grounded Look-Ahead Reasoning
SafeMCP:基于环境接地前瞻推理的LLM智能体防御主动功率调节
Lichao Wang, Zhaoxing Ren, Tianzhuo Yang, Jiaming Ji, Chi Harold Liu, Yaodong Yang, Juntao Dai
机构
*
Beijing Institute of Technology(北京理工大学)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
;
Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)
Hierarchical Semantic-Augmented Navigation: Optimal Transport and Graph-Driven Reasoning for Vision-Language Navigation
层级语义增强导航:面向视觉语言导航的最优传输与图驱动推理
Xiang Fang, Wanlong Fang, Changshuo Wang
机构
*
School of Software Engineering, Huazhong University of Science and Technology(华中科技大学软件学院)
;
Interdisciplinary Graduate Programme, Nanyang Technological University, Singapore(新加坡南洋理工大学交叉学科研究生项目)
;
University College London(伦敦大学学院)
机构
*
Tencent BAC(腾讯BAC)
;
Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学)
;
School of Electronic and Computer Engineering, Peking University(北京大学电子与计算机工程学院)
;
School of Mathematics and Statistics, University of Glasgow(格拉斯哥大学数学与统计学学院)
专题命中
视觉推理
:vision language model(abstract);分类 cs.CV