Scaling Offline Model-Based RL via Jointly-Optimized World-Action Model Pretraining
通过联合优化的世界-动作模型扩展离线模型基于的强化学习
Jie Cheng, Ruixi Qiao, Yingwei Ma, Binhua Li, Gang Xiong, Qinghai Miao, Yongbin Li, Yisheng Lv
机构
*
State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Alibaba Group(阿里巴巴集团)
A Unified XAI-LLM Approach for EndotrachealSuctioning Activity Recognition
面向气管吸引活动识别的统一XAI-LLM方法
Hoang Khang Phan, Quang Vinh Dang, Noriyo Colley, Christina Garcia, Nhat Tan Le
机构
*
Dept. of Biomedical Engineering(生物医学工程系)
;
Manning College of Information(信息与计算机科学学院)
;
Faculty of Health Science(健康科学学院)
;
Kyushu Institute of Technology(九州工业大学)
机构
*
College of Internet of Things, Nanjing University of Posts and Telecommunications(物联网学院,南京邮电大学)
;
Digital Intelligence Research Institute, PowerChina, Beijing Engineering Corporation Limited(数字智能研究院,中国电力工程顾问集团北京公司)
;
College of Telecommunications and Information Engineering, Nanjing University of Posts and Telecommunications(电信与信息工程学院,南京邮电大学)
RSGround-R1: Rethinking Remote Sensing Visual Grounding through Spatial Reasoning
RSGround-R1: 重新思考通过空间推理的遥感视觉定位
Shiqi Huang, Shuting He, Bihan Wen
机构
*
School of Electrical and Electronic Engineering, Nanyang Technological University(电气电子工程学院,南洋理工大学)
;
MoE Key Laboratory of Interdisciplinary Research of Computation and Economics, Shanghai University of Finance and Economics(教育部计算与经济交叉学科重点实验室,上海财经大学)
Thinking in Frames: How Visual Context and Test-Time Scaling Empower Video Reasoning
基于框架的思考:视觉上下文和测试时扩展如何增强视频推理
Chengzu Li, Zanyi Wang, Jiaang Li, Yi Xu, Han Zhou, Huanyu Zhang, Ruichuan An, Dengyang Jiang, Zhaochong An, Ivan Vulić, Serge Belongie, Anna Korhonen
机构
*
University of Cambridge(剑桥大学)
;
Pioneer Center for AI, University of Copenhagen(人工智能先锋中心,哥本哈根大学)
;
Hong Kong University of Science(香港科学大学)
;
University of California San Diego(加州大学圣地亚哥分校)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Peking University(北京大学)
Dynamic Topology Awareness: Breaking the Granularity Rigidity in Vision-Language Navigation
动态拓扑感知:突破视觉语言导航中的粒度刚性
Jiankun Peng, Jianyuan Guo, Ying Xu, Yue Liu, Jiashuang Yan, Xuanwei Ye, Houhua Li, Xiaoming Wang
机构
*
Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航空航天信息研究所)
;
School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences(中国科学院大学电子电气与通信工程学院)
;
Department of Computer Science, City University of Hong Kong(香港城市大学计算机科学系)
Mitigating Overthinking in Large Reasoning Models via Difficulty-aware Reinforcement Learning
通过难度感知强化学习缓解大推理模型中的过度思考
Qian Wan, Ziao Xu, Luona Wei, Xiaoxuan Shen, Jianwen Sun
机构
*
Laboratory for Artificial Intelligence and New Forms of Education(人工智能与新教育形式实验室)
;
National Engineering Research Center of Educational Big Data(教育大数据国家工程研究中心)
;
Faculty of Artificial Intelligence in Education, Central China Normal University(教育人工智能学院,中央财经大学)
;
College of Electronics and Information Engineering, South-Central Minzu University(电子与信息工程学院,西南民族大学)