Thinking Beyond Videos: Unifying Video Reasoning and Deep Research for Open-World Video Agents
超越视频:统一视频推理与深度研究的开放世界视频智能体
Wenqi Liu, Shijie Ma, Yunxiao Wang, Meng Liu, Qile Su, Han Liu, Bohan Hou, Zeyu Wang, Xuanyu Zheng, Changyi Liu, Tianke Zhang, Haonan Fan, Kaiyu Jiang, Yingxin Li, Jiankang Chen, Xu Wang, Hongyi Fu, Jianxiong Wang, Bin Wen, Tingting Gao, Han Li, Jianhua Yin, Yinwei Wei, Xuemeng Song
机构
*
Shandong University(山东大学)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Beihang University(北京航空航天大学)
;
City University of Hong Kong(香港城市大学)
;
Nanyang Technological University(南洋理工大学)
;
Kuaishou Technology(快手科技)
;
Southern University of Science and Technology(南方科技大学)
GenCoord: Skill-Path Commitments under Private Information
Peng He, Junning Zhu, Haohan Yuan, Jianpeng Liang
机构
*
Tsinghua University(清华大学)
;
Beijing Normal-Hong Kong Baptist University(北京师范大学-香港浸会大学联合国际学院)
;
University of North Carolina at Charlotte(北卡罗来纳大学夏洛特分校)
;
University of California San Diego(加利福尼亚大学圣迭戈分校)
CommentsRevised version prepared in response to the editorial assessment. The main manuscript is 32 pages; detailed mathematical derivations have been moved to the accompanying Supplementary Material. The principal results and contributions are strengthened and clarified
CoWorld-VLA: Thinking in a Multi-Expert World Model for Autonomous Driving
CoWorld-VLA:面向自动驾驶的多专家世界模型中的思考
Minqing Huang, Yujiao Xiang, Zihan Liang, Jiajie Huang, Jingqi Wang, Yuheng Zhou, Zhi Xu, Feiyang Tan, Hangning Zhou, Mu Yang, Gong Che
机构
*
Afari Intelligent Drive(Afari智能驾驶公司)
;
University of Electronic Science and Technology of China(电子科技大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Beijing University Of Posts and Telecommunications(北京邮电大学)
;
Tianjin University(天津大学)
RA-CMF: Region-Adaptive Conditional MeanFlow for CT Image Reconstruction
RA-CMF:基于区域自适应的条件均值流用于CT图像重建
Md Shifatul Ahsan Apurba, Md Selim, Jin Chen
机构
*
Biomedical Informatics(生物医学信息学)
;
Data Science University of Alabama at Birmingham Birmingham, AL, United States(数据科学,阿拉巴马大学伯明翰分校,伯明翰,AL,美国)
;
Computer Science Florida Polytechnic University Lakeland, FL, United States(计算机科学,佛罗里达理工学院,拉凯兰德,FL,美国)
Can large language models assist choice modelling? Insights into prompting strategies and current models' capabilities
大语言模型能否协助选择建模?关于提示策略和当前模型能力的洞察
Georges Sfeir, Gabriel Nova, Stephane Hess, Sander van Cranenburgh
机构
*
Choice Modelling Centre & Institute for Transport Studies, University of Leeds(选择建模中心及交通研究学院,利兹大学)
;
CityAI Lab, Transport and Logistics group, Engineering Systems and Services Department, TU Delft(CityAI实验室,运输与物流组,工程系统与服务部门,代尔夫特理工大学)
VizAnchor: Decoding Manipulation Intent from Tampering Visualizations via Dual-Anchor Reasoning
VizAnchor:通过双锚推理从篡改可视化中解码操纵意图
Xiaotian Zhang, Huayuan Ye, Haiyang Zhang, Chenhui Li, Changbo Wang, Sicheng Song
机构
*
School of Data Science and Engineering, East China Normal University(华东师范大学数据科学与工程学院)
;
Division of Emerging Interdisciplinary Areas, The Hong Kong University of Science and Technology(香港科技大学新兴跨学科领域分部)
;
School of Computer Science and Technology, East China Normal University(华东师范大学计算机科学与技术学院)