arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Kuaishou(快手)

2026-08-25 至 2026-08-25 共收录 2
2608.23329 2026-08-25 cs.CV cs.AI 新提交

Thinking Beyond Videos: Unifying Video Reasoning and Deep Research for Open-World Video Agents

超越视频:统一视频推理与深度研究的开放世界视频智能体

Wenqi Liu, Shijie Ma, Yunxiao Wang, Meng Liu, Qile Su, Han Liu, Bohan Hou, Xuanyu Zheng, Changyi Liu, Tianke Zhang, Haonan Fan, Kaiyu Jiang, Yingxin Li, Jiankang Chen, Xu Wang, Bin Wen, Tingting Gao, Han Li, Jianhua Yin, Yinwei Wei, Xuemeng Song

机构 * Shandong University(山东大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Beihang University(北京航空航天大学) City University of Hong Kong(香港城市大学) Nanyang Technological University(南洋理工大学) Kuaishou Technology(快手科技) Southern University of Science and Technology(南方科技大学)

AI总结 本研究提出统一视频推理与深度研究的VideoRover框架,构建相关数据集与基准,其8B-RL模型在无工具直接回答场景性能接近专有模型,优于同工具套件的更大开源模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21776 2026-08-25 cs.CV 新提交

SpatialDiff: 3D-Aware Object Movement via Implicit Spatial Modeling

SpatialDiff:基于隐式空间建模的三维感知物体运动

Zheng Liu, Zijian He, Huiguo He, Weizhi Zhong, Yejun Tang, Huan Yang, Kun Gai, Guanbin Li

机构 * Sun Yat-sen University(中山大学) South China University of Technology(华南理工大学) Kuaishou Technology(快手科技) Shenzhen Loop Area Institute(深圳河套学院)

AI总结 SpatialDiff通过隐式三维空间建模和全局空间监督,解决了现有图像编辑方法难以处理复杂场景中物体空间运动的问题,提升了空间运动的准确性与保真度。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏