arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Kuaishou(快手)

2026-06-24 至 2026-06-24 共收录 3
2606.24636 2026-06-24 cs.AI 新提交

CineCap: Structured Reasoning with Spatio-Temporal Anchors for Cinematographic Video Captioning

CineCap: 基于时空锚点的结构化推理用于电影化视频描述

Xinyu Mao, Yuhui Zeng, Xiaokun Liu, Wenyu Qin, Meng Wang, Xin Tao, Pengfei Wan, Xiaohan Xing, Max Meng

机构 * The Chinese University of Hong Kong(香港中文大学) Xiamen University(厦门大学) Kling Team, Kuaishou Technology(快手科技Kling团队) National University of Singapore(新加坡国立大学) Southern University of Science and Technology(南方科技大学)

AI总结 提出CineCap框架,通过时空锚点结构化推理和强化学习(覆盖完整性、准确性和门控覆盖奖励)生成电影化视频描述,在CineCap Bench基准上达到新最优。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24225 2026-06-24 cs.CV 新提交

Geometry-Instructed Video Editing

几何指导的视频编辑

Chirui Chang, Xiaoyang Lyu, Yi-Hua Huang, Haoru Tan, Shizhen Zhao, Yikang Ding, Jianmin Bao, Xin Tao, Pengfei Wan, Xiaojuan Qi

机构 * The University of Hong Kong(香港大学) Kuaishou Technology(快手科技)

AI总结 提出GIVE框架,通过深度框和方向框统一描述对象状态变化,实现物体级几何编辑(平移、旋转、缩放等),并保持阴影等二次效果一致,在合成和真实视频上展现良好效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20737 2026-06-24 cs.AI cs.LG 新提交

Repeated Shared Access Enables Grokking, but Edit Propagation Depends on an Addressable Memory

重复共享访问实现Grokking,但编辑传播依赖于细粒度可寻址内存

Yanan Niu

机构 * Kuaishou(快手)

AI总结 本研究在合成知识图谱问答中比较四种架构,发现重复共享访问是学习OOD组合的关键,但编辑传播仅在具有细粒度可寻址内存的架构中有效。

Comments 35 pages, 4 figures, 22 tables

详情

展开后加载摘要…

URL PDF HTML 收藏