arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Texas at Austin(得克萨斯大学奥斯汀分校)

2026-01-01 至 2026-01-01 共收录 3
2512.24026 2026-01-01 cs.CV cs.AI

PipeFlow: Pipelined Processing and Motion-Aware Frame Selection for Long-Form Video Editing

PipeFlow: 管道处理与运动感知帧选择用于长格式视频编辑

Mustafa Munir, Md Mostafijur Rahman, Kartikeya Bhardwaj, Paul Whatmough, Radu Marculescu

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) Qualcomm AI Research(高通人工智能研究)

AI总结 PipeFlow通过运动感知帧选择和流水线任务调度,实现长格式视频编辑的高效处理,相比现有方法速度提升达9.6至31.7倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23988 2026-01-01 cs.CL cs.AI cs.LG

Fantastic Reasoning Behaviors and Where to Find Them: Unsupervised Discovery of the Reasoning Process

非凡的推理行为及其发现位置:无监督发现推理过程

Zhenyu Zhang, Shujian Zhang, John Lambert, Wenxuan Zhou, Zhangyang Wang, Mingqing Chen, Andrew Hard, Rajiv Mathews, Lun Wang

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) Google DeepMind(谷歌DeepMind)

AI总结 本研究提出无监督框架RISE,通过稀疏自编码器发现LLM推理行为,揭示可解释的推理特征并控制推理轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.06507 2026-01-01 cs.CV

Reconstructing Hand-Held Objects in 3D from Images and Videos

从图像和视频中重建手持物体的三维结构

Jane Wu, Georgios Pavlakos, Georgia Gkioxari, Jitendra Malik

机构 * UC Berkeley(伯克利大学) UT Austin(德克萨斯大学奥斯汀分校) Caltech(加州理工学院)

AI总结 本文提出了一种基于3D手和物体联合重建的方法,通过检索增强重建实现对视频中手持物体的高效三维重建。

Comments 3DV 2026, Project page: https://janehwu.github.io/mcc-ho

详情

展开后加载摘要…

URL PDF HTML 收藏