arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Google(谷歌)

2026-06-08 至 2026-06-08 共收录 3
2606.07249 2026-06-08 cs.CV 新提交

Reconstructing Multi-Decadal Forest Disturbances: A Spatio-Temporal Transformer Approach

重建多年代森林干扰:一种时空Transformer方法

Linus Scheibenreif, Anton Raichuk, Maxim Neumann

机构 * Google DeepMind(谷歌DeepMind)

AI总结 提出时空Transformer框架,同时建模时间轨迹和空间邻域,利用Landsat、Sentinel-1/2数据重建美国1984-2022年森林干扰图,在手动标注验证集上达到高精度并减少空间伪影。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07079 2026-06-08 cs.CV 新提交

AsyncPatch Diffusion: spatially-flexible image generation

异步补丁扩散:空间灵活的图像生成

Samuele Papa, Valentin De Bortoli, Guillaume Couairon, Daniel Sýkora, Romuald Elie, Klaus Greff

机构 * Google DeepMind(谷歌DeepMind) University of Amsterdam(阿姆斯特丹大学) The Netherlands Cancer Institute(荷兰癌症研究所)

AI总结 提出AsyncPatch Diffusion框架,通过为不同空间区域分配不同噪声水平实现异质去噪轨迹,在保持生成质量的同时原生支持图像修复和自适应生成。

Comments 36 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06601 2026-06-08 cs.CV cs.AI cs.LG 新提交

Direct 3D-Aware Object Insertion via Decomposed Visual Proxies

通过分解视觉代理实现直接3D感知物体插入

Jingbo Gong, Yikai Wang, Yushi Lan, Yuhao Wan, Ziheng Ouyang, Rui Zhao, Ming-Ming Cheng, Qibin Hou, Chen Change Loy

机构 * Google(谷歌) Black Forest Labs(黑森林实验室)

AI总结 提出DIRECT框架,通过分解外观、几何和上下文引导,实现可控制3D姿态的物体插入,在几何可控性和视觉质量上优于现有方法。

Comments ICML 2026; Project Page: https://gong1130.github.io/DIRECT/

详情

展开后加载摘要…

URL PDF HTML 收藏