arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Amazon(亚马逊)

2026-07-02 至 2026-07-02 共收录 3
2607.00861 2026-07-02 cs.CV cs.GR 新提交

TrajLoc: Trajectory-Attention Localization for Multi-Object Motion Control

TrajLoc: 用于多目标运动控制的轨迹注意力定位

Omer Sela, Inbar Huberman-Spiegelglas, Michael Rotman, Sagie Benaim, Avi Ben-Cohen

机构 * Amazon Prime Video(亚马逊Prime Video) Tel Aviv University(特拉维夫大学)

AI总结 提出TrajLoc方法,通过在注意力层为每个目标替换交叉注意力权重为高斯热图,实现多目标独立轨迹控制,提升图像到视频生成中的视觉保真度和轨迹遵循度。

Comments Project page: https://sela-omer.github.io/traj-loc/ Code: https://github.com/Sela-Omer/traj-loc

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00382 2026-07-02 cs.CV 新提交

Vitality-Aware Compression for Efficient Image-to-Shape Diffusion Transformers

活力感知压缩:面向高效图像到形状扩散Transformer

Jaeah Lee, Hyunjin Kim, Jaewoong Cho, Gihyun Kwon

机构 * KRAFTON AI, Republic of Korea(KRAFTON AI, 韩国) Amazon, Australia(亚马逊, 澳大利亚)

AI总结 提出首个针对图像到形状扩散Transformer的压缩方法,通过活力引导的结构化剪枝、自适应量化和微调,在保持几何保真度下实现高达66%的模型尺寸缩减。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31979 2026-07-02 cs.CV 新提交

Planar-SfM: Camera Pose Estimation via Homography Graph Embeddings

Planar-SfM:通过单应图嵌入的相机姿态估计

Gabi Pragier, Matan Karklinsky, David Ungarish, Avi Ben-Cohen

机构 * Amazon Prime Video Live Events(亚马逊Prime视频直播活动)

AI总结 提出一种利用平面场景中单应分解估计相机姿态的框架,通过构建姿态图并采用谱嵌入过滤不可靠边,提取最大一致生成树恢复姿态,在平面和一般场景中均表现优异。

Comments Accepted at ICPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏