arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Microsoft(微软)

2026-07-30 至 2026-07-30 共收录 4
2607.27194 2026-07-30 cs.CV cs.RO 新提交

VidMap: Exploiting Temporal Structure for Video-Based Structure-from-Motion

VidMap:利用时序结构实现基于视频的运动恢复结构

Zador Pataki, Paul-Edouard Sarlin, Marc Pollefeys

机构 * ETH Zurich(苏黎世联邦理工学院) Google(谷歌) Microsoft(微软)

AI总结 VidMap结合SLAM序列约束与SfM全局优化,利用宽基线匹配和深度先验,在多样挑战性数据集上,较最新SLAM和SfM更鲁棒准确,可实现任意长未标定视频的度量重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26200 2026-07-30 cs.CL 新提交

Choosing Where and How to Moderate: End-to-End Trade-offs in Filter Placement and Response Rewriting

选择 moderation 的位置与方式:过滤点与响应重写的端到端权衡

Mengya Hu, Susie Park, Suzana Ilic, Qiong Wei, Sandeep Atluri, Myra Deng, Tucker Fross, Curt Tigges

机构 * Microsoft Responsible AI(微软负责任人工智能部门) Goodfire(古德法尔公司)

AI总结 该研究针对内容审核部署中的过滤点与响应方式,对比不同方案的有用性、有害暴露等指标,发现响应重写可平衡流量恢复与安全,支持按部署约束选择审核配置。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26165 2026-07-30 cs.CV 新提交

DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving

DVPSFormer:面向自动驾驶的高效在线深度感知视频全景分割

Yung-Hsu Yang, Luigi Piccinelli, Siyuan Li, Mattia Segu, Lei Ke, Martin Danelljan, Yuqian Fu, Zuria Bauer, Fisher Yu, Hermann Blum, Marc Pollefeys

机构 * ETH Zürich(苏黎世联邦理工学院) INSAIT, Sofia University(保加利亚索菲亚大学INSAIT研究所) University of Bonn(波恩大学) Microsoft(微软公司)

AI总结 DVPSFormer是一种统一在线架构,通过ESD和OMV机制实现高效4D场景理解,在两个DVPS基准上达SOTA,为自动驾驶提供在线机器人感知的精简方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28027 2026-07-30 eess.IV cs.AI cs.CV cs.LG 版本更新

MLVC: Multi-platform Learned Video Codec for Real-World Deployment

MLVC:面向实际部署的多平台学习型视频编解码器

Tanel Pärnamaa, Martin Lumiste, Ardi Loot, Evgenii Indenbom, Andrei Znobishchev, Ando Saabas

机构 * Microsoft Corporation(微软公司)

AI总结 提出MLVC,一种跨平台鲁棒的神经视频编解码器,通过超先验显式传输缩放参数保证熵编码一致性,结合门控记忆、ReGLU激活等架构改进,在VCD基准上相比硬件HEVC实现>70% BD-rate提升,且与无法跨平台运行的DCVC-RT主观质量相当。

Comments Accepted to ECCV 2026. Code: https://github.com/microsoft/mlvc

详情

展开后加载摘要…

URL PDF HTML 收藏