arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

European Conference on Computer Vision · 会议 · Computer Vision

2026-06-24 至 2026-06-24 共收录 8
2605.12218 2026-06-24 cs.CV 版本更新

Learning Ego-Centric BEV Representations from a Perspective-Privileged View: Cross-View Supervision for Online HD Map Construction

从视角优先视角学习自主视角BEV表示:用于在线HD地图构建的跨视角监督

Daniel Lengerer, Mathias Pechinger, Klaus Bogenberger, Carsten Markgraf

机构 * Technical University of Applied Sciences Augsburg, Germany(应用技术大学阿格堡学院,德国) Technical University of Munich, Germany(慕尼黑技术大学,德国)

AI总结 本文提出跨视角监督方法,通过将几何和拓扑先验从视角优先的俯视视角转移到基于摄像头的BEV编码器,提升自主视角BEV表示的一致性,实验显示在nuScenes数据集上取得显著提升。

Comments Accepted at the European Conference on Computer Vision (ECCV) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14792 2026-06-24 cs.CV 版本更新

MSPL: Multi-Step Pseudo-Labeling for Open-Vocabulary Object Detection

MSPL: 用于开放词汇目标检测的多步伪标签方法

Hojun Choi, Youngsun Lim, Jaeyo Shin, Hyunjung Shim

机构 * KAIST AI(韩国韩世大学AI研究所) Boston University(波士顿大学)

AI总结 提出MSPL框架,通过多步视觉推理(目标定位、类别识别、背景确认)生成伪标签,解决开放词汇检测中单步图像-文本匹配忽略中间推理步骤的问题,在OV-COCO和OV-LVIS上取得最优性能。

Comments This paper has been accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21945 2026-06-24 cs.CV 版本更新

GENA3D: Generative Amodal 3D Modeling by Bridging 2D Priors and 3D Coherence

GENA3D:通过桥接2D先验和3D一致性的生成式非完整3D建模

Junwei Zhou, Yu-Wing Tai

机构 * Dartmouth College(达特茅斯学院)

AI总结 提出GENA3D框架,结合2D生成先验与3D几何推理,在部分遮挡下生成完整且几何一致的3D物体,优于现有方法。

Comments Paper accepted by ECCV 2026. Project page: https://colezwhy.github.io/gena3d/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10931 2026-06-24 cs.CV 版本更新

M4-SAR: A Multi-Resolution, Multi-Polarization, Multi-Scene, Multi-Source Dataset and Benchmark for optical-SAR Object Detection

M4-SAR:面向光学-SAR目标检测的多分辨率、多极化、多场景、多源数据集与基准

Chao Wang, Wei Lu, Xiang Li, Jian Yang, Lei Luo

机构 * Nanjing University of Science and Technology(南京理工大学) Anhui University(安徽大学) Nankai University(南开大学)

AI总结 针对光学与SAR图像融合检测缺乏大规模标准化数据集的问题,构建了包含112,174对对齐图像和近百万标注实例的M4-SAR数据集,并提出端到端融合检测框架E2E-OSDet,实验表明融合可提升mAP 5.7%。

Comments Accepted at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21029 2026-06-24 cs.CV 版本更新

FlowerDance: MeanFlow for Efficient and Refined 3D Dance Generation

FlowerDance: MeanFlow实现高效精细的3D舞蹈生成

Kaixing Yang, Xulong Tang, Ziqiao Peng, Xiangyue Zhang, Puwei Wang, Jun He, Hongyan Liu

机构 * Renmin University of China(中国人民大学) Tsinghua University(清华大学) Wuhan University(武汉大学) Malou Tech Inc(Malou科技公司)

AI总结 提出FlowerDance,结合MeanFlow与物理一致性约束,以少量采样步骤生成高质量舞蹈,并采用BiMamba骨干和通道级跨模态融合实现高效非自回归生成,支持运动编辑,在AIST++和FineDance上达到最优。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18037 2026-06-24 cs.CV 版本更新

Hybrid Event Frame Sensors: Modeling, Calibration, and Simulation

混合事件帧传感器:建模、标定与仿真

Yunfan Lu, Nico Messikommer, Xiaogang Xu, Liming Chen, Yuhan Chen, Nikola Zubic, Davide Scaramuzza, Hui Xiong

机构 * AI Thrust, HKUST(GZ)(人工智能 thrust,香港科技大学(广州)) RPG, University of Zurich(RPG,苏黎世大学) CUHK(香港中文大学) AlpsenTek(阿尔卑斯电子技术)

AI总结 提出首个统一统计成像噪声模型,联合描述APS和EVS像素噪声,开发标定流程估计参数,并构建H-ESIM仿真器生成含真实噪声的RAW帧和事件。

Comments 20 pages, 7 figures, ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14001 2026-06-24 cs.CV cs.AI cs.LG 版本更新

MOCHA: Multi-modal Objects-aware Cross-arcHitecture Alignment

MOCHA: 多模态对象感知的跨架构对齐

Elena Camuffo, Francesco Barbato, Mete Ozay, Simone Milani, Umberto Michieli

机构 * University of Padova(帕多瓦大学)

AI总结 提出MOCHA蒸馏框架,将冻结VLM教师的多模态区域知识迁移至轻量视觉检测器,通过双重损失实现局部对齐与全局关系一致性,在少样本个性化检测中平均提升10.1%。

Comments 18 pages main paper, 10 pages supplementary material

Journal ref Proceedings of ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17338 2026-06-24 cs.CV cs.AI 版本更新

Render-FM: Feedforward Model for Real-time Photorealistic Volumetric Rendering

Render-FM: 用于实时逼真体积渲染的前馈模型

Zhongpai Gao, Benjamin Planche, Meng Zheng, Anwesa Choudhuri, Van Nguyen Nguyen, Terrence Chen, Ziyan Wu

机构 * United Imaging Intelligence(联合影像智能)

AI总结 提出Render-FM前馈模型,直接从CT体积回归6D高斯溅射参数,实现2.8秒实时渲染,速度提升500倍,并引入解剖引导初始化提升医学图像渲染质量。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏