arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

European Conference on Computer Vision · 会议 · Computer Vision

2026-07-29 至 2026-07-29 共收录 8
2607.25984 2026-07-29 cs.CV cs.LG 新提交

Schrödinger's Cat: Probabilistic Representation and Prediction of Potential Scene Kinematics

薛定谔的猫:潜在场景运动学的概率表示与预测

Timy Phan, Jannik Wiese, Björn Ommer

AI总结 研究如何从部分观测预测场景演变,提出GARFIELD概率模型,能学习潜在表示实现轨迹联合采样和运动分布访问,实验显示其在运动规划性能、采样速度及密度估计上优势显著。

Comments Accepted at ECCV 2026. Project page: https://compvis.github.io/schroedingers_cat

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25565 2026-07-29 cs.CV 新提交

ReDesign: Recovering Editable Design Structures from Images via Agentic Decomposition

ReDesign:通过智能分解从图像中恢复可编辑设计结构

Jooyeol Yun, Jintae Park, Hyesu Lim, Junha Hyung, Hyungjin Chung, Jaegul Choo

机构 * KAIST AI(韩国科学技术院人工智能研究所) Helmholtz Munich(慕尼黑亥姆霍兹中心) Korea University(韩国大学)

AI总结 研究旨在从图像恢复可编辑设计文件,提出ReDesign智能框架,通过跨模态选工具生成层层次结构,引入优雅验证与评估基准,在视觉保真度和编辑性上表现出色,超越基线和管道。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25362 2026-07-29 cs.CV 新提交

PanoLess: Environment Reconstruction from Partial Reflective Views

PanoLess:从部分反射视图进行环境重建

Ahitagni Das, Ashok Veeraraghavan, Vivek Boominathan

机构 * Rice University(莱斯大学)

AI总结 研究从部分反射视图进行环境重建,提出基于高斯点的PanoLess框架,利用表面对齐二维高斯点和延迟阴影恢复法线与反射线索,生成可见性图,能从部分视图输入实现光照估计,在多数据集上表现出色,实现高保真和几何一致的环境重建。

Comments ECCV 2026. Main paper with supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25125 2026-07-29 cs.CV 新提交

LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos

LENS:用于长视频关键帧采样的自适应时空缩放

Ce Zhang, Jinxi He, Katia Sycara, Yaqi Xie

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

AI总结 研究针对长视频理解受限于上下文窗口的问题,提出无需训练的关键帧采样框架LENS,它能基于文本查询动态分配帧预算,在时空缩放间平衡,提升关键帧采样效果,优于现有方法,提高了Video-MME准确率。

Comments Accepted at ECCV 2026. Project page: https://zhangce01.github.io/LENS/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24794 2026-07-29 cs.AI cs.CV 新提交

Reasoning with Memory: A Temporal Granularity-Adaptive Framework for Training-Free Long Video Understanding

利用记忆进行推理:一种用于免训练长视频理解的时间粒度自适应框架

Linghao Meng, Qiankun Li, Junyuan Mao, Pujin Liao, Zhicheng He, Enbo Zhang, Kun Wang, Yang Liu, Huazhu Fu, Yueming Jin

机构 * National University of Singapore(新加坡国立大学) Institute of High Performance Computing, Agency for Science, Technology and Research (A*STAR)(高性能计算研究所,科学、技术与研究机构(A*STAR)) Nanyang Technological University(南洋理工大学) University of Science and Technology of China(中国科学技术大学) Jilin University(吉林大学)

AI总结 研究针对多模态大语言模型长视频理解受限问题,提出ReMem框架,通过双级记忆增强自适应,在查询和视频级别分别处理,能适应不同时间粒度,经实验验证在多个基准测试中实现高效零样本性能,提升模型长视频推理能力。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06757 2026-07-29 cs.CV 版本更新

FlowInOne:Unifying Multimodal Generation as Image-in, Image-out Flow Matching

FlowInOne:将多模态生成统一为图像输入、图像输出的流匹配

Junchao Yi, Rui Zhao, Jiahao Tang, Weixian Lei, Linjie Li, Qisheng Su, Zhengyuan Yang, Lijuan Wang, Xiaofeng Zhu, Alex Jinpeng Wang

机构 * University of Electronic Science and Technology of China(电子科技大学) Central South University(中南大学) National University of Singapore(新加坡国立大学) University of Science and Technology of China(中国科学技术大学) Microsoft(微软)

AI总结 本文提出FlowInOne框架,将多模态生成统一为纯视觉流匹配,通过视觉提示消除跨模态对齐瓶颈,实现文本到图像生成、布局引导编辑和视觉指令遵循的统一。

Comments Accepted by ECCV 2026. 38 Pages, 21 Figures, 12 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14914 2026-07-29 cs.CV 版本更新

Beyond Prompts: Unconditional 3D Inversion for Out-of-Distribution Shapes

超越提示:无条件3D反演用于分布外形状

Victoria Yue Chen, Emery Pierson, Léopold Maillard, Maks Ovsjanikov

机构 * ETH Zürich(苏黎世联邦理工学院) École Polytechnique(巴黎高等理工学院) Dassault Systèmes(达索系统)

AI总结 研究揭示了文本驱动生成模型在3D形状生成中的局限性,提出通过解耦几何表示与语言敏感性来提升无条件生成的鲁棒性。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09411 2026-07-29 cs.CV 版本更新

SynFlow: Scaling Up LiDAR Scene Flow Estimation with Synthetic Data

SynFlow:通过合成数据扩大LiDAR场景流估计

Qingwen Zhang, Xiaomeng Zhu, Chenhan Jiang, Patric Jensfelt

机构 * RPL, KTH Royal Institute of Technology(RPL,瑞典皇家理工学院) Hong Kong University of Science and Technology(香港科技大学)

AI总结 本文提出SynFlow,通过大规模合成数据生成管道,为LiDAR场景流估计提供鲁棒的运动先验。实验表明,基于SynFlow-4k的模型在多个真实世界基准上表现优异,且在少量真实标签下仍能超越基线模型。

Comments ECCV 2026; 18 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏