arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 19082 信号源:cs.CV, cs.GR, cs.RO

1. Gaussian Splatting 3163 篇

2407.15187 2024-07-23 cs.CV cs.GR 62%

HoloDreamer: Holistic 3D Panoramic World Generation from Text Descriptions

Haiyang Zhou, Xinhua Cheng, Wangbo Yu, Yonghong Tian, Li Yuan

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

Comments Homepage: https://zhouhyocean.github.io/holodreamer

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11793 2024-07-17 cs.CV cs.AI cs.GR 62%

Click-Gaussian: Interactive Segmentation to Any 3D Gaussians

Seokhun Choi, Hyeonseop Song, Jaechul Kim, Taehyeong Kim, Hoseok Do

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

Comments Accepted to ECCV 2024. The first two authors contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18462 2024-06-27 cs.CV cs.GR 62%

GaussianDreamerPro: Text to Manipulable 3D Gaussians with Highly Enhanced Quality

Taoran Yi, Jiemin Fang, Zanwei Zhou, Junjie Wang, Guanjun Wu, Lingxi Xie, Xiaopeng Zhang, Wenyu Liu, Xinggang Wang, Qi Tian

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

Comments Project page: https://taoranyi.com/gaussiandreamerpro/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.18546 2024-05-15 cs.RO cs.AI cs.CV 62%

Efficient Heatmap-Guided 6-Dof Grasp Detection in Cluttered Scenes

Siang Chen, Wei Tang, Pengwei Xie, Wenming Yang, Guijin Wang

专题命中 Gaussian Splatting :point cloud(abstract);分类 cs.CV、cs.RO

Comments Extensive results on GraspNet-1B dataset

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.19398 2024-05-03 cs.GR cs.CV 62%

3D Gaussian Blendshapes for Head Avatar Animation

Shengjie Ma, Yanlin Weng, Tianjia Shao, Kun Zhou

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

Comments ACM SIGGRAPH Conference Proceedings 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.12888 2024-04-22 cs.CV cs.GR cs.LG 62%

Learn2Talk: 3D Talking Face Learns from 2D Talking Face

Yixiang Zhuang, Baoping Cheng, Yao Cheng, Yuntao Jin, Renshuai Liu, Chengyang Li, Xuan Cheng, Jing Liao, Juncong Lin

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.16812 2024-04-08 cs.CV cs.GR 62%

Spacetime Gaussian Feature Splatting for Real-Time Dynamic View Synthesis

Zhan Li, Zhang Chen, Zhong Li, Yi Xu

专题命中 Gaussian Splatting :novel view synthesis(abstract);分类 cs.CV、cs.GR

Comments Accepted to CVPR 2024. Project page: https://oppo-us-research.github.io/SpacetimeGaussians-website/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14554 2024-03-22 cs.CV cs.GR 62%

Gaussian Frosting: Editable Complex Radiance Fields with Real-Time Rendering

Antoine Guédon, Vincent Lepetit

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

Comments Project Webpage: https://anttwo.github.io/frosting/

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.15401 2024-01-30 cs.GR cs.CV 62%

VoGE: A Differentiable Volume Renderer using Gaussian Ellipsoids for Analysis-by-Synthesis

Angtian Wang, Peng Wang, Jian Sun, Adam Kortylewski, Alan Yuille

专题命中 Gaussian Splatting :point cloud(abstract);分类 cs.CV、cs.GR

Comments Accepted by ICLR2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.05345 2024-01-12 cs.CV cs.GR cs.PF 62%

DISTWAR: Fast Differentiable Rendering on Raster-based Rendering Pipelines

Sankeerth Durvasula, Adrian Zhao, Fan Chen, Ruofan Liang, Pawan Kumar Sanjaya, Nandita Vijaykumar

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.02121 2023-12-05 cs.MS cs.CV cs.GR cs.NA math.NA 62%

Mathematical Supplement for the $\texttt{gsplat}$ Library

Vickie Ye, Angjoo Kanazawa

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

Comments Find the library at: https://docs.gsplat.studio/

详情

展开后加载摘要…

URL PDF HTML 收藏
2009.00221 2020-09-02 cs.RO cs.CV 62%

Gaussian Process Gradient Maps for Loop-Closure Detection in Unstructured Planetary Environments

Cedric Le Gentil, Mallikarjuna Vayugundla, Riccardo Giubilato, Wolfgang Stürzl, Teresa Vidal-Calleja, Rudolph Triebel

专题命中 Gaussian Splatting :point cloud(abstract);分类 cs.CV、cs.RO

Comments This work is accepted for presentation at the 2020 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS). Please find IEEE's copyright statement at the bottom of the first page. Cedric Le Gentil and Mallikarjuna Vayugundla share the first authorship of this paper

详情

展开后加载摘要…

URL PDF HTML 收藏
1904.05537 2019-06-13 cs.CV cs.GR 62%

Direct Fitting of Gaussian Mixture Models

Leonid Keselman, Martial Hebert

专题命中 Gaussian Splatting :point cloud(abstract);分类 cs.CV、cs.GR

Comments Accepted to the Conference on Computer and Robot Vision 2019. 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1707.08626 2017-07-28 cs.CV cs.AI cs.RO 62%

Robust Rigid Point Registration based on Convolution of Adaptive Gaussian Mixture Models

Can Pu, Nanbo Li, Robert B Fisher

专题命中 Gaussian Splatting :point cloud(abstract);分类 cs.CV、cs.RO

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04802 2026-08-28 cs.CV cs.AI 版本更新 57%

Egosurg: Arbitrary view synthesis for egocentric replay of operating room workflows from ambient cameras

EgoSurg:基于环境相机的手术室工作流程自我中心视角回放的任意视角合成

Han Zhang, Lalithkumar Seenivasan, Jose L. Porras, Roger D. Soberanis-Mukul, Hao Ding, Hongchao Shu, Benjamin D. Killeen, Ankita Ghosh, Lonny Yarmus, Jeffrey K. Jopling, Masaru Ishii, Angela C. Argento, Mathias Unberath

机构 * Johns Hopkins University(约翰霍普金斯大学) Johns Hopkins Medical Institutions(约翰霍普金斯医学机构)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 EgoSurg框架基于环境相机的立体视频重建手术室场景,渲染角色特定的自我中心视角,经评估可实现高质量重建,支持手术安全审查、培训等应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20335 2026-08-21 cs.CV 新提交 57%

4DAnyone: Create Anyone in 4D from a Casual Monocular Video

4DAnyone:从随意的单目视频中创建4D虚拟人物

Yudong Jin, Tao Xie, Qihang Zhang, Zehong Shen, Zhen Xu, Yujun Shen, Hujun Bao, Xiaowei Zhou, Yinghao Xu

机构 * State Key Lab of CAD&CG, Zhejiang University(浙江大学CAD&CG国家重点实验室) Robbyant Chinese University of Hong Kong(香港中文大学) Ant Group(蚂蚁集团) Hong Kong University of Science and Technology(香港科技大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 4DAnyone是一种从单目视频重建4D人体的框架,通过RCP和TCR解决多视图一致性问题,在相关数据集上优于现有方法且泛化性好。

Comments Project page: https://4danyone.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19556 2026-08-21 cs.CV cs.AI 新提交 57%

Stream4D: 4D-Consistency for Streaming Autoregressive Diffusion Video Models

Stream4D:面向流式自回归扩散视频模型的4D一致性

Yuanhao Ban, Jiaqi Feng, Hengguang Zhou, Xiaohuan Pei, Justin Cui, Cho-Jui Hsieh

机构 * UCLA(加州大学洛杉矶分校) Tsinghua University(清华大学)

专题命中 Gaussian Splatting :3D reconstruction(abstract);分类 cs.CV

AI总结 Stream4D用显式建模场景动力学的前馈4D重建奖励替代静态评判器,结合运动先验与感知锚,提升流式自回归扩散视频模型的4D重建质量、运动保留效果及人类对齐偏好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14986 2026-08-18 cs.RO cs.AI 新提交 57%

GaussMemory: Task-Driven 3D Gaussian Scene Memory for Long-Horizon Robotic Manipulation

GaussMemory:面向长时程机器人操作的任务驱动三维高斯场景记忆

Zhiqiang Hu, Shouren Huang, Masatoshi Ishikawa

机构 * Research Institute for Science & Technology, Tokyo University of Science(东京理科大学科学技术研究所)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.RO

AI总结 该研究针对现有三维机器人记忆系统被动存储的缺陷,提出任务驱动的主动场景记忆框架GaussMemory,在LIBERO、VLABench基准上超越了MemoryVLA、π₀-FAST等方法。

Comments 8 pages, 10 figures. Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03023 2026-08-05 cs.CV cs.AI 新提交 57%

Standalone DINOv3 for Training-Free Open-Vocabulary Semantic Segmentation in Remote Sensing

用于遥感领域无需训练的开放词汇语义分割的独立DINOv3模型

Changhao Zhao, Haoxiang Li, Yuke Li, Hai Liu, LingLin Zeng

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 针对遥感语义分割标注成本高的问题,提出无需训练的DinoSplat-OV框架,结合DINOv3的文本感知拉普拉斯传播与高斯溅射上采样模块,在多数据集上取得优于现有方法的性能,填补了DINO系列模型在该领域的空白。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02206 2026-08-04 cs.CV 新提交 57%

CLEAR: Conflict-aware Learning via Evidence-guided Adaptive Routing for Unified Sparse-View 3D Gaussian Super-Resolution

CLEAR:面向统一稀疏视图三维高斯超分辨率的证据引导自适应路由的冲突感知学习

Hantang Li, Qiang Zhu, Xiandong Meng, Debin Zhao, Xiaopeng Fan

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 针对稀疏视图三维高斯超分辨率的误差累积问题,提出首个统一单阶段框架CLEAR,通过冲突感知优化、证据引导路由等技术,在4×超分辨率基准上实现了最优渲染质量与几何保真度。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11500 2026-08-04 cs.CV 版本更新 57%

HyperGS: Fast and Generalizable Gaussian Video Representation

HyperGS:快速且通用的高斯视频表示

Fatimah Zohra, Chen Zhao, Shuming Liu, Yahya Al Malallah, Bernard Ghanem

机构 * King Abdullah University of Science and Technology (KAUST)(阿卜杜拉国王科技大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究针对高斯视频表示中现有方法依赖单视频优化、编码慢且通用性受限的问题,提出HyperGS方法,通过设计特定Transformer提取令牌和获得高斯表示,结合正则化器解决退化问题,实现快速编码及跨视频通用,提升了PSNR。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27634 2026-07-31 cs.CV 新提交 57%

4DHumanDiff: Direct Text-to-4DGS Generation for Consistent 360-Degree Dynamic Humans

4DHumanDiff:直接基于文本生成4DGS以实现一致的360度动态人类

Renlong Wu, Haoran Chen, Yuxiang Wei, Xiaowei Jin, Wangmeng Zuo, Hui Li

机构 * School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 针对文本生成360度动态人类的现有方法存在成本高、一致性差的问题,本文提出4DHumanDiff扩散框架,直接基于文本生成4DGS表示的动态人类,结合新数据集与技术,实现高效且一致性更好的生成。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24353 2026-07-31 cs.CV cs.LG 版本更新 57%

Open-Vocabulary BEV Segmentation with 3D-Aware Geometric Constraints

开放词汇BEV分割:基于3D感知几何约束的方法

Hojun Choi, Seulbin Hwang, Daejung Kim, Kisung Kim, Hyunjung Shim, Jinhan Lee

机构 * KAIST AI(韩国科学技术院人工智能) NAVER LABS(NAVER实验室)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 针对开放词汇BEV分割中2D VLM语义到BEV的3D几何不一致问题,提出OVBEVSeg框架,通过三阶段几何约束(伪标签、场景优化、知识蒸馏)实现高效在线推理,在nuScenes上未见类别mIoU超越闭集方法15.3,推理速度提升2.5倍。

Comments This paper has been accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19100 2026-07-22 cs.CV 新提交 57%

FlexiAvatar: Unified 3D Gaussian Human Avatars Under Arbitrary Body Visibility

FlexiAvatar:任意身体可见性下的统一3D高斯人体头像

Yihalem Yimolal Tiruneh, Muhammad Salman Ali, Uyoung Jeong, Muneeb A. Khan, MD Khalequzzaman Chowdhury Sayem, Allanur Bayramgeldiyev, Binod Bhattarai, Seungryul Baek

机构 * UNIST(韩国蔚山科学技术院) University of Aberdeen(阿伯丁大学) University College London(伦敦大学学院) Fogsphere(雾球公司)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究从单目视频重建3D人体头像问题,提出FlexiAvatar框架,结合遮挡鲁棒跟踪与特定部分残差细化捕捉细节,用扩散方法处理不可见区域,实验表明其重建质量高,还能减少运行时和内存开销。

Comments Accepted in ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17896 2026-07-21 cs.CV 新提交 57%

Locality-Aware Density Control for Efficient Gaussian-based Image Representation

用于高效基于高斯的图像表示的局部感知密度控制

Jiacong Chen, Qingyu Mao, Xiandong Meng, Shuai Liu, Chao Li, Fanyang Meng, Youneng Bao, Yongsheng Liang

机构 * Shenzhen University(深圳大学) Pengcheng Laboratory(鹏城实验室) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究二维高斯喷溅图像表示中高斯容量分配低效问题,提出局部感知密度控制框架LocoADC,通过区域高斯致密化和相似性驱动高斯合并策略及局部颜色一致性约束,有效提升高斯容量利用率,改进图像表示。

Comments Accepted by ACMMM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16362 2026-07-21 cs.CV 新提交 57%

OmniStyle-INR: Universal and Multimodal Style Transfer for INRs

OmniStyle-INR:用于隐式神经表示的通用多模态风格迁移

Rafał Kajca, Michał Miziołek, Kornel Howil, Rafał Tobiasz, Przemysław Spurek

机构 * Jagiellonian University(雅盖隆大学) IDEAS Research Institute(IDEAS 研究所)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究针对不同数据模态的风格迁移问题,提出OmniStyle-INR框架,利用基于网络的连续表示作为通用域,实现了在文本提示和视觉示例引导下跨视觉模态的高质量风格迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16309 2026-07-21 cs.CV 新提交 57%

SaaF: Scene-Specific Ambiguity-Aware 3D Language Fields towards Interactive Real-World Object Retrieval

SaaF:面向交互式现实世界对象检索的特定场景模糊感知3D语言场

Yuga Yano, Daiju Kanaoka, Hakaru Tamukoh, Yasutomo Kawanishi

机构 * Kyushu Institute of Technology(九州工业大学) RIKEN(理化学研究所) Research Center for Neuromorphic AI Hardware(神经形态人工智能硬件研究中心)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究针对现实世界场景中交互式对象检索问题,提出SaaF方法。通过引入度量学习策略构建统一特征空间,增强实例辨别性与模糊感知能力,提升了检索准确性,还能稳健处理查询模糊性。

Comments 8 pages, accepted as a conference paper for IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08982 2026-07-21 cs.CV 版本更新 57%

CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation

CityLoc:基于高斯表示的大规模场景文本描述的6自由度姿态分布定位

Qi Ma, Runyi Yang, Bin Ren, Nicu Sebe, Ender Konukoglu, Luc Van Gool, Danda Pani Paudel

机构 * Computer Vision Lab, ETH Zurich(苏黎世联邦理工学院计算机视觉实验室) University of Pisa(比萨大学) University of Trento(特伦托大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究大规模场景文本描述的6自由度姿态分布定位问题,核心方法是用基于扩散架构结合预训练文本编码器细化姿态,经3D高斯渲染提高精度,通过与标准方法对比验证其在多数据集上的优越性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15806 2026-07-20 cs.CV 新提交 57%

HybridSim: A Physics-Learning Hybrid Digital Twin for mmWave Human Sensing

HybridSim:用于毫米波人体感知的物理学习混合数字孪生

Weitao Xiong, Tianyu Liu, Peng Li, Kok Chung Chua, Toa Chean Khim, Pu Wang, Hongfei Xue

机构 * Xiamen University Malaysia(厦门大学马来西亚分校) The Hong Kong University of Science and Technology(香港科技大学) University of North Carolina at Charlotte(北卡罗来纳大学夏洛特分校)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究针对毫米波雷达信号模拟成本高问题,提出HybridSim混合模拟器,用三平面和图卷积网络等提取人体特征、稳定优化,通过逆渲染等建模信号路径,实验显示其能有效增强特定地点数据,提升人体感知任务表现。

Comments Accepted to ECCV 2026. Project Page: https://weitao-xiong.github.io/HybridSim/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13154 2026-07-20 cs.RO 版本更新 57%

Worlds in One Demo: A Synthetic Data Engine for Learning Open-World Mobile Manipulation

世界合一演示:用于学习开放世界移动操作的合成数据引擎

Lingxiao Guo, Huanyu Li, Guanya Shi

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.RO

AI总结 研究如何通过合成数据引擎WANDA从单个演示学习开放世界移动操作策略,利用重建背景、重排交互片段、校正状态扩展等方法,实现长期鲁棒性、空间泛化和跨环境泛化,还支持跨实体数据生成。

Comments Project website: https://wanda.lecar-lab.org/

详情

展开后加载摘要…

URL PDF HTML 收藏