arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2025-12-12 至 2025-12-12 共收录 16 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 3 篇

2512.10095 2025-12-12 cs.CV 79%

TraceFlow: Dynamic 3D Reconstruction of Specular Scenes Driven by Ray Tracing

TraceFlow: 通过光线追踪驱动的动态3D重建

Jiachen Tao, Junyi Wu, Haoxuan Wang, Zongxin Yang, Dawen Cai, Yan Yan

专题命中 三维重建 :3D reconstruction(title);Gaussian Splatting(abstract);分类 cs.CV

AI总结 TraceFlow通过残差材料增强的2D高斯点分布和混合渲染流水线,实现了动态镜面场景的高保真渲染,提升了复杂环境中的镜面反射效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10379 2025-12-12 cs.CV 70%

Self-Supervised Contrastive Embedding Adaptation for Endoscopic Image Matching

自监督对比嵌入适应用于内窥镜图像匹配

Alberto Rota, Elena De Momi

机构 * Department of Electronics, Information and Bioengineering, Politecnico di Milano(电子、信息与生物工程系,米兰理工学院)

专题命中 三维重建 :3D reconstruction(abstract);spatial understanding(abstract);分类 cs.CV

AI总结 本研究提出了一种自监督对比嵌入适应方法,用于提高内窥镜图像匹配的精度和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.08591 2025-12-12 cs.CV 57%

Joint2Human: High-quality 3D Human Generation via Compact Spherical Embedding of 3D Joints

Joint2Human: 通过紧凑的球面嵌入3D关节实现高质量3D人体生成

Muxin Zhang, Qiao Feng, Zhuo Su, Chao Wen, Zhou Xue, Kun Li

机构 * College of Intelligence and Computing, Tianjin University(智能与计算学院,天津大学) PICO IDL, ByteDance China(字节跳动中国PICO IDL) Li Auto(利亚德)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV

AI总结 Joint2Human通过紧凑球面嵌入3D关节,结合2D扩散模型和多视角重绘策略,实现高质量3D人体生成,兼顾全局结构与局部细节。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 7 篇

2510.07752 2025-12-12 cs.CV 83%

DEGS: Deformable Event-based 3D Gaussian Splatting from RGB and Event Stream

DEGS: 从RGB和事件流中基于可变形的3D高斯点云重建

Junhao He, Jiaxu Wang, Jia Li, Mingyuan Sun, Qiang Zhang, Jiahang Cao, Ziyi Zhang, Yi Gu, Jingkai Sun, Renjing Xu

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Hong Kong University of Science and Technology(香港科技大学) University of Hong Kong(香港大学) Northeastern University(东北大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);分类 cs.CV

AI总结 本文提出DEGS框架,结合RGB和事件流优化动态3DGS,通过事件运动先验指导变形场优化,提升重建性能。

Comments Accepted by IEEE TVCG

Journal ref 2025 IEEE Transactions on Visualization and Computer Graphics

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09335 2025-12-12 cs.CV cs.MM 81%

Relightable and Dynamic Gaussian Avatar Reconstruction from Monocular Video

可重照明和动态高斯人偶重建从单目视频

Seonghwa Choi, Moonkyeong Choi, Mingyu Jang, Jaekyung Kim, Jianfei Cai, Wen-Huang Cheng, Sanghoon Lee

机构 * Yonsei University(延世大学) Monash University(莫纳什大学) National Taiwan University(国立台湾大学)

专题命中 Gaussian Splatting :NeRF(abstract);Gaussian Splatting(abstract);3DGS(abstract);novel view synthesis(abstract)

AI总结 本文提出了一种基于3DGS的人偶建模框架RnD-Avatar,通过动态皮肤权重和新的正则化方法实现高保真几何细节,支持在任意光照条件下进行逼真渲染和重照明。

Comments 8 pages, 9 figures, published in ACM MM 2025

Journal ref In Proceedings of the 33rd ACM International Conference on Multimedia. 2025. p. 7405-7414

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10939 2025-12-12 cs.CV 79%

GaussianHeadTalk: Wobble-Free 3D Talking Heads with Audio Driven Gaussian Splatting

GaussianHeadTalk: 无抖动的3D说话头:基于音频驱动的高斯点云法

Madhav Agarwal, Mingtian Zhang, Laura Sevilla-Lara, Steven McDonagh

机构 * University of Edinburgh(爱丁堡大学) University College London(伦敦大学学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 本文提出基于音频驱动的3D说话头生成方法,利用高斯点云法和Transformer模型实现高保真、实时的虚拟角色生成。

Comments IEEE/CVF Winter Conference on Applications of Computer Vision 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10572 2025-12-12 cs.GR 79%

DeMapGS: Simultaneous Mesh Deformation and Surface Attribute Mapping via Gaussian Splatting

DeMapGS:通过高斯散射实现同时的网格变形与表面属性映射

Shuyi Zhou, Shengze Zhong, Kenshi Takayama, Takafumi Taketomi, Takeshi Oishi

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.GR

AI总结 DeMapGS通过高斯散射实现网格变形与表面属性映射的联合优化,提升重建质量与下游应用能力。

Comments Project page see https://shuyizhou495.github.io/DeMapGS-project-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17951 2025-12-12 cs.CV 79%

SplatCo: Structure-View Collaborative Gaussian Splatting for Detail-Preserving Rendering of Large-Scale Unbounded Scenes

SplatCo:结构-视图协作高斯点溅射用于大规模无界场景的细节保留渲染

Haihong Xiao, Jianan Zou, Yuxin Zhou, Ying He, Wenxiong Kang

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 SplatCo通过结构-视图协作机制,实现大规模无界场景的高保真渲染,结合全局与局部特征融合、视图修剪和共学模块,提升渲染质量和存储效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10293 2025-12-12 cs.CV 70%

Physically Aware 360$^\circ$ View Generation from a Single Image using Disentangled Scene Embeddings

基于单张图像的物理感知360度视图生成

Karthikeya KV, Narendra Bandaru

专题命中 Gaussian Splatting :NeRF(abstract);Gaussian Splatting(abstract);分类 cs.CV

AI总结 Disentangled360通过结合方向解耦体积渲染和单图像360°视图合成,实现了医学影像和自然场景重建中的高效真实感视图生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05991 2025-12-12 cs.CV 57%

EmoDiffTalk:Emotion-aware Diffusion for Editable 3D Gaussian Talking Head

EmoDiffTalk:面向可编辑3D高斯说话头的情绪感知扩散

Chang Liu, Tianjiao Jing, Chengcheng Ma, Xuanqi Zhou, Zhengxuan Lian, Qin Jin, Hongliang Yuan, Shi-Sheng Huang

机构 * Beijing Normal University(北京师范大学) Renmin University of China(中国人民大学) Tencent AI Lab(腾讯AI实验室)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 EmoDiffTalk通过情绪感知高斯扩散实现细粒度面部动画与多模态情绪编辑,提升3D说话头的情绪表达精度和可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 3 篇

2512.10376 2025-12-12 cs.CV 79%

RaLiFlow: Scene Flow Estimation with 4D Radar and LiDAR Point Clouds

RaLiFlow: 基于4D雷达和激光雷达点云的场景流估计

Jingyun Fu, Zhiyu Xiang, Na Zhao

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 RaLiFlow是首个联合4D雷达和激光雷达的场景流学习框架,通过动态感知双向跨模态融合模块和精心设计的损失函数实现高效的雷达-激光雷达融合。

Comments Accepted by AAAI

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10321 2025-12-12 cs.CV 79%

Point2Pose: A Generative Framework for 3D Human Pose Estimation with Multi-View Point Cloud Dataset

Point2Pose:基于多视角点云数据集的3D人体姿态估计生成框架

Hyunsoo Lee, Daeum Jeon, Hyeokjae Oh

机构 * ECE, Seoul National University(首尔国立大学电子与计算机工程系) CS, KAIST(韩国科学技术院计算机科学系) Soulart Inc.(Soulart公司)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 Point2Pose通过生成模型和大规模数据集提升3D人体姿态估计的准确性与鲁棒性。

Comments WACV 2026 camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00173 2025-12-12 cs.LG physics.bio-ph physics.data-an q-bio.QM 50%

Enhanced Spatial Clustering of Single-Molecule Localizations with Graph Neural Networks

利用图神经网络增强单分子定位的空域聚类

Jesús Pineda, Sergi Masó-Orriols, Montse Masoliver, Joan Bertran, Mattias Goksör, Giovanni Volpe, Carlo Manzo

机构 * University of Gothenburg(哥德堡大学) Universitat de Vic – Universitat Central de Catalunya (UVic-UCC)(维克大学–中央加泰罗尼亚大学) Institut de Recerca i Innovació en Ciències de la Vida i de la Salut a la Catalunya Central (IRIS-CC)(加泰罗尼亚中央生命与健康研究所) Science for Life Laboratory, Department of Physics(生命科学实验室,物理系)

专题命中 点云 :point cloud(abstract)

AI总结 MIRO通过图神经网络提升单分子定位的空域聚类效率,适用于多种生物和环境数据的聚类分析。

Comments 47 pages, 5 main figures, 3 table, 3 supplementary figures, 9 supplementary tables. This is the author's version of the article published in Nature Communications under CC BY 4.0. The final published version is available at https://doi.org/10.1038/s41467-025-65557-7

Journal ref Nat Commun 16, 9693 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 新视角合成 1 篇

2512.10424 2025-12-12 cs.GR 57%

Neural Hamiltonian Deformation Fields for Dynamic Scene Rendering

基于神经哈密顿变形场的动态场景渲染

Hai-Long Qin, Sixian Wang, Guo Lu, Jincheng Dai

专题命中 新视角合成 :Gaussian Splatting(abstract);分类 cs.GR

AI总结 NeHaD通过哈密顿力学建模动态高斯点漂,实现物理真实的动态场景渲染与流媒体能力。

Comments Accepted by ACM SIGGRAPH Asia 2025, project page: https://qin-jingyun.github.io/NeHaD

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 3D生成 2 篇

2512.10949 2025-12-12 cs.CV cs.AI cs.CL 79%

Are We Ready for RL in Text-to-3D Generation? A Progressive Investigation

我们是否准备好在文本到3D生成中使用强化学习?一项渐进性的调查

Yiwen Tang, Zoey Guo, Kaixin Zhu, Ray Zhang, Qizhi Chen, Dongzhi Jiang, Junli Liu, Bohan Zeng, Haoming Song, Delin Qu, Tianyi Bai, Dan Xu, Wentao Zhang, Bin Zhao

专题命中 3D生成 :3D generation(title,abstract);分类 cs.CV

AI总结 本文首次系统研究了强化学习在文本到3D生成中的应用,提出Hi-GRPO范式和AR3D-R1模型,探讨奖励设计、算法优化及3D生成基准。

Comments Code is released at https://github.com/Ivan-Tang-3D/3DGen-R1

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10860 2025-12-12 cs.CV 57%

SWiT-4D: Sliding-Window Transformer for Lossless and Parameter-Free Temporal 4D Generation

SWiT-4D: 用于无损和参数无关的时序4D生成的滑动窗口变换器

Kehong Gong, Zhengyu Wen, Mingxi Xu, Weixia He, Qi Wang, Ning Zhang, Zhengyu Li, Chenbin Li, Dongze Lian, Wei Zhao, Xiaoyu He, Mingyuan Zhang

机构 * Huawei Technologies Co., Ltd.(华为技术有限公司) Huawei Central Media Technology Institute(华为中央媒体技术研究院)

专题命中 3D生成 :3D generation(abstract);分类 cs.CV

AI总结 SWiT-4D通过滑动窗口变换器实现无损、无参数的时序4D网格生成,结合扩散变换器生成3D模型,提升视频到4D网格的生成效果。

Comments Project page: https://animotionlab.github.io/SWIT4D/

详情

展开后加载摘要…

URL PDF HTML 收藏