arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 251 信号源:cs.CV, cs.GR, cs.RO

1. Gaussian Splatting 251 篇

2606.26092 2026-07-07 cs.CV 新提交 77%

TryOnCrafter: Unleashing Camera Trajectories for Realistic Video Virtual Try-on via a Renderable 4D Try-on Proxy

TryOnCrafter: 通过可渲染的4D试穿代理释放相机轨迹以实现逼真的视频虚拟试穿

Hao Sun, Hao Yan, Mengting Chen, Quanjian Song, Yu Li, Juan Cao, Jinsong Lan, Xiaoyong Zhu, Bo Zheng, Sheng Tang

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) Xiamen University(厦门大学) Alibaba Group(阿里巴巴集团)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);point cloud(abstract);分类 cs.CV

AI总结 提出TryOnCrafter,首个基于DiT的统一框架,通过可渲染4D试穿代理解耦人体与环境,实现相机可控的视频虚拟试穿,支持任意视角合成和下游应用。

Comments Project Page: https://sunhao242.github.io/TryOnCrafter_web.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01628 2026-07-03 cs.CV 新提交 77%

Online Segment 3D Gaussians via Launching Virtual Drones

通过发射虚拟无人机在线分割3D高斯体

Liwei Liao, Rongjie Wang, Ronggang Wang

机构 * Guangdong Provincial Key Laboratory of Ultra High Definition Immersive Media Technology, Shenzhen Graduate School, Peking University(广东省超高清沉浸式媒体技术重点实验室,北京大学深圳研究生院) Pengcheng Laboratory(鹏城实验室) Peking University(北京大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出SAGO框架,通过虚拟无人机将3D分割转化为在线最佳视角规划任务,无需预设置即可在亚秒内从3D高斯体中提取干净3D资产。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24874 2026-06-24 cs.CV cs.AI 新提交 77%

FLUX3D: High-Fidelity 3D Gaussian Generation with Diffusion-Aligned Sparse Representation

FLUX3D: 基于扩散对齐稀疏表示的高保真3D高斯生成

Haorui Ji, Weizhe Liu, Hongdong Li, Hengkai Guo

机构 * The Australian National University(澳大利亚国立大学) ByteDance(字节跳动)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出FLUX3D框架,通过扩散对齐结构化潜变量(DA-SLAT)和稀疏结构感知扩散变压器(SMDiT)解决稀疏体素表示中高频细节丢失和跨模态对齐问题,实现高保真图像到3D高斯生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24361 2026-06-24 cs.CV 新提交 77%

SignNet-1M: Large-Scale Multilingual Sign Language Video Dataset with Downstream Benchmarks

SignNet-1M:大规模多语言手语视频数据集及下游基准

Zhewen He, Junyi Hu, Haomian Huang, Zhenhua Li, Yu-Shen Liu, Yi Fang

机构 * New York University Abu Dhabi(纽约大学阿布扎比分校) ChatSign Technology(ChatSign 技术公司) Tsinghua University(清华大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出SignNet-1M,通过3D高斯泼溅、扩散模型和后期渲染增强合成多样化手语视频,提升模型在跨视角、背景和身份等分布偏移下的泛化能力。

Comments 25 pages. Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16232 2026-06-16 cs.RO 新提交 77%

PolyMerge: Compressing 3D Gaussian Splats with Polytope Coverings for Provably Safe Resource-Constrained Navigation

PolyMerge: 用多面体覆盖压缩3D高斯泼溅以实现可证明安全的资源受限导航

Jihoon Hong, Chih-Yuan Chiu, Sara Fridovich-Keil, Glen Chou

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.RO

AI总结 提出PolyMerge,将大规模3D高斯泼溅模型转换为凸多面体覆盖,保证覆盖原模型所有障碍物,结合控制障碍函数实现实时安全路径规划,在Crazyflie无人机上验证。

Journal ref IEEE Robotics and Automation Letters, vol. 11, no. 7, pp. 8512-8519, July 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15659 2026-06-16 cs.CV 新提交 77%

SpatialAvatar-0: High-Quality 4D Head Avatar with Multi-Stage Reconstruction

SpatialAvatar-0: 高质量4D头部虚拟形象的多阶段重建

Yiran Wang, Zeyu Zhang, Yuanming Li, Ziming Wang, Yang Zhao

机构 * USYD(悉尼大学) SpatialReal ZJU(浙江大学) La Trobe(拉筹伯大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出基于FLAME网格绑定高斯表示的多阶段框架,通过前馈生成器和10K迭代布局保持微调,实现跨域零样本和单目基准领先性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15024 2026-08-18 cs.RO cs.AI cs.CV 新提交 76%

MotionGS-SLAM: Event-Modulated Gaussian Splatting for Motion-Blur Robust SLAM

MotionGS-SLAM:面向运动模糊鲁棒SLAM的事件调制高斯溅射

Zhiqiang Hu, Shouren Huang, Masatoshi Ishikawa

机构 * Research Institute for Science & Technology, Tokyo University of Science(东京理科大学科学技术研究所)

专题命中 Gaussian Splatting :Gaussian Splatting(title);分类 cs.CV、cs.RO

AI总结 MotionGS-SLAM通过事件调制高斯核与双调制机制,在渲染流水线中建模运动模糊形成,实现相机轨迹与场景几何联合优化,显著提升高运动下SLAM的轨迹与地图精度。

Comments 8 pages, 5 figures. Published in the 2026 IEEE International Conference on Robotics and Automation

Journal ref 2026 IEEE International Conference on Robotics and Automation (ICRA), pp. 14608-14615, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07760 2026-08-11 cs.CV cs.GR 新提交 76%

XClipGS: Exact Half-Space Clipping for Medical Volume Gaussian Splatting

XClipGS: 用于医学体高斯溅射的精确半空间裁剪

Zhongpai Gao, Benjamin Planche, Meng Zheng, Anwesa Choudhuri, Chaoyi Zhou, Terrence Chen, Ziyan Wu

专题命中 Gaussian Splatting :Gaussian Splatting(title);分类 cs.CV、cs.GR

AI总结 本文提出XClipGS精确裁剪方法,通过闭式逐像素算子实现医学体高斯溅射的半空间精确裁剪,在8组CT/MRI数据集上,其PSNR、SSIM等指标均优于现有方法,渲染速度超650 FPS且泄漏量显著降低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17520 2026-06-17 cs.RO cs.CV 新提交 76%

GASE: Gaussian Splatting-Based Automated System for Reconstructing Embodied-Simulation Environments

GASE:基于高斯溅射的自动化系统用于重建具身仿真环境

Jiawei Zhang, Yiming Yan, Chao Liang, Nuo Xu, Seson Sun, Qichen Zhang, Yuhao Xu, Yantai Yang, Yingqiao Wang, Qin Jin, Zhipeng Zhang

机构 * AutoLab, SAI, Shanghai Jiao Tong University(上海交通大学SAI学院AutoLab实验室) AIM3 Lab, School of Information, Renmin University of China(中国人民大学信息学院AIM3实验室) Research Lab, Anyverse Dynamics(Anyverse Dynamics研究实验室)

专题命中 Gaussian Splatting :Gaussian Splatting(title);分类 cs.CV、cs.RO

AI总结 提出GASE系统,利用全景相机阵列和多视图视频流,通过相机位姿策略提取前景物体并修复场景,独立重建后导入物理仿真器,实现高效高保真仿真环境构建,分割精度提升超10%,真实机器人部署性能差距小于10%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01803 2026-07-07 cs.CV cs.GR cs.RO 新提交 75%

PixGS: Pixel-Space Diffusion for Direct 3D Gaussian Splat Generation

PixGS: 像素空间扩散用于直接三维高斯泼溅生成

Cao Duy, Phong Nguyen-Ha

机构 * Qualcomm AI Research(高通人工智能研究院)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);分类 cs.CV、cs.GR、cs.RO

AI总结 提出单阶段管道PixGS,利用像素空间扩散从文本或图像直接生成高质量3D高斯泼溅,避免潜在压缩伪影,并引入表面法线、深度和高频结构监督,在单张A100 GPU上1秒内生成,性能超越现有方法。

Comments Accepted at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19066 2026-08-20 cs.CV cs.AI 新提交 74%

GS-VLA: Plug-and-Play Viewpoint Canonicalization for Frozen VLA Policies via Gaussian Splatting

GS-VLA:基于高斯溅射的冻结VLA策略的即插即用视角规范化方法

Yechan Park, HyunJin Kim

机构 * Dankook University(檀国大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title);分类 cs.CV

AI总结 GS-VLA是首个基于3D高斯的VLA视角规范化即插即用框架,通过轻量4M参数的3D高斯规范化器提升VLA策略视角偏移鲁棒性,无需重训即可在多维度恢复性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10057 2026-08-12 cs.CV 新提交 74%

LEGO: Leveled Language Gaussian Splatting

LEGO:分层语言高斯溅射

Yuning Peng, Haiping Wang, Yuan Liu, Yipeng Lu, Zhen Dong, Bisheng Yang

机构 * Wuhan University(武汉大学) Hong Kong University of Science and Technology(香港科技大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title);分类 cs.CV

AI总结 LEGO是一种新方法,通过将多视角SAM粒度转为3D一致层级,结合CLIP嵌入构建分层语言场景图,在3D分割基准上取得最优性能,可赋能大语言模型的空间推理与视觉定位。

Comments Accepted to ECCV 2026. Project page: https://pz0826.github.io/LEGO-Webpage/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.32036 2026-07-01 cs.CV 新提交 74%

PointSplat: Compact Gaussian Splatting via Human-Centric Prediction

PointSplat: 通过以人为中心的预测实现紧凑的高斯泼溅

Yujie Guo, Yudong Jin, Lingteng Qiu, Zehong Shen, Zhen Xu, Jing Zhang, Xianchao Shen, Hujun Bao, Sida Peng, Xiaowei Zhou

机构 * State Key Lab of CAD&CG, Zhejiang University(浙江大学CAD&CG国家重点实验室) ByteDance(字节跳动) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 Gaussian Splatting :Gaussian Splatting(title);分类 cs.CV

AI总结 提出PointSplat,一种以人为中心的方法,直接从输入点集推断高斯原语,通过3D空间预测减少冗余,实现紧凑表示和高质量新视角渲染。

Comments Project Page: https://zju3dv.github.io/pointsplat

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28321 2026-06-29 cs.CV 新提交 74%

StructSplat: Generalizable 3D Gaussian Splatting from Uncalibrated Sparse Views

StructSplat: 从无标定稀疏视图进行可泛化的3D高斯泼溅

Jia-Chen Zhao, Beiqi Chen, Xinyang Chen, Guangcong Wang, Liqiang Nie

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Great Bay University(大湾区大学) Guangzhou CloudButterfly Technology Co., Ltd.(广州云蝴蝶科技有限公司)

专题命中 Gaussian Splatting :Gaussian Splatting(title);分类 cs.CV

AI总结 提出StructSplat,一种前馈式可泛化3D高斯重建框架,无需相机参数,通过结构化表示分离几何、语义和纹理线索,在多个基准上显著超越现有方法。

Comments Project page: https://structsplat.github.io Code: https://github.com/J-C-Zhao/StructSplat

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10656 2026-06-10 cs.CV 新提交 74%

Envision4D: Envisioning Visual Futures via Feed-forward 4D Gaussian Splatting for Autonomous Driving

Envision4D: 通过前馈4D高斯泼溅展望自动驾驶的视觉未来

Qi Song, Yifei He, Chi Zhang, Zheng Fu, Xuhe Zhao, Mengmeng Yang, Kun Jiang, Rui Huang, Diange Yang

机构 * Tsinghua University(清华大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 Gaussian Splatting :Gaussian Splatting(title);分类 cs.CV

AI总结 提出Envision4D,一种全自监督前馈框架,通过未来姿态预测、层内时间注意力和条件运动提升,实现无位姿的未来外推,在自动驾驶动态场景预测中达到最先进性能。

Comments Project Page: https://maggiesong7.github.io/research/Envision4D/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16499 2026-08-18 cs.RO cs.CV 新提交 73%

OccamView: Object-Conditioned View Selection for Frame-Budgeted Active 3D Gaussian Reconstruction

OccamView:面向帧预算约束下主动式3D高斯重建的物体条件视角选择方法

Hongbo Gao, Wei Zhang, Zeyu Ni, Dihao Zhu, Ruifeng Li, Yunke Wang, Chang Xu

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);分类 cs.CV、cs.RO

AI总结 针对帧预算紧张时现有主动3D高斯重建方法易漏重建物体的问题,提出OccamView框架,通过物体条件视角选择与Geo-Floor机制优化规划,在多数据集上提升了重建表现。

Comments 7 pages, 5 figures. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22997 2026-07-28 cs.RO cs.AI cs.GR cs.LG 新提交 73%

Real2Sim2Real for Vision-Language-Action Manipulation: An AMD ROCm-Based Pipeline

用于视觉-语言-动作操纵的Real2Sim2Real:基于AMD ROCm的管道

Qing Yang, Xun Wang, Ziguan Wang, Zhenjiang Li, Hongqiang Wang, Dongdong Weng

机构 * AMD AIG Team(AMD人工智能团队) Beijing Institute of Technology(北京理工大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.GR、cs.RO

AI总结 本文针对视觉-语言-动作操纵提出基于AMD ROCm的Real2Sim2Real技术栈,涵盖多硬件计算,由开放软件栈统一。通过四个演示表明无需CUDA锁定生态系统,展示了在多硬件平台上的相关成果,且管道可在特定硬件和平台上原生运行并重现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20789 2026-07-24 cs.CV cs.GR 新提交 73%

3D-GIMP: When 3D Gaussian Inpainting Meets PatchMatch

3D-GIMP:当3D高斯图像修复与PatchMatch相遇

Xuening Tian, Dieter Schmalstieg, Shohei Mori

机构 * University of Stuttgart(斯图加特大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 针对3D场景编辑中迭代扩散模型的问题,提出3D-GIMP混合范式,通过在关键参考视图进行图像修复并利用3D感知PatchMatch算法传播纹理,优先保证重建一致性,在渲染速度和视图一致性上表现更优。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01202 2026-07-02 cs.CV cs.AI cs.GR 新提交 73%

World from Motion: Generative Dynamic Gaussian Reconstruction from Monocular Video

世界源于运动:从单目视频生成动态高斯重建

Liyuan Zhu, Shengyu Huang, Amrita Mazumdar, Tianye Li, Zan Gojcic, Gordon Wetzstein, Iro Armeni, Shalini De Mello, Alex Trevithick

机构 * Stanford University(斯坦福大学) NVIDIA(英伟达)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);分类 cs.CV、cs.GR

AI总结 提出World from Motion方法,利用视频模型从单目视频生成可自由渲染的动态3D高斯表示,通过像素对齐渲染校正伪影并填充缺失区域,实现4D重建新高度。

Comments Project page: https://research.nvidia.com/labs/amri/projects/world-from-motion/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12860 2026-08-14 cs.RO 新提交 70%

HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments

HumanoidVLN:面向多种人形机器人形态的基于物理的视觉语言导航模拟器与基准

Quan-Dung Pham, Anh Dao, The-Anh Nguyen, Minh Nguyen-Dinh, Phuong Nam Dang, Tri Pham, Hung Tran, Bach Dao, Tuyen P. Le, Truong Nguyen, Quan Nguyen

机构 * VinMotion, Inc.(VinMotion公司) University of Southern California(南加州大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract,abstract_cn);分类 cs.RO

AI总结 本研究针对人形机器人VLN的物理约束与形态差异问题,提出基于NVIDIA Isaac Sim的HumanoidVLN模拟器与基准,验证其与多种模型、机器人的兼容性,实验揭示了VLN模型、控制器与人形形态的交互关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11077 2026-08-12 cs.CV 新提交 70%

Learning Gaussian Structure: Intervention-Guided Density Control for Feed-Forward Driving Reconstruction

学习高斯结构:用于前向驾驶重建的干预引导密度控制

Hang Li, Jiahe Li, Meiying Gu, Jin Zheng, Lina Yu, Xiao Bai

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 本文提出Learning Gaussian Structure(LGS)框架,通过干预引导的高斯结构调整与跨时间点查询,在Waymo Open Dataset和PandaSet上实现了优于现有方法的驾驶场景重建效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10712 2026-08-12 cs.CV 新提交 70%

Compact Feed-Forward 3D Gaussians via Saliency-Guided Primitive Merging

基于显著性引导基元合并的紧凑前馈三维高斯模型

Tim-Felix Fassch, Jochen Kall, Cyrill Stachniss

机构 * Bosch Research(博世研究院) University of Bonn(波恩大学) Lamarr Institute for Machine Learning and Artificial Intelligence(拉马尔机器学习与人工智能研究院)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract,abstract_cn);分类 cs.CV

AI总结 该研究针对前馈三维高斯方法基元冗余问题,提出显著性引导的基元合并流水线,可在仅1/20高斯数量下保留视觉质量,实现高效紧凑的三维场景表示与渲染。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10682 2026-08-12 cs.CV 新提交 70%

Visual Geometry Foundation-Aware Gaussians for Single-Frame Surround-View Driving Reconstruction

面向单帧环视驾驶场景重建的视觉几何基础感知高斯模型

Junhong Lin, Jinlong Wang, Xianda Guo, Yanlun Peng, Wei Zheng, Guoqing Liu, Hanli Wang, Tiesong Zhao, Wei Gao

机构 * Guangdong Provincial Key Laboratory of Ultra High Definition Immersive Media Technology(广东省超高清沉浸式媒体技术重点实验室) School of Electronic and Computer Engineering, Peking University(北京大学电子与计算机工程学院) Peng Cheng Laboratory(鹏城实验室) Wuhan University(武汉大学) Great Wall Motor(长城汽车) Minieye Corporation(Minieye公司) Tongji University(同济大学) Fuzhou University(福州大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract,abstract_cn);分类 cs.CV

AI总结 本文提出VGGD框架,通过引入视觉几何先验、双路径颈部等模块,在nuScenes基准上实现了单帧环视驾驶场景重建的最优渲染质量与几何一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05482 2026-08-07 cs.CV 新提交 70%

CDSeg: A Renderable Gaussian Carrier for Image-to-3D Label Transfer

CDSeg:用于图像到3D标签迁移的可渲染高斯载体

Wentao Sun, Yiping Chen, Zhengsen Xu, Jonathan Li, John S. Zelek

机构 * University of Waterloo(滑铁卢大学) Sun Yat-sen University(中山大学) University of Calgary(卡尔加里大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);point cloud(abstract);分类 cs.CV

AI总结 CDSeg是基于高斯溅射的跨域分割接口,无需特定任务3D分割训练,可复用2D掩码实现多视图标签迁移,在多个数据集上取得高mIoU,能快速处理大规模场景。

Comments 15 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01726 2026-08-04 cs.CV 新提交 70%

G-Skin: Learning to Bind 3D Gaussians with Generative Visual Priors

G-Skin:学习结合生成式视觉先验的3D高斯绑定方法

Yuxin Yao, Kendong Liu, Shiqi Zhou, Jiazhi Xia, Junhui Hou

机构 * City University of Hong Kong(香港城市大学) Central Media Technology Institute, Huawei(华为中央媒体技术研究院) Central South University(中南大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract,abstract_cn);分类 cs.CV

AI总结 本文针对3D高斯资产绑定的难题,提出生成式蒙皮框架G-Skin,利用2D视觉基础模型提炼运动先验构建优化流程,可灵活泛化并优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01053 2026-08-04 cs.CV 新提交 70%

Struct-GStream: Towards Efficient Free-Viewpoint Video Streaming at Low-Bitrates with Structured 3D Gaussians

Struct-GStream:基于结构化3D高斯的低码率高效自由视点视频流技术

Han Jiao, Jiakai Sun, Lei Zhao, Wei Xing, Huaizhong Lin, Zhanjie Zhang, Ao Ma

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Chinese Academy of Sciences(中国科学院) University of Science and Technology Beijing(北京科技大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 本文针对现有自由视点视频在线训练方法存储与训练时间不足的问题,提出Struct-GStream,通过结构化3D高斯等技术实现低码率下的高效视频流,性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28032 2026-07-31 cs.CV 新提交 70%

Split and Drive: Dual-Axis Disentanglement for Real-Time Gaussian Head Avatars

Split and Drive:用于实时高斯头像的双轴解耦

MD Wahiduzzaman Khan, Mingshan Jia, Xiaolin Zhang, En Yu, Kaska Musial-Gabrys

机构 * University of Technology Sydney(悉尼科技大学) Shandong University of Science and Technology(山东科技大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract,abstract_cn);分类 cs.CV

AI总结 该研究针对单图像生成可动画头部头像的挑战,提出双轴解耦的SpiD框架,通过内化逐帧驱动、分解面部高斯分支,实现了性能优且速度快的实时高斯头像生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23189 2026-07-28 cs.CV cs.AI 新提交 70%

Fashion-3DLR: A Controllable 3D Garment Generation Using Pairwise Fashion Elements for Intelligent Design

Fashion-3DLR:一种使用成对时尚元素进行智能设计的可控3D服装生成方法

Shenghao Yang, Hongtao Zhang, Yuhan Yi, Zhihao Tang, Zihao Cui, Lian Wen, Han Yan, Yuan Gao, Mingbo Zhao

机构 * Donghua University(东华大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.CV

AI总结 研究针对3D服装生成难题,提出Fashion-3DLR框架,通过GFF-DiT模块融合2D时尚设计元素,利用整流流Transformer生成几何潜在值,实现多种3D服装表示,并集成到下游任务,实验证明其超越现有方法,有成为通用3D服装设计工具的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10489 2026-07-14 cs.CV 新提交 70%

Grassmannian Splatting I: Moving rank-2 Spacetime Surfels for Dynamic Scene Rendering

格拉斯曼体点云绘制 I:用于动态场景渲染的移动秩-2时空表面元素

Aaron Maurice Berman, Shantanu Dave

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.CV

AI总结 该研究提出格拉斯曼体点云绘制用于动态场景渲染,其基元为特定高斯分布,运动模型封闭,无需学习变形场和自定义CUDA。在17个HyperNeRF场景训练速度最快,PSNR、MS-SSIM和LPIPS排名第二。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08769 2026-07-10 cs.CV 新提交 70%

Geometry and Gradient-based Partitioning for Panoramic Outdoor Reconstruction

基于几何和梯度的全景户外重建分区方法

Weijian Chen, Weibo Yao, Yuhang Zhang, Xiaolin Tang, Guo Wang, Weijun Zhang, Xitong Gao, Yihao Chen, Hongde Qin, Lu Qi

机构 * Insta360 Research(Insta360研究机构) Sun Yat-sen University(中山大学) South China University of Technology(华南理工大学) University of Chinese Academy of Sciences(中国科学院大学) Harbin Engineering University(哈尔滨工程大学) Wuhan University(武汉大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.CV

AI总结 针对大规模全景3D高斯点云重建成本高问题,提出PanoLOG两阶段框架,利用几何和梯度进行分区,粗阶段用天球建模等,细化阶段构建自适应边界体积等,还构建数据集,实现了高质量渲染和可扩展训练。

Comments Project Webpage: https://insta360-research-team.github.io/GGPS-Website

详情

展开后加载摘要…

URL PDF HTML 收藏