arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 127 信号源:cs.CV, cs.GR, cs.RO

1. Gaussian Splatting 127 篇

2604.01207 2026-08-03 cs.CV 版本更新 77%

TRACE: High-Fidelity 3D Scene Editing via Tangible Reconstruction and Geometry-Aligned Contextual Video Masking

TRACE:通过可触觉重建和几何对齐的上下文视频遮罩实现高保真的3D场景编辑

Jiyuan Hu, Zechuan Zhang, Zongxin Yang, Yi Yang

机构 * ReLER Lab, CCAI, Zhejiang University(浙江大学计算机辅助设计与图形学全国重点实验室(CCAI)ReLER实验室) DBMI, HMS, Harvard University(哈佛大学医学院生物医学信息学系(DBMI))

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 TRACE通过可触觉重建和几何对齐的上下文视频遮罩,实现高保真的3D场景编辑,解决了现有方法在局部姿态调整和组件替换时结构完整性不足的问题。

Comments 9 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13335 2026-07-28 cs.CV 版本更新 77%

Deblur-Avatar: Animatable Avatars from Motion-Blurred Monocular Videos

Deblur-Avatar:从运动模糊单目视频生成可动画化头像

Xianrui Luo, Juewen Peng, Zhongang Cai, Lei Yang, Fan Yang, Zhiguo Cao, Guosheng Lin

机构 * School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(华中科技大学人工智能与自动化学院) S-Lab for Advanced Intelligence, Nanyang Technological University(南洋理工大学先进智能实验室) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院) SenseTime Research(商汤科技研究院)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 该研究针对运动模糊单目视频输入,提出将基于人类运动的运动模糊模型集成到3D高斯平铺的框架,通过优化轨迹和高斯分布重建高质量可动画化头像,实验证明其在渲染质量等方面显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19822 2026-07-07 cs.CV 版本更新 77%

HUGE-Bench: A Benchmark for High-Level UAV Vision-Language-Action Tasks

HUGE-Bench: 面向高级无人机视觉-语言-动作任务的基准测试

Jingyu Guo, Ziye Chen, Ziwen Li, Zhengqing Gao, Jiaxin Huang, Hanlue Zhang, Fengming Huang, Yu Yao, Tongliang Liu, Mingming Gong

机构 * The University of Melbourne(墨尔本大学) Melsy Tech(Melsy科技) MBZUAI Navlyn The University of Sydney(悉尼大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出HUGE-Bench基准,通过4个数字孪生场景和8个高级任务,评估无人机在简洁语言指令下执行安全、过程导向的复杂轨迹能力,并引入过程导向和碰撞感知指标,揭示现有VLA模型在高级语义完成和安全执行上的显著差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06852 2026-07-02 cs.CV 版本更新 77%

Active View Selection with Perturbed Gaussian Ensemble for Tomographic Reconstruction

基于扰动高斯集成的主动视角选择用于层析重建

Yulun Wu, Ruyi Zha, Wei Cao, Yingying Li, Yuanhao Cai, Yaoyao Liu

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Australian National University(澳大利亚国立大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 针对稀疏视角CT重建中视角选择问题,提出扰动高斯集成框架,通过不确定性建模和密度引导扰动选择最优视角,有效消除几何伪影。

Comments Accepted to ECCV 2026. Project page: https://perturbed-gaussian-ensemble.cvmlgroup.web.illinois.edu/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19255 2026-06-17 cs.CV 版本更新 77%

Advances in 4D Representation: Geometry, Motion, and Interaction

4D表示进展:几何、运动与交互

Mingrui Zhao, Sauradip Nag, Kai Wang, Aditya Vora, Guangda Ji, Peter Chun, Ali Mahdavi-Amiri, Hao Zhang

机构 * Simon Fraser University(西蒙弗雷泽大学) University of Alberta(阿尔伯塔大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 本文综述了4D生成与重建领域,从几何、运动和交互三个核心支柱出发,分析不同4D表示方法的特性、挑战及适用场景,并探讨了大语言模型和视频基础模型在其中的作用。

Comments CGF'26,21 pages. Project Page: https://mingrui-zhao.github.io/4DRep-GMI/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06212 2026-06-16 cs.CV cs.AI 版本更新 77%

Akasha 2: Hamiltonian State Space Duality and Visual-Language Joint Embedding Predictive Architectur

Akasha 2: 哈密顿状态空间对偶与视觉-语言联合嵌入预测架构

Yani Meziani

机构 * Independent AI Researcher(独立AI研究员) Québec (QC), Canada(魁北克(QC),加拿大)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出 Akasha 2 多模态架构,结合哈密顿状态空间对偶与视觉-语言联合嵌入预测,通过稀疏混合哈密顿专家和哈密顿流匹配实现超低延迟视频预测与合成,在保持能量守恒下取得 SOTA 性能。

Comments No supporting claims were validated in this automated agentic R&D research run

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10578 2026-06-08 cs.CV 版本更新 77%

Rein3D: Reinforced 3D Indoor Scene Generation with Panoramic Video Diffusion Models

Rein3D: 基于全景视频扩散模型的强化3D室内场景生成

Dehui Wang, Rong Wei, Yue Shi, Congsheng Xu, Shoufa Chen, Dingxiang Luo, Tianshuo Yang, Xiaokang Yang, Wei Sui, Yusen Qin, Rui Tang, Yao Mu

机构 * Shanghai Jiao Tong University(上海交通大学) Manycore Tech Inc.(Manycore科技公司) D-Robotics The University of Hong Kong(香港大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出Rein3D框架,结合3D高斯泼溅与视频扩散模型,通过“恢复-细化”范式从稀疏输入生成全局一致的360度室内场景,并构建PanoV2V-15K数据集,显著提升长距离相机探索效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06343 2026-08-11 cs.CV 版本更新 74%

Uncertainty-Aware 4D Gaussian Splatting for Monocular Occluded Human Rendering

考虑不确定性的4D高斯点散布用于单目遮挡人体渲染

Weiquan Wang, Feifei Shao, Lin Li, Zhen Wang, Fengda Zhang, Jun Xiao, Long Chen

机构 * Zhejiang University(浙江大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title);分类 cs.CV

AI总结 本文提出U-4DGS框架,通过概率变形网络和联合光栅化流程,在异方差观测噪声下实现最大后验估计,解决单目视频中遮挡导致的高保真动态人体渲染问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27422 2026-07-07 cs.CV 版本更新 74%

Difix3D-W: Distractor-Free Few-Shot 3D Gaussian Splatting in the Wild

野外稀疏视角3D高斯点云生成

Wongi Park, Jordan A. James, Myeongseok Nam, Minjae Lee, Soomok Lee, Sang-Hyun Lee, William J. Beksi

机构 * University of Texas at Arlington(德克萨斯大学阿灵顿分校) GenGenAI Seoul National University(首尔国立大学) Kennesaw State University(肯纳邦斯州立大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title);分类 cs.CV

AI总结 本文提出一种针对无约束真实场景的3D稀疏视角合成框架,通过引入扩散模型和瞬时掩码提升3D表示质量,实现高保真3D渲染。

Comments 16 pages, 16 figures, and 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01521 2026-07-03 cs.CV 版本更新 74%

MiraGe: Editable 2D Images using Gaussian Splatting

MiraGe: 使用高斯溅射的可编辑2D图像

Joanna Waczyńska, Tomasz Szczepanik, Piotr Borycki, Sławomir Tadeja, Thomas Bohné, Przemysław Spurek

专题命中 Gaussian Splatting :Gaussian Splatting(title);分类 cs.CV

AI总结 提出MiraGe方法,利用镜面反射在3D空间中感知2D图像,并通过平面控制的高斯函数实现精确编辑,提升渲染质量并支持物理仿真修改。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02220 2026-06-08 cs.LG cs.AI cs.CV 版本更新 74%

Forecasting as Rendering: A 2D Gaussian Splatting Framework for Time Series Forecasting

预测即渲染:面向时间序列预测的2D高斯泼溅框架

Yixin Wang, Yifan Hu, Peiyuan Liu, Naiqi Li, Tao Dai, Shu-Tao Xia

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) College of Computer Science and Software Engineering, Shenzhen University(深圳大学计算机科学与软件工程学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title);分类 cs.CV

AI总结 提出TimeGS框架,将时间序列预测转化为2D高斯泼溅生成渲染,通过各向异性高斯核和连续光栅化解决周期内与周期间的建模问题,实现SOTA性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04224 2026-08-11 cs.CV 版本更新 70%

SplitGaussian: Reconstructing Dynamic Scenes via Visual Geometry Decomposition

SplitGaussian:通过视觉几何分解重建动态场景

Lechao Cheng, Jiahui Li, Jingxuan He, Shengeng Tang, Gang Huang, Tianrui Hui, Yaxiong Wang, Zhun Zhong

专题命中 Gaussian Splatting :Gaussian Splatting(abstract,abstract_cn);分类 cs.CV

AI总结 SplitGaussian将场景表示分解为静态与动态分量,解耦运动建模与背景几何,提升动态场景重建的时间一致性、保真度与收敛速度,性能优于现有SOTA方法。

Comments version 2. Accepted By ACM MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02006 2026-08-07 cs.CV 版本更新 70%

ASTRA: Asynchronous Spatio-Temporal Reconstruction via Trajectory Alignment

ASTRA:基于轨迹对齐的异步时空重建

Junyu Zhu, Hao Zhu, Xinzhuo Zhang, Hongdong Li, Zhan Ma, Xun Cao

机构 * School of Electronic Science and Engineering, Nanjing University(南京大学电子科学与工程学院)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract,abstract_cn);分类 cs.CV

AI总结 针对动态三维场景重建中多相机异步导致的问题,提出ASTRA框架,通过轨迹对齐联合优化时间偏移与三维表示,在实验中实现了显著的性能提升。

Comments We wish to withdraw this preprint because the current statistical analysis of the experimental data is incomplete and requires re-verification. We plan to submit a revised and thoroughly checked version in the near future

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13310 2026-07-23 cs.CV 版本更新 70%

InstantSfM: Towards GPU-Native SfM for the Deep Learning Era

InstantSfM: 向深度学习时代迈进的GPU原生SfM

Jiankun Zhong, Zitong Zhan, Quankai Gao, Ziyu Chen, Haozhe Lou, Jiageng Mao, Ulrich Neumann, Chen Wang, Yue Wang

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 InstantSfM通过深度约束的雅可比结构实现GPU原生SfM,解决尺度模糊问题,提升大规模场景下的效率和精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29303 2026-07-01 cs.CV 版本更新 70%

Occlusion-Robust Multi-Object Decoupling for Physics-Based Robotic Interaction

基于物理的机器人交互的遮挡鲁棒多对象解耦

Xin Dong, Lihan Zhang, Tianru Dai, Wenfeng Deng, Yansong Tang

机构 * Pengcheng Laboratory(鹏城实验室) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 提出一种无掩码方法,从稀疏遮挡视角实现无损多对象3D重建,通过MPM模拟实现物理合理的机器人交互,核心是利用联合SDS过程结合扩散先验实现对象解耦。

Comments 7 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13910 2026-06-29 cs.CV 版本更新 70%

Scene Generation at Absolute Scale: Utilizing Semantic and Geometric Guidance From Text for Accurate and Interpretable 3D Indoor Scene Generation

绝对尺度下的场景生成:利用文本的语义和几何引导实现精确且可解释的3D室内场景生成

Stefan Ainetter, Thomas Deixelberger, Edoardo A. Dominici, Philipp Drescher, Konstantinos Vardis, Markus Steinberger

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3D generation(abstract);分类 cs.CV

AI总结 提出GuidedSceneGen框架,通过文本预测全局3D布局并利用全景扩散模型和视频扩散模型生成绝对尺度的室内场景,实现高一致性、可导航的3D重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17796 2026-06-25 cs.CV cs.AI 版本更新 70%

CustomX: Unified Character, Action, and Scene Customization in Video World Models

CustomX: 视频世界模型中的统一角色、动作与场景定制

Yitong Wang, Fangyun Wei, Hongyang Zhang, Bo Dai, Yan Lu

机构 * Fudan University(复旦大学) Microsoft Research(微软研究院) University of Waterloo(滑铁卢大学) The University of Hong Kong(香港大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 提出CustomX,结合静态世界生成与可控实体模型,支持用户指定角色在3D场景中执行开放动作,通过条件自回归视频生成保持视觉保真度。

Comments Accepted to ECCV 2026. Project page: https://snowflakewang.github.io/CustomX_Page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06846 2026-07-24 cs.SD 版本更新 67%

DynFOA: Generating First-Order Ambisonics with Conditional Diffusion for Dynamic and Acoustically Complex 360-Degree Videos

DynFOA: 基于条件扩散的动态和声学复杂的360度视频生成一阶混响

Ziyu Luo, Lin Chen, Qiang Qu, Xiaoming Chen, Yiran Shen

机构 * School of Computer and Artificial Intelligence, Beijing Technology and Business University, Beijing, China(计算机与人工智能学院,北京技术与商业大学) School of Computer Science, The University of Sydney, Sydney, NSW, Australia(计算机科学学院,悉尼大学) School of Software, Shandong University, Jinan, China(软件学院,山东大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract)

AI总结 DynFOA通过动态声学感知和条件扩散生成高质量的360度视频一阶混响,提升沉浸式音频体验。

Comments Revised version with updated content.This submission is the intended replacement of arXiv:2602.06846

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.24009 2026-07-03 cs.GR cs.AI cs.CV cs.LG cs.RO 版本更新 67%

Learning 3D-Gaussian Simulators from RGB Videos

从RGB视频学习3D高斯模拟器

Mikel Zhobro, Andreas René Geist, Georg Martius

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.GR、cs.RO

AI总结 提出3DGSim,一种从多视角RGB视频直接学习物理交互的3D模拟器,统一了3D场景重建、粒子动力学预测和视频合成,能泛化到未见过的多体交互和新场景编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17386 2026-07-17 cs.CV cs.AI cs.RO 版本更新 62%

TerraTransfer: Learning End-to-End Driving Policies Without Expert Demonstrations

TerraTransfer: 无需专家示范的端到端驾驶策略学习

Zikang Xiong, Weixin Li, Zhouchonghao Wu, Akshay Rangesh, Saarth Bonde, Grantland Hall, Chen Tang, Yihan Hu, Wei Zhan

机构 * Applied Intuition UCLA(加州大学洛杉矶分校) UC Berkeley(加州大学伯克利分校)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.RO

AI总结 提出一种无需专家示范的端到端驾驶方法,通过向量化模拟器中的自博弈预训练策略,再与预训练视觉骨干对齐,降低了数据成本并达到或超越现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29453 2026-07-03 cs.CV cs.AI cs.GR 版本更新 62%

Resonant Brane Splatting for Arbitrary-Scale Super-Resolution

用于任意尺度超分辨率的共振膜片溅射

Giulio Federico, Giuseppe Amato, Claudio Gennaro, Fabio Carrara, Marco Di Benedetto

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

AI总结 提出共振膜片溅射(RBS)框架,用Brane基元替代高斯溅射,通过高斯-埃尔米特模式捕获高频细节,实现任意尺度超分辨率的高质量与高效渲染。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05354 2026-06-25 cs.CV cs.GR 版本更新 62%

SplatPainter: Interactive Authoring of 3D Gaussians from 2D Edits via Test-Time Training

SplatPainter: 通过测试时训练从2D编辑交互式创作3D高斯

Yang Zheng, Hao Tan, Kai Zhang, Peng Wang, Leonidas Guibas, Gordon Wetzstein, Wang Yifan

机构 * Stanford University(斯坦福大学) Adobe

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

AI总结 提出SplatPainter,一种状态感知的前馈模型,通过测试时训练实现从用户2D视图连续编辑3D高斯资产,支持局部细节优化、涂改和全局重着色,达到交互速度。

Comments project page https://y-zheng18.github.io/SplatPainter/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22028 2026-06-12 cs.CV cs.RO 版本更新 62%

From Seeing to Experiencing: Scaling Navigation Foundation Models with Reinforcement Learning

从看见到体验:通过强化学习扩展导航基础模型

Honglin He, Yukai Ma, Brad Squicciarini, Wayne Wu, Bolei Zhou

机构 * University of California, Los Angeles(加州大学洛杉矶分校) Coco Robotics(Coco机器人)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.RO

AI总结 提出S2E框架,结合离线视频预训练和模拟环境强化学习,通过锚点引导分布匹配和残差注意力模块,提升导航基础模型的交互性和安全性。

Comments 27 pages, 20 figures, 9 tables, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11500 2026-08-04 cs.CV 版本更新 57%

HyperGS: Fast and Generalizable Gaussian Video Representation

HyperGS:快速且通用的高斯视频表示

Fatimah Zohra, Chen Zhao, Shuming Liu, Yahya Al Malallah, Bernard Ghanem

机构 * King Abdullah University of Science and Technology (KAUST)(阿卜杜拉国王科技大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究针对高斯视频表示中现有方法依赖单视频优化、编码慢且通用性受限的问题,提出HyperGS方法,通过设计特定Transformer提取令牌和获得高斯表示,结合正则化器解决退化问题,实现快速编码及跨视频通用,提升了PSNR。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24353 2026-07-31 cs.CV cs.LG 版本更新 57%

Open-Vocabulary BEV Segmentation with 3D-Aware Geometric Constraints

开放词汇BEV分割:基于3D感知几何约束的方法

Hojun Choi, Seulbin Hwang, Daejung Kim, Kisung Kim, Hyunjung Shim, Jinhan Lee

机构 * KAIST AI(韩国科学技术院人工智能) NAVER LABS(NAVER实验室)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 针对开放词汇BEV分割中2D VLM语义到BEV的3D几何不一致问题,提出OVBEVSeg框架,通过三阶段几何约束(伪标签、场景优化、知识蒸馏)实现高效在线推理,在nuScenes上未见类别mIoU超越闭集方法15.3,推理速度提升2.5倍。

Comments This paper has been accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08982 2026-07-21 cs.CV 版本更新 57%

CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation

CityLoc:基于高斯表示的大规模场景文本描述的6自由度姿态分布定位

Qi Ma, Runyi Yang, Bin Ren, Nicu Sebe, Ender Konukoglu, Luc Van Gool, Danda Pani Paudel

机构 * Computer Vision Lab, ETH Zurich(苏黎世联邦理工学院计算机视觉实验室) University of Pisa(比萨大学) University of Trento(特伦托大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究大规模场景文本描述的6自由度姿态分布定位问题,核心方法是用基于扩散架构结合预训练文本编码器细化姿态,经3D高斯渲染提高精度,通过与标准方法对比验证其在多数据集上的优越性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13154 2026-07-20 cs.RO 版本更新 57%

Worlds in One Demo: A Synthetic Data Engine for Learning Open-World Mobile Manipulation

世界合一演示:用于学习开放世界移动操作的合成数据引擎

Lingxiao Guo, Huanyu Li, Guanya Shi

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.RO

AI总结 研究如何通过合成数据引擎WANDA从单个演示学习开放世界移动操作策略,利用重建背景、重排交互片段、校正状态扩展等方法,实现长期鲁棒性、空间泛化和跨环境泛化,还支持跨实体数据生成。

Comments Project website: https://wanda.lecar-lab.org/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12356 2026-07-17 cs.RO 版本更新 57%

VistaVLA: Geometry- and Semantic-Aware 3D Gaussian-Grounded VLA for Robotic Manipulation

VistaVLA:用于机器人操作的几何和语义感知3D高斯基础VLA

Mohan Liu, Zhihao Gu, Xuanyu Chen, Haitian Zhang, Kaimin Mao, Yan Wu, Wei-Yun Yau, Lin Wang

机构 * EmPACT Lab, Nanyang Technological University(南洋理工大学EmPACT实验室) Institute for Infocomm Research (I2R), A*STAR(资讯通信研究院(I2R),新加坡科技研究局)

专题命中 Gaussian Splatting :point cloud(abstract);分类 cs.RO

AI总结 研究针对VLA模型缺乏3D表示的问题,提出VistaVLA框架,通过3D高斯原语构建几何和语义感知的3D认知表示,利用MtQ机制压缩令牌,在模拟和真实环境评估中有效提升VLA性能,尤其在真实场景中显著提高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09243 2026-07-17 cs.CV 版本更新 57%

A$^2$TG: Adaptive Anisotropic Textured Gaussians for Efficient 3D Scene Representation

A$^2$TG:用于高效3D场景表示的自适应各向异性纹理高斯方法

Sheng-Chi Hsu, Ting-Yu Yen, Shih-Hsuan Hung, Hung-Kuo Chu

机构 * National Tsing Hua University(国立清华大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究针对高斯体素化表示中纹理固定的问题,提出自适应各向异性纹理高斯(A$^2$TG)方法,通过梯度引导规则确定纹理参数,提升效率与质量,实验证明该方法在内存需求低的情况下能实现高渲染保真度。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09925 2026-07-15 cs.CV 版本更新 57%

GAINS: Gaussian-based Inverse Rendering from Sparse Multi-View Captures

GAINS:基于高斯的稀疏多视图捕获逆渲染

Patrick Noras, Jun Myeong Choi, Didier Stricker, Pieter Peers, Roni Sengupta

机构 * University Kaiserslautern-Landau(凯撒斯劳滕-兰道大学) German Research Center for Artificial Intelligence(德国人工智能研究中心) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) College of William & Mary(威廉与玛丽学院)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究针对稀疏视图设置下基于高斯的逆渲染精度下降问题,提出GAINS两阶段逆渲染框架,利用基础模型先验稳定几何和材质估计,经实验验证其在提升材质参数精度等方面效果显著,尤其在稀疏视图下优势明显。

详情

展开后加载摘要…

URL PDF HTML 收藏