arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2025-12-10 至 2025-12-10 共收录 45 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 1 篇

2509.23823 2025-12-10 cs.RO 57%

Control Your Robot: A Unified System for Robot Control and Policy Deployment

掌控你的机器人:一种统一的机器人控制与策略部署系统

Tian Nian, Weijie Ke, Shaolong Zhu, Bingshan Hu

机构 * ScaleLab, Shanghai Jiao Tong University(上海交通大学ScaleLab) University of Shanghai for Science and Technology(上海科学技术大学)

专题命中 机器人学习 :robot learning(abstract);分类 cs.RO

AI总结 Control Your Robot提出了一种统一的机器人控制与策略部署框架,通过模块化设计和标准化流程,实现跨平台的数据收集与策略学习,提升机器人学习的可扩展性和可重复性。

Comments Code: https://github.com/Tian-Nian/control_your_robot

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 14 篇

2512.08405 2025-12-10 cs.RO 90%

Learning Robot Manipulation from Audio World Models

从音频世界模型中学习机器人操作

Fan Zhang, Michael Gienger

机构 * Honda Research Institute EU(本田欧洲研究院)

专题命中 机器人操作 :manipulation(title,abstract);world model(title,abstract);robot policy(abstract);robotic(abstract)

AI总结 本文提出一种生成性潜在流匹配模型,用于通过预测未来音频状态提升机器人操作任务中的多模态推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08188 2025-12-10 cs.RO cs.AI cs.CV 89%

Embodied Tree of Thoughts: Deliberate Manipulation Planning with Embodied World Model

具身思维树:基于具身世界模型的 deliberative 操控规划

Wenjiang Xu, Cindy Wang, Rui Fang, Mingkang Zhang, Lusong Li, Jing Xu, Jiayuan Gu, Zecui Zeng, Rui Chen

机构 * University of Chinese Academy of Sciences (UCAS)(中国科学院大学) Tsinghua University(清华大学) JD Explore Academy(京东探索学院) ShanghaiTech University(上海科技大学) Nanjing University(南京大学)

专题命中 机器人操作 :manipulation(title,abstract);world model(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 EToT通过基于物理的交互数字双胞胎实现具身世界模型,结合先验分支和反思分支机制,提升机器人操控规划的物理一致性和鲁棒性。

Comments Website at https://embodied-tree-of-thoughts.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08229 2025-12-10 cs.CV cs.RO 86%

Geometry-Aware Sparse Depth Sampling for High-Fidelity RGB-D Depth Completion in Robotic Systems

基于几何的稀疏深度采样用于机器人系统中高保真的RGB-D深度补全

Tony Salloom, Dandi Zhou, Xinhai Sun

机构 * Saisuode (Shanghai) Intelligent Technology Co., Ltd. (Synthoid.ai)(上海思度智能科技有限公司(Synthoid.ai))

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);navigation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出基于几何的稀疏深度采样方法,利用表面法线估计提升RGB-D深度补全的准确性和现实感。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08629 2025-12-10 cs.AI cs.CV cs.HC 84%

See-Control: A Multimodal Agent Framework for Smartphone Interaction with a Robotic Arm

See-Control: 一种多模态代理框架用于智能手机与机械臂的交互

Haoyu Zhao, Weizhong Ding, Yuhao Yang, Zheng Tian, Linyi Yang, Kun Shao, Jun Wang

机构 * University College London(伦敦大学学院) Imperial College London(伦敦帝国学院) Huawei Noah’s Ark Lab(华为诺亚实验室) ShanghaiTech University(上海科技大学) Southern University of Science(南方科技大学)

专题命中 机器人操作 :robotic(title,abstract);embodied agent(abstract);分类 cs.AI、cs.CV

AI总结 See-Control通过直接与机械臂交互实现智能手机操作,无需ADB或系统后台访问,提供了一个平台无关的多模态代理框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08548 2025-12-10 cs.RO cs.AI 84%

Bridging Scale Discrepancies in Robotic Control via Language-Based Action Representations

通过基于语言的动作表示弥合机器人控制中的尺度差异

Yuchi Zhang, Churui Sun, Shiqi Liang, Diyuan Liu, Chao Ji, Wei-Nan Zhang, Ting Liu

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO、cs.AI

AI总结 本文提出基于语言的动作表示方法,通过规范动作以缓解机器人控制中的尺度差异问题,提升操作任务的泛化能力和迁移性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08920 2025-12-10 cs.RO cs.LG 73%

OSMO: Open-Source Tactile Glove for Human-to-Robot Skill Transfer

OSMO:开源触觉手套用于人到机器人技能转移

Jessica Yin, Haozhi Qi, Youngsun Wi, Sayantan Kundu, Mike Lambeta, William Yang, Changhao Wang, Tingfan Wu, Jitendra Malik, Tess Hellebrekers

机构 * Meta FAIR University of Michigan(密歇根大学) University of Pennsylvania(宾夕法尼亚大学)

专题命中 机器人操作 :manipulation(abstract);robot policy(abstract);分类 cs.RO、cs.LG

AI总结 OSMO通过触觉手套实现人到机器人技能转移,利用触觉数据提升机器人操作性能。

Comments Project website: https://jessicayin.github.io/osmo_tactile_glove/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07215 2025-12-10 cs.CV cs.AI 73%

VFM-VLM: Vision Foundation Model and Vision Language Model based Visual Comparison for 3D Pose Estimation

基于视觉基础模型和视觉语言模型的3D姿态估计视觉比较:VFM-VLM

Md Selim Sarowar, Sungho Kim

机构 * Dept. of Electronic Engineering Yeungnam University Advanced Visual Intelligence Lab(电子工程系 韩国又南大学 高级视觉智能实验室)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.AI、cs.CV

AI总结 本文比较了基于CLIP和DINOv2的视觉模型在3D姿态估计中的性能,展示了两者在语义理解和几何精度上的互补优势,为机器人抓取应用提供了模型选择依据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08236 2025-12-10 cond-mat.mes-hall cond-mat.mtrl-sci 71%

Field manipulation of Weyl modes in an ideal Dirac semimetal

在理想狄拉克半金属中操控韦伊尔模

Jingyuan Zhong, Jianfeng Wang, Ming Yang, Jie Liu, Zhizhen Ren, Anping Huang, Zhixiang Shi, Zengwei Zhu, Yan Shi, Weichang Hao, Jincheng Zhuang, Yi Du

专题命中 机器人操作 :manipulation(title)

AI总结 通过调节磁场实现理想狄拉克半金属中多重韦伊尔模,揭示了在交织对称性和时间反演破缺下的不同韦伊尔模特性。

Journal ref Nat Commun 16, 10785 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00540 2025-12-10 cs.ET cs.AI cs.LG 62%

The Energy Cost of Artificial Intelligence Lifecycle in Communication Networks

人工智能生命周期在通信网络中的能耗

Shih-Kai Chou, Jernej Hribar, Vid Hanžel, Mihael Mohorčič, Carolina Fortuna

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种衡量人工智能在通信网络生命周期中能耗的新指标eCAL,通过分析数据收集和处理复杂性,量化模型部署和推理过程中的能耗变化。

Comments 16 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08185 2025-12-10 cs.CR cs.AI 57%

A Practical Framework for Evaluating Medical AI Security: Reproducible Assessment of Jailbreaking and Privacy Vulnerabilities Across Clinical Specialties

评估医疗AI安全的实用框架:在不同临床专科中可重复评估劫持和隐私漏洞

Jinghao Wang, Ping Zhang, Carter Yagemann

机构 * The Ohio State University(俄亥俄州立大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本文提出了一种可重复评估医疗AI安全性的框架,针对不同临床专科的劫持和隐私漏洞进行评估,无需特殊资源或数据权限。

Comments 6 pages, 1 figure, framework proposal

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04053 2025-12-10 cs.LG cs.IT math.IT 57%

Curse of Slicing: Why Sliced Mutual Information is a Deceptive Measure of Statistical Dependence

切片互信息:为什么切片互信息是统计依赖性的一种欺骗性度量

Alexander Semenenko, Ivan Butakov, Alexey Frolov, Ivan Oseledets

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 该研究指出切片互信息在衡量统计依赖性时存在欺骗性,易受数据操纵影响,且在某些情况下表现不如相关系数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14570 2025-12-10 cs.RO cs.SY eess.SY 57%

Haptic-based Complementary Filter for Rigid Body Rotations

基于触觉的互补滤波器用于刚体旋转

Amit Kumar, Domenico Campolo, Ravi N. Banavar

机构 * School of Mechanical and Aerospace Engineering, Nanyang Technological University, Singapore(机械与航空航天工程学院,南洋理工大学)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 本文提出了一种基于触觉和视觉传感器的互补滤波器,用于估计刚体旋转,通过利用$\mathbf{\mathbb{SO}(3)}$的对称性和超级二次曲面表示,提高了三维方向估计的鲁棒性和稳定性。

Comments 7 pages, 7 figures; Updated filter design; Submitted to IFAC for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20304 2025-12-10 cs.CV cs.GR eess.IV eess.SP 57%

Deep Learning, Machine Learning -- Digital Signal and Image Processing: From Theory to Application

深度学习、机器学习--数字信号和图像处理:从理论到应用

Weiche Hsieh, Ziqian Bi, Junyu Liu, Benji Peng, Sen Zhang, Xuanhe Pan, Jiawei Xu, Jinlang Wang, Keyu Chen, Caitlyn Heqi Yin, Pohsun Feng, Yizhu Wen, Tianyang Wang, Ming Li, Jintao Ren, Xinyuan Song, Qian Niu, Silin Chen, Ming Liu

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 本文探讨了深度学习和机器学习在数字信号与图像处理中的应用,通过整合DFT、Z变换等方法,优化实时数据处理,推动计算机视觉领域的技术发展。

Comments 293 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07289 2025-12-10 cond-mat.mes-hall quant-ph 50%

Efficient driving of a spin-qubit using single-atom magnets

利用单原子磁体高效驱动自旋量子比特

Jose Reina-Gálvez, Hoang-Anh Le, Hong Thi Bui, Soo-hyon Phark, Nicolás Lorente, Christoph Wolf

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究通过单原子磁体高效驱动邻近单自旋量子比特,利用交换耦合调制实现数十兆赫兹范围的拉比速率,为量子态操控提供了新的方法。

Journal ref Phys. Rev. Research 7, L042055 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 14 篇

2512.06912 2025-12-10 cs.RO cs.LG 82%

Khalasi: Energy-Efficient Navigation for Surface Vehicles in Vortical Flow Fields

Khalasi:在涡流流场中表面车辆的节能导航

Rushiraj Gadhvi, Sandeep Manjanna

机构 * Plaksha University(普拉克斯大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.LG;robotics(comments)

AI总结 本文提出了一种基于强化学习的端到端方法,用于在涡流流场中实现表面车辆的节能导航,通过局部速度测量学习流感知的导航策略,显著提升能源效率和泛化能力。

Comments Under Review for International Conference on Robotics and Automation (ICRA 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08754 2025-12-10 cs.RO 79%

A Multi-Robot Platform for Robotic Triage Combining Onboard Sensing and Foundation Models

一种结合 onboard 感知与基础模型的多机器人平台用于机器人 triage

Jason Hughes, Marcel Hussing, Edward Zhang, Shenbagaraj Kannapiran, Joshua Caswell, Kenneth Chaney, Ruichen Deng, Michaela Feehery, Agelos Kratimenos, Yi Fan Li, Britny Major, Ethan Sanchez, Sumukh Shrote, Youkang Wang, Jeremy Wang, Daudi Zein, Luying Zhang, Ruijun Zhang, Alex Zhou, Tenzi Zhouga, Jeremy Cannon, Zaffir Qasim, Jay Yelon, Fernando Cladera, Kostas Daniilidis, Camillo J. Taylor, Eric Eaton

机构 * GRASP Lab, School of Engineering and Applied Sciences, University of Pennsylvania(GRASP实验室,工程与应用科学学院,宾夕法尼亚大学) Perelman School of Medicine, University of Pennsylvania(佩拉蒙医学学院,宾夕法尼亚大学)

专题命中 具身导航 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出一种多机器人平台,结合 onboard 感知与基础模型,实现大规模伤亡事件中的机器人 triage,涵盖伤员定位、生命体征测量和伤情评估等关键步骤。

Comments Technical Report for the DARPA Triage Challenge PRONTO team

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08186 2025-12-10 cs.RO 79%

Ground Slow, Move Fast: A Dual-System Foundation Model for Generalizable Vision-and-Language Navigation

放慢脚步,快速移动:一种通用视觉-语言导航的双系统基础模型

Meng Wei, Chenyang Wan, Jiaqi Peng, Xiqian Yu, Yuqiang Yang, Delin Feng, Wenzhe Cai, Chenming Zhu, Tai Wang, Jiangmiao Pang, Xihui Liu

机构 * Shanghai AI Laboratory(上海人工智能实验室) The University of Hong Kong(香港大学) Zhejiang University(浙江大学) Tsinghua University(清华大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 DualVLN通过双系统架构,结合高层推理与低层动作执行,提升视觉-语言导航的泛化能力和动态环境适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06198 2025-12-10 cs.RO cs.SY eess.SY 79%

Cascaded Tightly-Coupled Observer Design for Single-Range-Aided Inertial Navigation

单范围辅助惯性导航的级联紧密耦合观测器设计

Oussama Sifour, Soulaimane Berkane, Abdelhamid Tayebi

机构 * Department of Computer Science(计算机科学系) Engineering, University of Quebec in Outaouais, Gatineau, QC, Canada(魁北克大学Outaouais工程学院,加蒂纳岛,QC,加拿大) Department of Electrical and Computer Engineering(电气与计算机工程系) Lakehead University(拉克头大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出一种利用单范围辅助信息的级联紧密耦合观测器,通过IMU、向量测量和距离测量实现对惯性导航系统完整状态的估计,具有良好的鲁棒性和精度。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07609 2025-12-10 cs.HC cs.RO 79%

IGUANA: Immersive Guidance, Navigation, and Control for Consumer UAV

IGUANA:面向消费级无人机的沉浸式引导、导航与控制

Victor Victor, Tania Krisanty, Matthew McGinity, Stefan Gumhold, Uwe Aßmann

机构 * Immersive Experience Lab(沉浸体验实验室) Technische Universität Dresden(德累斯顿技术大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 IGUANA通过三维地形地图、虚拟球体控制和空间叠加层,为消费级无人机提供直观的沉浸式引导、导航与控制方案,提升用户操作效率和情境感知能力。

Comments This is the author's version of the work. The definitive Version of Record was published in 31st ACM Symposium on Virtual Reality Software and Technology (VRST '25)

Journal ref VRST '25: Proceedings of the 31st ACM Symposium on Virtual Reality Software and Technology (2025) 16, 1-11

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08084 2025-12-10 cond-mat.mtrl-sci 78%

Bayesian Co-Navigation of a Computational Physical Model and AFM Experiment to Autonomously Survey a Combinatorial Materials Library

基于计算物理模型和原子力显微镜实验的贝叶斯协同导航以自主调查组合材料库

Boris N. Slautin, Kamyar Barakati, Yu Liu, Reece Emery, Philip Rack, Sergei V. Kalinin

专题命中 具身导航 :navigation(title,abstract)

AI总结 本文提出通过贝叶斯协同导航框架,结合计算物理模型与AFM实验,自主调查组合材料库,实现理论模型与实验的动态整合与持续修正。

Comments 19 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07845 2025-12-10 cs.SD cs.AI eess.AS 70%

AudioScene: Integrating Object-Event Audio into 3D Scenes

AudioScene: 将对象事件音频整合到3D场景中

Shuaihang Yuan, Congcong Wen, Muhammad Shafique, Anthony Tzes, Yi Fang

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.AI

AI总结 本文提出AudioScene数据集,通过整合音频事件与3D场景,探索音频条件任务,提升空间学习的准确性与多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08286 2025-12-10 cs.SE cs.AI cs.LG 62%

Empowering smart app development with SolidGPT: an edge-cloud hybrid AI agent framework

通过SolidGPT赋能智能应用开发:一种边缘-云混合AI代理框架

Liao Hu, Qiteng Wu, Ruoyu Qi

机构 * University of Illinois, Chicago, USA(伊利诺伊大学芝加哥分校) North Carolina State University, North Carolina, USA(北卡罗来纳州立大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 SolidGPT是一种结合边缘计算与云计算的AI代理框架,通过交互式代码查询、自动化项目生成和人机协作提升开发者生产力,适用于智能移动和软件工程领域。

Journal ref Advances in Engineering Innovation 16.7 (2025): 86-92

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08476 2025-12-10 cs.RO 57%

A Multi-Agent LLM Framework for Design Space Exploration in Autonomous Driving Systems

多智能体大语言模型框架用于自动驾驶系统的设计空间探索

Po-An Shih, Shao-Hua Wang, Yung-Che Li, Chia-Heng Tu, Chih-Han Chang

机构 * National Cheng Kung University(国立成功大学) Safeware Technology Inc.(Safeware技术公司)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出基于多智能体大语言模型的自动驾驶系统设计空间探索框架,通过多模态推理和3D模拟工具自动化解析执行输出,提升设计效率和成本效益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02581 2025-12-10 cond-mat.mtrl-sci cs.LG 57%

Automated Construction of Artificial Lattice Structures with Designer Electronic States

自动化构建人工晶格结构以实现设计电子态

Ganesh Narasimha, Mykola Telychko, Wooin Yang, Arthur P. Baddorf, P. Ganesh, An-Ping Li, Rama Vasudevan

专题命中 具身导航 :manipulation(abstract);分类 cs.LG

AI总结 本文提出基于强化学习的自动化方法,用于在铜基底上操控CO分子构建人工晶格,实现原子级精确的电子态设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08028 2025-12-10 cs.RO 57%

Optimized Area Coverage in Disaster Response Utilizing Autonomous UAV Swarm Formations

利用自主无人机蜂群编队优化灾害响应中的区域覆盖

Lampis Papakostas, Aristeidis Geladaris, Athanasios Mastrogeorgiou, Jim Sharples, Gautier Hattenberger, Panagiotis Chatzakos, Panagiotis Polygerinos

机构 * Tech Hive Labs Control Systems and Robotics Lab (CSRL)(控制系统与机器人实验室) National Technical University of Athens(国家技术大学雅典) Fédération ENAC ISAE-SUPAERO ONERA(ENAC ISAE-SUPAERO ONERA联合会) AI Innovation Centre(人工智能创新中心)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出了一种基于无人机蜂群的灾害响应系统,通过优化区域覆盖和障碍物避障,提升灾害场景下的救援效率和任务可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08437 2025-12-10 cs.HC 50%

Time and Money Matters for Sustainability: Insights on User Preferences on Renewable Energy for Electric Vehicle Charging Stations

时间与金钱对可持续性的影响:关于用户对电动汽车充电站可再生能源偏好的洞察

Delong Du, Apostolos Vavouris, Omid Veisi, Lu Jin, Gunnar Stevens, Lina Stankovic, Vladimir Stankovic, Alexander Boden

专题命中 具身导航 :navigation(abstract)

AI总结 研究探讨了电动汽车用户在选择充电站时对时间与金钱的优先考虑,以及动态可再生能源可用性对可持续充电站导航系统的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04971 2025-12-10 cs.HC 50%

NERVIS: An Interactive System for Graph-Based Exploration and Editing of Named Entities

NERVIS:基于图的命名实体探索与编辑交互系统

Uroš Šmajdek, Ciril Bohak

专题命中 具身导航 :navigation(abstract)

AI总结 NERVIS是一个用于探索和编辑命名实体的交互式系统,通过图表示整合文档、实体提及和实体,支持灵活的探索和交互式编辑。

Comments 10 pages, 6 figures, submitted to HCI SI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08179 2025-12-10 cs.SE 50%

MBTModelGenerator: Automated Reverse Engineering of Test Models from Clickstream Data for Model-Based Testing of Web Applications

MBTModelGenerator: 从点击流数据自动反向工程Web应用的测试模型

Vahid Garousi, Alper Buğra Keleş, Yunus Balaman, Sasidhar Matta, Zafar Jafarov, Aytan Mövsümova, Atif Namazov

专题命中 具身导航 :navigation(abstract)

AI总结 MBTModelGenerator通过自动反向工程点击流数据生成Web应用的测试模型,大幅降低手动设计MBT模型的工作量。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 具身推理 1 篇

2512.08478 2025-12-10 cs.CV cs.AI cs.GR 81%

Visionary: The World Model Carrier Built on WebGPU-Powered Gaussian Splatting Platform

Visionary: 基于WebGPU驱动的高斯点云平台的世界模型载体

Yuning Gong, Yifei Liu, Yifan Zhan, Muyao Niu, Xueying Li, Yuanjun Liao, Jiaming Chen, Yuanyuan Gao, Jiaqi Chen, Minming Chen, Li Zhou, Yuning Zhang, Wei Wang, Xiaoqing Hou, Huaxi Huang, Shixiang Tang, Le Ma, Dingwen Zhang, Xue Yang, Junchi Yan, Yanchi Zhang, Yinqiang Zheng, Xiao Sun, Zhihang Zhong

机构 * Shanghai AI Laboratory(上海人工智能实验室) Sichuan University(四川大学) The University of Tokyo(东京大学) Shanghai Jiao Tong University(上海交通大学) Northwestern Polytechnical University(西北工业大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.CV

AI总结 Visionary是一款基于WebGPU的实时高斯点云渲染平台,通过高效推断和浏览器集成,提升3DGS方法的部署效率与多样性。

Comments Project page: https://visionary-laboratory.github.io/visionary

详情

展开后加载摘要…

URL PDF HTML 收藏