arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-02-26 至 2026-02-26 共收录 58 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 9 篇

2602.21904 2026-02-26 cs.CV cs.RO 62%

UNet-Based Keypoint Regression for 3D Cone Localization in Autonomous Racing

基于UNet的关键点回归用于自动驾驶赛车中3D圆锥定位

Mariia Baidachna, James Carty, Aidan Ferguson, Joseph Agrane, Varad Kulkarni, Aubrey Agub, Michael Baxendale, Aaron David, Rachel Horton, Elliott Atkinson

机构 * School of Computer Science, University of Glasgow(计算机科学学院,格拉斯哥大学) Amazon(亚马逊)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出基于UNet的关键点回归方法,用于自动驾驶赛车中3D圆锥定位,通过大规模数据集提升定位精度并实现颜色预测。

Comments 8 pages, 9 figures. Accepted to ICCV End-to-End 3D Learning Workshop 2025 and presented as a poster; not included in the final proceedings due to a conference administrative error

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21266 2026-02-26 cs.RO 57%

Dual-Branch INS/GNSS Fusion with Inequality and Equality Constraints

双分支INS/GNSS融合与不等式和等式约束

Mor Levenhar, Itzik Klein

机构 * Autonomous Navigation and Sensor Fusion Lab, Hatter Department of Marine Technologies, University of Haifa(自主导航与传感器融合实验室,哈特尔海洋技术系,海法大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出一种双分支信息辅助框架,通过方差加权方案融合等式和不等式运动约束,提升GNSS受限条件下的导航鲁棒性和连续性。

Comments 12 pages, 5 figuers

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13595 2026-02-26 cs.RO 57%

Active Tactile Exploration for Rigid Body Pose and Shape Estimation

主动触觉探索用于刚体位姿与形状估计

Ethan K. Gordon, Bruke Baraki, Hien Bui, Michael Posa

机构 * General Robotics, Automation, Sensing, and Perception (GRASP) Laboratory(通用机器人、自动化、感知与感知实验室)

专题命中 具身导航 :manipulation(abstract);分类 cs.RO

AI总结 本研究提出了一种基于触觉数据的主动探索框架,用于高效估计刚体的位姿与形状,通过优化损失函数实现快速学习。

Comments Presented at ICRA 2026; 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21874 2026-02-26 cs.HC 50%

Interactive Augmented Reality-enabled Outdoor Scene Visualization For Enhanced Real-time Disaster Response

交互式增强现实赋能的户外场景可视化以提升实时灾害响应

Dimitrios Apostolakis, Georgios Angelidis, Vasileios Argyriou, Panagiotis Sarigiannidis, Georgios Th. Papadopoulos

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出了一种基于3DGS的交互式AR界面,用于提升实时灾害响应中的场景可视化与决策效率。

Comments 6 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19784 2026-02-26 eess.SY cs.SY 50%

High-Altitude Platforms in the Low-Altitude Economy: Bridging Communication, Computing, and Regulation

高空平台在低空经济中的作用:连接通信、计算与监管

Bang Huang, Baha Eddine Youcef Belmekki, Mohamed-Slim Alouini

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出高空平台在低空经济中的五阶段发展路线,旨在通过连接、计算和监管提升低空经济的自主性和可持续性。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身推理 3 篇

2602.22010 2026-02-26 cs.RO cs.CV 84%

World Guidance: World Modeling in Condition Space for Action Generation

世界引导:在条件空间中进行世界建模以生成动作

Yue Su, Sijin Chen, Haixin Shi, Mingyu Liu, Zhengshen Zhang, Ningyuan Huang, Weiheng Zhong, Zhengbang Zhu, Yuxiao Liu, Xihui Liu

机构 * The University of Hong Kong(香港大学)

专题命中 具身推理 :world model(title,abstract);manipulation(abstract);分类 cs.RO、cs.CV

AI总结 WoG通过在条件空间中建模未来观测,提升视觉-语言-动作模型的动作生成能力与泛化性能。

Comments Project Page: https://selen-suyue.github.io/WoGNet/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21467 2026-02-26 cs.LG 79%

Geometric Priors for Generalizable World Models via Vector Symbolic Architecture

基于向量符号架构的几何先验用于通用世界模型

William Youngwoo Chung, Calvin Yeung, Hansen Jin Lillemark, Zhuowen Zou, Xiangjian Liu, Mohsen Imani

机构 * University of California Irvine(加州大学伊文斯分校) University of California San Diego(加州大学圣地亚哥分校)

专题命中 具身推理 :world model(title,abstract);分类 cs.LG

AI总结 本文提出基于向量符号架构的几何先验方法,通过学习复数空间的群结构,实现高效且可解释的世界模型,提升多步组合和泛化能力。

Comments 9 pages, accepted to Neurips 2025 Workshop Symmetry and Geometry in Neural Representations

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20685 2026-02-26 cs.CV 79%

RAYNOVA: Scale-Temporal Autoregressive World Modeling in Ray Space

RAYNOVA:在射线空间中实现尺度-时间自回归世界建模

Yichen Xie, Chensheng Peng, Mazen Abdelfattah, Yihan Hu, Jiezhi Yang, Eric Higgins, Ryan Brigden, Masayoshi Tomizuka, Wei Zhan

机构 * Applied Intuition UC Berkeley(加州大学伯克利分校)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 RAYNOVA通过双因果自回归框架实现尺度-时间自回归世界建模,在驾驶场景中实现多视角视频生成,具有更高的吞吐量和可控性。

Comments Accepted by CVPR 2026; Project website: https://raynova-ai.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 机器人基础模型 5 篇

2602.21531 2026-02-26 cs.RO cs.AI cs.CV cs.LG cs.SY eess.SY 83%

LiLo-VLA: Compositional Long-Horizon Manipulation via Linked Object-Centric Policies

LiLo-VLA:通过链接的对象为中心策略实现组合长周期操控

Yue Yang, Shuo Cheng, Yu Fang, Homanga Bharadhwaj, Mingyu Ding, Gedas Bertasius, Daniel Szafir

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Georgia Institute of Technology(佐治亚理工学院) Carnegie Mellon University(卡内基梅隆大学)

专题命中 机器人基础模型 :manipulation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 LiLo-VLA通过链接的对象为中心策略实现长周期操控,通过模块化框架实现零样本泛化,提升机器人任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21112 2026-02-26 cs.RO cs.AI 73%

EO-1: An Open Unified Embodied Foundation Model for General Robot Control

EO-1:一个通用机器人控制的开放统一具身基础模型

Delin Qu, Haoming Song, Qizhi Chen, Zhaoqing Chen, Xianqiang Gao, Dong Wang, Xinyi Ye, Qi Lv, Modi Shi, Guanghui Ren, Cheng Ruan, Maoqing Yao, Haoran Yang, Jiacheng Bao, Bin Zhao, Xuelong Li

机构 * Shanghai AI Laboratory(上海人工智能实验室) Fudan University(复旦大学) AgiBot Northwestern Polytechnical University(西北工业大学)

专题命中 机器人基础模型 :robotics(abstract);manipulation(abstract);分类 cs.RO、cs.AI

AI总结 EO-1是一个统一的具身基础模型,通过交错视觉-文本-动作预训练实现了在多模态推理和机器人控制中的卓越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02310 2026-02-26 cs.RO cs.CV 73%

PD-VLA: Accelerating Vision-Language-Action Model Integrated with Action Chunking via Parallel Decoding

PD-VLA:通过并行解码加速集成动作分块的视觉-语言-动作模型

Wenxuan Song, Jiayi Chen, Pengxiang Ding, Han Zhao, Wei Zhao, Zhide Zhong, Zongyuan Ge, Zhijun Li, Donglin Wang, Jun Ma, Lujia Wang, Haoang Li

专题命中 机器人基础模型 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 PD-VLA通过并行解码框架提升视觉-语言-动作模型在动作分块中的效率与性能

Comments Accepted by IROS 2025, updated results on LIBERO

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21633 2026-02-26 cs.RO cs.AI cs.CV 67%

Self-Correcting VLA: Online Action Refinement via Sparse World Imagination

自校正视觉-语言-动作模型:通过稀疏世界想象实现在线动作细化

Chenyv Liu, Wentao Tan, Lei Zhu, Fengling Li, Jingjing Li, Guoli Yang, Heng Tao Shen

机构 * Tongji University(同济大学) University of Technology Sydney(技术悉尼大学) University of Electronic Science(电子科学大学) Advanced Institute of Big Data(大数据高级研究所)

专题命中 机器人基础模型 :manipulation(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 SC-VLA通过稀疏世界想象实现自校正,提升机器人操作任务的效率和成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21736 2026-02-26 cs.RO 57%

Joint-Aligned Latent Action: Towards Scalable VLA Pretraining in the Wild

联合对齐的潜在动作:迈向大规模野外VLA预训练

Hao Luo, Ye Wang, Wanpeng Zhang, Haoqi Yuan, Yicheng Feng, Haiweng Xu, Sipeng Zheng, Zongqing Lu

机构 * Peking University(北京大学) Renmin University of China(中国人民大学) BeingBeyond

专题命中 机器人基础模型 :manipulation(abstract);分类 cs.RO

AI总结 JALA通过联合对齐的潜在动作预训练框架,提升从人类数据中大规模预训练视觉-语言-动作模型的效率与性能。

Comments CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 模仿学习与强化学习 3 篇

2501.16443 2026-02-26 cs.LG cs.CV 81%

Object-Centric World Models from Few-Shot Annotations for Sample-Efficient Reinforcement Learning

基于少量标注的面向对象世界模型用于样本高效强化学习

Weipu Zhang, Adam Jelley, Trevor McInroe, Amos Storkey, Gang Wang

机构 * University of Edinburgh(爱丁堡大学) Beijing Institute of Technology(北京理工大学)

专题命中 模仿学习与强化学习 :world model(title,abstract);分类 cs.CV、cs.LG

AI总结 本文提出OC-STORM框架,通过面向对象表示提升MBRL在复杂视觉领域的样本效率,实验证明其在Atari和Hollow Knight中的优越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21992 2026-02-26 cs.CV 57%

PanoEnv: Exploring 3D Spatial Intelligence in Panoramic Environments with Reinforcement Learning

PanoEnv:探索基于强化学习的全景环境中3D空间智能

Zekai Lin, Xu Zheng

机构 * University of Glasgow(格拉斯哥大学) HKUST(GZ)(香港科技大学(广州))

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.CV

AI总结 PanoEnv通过强化学习框架提升VLMs在全景环境中3D空间推理能力,实现更高准确率和语义评分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04579 2026-02-26 eess.SY cs.RO cs.SY 57%

Gauss-Newton accelerated MPPI Control

Gauss-Newton加速的MPPI控制

Hannes Homburger, Katrin Baumgärtner, Moritz Diehl, Johannes Reuter

机构 * Institute of System Dynamics, HTWG Konstanz - University of Applied Sciences(系统动力学研究所,霍特廷根应用科学大学) Department of Microsystems Engineering (IMTEK), University of Freiburg(微系统工程系(IMTEK),弗赖堡大学) Department of Microsystems Engineering (IMTEK)(微系统工程系(IMTEK)) Department of Mathematics, University of Freiburg(数学系,弗赖堡大学)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

AI总结 本文提出Gauss-Newton加速的MPPI方法,通过结合雅可比重构和二次广义高斯-牛顿方法,提升MPPI在高维问题中的可扩展性和计算效率。

Comments 6 pages, 3 figures, submitted to the IFAC World Congress 2026, parts of this preprint are directly taken from Chapter 3 of the main author's PhD thesis with title "Optimal Control for Efficient Vessel Operation: From Theory to Real-World Applications"

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 人机交互与遥操作 1 篇

2602.22100 2026-02-26 cs.RO 74%

Behavioral Cloning for Robotic Connector Assembly: An Empirical Study

基于行为克隆的机器人连接器装配:实证研究

Andreas Kernbach, Daniel Bargmann, Werner Kraus, Marco F. Huber

机构 * Fraunhofer Institute for Manufacturing Engineering and Automation IPA(弗劳恩霍夫制造工程与自动化研究所) University of Stuttgart(斯图加特大学)

专题命中 人机交互与遥操作 :robotic(title);分类 cs.RO

AI总结 本文通过实证研究探讨了基于行为克隆的连接器装配方法,结合力矩传感与摄像头,实现高成功率的连接器插入任务。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 机器人数据与评测 9 篇

2602.20871 2026-02-26 cs.RO 79%

GeCo-SRT: Geometry-aware Continual Adaptation for Robotic Cross-Task Sim-to-Real Transfer

GeCo-SRT: 基于几何的持续适应用于机器人跨任务仿真到现实迁移

Wenbo Yu, Wenke Xia, Weitao Zhang, Di Hu

机构 * Beijing Forestry University(北京林业大学) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院) Beijing Key Laboratory of Research on Large Models and Intelligent Governance(北京大型模型与智能治理研究重点实验室) Engineering Research Center of Next-Generation Intelligent Search and Recommendation, MOE(下一代智能搜索与推荐工程研究中心,教育部)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 GeCo-SRT通过几何感知的持续适应方法,实现跨任务仿真到现实迁移的高效和有效适应,提升新任务性能并提高数据效率。

Comments Accepted By CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00062 2026-02-26 cs.CV cs.AI cs.LG cs.RO 70%

World Simulation with Video Foundation Models for Physical AI

基于视频基础模型的世界模拟用于物理AI

NVIDIA, :, Arslan Ali, Junjie Bai, Maciej Bala, Yogesh Balaji, Aaron Blakeman, Tiffany Cai, Jiaxin Cao, Tianshi Cao, Elizabeth Cha, Yu-Wei Chao, Prithvijit Chattopadhyay, Mike Chen, Yongxin Chen, Yu Chen, Shuai Cheng, Yin Cui, Jenna Diamond, Yifan Ding, Jiaojiao Fan, Linxi Fan, Liang Feng, Francesco Ferroni, Sanja Fidler, Xiao Fu, Ruiyuan Gao, Yunhao Ge, Jinwei Gu, Aryaman Gupta, Siddharth Gururani, Imad El Hanafi, Ali Hassani, Zekun Hao, Jacob Huffman, Joel Jang, Pooya Jannaty, Jan Kautz, Grace Lam, Xuan Li, Zhaoshuo Li, Maosheng Liao, Chen-Hsuan Lin, Tsung-Yi Lin, Yen-Chen Lin, Huan Ling, Ming-Yu Liu, Xian Liu, Yifan Lu, Alice Luo, Qianli Ma, Hanzi Mao, Kaichun Mo, Seungjun Nah, Yashraj Narang, Abhijeet Panaskar, Lindsey Pavao, Trung Pham, Morteza Ramezanali, Fitsum Reda, Scott Reed, Xuanchi Ren, Haonan Shao, Yue Shen, Stella Shi, Shuran Song, Bartosz Stefaniak, Shangkun Sun, Shitao Tang, Sameena Tasmeen, Lyne Tchapmi, Wei-Cheng Tseng, Jibin Varghese, Andrew Z. Wang, Hao Wang, Haoxiang Wang, Heng Wang, Ting-Chun Wang, Fangyin Wei, Jiashu Xu, Dinghao Yang, Xiaodong Yang, Haotian Ye, Seonghyeon Ye, Xiaohui Zeng, Jing Zhang, Qinsheng Zhang, Kaiwen Zheng, Andrew Zhu, Yuke Zhu

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 Cosmos-Predict2.5和Cosmos-Transfer2.5通过统一生成和增强的模拟能力,推动物理AI领域的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00288 2026-02-26 cs.CV cs.AI 62%

TimeBlind: A Spatio-Temporal Compositionality Benchmark for Video LLMs

TimeBlind: 一种用于视频大语言模型的时空组合性基准

Baiqi Li, Kangyi Zhao, Ce Zhang, Chancharik Mitra, Jean de Dieu Nyandwi, Gedas Bertasius

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) University of Pittsburgh(匹兹堡大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 机器人数据与评测 :embodied AI(abstract);分类 cs.AI、cs.CV

AI总结 TimeBlind通过细粒度时空理解基准揭示视频大语言模型对时间动态理解的不足,展示其在实例准确率上的显著劣势,强调对静态视觉捷径的依赖。

Comments For code and data, see https://baiqi-li.github.io/timeblind_project/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15427 2026-02-26 cs.RO cs.CV 62%

Lang2Lift: A Language-Guided Autonomous Forklift System for Outdoor Industrial Pallet Handling

Lang2Lift: 一种基于语言引导的户外工业叉车自主系统

Huy Hoang Nguyen, Johannes Huemer, Markus Murschitz, Tobias Glueck, Minh Nhat Vu, Andreas Kugi

机构 * AIT Austrian Institute of Technology GmbH(奥地利技术研究所) Automation & Control Institute(自动化与控制研究所)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO、cs.CV

AI总结 Lang2Lift通过语言引导的视觉感知和闭环控制,实现户外环境下的自主叉车托盘拾取,提升工业自动化效率。

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19983 2026-02-26 cs.RO cs.AI 62%

Contextual Safety Reasoning and Grounding for Open-World Robots

面向开放世界机器人的上下文安全推理与 grounding

Zachary Ravichandran, David Snyder, Alexander Robey, Hamed Hassani, Vijay Kumar, George J. Pappas

机构 * University of Pennsylvania(宾夕法尼亚大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 CORE框架通过视觉语言模型实现在线上下文推理与空间grounding,提供概率安全保证,在开放世界中有效执行上下文适应的安全行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22073 2026-02-26 cs.CV 57%

AdaSpot: Spend Resolution Where It Matters for Precise Event Spotting

AdaSpot: 在关键区域进行高精度事件定位以实现精确事件检测

Artur Xarles, Sergio Escalera, Thomas B. Moeslund, Albert Clapés

机构 * Universitat de Barcelona(巴塞罗那大学) Computer Vision Center(计算机视觉中心) Aalborg University(阿勒斯大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 AdaSpot通过自适应选择关键区域进行高分辨率处理,实现高精度事件检测,提升效率并取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21721 2026-02-26 cs.CR cs.GT cs.LG 57%

Private and Robust Contribution Evaluation in Federated Learning

联邦学习中的隐私与鲁棒贡献评估

Delio Jaramillo Velez, Gergely Biczok, Alexandre Graell i Amat, Johan Ostman, Balazs Pejo

机构 * University of La Laguna(拉拉加大学) HUN-REN Hungarian Research Network(HUN-REN匈牙利研究网络) Chalmers University(查尔姆斯大学) Budapest University of Technology and Economics(布达佩斯技术经济大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.LG

AI总结 本文提出两种与安全聚合兼容的边际差异贡献评分,兼顾公平性、隐私和鲁棒性,提升联邦学习中的贡献评估效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11456 2026-02-26 cs.RO 57%

SimTac: A Physics-Based Simulator for Vision-Based Tactile Sensing with Biomorphic Structures

SimTac: 基于物理的模拟器用于基于视觉的生物形态触觉感知

Xuyang Zhang, Jiaqi Jiang, Zhuo Chen, Yongqiang Zhao, Tianqi Yang, Daniel Fernandes Gomes, Jianan Wang, Shan Luo

机构 * Department of Engineering, King’s College London(工程系,伦敦国王学院) School of Aerospace Engineering, Beijing Institute of Technology(航空工程学院,北京理工大学) Department of Computer Science, University College London(计算机科学系,伦敦大学学院)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 SimTac是一个基于物理的模拟器,用于设计和验证生物形态触觉传感器,通过多种几何结构实现准确高效的触觉感知模拟。

Journal ref Cyborg and Bionic Systems, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21666 2026-02-26 cs.RO 57%

Biomechanical Comparisons Reveal Divergence of Human and Humanoid Gaits

生物力学比较揭示人类与仿人步态的分歧

Luying Feng, Yaochu Jin, Hanze Hu, Wei Chen

机构 * Zhejiang University(浙江大学) School of Engineering, Westlake University(西湖大学工程学院) Ningbo Institute of Materials Technology and Engineering, Chinese Academy of Sciences(中国科学院宁波材料技术与工程研究所)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本研究提出GDAF框架,通过比较人类与仿人步态的生物力学差异,揭示现代仿人控制器在步态对称性、能量分布和关节协调方面的系统性偏差,为提升仿人运动的生物力学保真度和节能性提供基准和工具。

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 其他机器人 2 篇

2602.22001 2026-02-26 cs.RO 83%

Are Foundation Models the Route to Full-Stack Transfer in Robotics?

基础模型是否是机器人领域全栈迁移的途径?

Freek Stulp, Samuel Bustamante, João Silvério, Alin Albu-Schäffer, Jeannette Bohg, Shuran Song

机构 * Institute of Robotics and Mechatronics, German Aerospace Center (DLR)(机器人与机电研究所,德国航空航天中心(DLR)) Stanford AI Lab, Stanford University(斯坦福大学人工智能实验室)

专题命中 其他机器人 :robotics(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文探讨基础模型在机器人全栈迁移中的作用,分析其对不同迁移层次的影响及面临的挑战。

Comments 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21965 2026-02-26 cs.LG 57%

Compact Circulant Layers with Spectral Priors

紧凑的循环层与频谱先验

Joseph Margaryan, Thomas Hamelryck

机构 * Department of Computer Science (DIKU), University of Copenhagen, Copenhagen, Denmark(计算机科学系(DIKU),哥本哈根大学,哥本哈根,丹麦) Department of Biology, University of Copenhagen, Copenhagen, Denmark(生物学系,哥本哈根大学,哥本哈根,丹麦)

专题命中 其他机器人 :robotics(abstract);分类 cs.LG

AI总结 本文提出紧凑的频谱循环与BCCB层,通过频域参数化实现高效的模型压缩和鲁棒性保障。

详情

展开后加载摘要…

URL PDF HTML 收藏