arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-02-17 至 2026-02-17 共收录 129 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 26 篇

2505.10685 2026-02-17 cs.CV 70%

GaussianFormer3D: Multi-Modal Gaussian-based Semantic Occupancy Prediction with 3D Deformable Attention

GaussianFormer3D: 多模态基于高斯的语义占用预测与3D可变形注意力

Lingjun Zhao, Sizhe Wei, James Hays, Lu Gan

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.CV

AI总结 GaussianFormer3D通过3D可变形注意力机制,结合激光雷达与摄像头数据,实现高效且精确的语义占用预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13972 2026-02-17 physics.optics 67%

Polarization-Multiplexed Chaotic LiDAR Based on a VCSEL with Delayed Orthogonal Feedback

基于VCSEL的极化多路复用混沌LiDAR

T. Wang, Z. Li, H. Shen, Y. Ma, Y. Li, S. Xiang, S. Baland, Y. Hao

专题命中 具身导航 :robotics(abstract);navigation(abstract)

AI总结 本文提出基于VCSEL的极化多路复用混沌LiDAR系统,通过延迟正交极化反馈实现高精度测距,具备可调谐和抗干扰优势,适用于自动驾驶等应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13327 2026-02-17 physics.gen-ph 67%

Uncertainty in space, time, and motion on the special Galilean group

时空与运动中的不确定性在特殊伽利略群中

Jonathan Kelly, Matthew Giamou

专题命中 具身导航 :robotics(abstract);navigation(abstract)

AI总结 本文提出在伽利略群上直接表达和传播不确定性的方法,通过闭式雅可比表达式提升时空估计的统计一致性。

Comments 21 pages, 3 figures. Submitted to Philosophical Transactions of the Royal Society A

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11047 2026-02-17 cs.RO cs.AI 66%

Enhancing Supermarket Robot Interaction: A Multi-Level LLM Conversational Interface for Handling Diverse Customer Intents

增强超市机器人交互:一种多层级LLM对话接口用于处理多样化客户意图

Chandran Nandkumar, Luka Peternel

机构 * Delft University of Technology(代尔夫特理工大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI;robotics(journal_ref)

AI总结 本文提出多层级LLM接口提升超市机器人处理多样化客户意图的效率与性能。

Journal ref Frontiers in Robotics and AI, Volume 12, 1576348, April 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15987 2026-02-17 cs.LG cs.AI 62%

Algorithmic Primitives and Compositional Geometry of Reasoning in Language Models

语言模型中推理的算法原语与组合几何

Samuel Lippl, Thomas McGee, Kimberly Lopez, Ziwen Pan, Pierce Zhang, Salma Ziadi, Oliver Eberle, Ida Momennejad

机构 * Microsoft Research NYC(微软研究院纽约分部) Center for Theoretical Neuroscience(理论神经科学中心) Department of Psychology(心理学系) University of California Los Angeles(加州大学洛杉矶分校) Institute for Pure and Applied Mathematics(纯粹与应用数学研究所) Emory University(埃默里大学) Rice University(里士满大学) Mount Holyoke College(马里兰霍克学院) Technische Universität Berlin(柏林技术大学) BIFOLD-Berlin Institute for the Foundations of Learning and Data(柏林学习与数据基础研究所)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 研究通过分析语言模型中的算法原语,揭示其推理过程的组合几何结构,并展示原语在跨任务和跨模型中的可迁移性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14311 2026-02-17 cs.RO 61%

Exploiting Structure-from-Motion for Robust Vision-Based Map Matching for Aircraft Surface Movement

利用结构从运动实现鲁棒的基于视觉的地图匹配用于飞机地面运动

Daniel Choate, Jason Rife

专题命中 具身导航 :navigation(abstract,comments);分类 cs.RO

AI总结 本文提出一种结合间接方法与直接图像技术的视觉辅助导航算法,用于提升自主飞机地面运动的地图匹配鲁棒性。

Comments Accepted to the Proceedings of the 38th International Technical Meeting of the Satellite Division of The Institute of Navigation (ION GNSS+ 2025). 15 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14958 2026-02-17 cs.RO cs.CG 57%

Morphing of and writing with a scissor linkage mechanism

剪刀连杆机构的变形与书写

Mohanraj A, S Ganga Prasath

机构 * Department of Applied Mechanics \& Biomedical Engineering, IIT Madras, Chennai, TN 600036.

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出利用剪刀连杆机构的几何特性,通过优化方法实现形状变形与书写任务,展示其在复杂环境中的自动化导航与检测应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14929 2026-02-17 cs.CV 57%

Wrivinder: Towards Spatial Intelligence for Geo-locating Ground Images onto Satellite Imagery

Wrivinder:迈向空间智能:将地面图像定位到卫星图像

Chandrakanth Gudavalli, Tajuddin Manhar Mohammed, Abhay Yadav, Ananth Vishnu Bhaskar, Hardik Prajapati, Cheng Peng, Rama Chellappa, Shivkumar Chandrasekaran, B. S. Manjunath

机构 * Mayachitra, Inc.(Mayachitra公司) Johns Hopkins University(约翰霍普金斯大学)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 Wrivinder通过聚合地面影像与卫星图像,实现零样本的几何驱动定位,提供首个全面的跨视角对齐基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14799 2026-02-17 cs.RO quant-ph 57%

Scalable Multi-Robot Path Planning via Quadratic Unconstrained Binary Optimization

通过二次无约束二元优化实现可扩展的多机器人路径规划

Javier González Villasmil

专题命中 具身导航 :robotics(abstract);分类 cs.RO

AI总结 本文提出了一种基于二次无约束二元优化的多机器人路径规划方法,通过逻辑预处理和时间窗口分解策略实现了高效且可扩展的路径规划。

Comments 21 pages, 9 figures, 1 table. Accompanying open-source implementation at https://github.com/JavideuS/Spooky

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13739 2026-02-17 cs.RO cs.SY eess.SY 57%

XIT: Exploration and Exploitation Informed Trees for Active Gas Distribution Mapping in Unknown Environments

XIT:在未知环境中主动气体分布映射的探索与利用树

Mal Fazliu, Matthew Coombes, Sen Wang, Cunjia Liu

专题命中 具身导航 :robotic(abstract);分类 cs.RO

AI总结 XIT通过平衡探索与利用,提升未知环境中自主气体分布映射的效率和质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06288 2026-02-17 cs.CV 57%

Unsupervised MR-US Multimodal Image Registration with Multilevel Correlation Pyramidal Optimization

无监督的MR-US多模态图像配准与多级相关金字塔优化

Jiazheng Wang, Zeyu Liu, Min Liu, Xiang Chen, Xinyao Yu, Yaonan Wang, Hang Zhang

机构 * School of Artificial Intelligence and Robotics, Hunan University, Changsha, Hunan, China(人工智能与机器人学院,湖南大学,长沙,湖南,中国) National Engineering Research Center of Robot Visual Perception and Control Technology, Hunan University, Changsha, Hunan, China(机器人视觉感知与控制技术国家工程研究中心,湖南大学,长沙,湖南,中国) National University of Singapore(新加坡国立大学) Cornell University(康奈尔大学)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 本研究提出基于多级相关金字塔优化的无监督多模态图像配准方法,以解决术前与术中多模态图像的配准问题,实现了在ReMIND2Reg任务中的优异表现。

Comments first-place method of ReMIND2Reg Learn2Reg MICCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19628 2026-02-17 stat.ML cs.LG stat.CO 57%

Optimization and Regularization Under Arbitrary Objectives

在任意目标函数下的优化与正则化

Jared N. Lakhani, Etienne Pienaar

专题命中 具身导航 :navigation(abstract);分类 cs.LG

AI总结 本研究探讨了在任意目标函数下,MCMC方法的性能依赖于似然锐度,并通过混合方法验证了过度锐度对后验质量的影响。

Comments 74 pages, 29 figures, 16 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13516 2026-02-17 cs.AI 57%

SPILLage: Agentic Oversharing on the Web

SPILLage:网络上的代理过度分享

Jaechul Roh, Eugene Bagdasarian, Hamed Haddadi, Ali Shahin Shamsabadi

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 SPILLage研究网络代理在执行任务时无意泄露用户信息的问题,通过分析行为和内容两个维度揭示过度分享现象,并通过实验验证减少过度分享可提升任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13291 2026-02-17 cs.MA astro-ph.IM cs.AI 57%

Agent Mars: Multi-Agent Simulation for Multi-Planetary Life Exploration and Settlement

Agent Mars: 多智能体模拟用于多行星生命探索与定居

Ziyang Wang

机构 * IEEE

专题命中 具身导航 :robotics(abstract);分类 cs.AI

AI总结 Agent Mars通过多智能体模拟框架,研究多行星生命探索中的协调机制与性能评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10080 2026-02-17 cs.CV 57%

BEVTraj: Map-Free End-to-End Trajectory Prediction in Bird's-Eye View with Deformable Attention and Sparse Goal Proposals

BEVTraj: 无地图端到端鸟瞰图轨迹预测方法,采用可变形注意力和稀疏目标提案

Minsang Kong, Myeongjun Kim, Sang Gu Kang, Hejiu Lu, Yupeng Zhong, Sang Hun Lee

机构 * Department of Automobile and IT Convergence, Kookmin University(汽车与IT融合系,韩国釜山大学) Department of Automotive Engineering, Kookmin University(汽车工程系,韩国釜山大学) Graduate School of Automobile and Mobility, Kookmin University(汽车与移动研究生院,韩国釜山大学)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 BEVTraj通过可变形注意力和稀疏目标提案实现无地图端到端鸟瞰图轨迹预测,提升自动驾驶的鲁棒性和灵活性。

Comments Submitted to IEEE Transactions on Intelligent Transportation Systems (under review)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08432 2026-02-17 astro-ph.EP astro-ph.IM 50%

NovaMoon: A Strategic Lunar Reference Station for Positioning, Timing, and Largely Enhanced Science in the Earth-Moon System

NovaMoon:一个战略月球参考站,用于定位、定时和显著增强地球-月球系统中的科学

Serena Molli, Agnès Fienga, Pascale Defraigne, Krzysztof Sośnica, Luigi Cacciapuoti, Luca Porcelli, Lotfi Massarweh, Sara Bruni, Riccardo Pozzobon, Albert Roura, Francesco Vespe, Diego Blas, Ozgur Karatekin, Yoann Audet, Floor Melman, Richard Swinden, Javier Ventura-Traveset, Olivier Alibart, Marie-Christine Angonin, Daniel Arnold, Ruth Bamford, Emmanuele Battista, Marco Belloni, J. C. Berton, Orfeu Bertolami, Mathis Bloßfeld, Adrien Bourgoin, Giada Bargiacchi, Salvatore Buoninfante, Nicolò Burzillà, Roberto Campagnola, Paolo Cappuccio, Salvatore Capozziello, Giuseppe Cimò, Clément Courde, Rolf Dach, Mario Siciliani de Cumis, Simone Dell'Agnello, Fabrizio De Marchi, Valentina Galluzzi, Francesco Gini, Philipp Glaeser, Klaus Gwinner, Alex Guinard, Rüdiger Haas, Aurélien Hees, Hauke Hussmann, Luciano Iess, Alexander C. Jenkins, Siddarth K. Joshi, Maria Karbon, Sergei Klioner, Kaisa Laiho, Christophe Le Poncin-Lafitte, Marco Lucente, David Lucchesi, Riccardo March, Lucia McCallum, Jürgen Müller, Weijie Nie, Jillian Oduber, Roberto Peron, Francesco Picciariello, Théo Pichavant, Michael Plumaris, Eleonora Polini, Ana-Catalina Plesa, Dimitrios Psychas, Bernardino Quaranta, Nicolas Rambaux, Marc Rovira-Navarro, Francesco Santoli, Matthias Schartner, Florian Seitz, Ilaria Sesia, Yan Seyffert, Stefano Speretta, Tim Springer, Giuseppe Vallone, Paolo Villoresi, Sebastien Vincent-Bonnieu, Ben Wadsworth, Pierre Waller, Radosław Zajdel, Erik Schoenemann

专题命中 具身导航 :navigation(abstract)

AI总结 NovaMoon是首个在月球上集成了多种测距、跟踪和定时技术的参考站,旨在提升地球-月球系统的定位、定时精度及科学探索能力。

Comments This manuscript is a preprint and has not yet been peer reviewed. It is currently under review at Space Science Reviews

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身推理 8 篇

2602.13347 2026-02-17 cs.CV cs.AI cs.RO 88%

Visual Foresight for Robotic Stow: A Diffusion-Based World Model from Sparse Snapshots

机器人存取的视觉预见:一种基于稀疏快照的扩散世界模型

Lijun Zhang, Nikhil Chacko, Petter Nilsson, Ruinian Xu, Shantanu Thakar, Bai Lou, Harpreet Sawhney, Zhebin Zhang, Mudit Agrawal, Bhavana Chandrashekhar, Aaron Parness

机构 * Amazon, Seattle, US(亚马逊(美国西雅图))

专题命中 具身推理 :world model(title,abstract);robotic(title);分类 cs.RO、cs.AI、cs.CV

AI总结 FOREST通过基于稀疏快照的扩散模型,提升仓库存取操作的预测精度,为仓储规划提供有效预见信号。

Comments 20 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12063 2026-02-17 cs.RO 83%

VLAW: Iterative Co-Improvement of Vision-Language-Action Policy and World Model

VLAW: 视觉-语言-动作策略与世界模型的迭代共改进

Yanjiang Guo, Tony Lee, Lucy Xiaoyang Shi, Jianyu Chen, Percy Liang, Chelsea Finn

机构 * Stanford University(斯坦福大学) Tsinghua University(清华大学)

专题命中 具身推理 :world model(title,abstract);manipulation(abstract);分类 cs.RO

AI总结 本文提出通过迭代改进视觉-语言-动作策略与世界模型,提升真实机器人任务的性能和可靠性。

Comments Project Page: https://sites.google.com/view/vlaw-arxiv

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15012 2026-02-17 cs.CL cs.AI cs.LG 81%

Cold-Start Personalization via Training-Free Priors from Structured World Models

冷启动个性化通过从结构化世界模型中训练无关先验进行个性化

Avinandan Bose, Shuyue Stella Li, Faeze Brahman, Pang Wei Koh, Simon Shaolei Du, Yulia Tsvetkov, Maryam Fazel, Lin Xiao, Asli Celikyilmaz

机构 * Meta University of Washington(华盛顿大学) Allen Institute for AI(人工智能研究院)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.LG

AI总结 Pep通过结构化世界模型和贝叶斯推断实现冷启动个性化,相比强化学习更高效且能更准确预测用户偏好。

Comments 24 pages, 4 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07672 2026-02-17 cs.SE cs.AI cs.LG cs.PL cs.SC 81%

Debugging code world models

调试代码世界模型

Babak Rahmani

机构 * Tübingen AI Center, University of Tübingen, Microsoft Research(图宾根人工智能中心、图宾根大学、微软研究院)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.LG

AI总结 代码世界模型通过模拟程序执行来预测运行时状态,研究发现其在长周期状态跟踪中存在token预算耗尽和字符串状态处理的局限性,提出改进监督和状态表示的方向。

Comments 8 pages, 4 figures, under review in conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06130 2026-02-17 cs.LG cs.AI cs.CL 81%

Self-Improving World Modelling with Latent Actions

具有潜在动作的自我改进世界建模

Yifu Qiu, Zheng Zhao, Waylon Li, Yftah Ziser, Anna Korhonen, Shay B. Cohen, Edoardo M. Ponti

机构 * University of Edinburgh(爱丁堡大学) Nvidia Research(Nvidia研究) University of Groningen(格罗宁根大学) University of Cambridge(剑桥大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.LG

AI总结 SWIRL通过将动作视为潜在变量,结合前向世界建模和逆动态建模,实现了对LLM和VLM的自我改进世界建模,在多个基准测试中取得了显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14857 2026-02-17 cs.AI 79%

World Models for Policy Refinement in StarCraft II

为《星际2》政策细化设计的世界模型

Yixin Zhang, Ziyi Wang, Yiming Rong, Haoxi Wang, Jinling Jiang, Shuang Xu, Haoran Wu, Shiyu Zhou, Bo Xu

机构 * The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(认知与决策智能复杂系统重点实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 StarWM为《星际2》政策细化设计的世界模型,通过预测未来观察和结构化文本表示提升策略决策性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13554 2026-02-17 cs.ET cs.IT cs.RO math.IT 79%

From Snapshot Sensing to Persistent EM World Modeling: A Generative-Space Perspective for ISAC

从快照感知到持久电磁世界建模:一种面向ISAC的生成空间视角

Pin-Han Ho, Haoran Mei, Limei Peng, Yiming Miao, Kairan Liang, Yan Jiao

专题命中 具身推理 :world model(title,abstract);分类 cs.RO

AI总结 本文提出一种基于生成空间的毫米波感知框架,通过低维激励空间实现灵活、可扩展的持续电磁世界建模,避免了快照感知的局限性。

Comments 7 pages, 6 figures/tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14874 2026-02-17 cs.RO 70%

Affordance Transfer Across Object Instances via Semantically Anchored Functional Map

通过语义锚定的功能映射实现跨物体实例的 affordance 转移

Xiaoxiang Dong, Weiming Zhi

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所) School of Computer Science, The University of Sydney(悉尼大学计算机科学学院) Australian Centre for Robotics, The University of Sydney(悉尼大学机器人中心) College of Connected Computing, Vanderbilt University(范德比大学连接计算学院)

专题命中 具身推理 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出语义锚定的功能映射方法,通过单个视觉示范实现跨不同几何物体的 affordance 转移,提升机器人感知与行动的实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 机器人基础模型 3 篇

2602.10098 2026-02-17 cs.RO cs.CV 81%

VLA-JEPA: Enhancing Vision-Language-Action Model with Latent World Model

VLA-JEPA: 通过潜在世界模型增强视觉-语言-动作模型

Jingwen Sun, Wenyao Zhang, Zekun Qi, Shaojie Ren, Zezhi Liu, Hanxin Zhu, Guangzhong Sun, Xin Jin, Zhibo Chen

机构 * University of Science and Technology of China(中国科学技术大学) Zhongguancun Academy, Beijing, China(中关村学院) Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) Eastern Institute of Technology, Ningbo(宁波东部科技研究院) University of Chinese Academy of Sciences(中国科学院大学) Nankai University(南开大学)

专题命中 机器人基础模型 :world model(title);manipulation(abstract);分类 cs.RO、cs.CV

AI总结 VLA-JEPA通过潜在世界模型提升视觉-语言-动作模型的泛化与鲁棒性,采用无泄露状态预测和两阶段训练策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10556 2026-02-17 cs.RO cs.AI 73%

LAP: Language-Action Pre-Training Enables Zero-shot Cross-Embodiment Transfer

LAP:语言-动作预训练实现零样本跨躯体迁移

Lihan Zha, Asher J. Hancock, Mingtong Zhang, Tenny Yin, Yixuan Huang, Dhruv Shah, Allen Z. Ren, Anirudha Majumdar

机构 * Princeton University(普林斯顿大学)

专题命中 机器人基础模型 :robotics(abstract);manipulation(abstract);分类 cs.RO、cs.AI

AI总结 LAP通过语言-动作预训练实现零样本跨躯体迁移,首次在无需特定躯体微调的情况下达到显著的迁移效果,提升性能达两倍。

Comments Project website: https://lap-vla.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13764 2026-02-17 cs.RO cs.AI 62%

MOTIF: Learning Action Motifs for Few-shot Cross-Embodiment Transfer

MOTIF: 为少样本跨躯体迁移学习动作动机

Heng Zhi, Wentao Tan, Lei Zhu, Fengling Li, Jingjing Li, Guoli Yang, Heng Tao Shen

机构 * Tongji University(同济大学) University of Technology Sydney(技术悉尼大学) University of Electronic Science(电子科学大学) Advanced Institute of Big Data(大数据高级研究所)

专题命中 机器人基础模型 :robotic(abstract);分类 cs.RO、cs.AI

AI总结 MOTIF通过学习动作动机实现高效的少样本跨躯体迁移,提升机器人在新躯体上的动作生成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 模仿学习与强化学习 7 篇

2602.13653 2026-02-17 cs.AI cs.CL cs.CV cs.HC 81%

Building Autonomous GUI Navigation via Agentic-Q Estimation and Step-Wise Policy Optimization

通过代理-Q估计和分步策略优化构建自主GUI导航

Yibo Wang, Guangda Huzhang, Yuwei Hu, Yu Xia, Shiyin Lu, Qing-Guo Chen, Zhao Xu, Weihua Luo, Kaifu Zhang, Lijun Zhang

机构 * National Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) Ovis Team, Alibaba Group(阿里团队,阿里巴巴集团)

专题命中 模仿学习与强化学习 :navigation(title,abstract);分类 cs.AI、cs.CV

AI总结 本文提出基于代理-Q估计和分步策略优化的GUI自主导航框架,通过强化学习提升GUI交互能力,实验证明其在导航和基准测试中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14526 2026-02-17 cs.RO cs.AI cs.LG 75%

TWISTED-RL: Hierarchical Skilled Agents for Knot-Tying without Human Demonstrations

TWISTED-RL:无人类示范的分层技能代理用于打结

Guy Freund, Tom Jurgenson, Matan Sudry, Erez Karpas

机构 * Reichman University(雷赫曼大学) Technion – Israel Institute of Technology(技术学院——以色列理工学院) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 模仿学习与强化学习 :robotics(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 TWISTED-RL通过强化学习和拓扑动作实现无示范的复杂打结任务,提升泛化能力和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08655 2026-02-17 cs.LG 74%

From Robotics to Sepsis Treatment: Offline RL via Geometric Pessimism

从机器人到败血症治疗:通过几何悲观性进行离线强化学习

Sarthak Wanjari

机构 * Sarthak Wanjari(独立研究者)

专题命中 模仿学习与强化学习 :robotics(title);分类 cs.LG

AI总结 Geo-IQL通过几何悲观性方法在离线强化学习中提高性能,减少计算开销,并在败血症治疗中实现更高的临床一致性

Comments 10 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏