arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-03-03 至 2026-03-03 共收录 36 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 36 篇

2509.12151 2026-03-03 cs.RO cs.LG 84%

Learning Contact Dynamics through Touching: Action-conditional Graph Neural Networks for Robotic Peg Insertion

通过接触学习动态:用于机器人圆柱体插入的基于动作的图神经网络

Zongyao Yi, Joachim Hertzberg, Martin Atzmueller

机构 * German Research Center for Artificial Intelligence(德国人工智能研究中心) Osnabrück University(奥斯纳布吕克大学)

专题命中 机器人数据与评测 :robotic(title,abstract);manipulation(abstract);分类 cs.RO、cs.LG

AI总结 本文提出了一种基于动作的图神经网络模型,用于提升机器人圆柱体插入任务中的运动和力矩预测精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20034 2026-03-03 cs.RO cs.CV 84%

Digital and Robotic Twinning for Validation of Proximity Operations and Formation Flying

数字与机器人双胞胎用于近距操作与编队飞行的验证

Z. Ahmed, E. Bates, P. Francesch Huc, S. Y. W. Low, A. Golan, T. Bell, A. Rizza, S. D'Amico

机构 * Stanford University(斯坦福大学)

专题命中 机器人数据与评测 :robotic(title,abstract);navigation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出了一种混合双胞胎框架,用于验证航天器GNC系统在近距操作和编队飞行中的性能。

Journal ref 2026 Rocky Mountain AAS GN&C Conference, Breckenridge, Colorado

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01505 2026-03-03 cs.RO 83%

FATE: Closed-Loop Feasibility-Aware Task Generation with Active Repair for Physically Grounded Robotic Curricula

FATE: 闭环可行性感知任务生成与主动修复的物理 grounded 机器人课程

Bingchuan Wei, Bingqi Huang, Jingheng Ma, Zeyu zhang, Sen Cui

机构 * School of Aerospace Engineering, Tsinghua University, Beijing, China(航空航天工程系,清华大学,北京,中国) Department of Automation, Tsinghua University, Beijing, China(自动化系,清华大学,北京,中国) School of Integrated Circuits, Tsinghua University, Beijing, China(集成电路学院,清华大学,北京,中国) State Key Laboratory of General Artificial Intelligence, Beijing Institute for General Artificial Intelligence (BIGAI), Beijing, China(通用人工智能国家重点实验室,北京通用人工智能研究院(BIGAI),北京,中国)

专题命中 机器人数据与评测 :robotic(title,abstract);embodied agent(abstract);分类 cs.RO

AI总结 FATE通过闭环验证与主动修复机制,生成物理 grounded 的机器人任务课程,有效减少执行失败率。

Comments 16 Pages, 4 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03537 2026-03-03 cs.RO 83%

Automated Action Generation based on Action Field for Robotic Garment Smoothing and Alignment

基于动作场的机器人服装平铺与对齐的自动化动作生成

Hu Cheng, Fuyuki Tokuda, Kazuhiro Kosuge

机构 * JC STEM Lab of Robotics for Soft Materials(机器人软材料实验室) Department of Electrical and Electronic Engineering(电气电子工程系) Faculty of Engineering(工程学院) The University of Hong Kong(香港大学)

专题命中 机器人数据与评测 :robotic(title,abstract);manipulation(abstract);分类 cs.RO

AI总结 本文提出基于动作场的机器人服装平铺与对齐方法,通过神经网络生成动作向量并预测操作评分图,实现更高效的服装处理。

Comments Accepted by IEEE Transactions on Automation Science and Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23893 2026-03-03 cs.CV cs.RO 81%

AoE: Always-on Egocentric Human Video Collection for Embodied AI

AoE: 始终在线的以自身为中心的人类视频采集用于具身AI

Bowen Yang, Zishuo Li, Yang Sun, Changtao Miao, Yifan Yang, Man Luo, Xiaotong Yan, Feng Jiang, Jinchuan Shi, Yankai Fu, Ning Chen, Junkai Zhao, Pengwei Wang, Guocai Yao, Shanghang Zhang, Hao Chen, Zhe Li, Kai Zhu

机构 * Ant Digital Technologies, Ant Group(蚂蚁集团数字技术部) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Zhejiang University(浙江大学) Peking University(北京大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 机器人数据与评测 :embodied AI(title);embodied agent(abstract);分类 cs.RO、cs.CV

AI总结 AoE系统通过利用人类和智能手机低成本采集以自身为中心的现实世界交互数据,解决具身AI的数据稀缺问题,提升现实世界泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01153 2026-03-03 cs.RO 79%

RAG-RUSS: A Retrieval-Augmented Robotic Ultrasound for Autonomous Carotid Examination

RAG-RUSS:一种增强检索的机器人超声用于自主颈动脉检查

Dianye Huang, Ziping Cong, Nassir Navab, Zhongliang Jiang

机构 * Computer-Aided Medical Procedures and Augmented Reality (CAMP), Technical University of Munich (TUM), Germany(计算机辅助医学程序与增强现实(CAMP),慕尼黑技术大学(TUM),德国) Munich Center for Machine Learning (MCML), Germany(慕尼黑机器学习中心(MCML),德国)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 RAG-RUSS通过可解释框架实现自主颈动脉检查,结合检索增强生成提升泛化能力,减少对大规模数据的依赖。

Comments Accepted by ICRA

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.16777 2026-03-03 cs.CV cs.HC 79%

A Dataset for Crucial Object Recognition in Blind and Low-Vision Individuals' Navigation

为盲人和低视力者导航至关重要的物体识别数据集

Md Touhidul Islam, Imran Kabir, Elena Ariel Pearce, Md Alimoor Reza, Syed Masum Billah

机构 * Pennsylvania State University(宾夕法尼亚州立大学) Drake University(德拉克大学)

专题命中 机器人数据与评测 :navigation(title,abstract);分类 cs.CV

AI总结 本文提出一个专为盲人和低视力者导航设计的数据集,包含90个关键物体的标注,旨在提升计算机视觉模型在实时物体识别中的准确性。

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00628 2026-03-03 cs.RO 79%

Validation of Space Robotics in Underwater Environments via Disturbance Robustness Equivalency

通过扰动鲁棒性等效性验证水下环境中的空间机器人

Joris Verhagen, Elias Krantz, Chelsea Sidrane, David Dörner, Nicola De Carli, Pedro Roque, Huina Mao, Gunnar Tibert, Ivan Stenius, Christer Fuglesang, Dimos Dimarogonas, Jana Tumova

机构 * Division of Robotics, Perception and Learning, KTH Royal Institute of Technology(机器人、感知与学习 division,皇家理工学院) School of Engineering Sciences, KTH Royal Institute of Technology(工程科学学院,皇家理工学院) Division of Decision and Control Systems, KTH Royal Institute of Technology(决策与控制系统 division,皇家理工学院) Department of Mechanical and Civil Engineering, California Institute of Technology(机械与土木工程 department,加州理工学院)

专题命中 机器人数据与评测 :robotics(title,abstract);分类 cs.RO

AI总结 通过水下环境验证空间机器人在微重力下的扰动鲁棒性等效性

Comments 8 pages, 5 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11617 2026-03-03 cs.RO 79%

AssemMate: Graph-Based LLM for Robotic Assembly Assistance

AssemMate:基于图的LLM用于机器人装配辅助

Qi Zheng, Chaoran Zhang, Zijian Liang, EnTe Lin, Shubo Cui, Qinghongbing Xie, Zhaobo Xu, Long Zeng

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University, Shenzhen, China(清华大学深圳国际研究生院,清华大学,深圳,中国)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 AssemMate是一种基于图的LLM,通过知识图谱问答和视觉增强策略提升机器人装配任务的精度和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01804 2026-03-03 cs.CV cs.AI 76%

Non-verbal Real-time Human-AI Interaction in Constrained Robotic Environments

非语言实时人机交互在受限机器人环境中

Dragos Costea, Alina Marcu, Cristina Lazar, Marius Leordeanu

机构 * National University of Science Princeton University, Princeton NJ 08544, USA, , WWW home page: http://users/ iekeland/web/welcome.html Universit\' e de Paris-Sud, Laboratoire d'Analyse Num\' e rique, B\ a timent 425, F-91405 Orsay Cedex, France

专题命中 机器人数据与评测 :robotic(title);分类 cs.AI、cs.CV

AI总结 本文提出首个实时生成非语言人机交互的框架,通过对比合成与真实数据发现时间一致性对实际性能的影响,揭示了人类与AI运动间的统计差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15018 2026-03-03 cs.CV cs.AI cs.RO 75%

UrbanVerse: Scaling Urban Simulation by Watching City-Tour Videos

UrbanVerse: 通过观看城市游览视频扩大城市模拟

Mingxuan Liu, Honglin He, Elisa Ricci, Wayne Wu, Bolei Zhou

专题命中 机器人数据与评测 :embodied AI(abstract);navigation(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 UrbanVerse 通过将众包城市游览视频转化为物理-aware 的模拟场景,实现了城市模拟的扩展,提升了城市导航中代理的泛化能力和现实任务完成效率。

Comments Accepted to ICLR 2026. Project page: https://urbanverseproject.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10085 2026-03-03 cs.CV cs.AI 73%

VITA: Zero-Shot Value Functions via Test-Time Adaptation of Vision-Language Models

VITA:通过视觉语言模型的测试时间适应实现零样本价值函数

Christos Ziakas, Alessandra Russo

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.AI、cs.CV

AI总结 VITA通过测试时间适应提升视觉语言模型的零样本价值估计能力,实现跨任务和环境的泛化,优于现有方法。

Comments International Conference on Learning Representations, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01475 2026-03-03 cs.CV 72%

WildCross: A Cross-Modal Large Scale Benchmark for Place Recognition and Metric Depth Estimation in Natural Environments

WildCross: 一种用于自然环境中地方识别和度量深度估计的跨模态大规模基准

Joshua Knights, Joseph Reid, Kaushik Roy, David Hall, Mark Cox, Peyman Moghadam

专题命中 机器人数据与评测 :robotics(abstract,comments);robotic(abstract);分类 cs.CV

AI总结 WildCross是一个用于自然环境中地方识别和度量深度估计的跨模态大规模基准,通过提供大规模数据集和实验验证,推动多模态机器人感知技术的发展。

Comments IEEE International Conference on Robotics & Automation (ICRA) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01178 2026-03-03 cs.RO 70%

riMESA: Consensus ADMM for Real-World Collaborative SLAM

riMESA: 基于共识ADMM的现实世界协作SLAM

Daniel McGann, Michael Kaess

专题命中 机器人数据与评测 :robotics(abstract);navigation(abstract);分类 cs.RO

AI总结 riMESA是一种基于共识ADMM的鲁棒增量分布式C-SLAM后端,能实时处理多机器人团队的定位与建图任务,准确度提升超过7倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23524 2026-03-03 cs.RO cs.CV cs.LG 67%

V-MORALS: Visual Morse Graph-Aided Estimation of Regions of Attraction in a Learned Latent Space

V-MORALS: 基于视觉莫尔斯图的学得潜在空间中吸引区域估计

Faiz Aladin, Ashwin Balasubramanian, Lars Lindemann, Daniel Seita

机构 * Viterbi School of Engineering, University of Southern California(美国南加州大学维特比工程学院) Automatic Control Laboratory, ETH Zürich(瑞士苏黎世联邦理工学院自动控制实验室)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 V-MORALS通过学习潜在空间生成莫尔斯图,实现无需全状态信息的吸引区域估计,适用于仅使用传感器数据的机器人系统分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00206 2026-03-03 cs.CV cs.AI 62%

TACIT Benchmark: A Programmatic Visual Reasoning Benchmark for Generative and Discriminative Models

TACIT基准:一个生成和判别模型的程序化视觉推理基准

Daniel Nobrega Medeiros

机构 * Independent Researcher(独立研究者)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 TACIT基准提出一个程序化视觉推理测试,包含10个任务和6个领域,通过生成和判别双轨评估模型在空间导航、抽象模式完成等任务中的推理能力。

Comments 10 pages, 4 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00108 2026-03-03 cs.RO cs.AI 62%

SurgFusion-Net: Diversified Adaptive Multimodal Fusion Network for Surgical Skill Assessment

SurgFusion-Net:用于外科技能评估的多样化自适应多模态融合网络

Runlong He, Freweini M. Tesfai, Matthew W. E. Boal, Nazir Sirajudeen, Dimitrios Anastasiou, Jialang Xu, Mobarak I. Hoque, Philip J. Edwards, John D. Kelly, Ashwin Sridhar, Abdolrahim Kadkhodamohammadi, Dhivya Chandrasekaran, Matthew J. Clarkson, Danail Stoyanov, Nader Francis, Evangelos B. Mazomenos

机构 * UCL Hawkes Institute and the Department of Medical Physics & Biomedical Engineering, UCL(UCL哈维斯研究所及UCL医学物理与生物医学工程系) UCL Hawkes Institute and the Department of Computer Science, UCL(UCL哈维斯研究所及UCL计算机科学系) UCL Hawkes Institute and the Division of Informatics, Imaging & Data Sciences, The University of Manchester(UCL哈维斯研究所及信息学、成像与数据科学系,曼彻斯特大学) UCL Hospitals NHS Foundation Trust(UCL医院 NHS基金会信托) Griffin Institute, Northwick Park and St Mark’s Hospital(格里芬研究所,北wick公园及圣马可医院)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.AI

AI总结 SurgFusion-Net通过引入DRA策略和两个新的临床数据集,提升了多模态外科技能评估的准确性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14450 2026-03-03 eess.SY cs.RO cs.SY 57%

Nonlinear System Identification Nano-drone Benchmark

非线性系统辨识纳无人机基准

Riccardo Busetto, Elia Cereda, Marco Forgione, Gabriele Maroni, Dario Piga, Daniele Palossi

机构 * Dalle Molle Institute for Artificial Intelligence (IDSIA)(达勒莫尔人工智能研究所) USI-SUPSI Integrated Systems Laboratory (IIS)(集成系统实验室) ETH Zürich(苏黎世联邦理工学院)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本研究提出一个基于纳无人机的非线性系统辨识基准,通过75000个真实数据样本,评估识别方法在复杂动态和噪声环境下的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01113 2026-03-03 cs.RO 57%

From Dialogue to Execution: Mixture-of-Agents Assisted Interactive Planning for Behavior Tree-Based Long-Horizon Robot Execution

从对话到执行:基于混合代理的交互式规划用于基于行为树的长时域机器人执行

Kanata Suzuki, Kazuki Hori, Haruka Miyoshi, Shuhei Kurita, Tetsuya Ogata

机构 * Waseda University(早稻田大学) National Institute of Informatics(国家信息研究所) NII Research and Development Center for Large Language Models(国家信息研究所大型语言模型研究开发中心) The Graduate University for Advanced Studies (SOKENDAI)(高级研究大学研究生院(SOKENDAI))

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文提出基于混合代理的交互式规划框架,通过生成行为树实现长时域机器人任务的高效执行,减少人类干预并提升执行质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01108 2026-03-03 cs.CV 57%

GroundedSurg: A Multi-Procedure Benchmark for Language-Conditioned Surgical Tool Segmentation

GroundedSurg: 一种多手术流程的语言条件手术工具分割基准

Tajamul Ashraf, Abrar Ul Riyaz, Wasif Tak, Tavaheed Tariq, Sonia Yadav, Moloud Abdar, Janibul Bashir

机构 * King Abdullah University of Science and Technology (KAUST)(卡奥尔大学科学与技术学院) Thapar Institute of Engineering and Technology(塔帕尔工程与技术学院) The University of Queensland(昆士兰大学) Gaash Research Lab, National Institute of Technology Srinagar(加什研究实验室,锡纳加尔国家理工学院)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 GroundedSurg提出了一种多手术流程的语言条件手术工具分割基准,通过实例级接地和空间注释评估视觉-语言模型在临床真实场景中的性能。

Comments https://github.com/gaash-lab/GroundedSurg

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23166 2026-03-03 cs.CV 57%

AgentVista: Evaluating Multimodal Agents in Ultra-Challenging Realistic Visual Scenarios

AgentVista: 评估在超挑战性现实视觉场景中的多模态代理

Zhaochen Su, Jincheng Gao, Hangyu Guo, Zhenhua Liu, Lueyang Zhang, Xinyu Geng, Shijue Huang, Peng Xia, Guanyu Jiang, Cheng Wang, Yue Zhang, Yi R. Fung, Junxian He

机构 * Hong Kong University of Science and Technology(香港理工大学) Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.CV

AI总结 AgentVista 是一个评估多模态代理在超挑战性现实视觉场景中能力的基准,通过真实场景和复杂工具交互任务揭示现有模型在长时间多模态工具使用方面的不足。

Comments The project website is available at https://agentvista-bench.github.io/, and the code is available at https://github.com/hkust-nlp/AgentVista

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01041 2026-03-03 cs.RO 57%

Coordinated Control of Multiple Construction Machines Using LLM-Generated Behavior Trees with Flag-Based Synchronization

利用LLM生成的行为树实现多台施工机械的协调控制

Akinosuke Tsutsumi, Tomoya Itsuka, Yuichiro Kasahara, Tomoya Kouno, Kota Akinari, Genki Yamauchi, Daisuke Endo, Taro Abe, Takeshi Hashimoto, Keiji Nagatani, Ryo Kurazume

机构 * Graduate School of Information Science and Electrical Engineering, Kyushu University(九州大学信息科学与电气工程研究生院) Public Works Research Institute(公共工程研究所) Institute of Systems and Information Engineering, University of Tsukuba(筑波大学系统与信息工程研究所) Faculty of Information Science and Electrical Engineering, Kyushu University(九州大学信息科学与电气工程学部)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文提出利用LLM生成行为树实现施工机械协调控制,通过同步标志提升多机协作效率,实验验证其在土方自动化中的可行性。

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23721 2026-03-03 cs.RO 57%

DA-MMP: Learning Coordinated and Accurate Throwing with Dynamics-Aware Motion Manifold Primitives

DA-MMP:学习协调且准确的投掷动作:动态感知的运动流形原语

Chi Chu, Huazhe Xu

机构 * Shanghai Qi Zhi Institute(上海启智研究院) Institute for Interdisciplinary Information Sciences, Tsinghua University(清华大学交叉信息研究院)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 DA-MMP通过动态感知的运动流形原语,实现了高协调性投掷动作的生成,优于人类专家并能推广至新目标。

Comments Accepted to ICRA 2026. Project page: https://cc299792458.github.io/da-mmp/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05490 2026-03-03 cs.RO eess.SP 57%

Adaptive Neural Unscented Kalman Filter

自适应神经无迹卡尔曼滤波器

Amit Levy, Itzik Klein

机构 * Hatter Department of Marine Technologies, Charney School of Marine Sciences, University of Haifa(哈特尔海洋技术系,查内海洋科学学院,海法大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO

AI总结 本文提出自适应神经无迹卡尔曼滤波器,用于解决自主水下航行器导航中的非线性传感器融合问题,通过ProcessNet实现过程噪声协方差的自适应估计。

Comments eight pages, ten figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01327 2026-03-03 cs.RO eess.SP 57%

Enhancement of Neural Inertial Regression Networks: A Data-Driven Perspective

神经惯性回归网络的增强:数据驱动视角

Victoria Khalfin Fekson, Nitsan Pri-Hadash, Netta Palez, Aviad Etzion, Itzik Klein

机构 * The Hatter Department of Marine Technologies(海洋技术系)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本文提出13种数据驱动技术,通过数据增强和预处理提升神经惯性回归网络性能,并建立基准策略以促进该领域的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01029 2026-03-03 cs.CV 57%

Vision-Language Feature Alignment for Road Anomaly Segmentation

视觉-语言特征对齐用于道路异常分割

Zhuolin He, Jiacheng Tang, Jian Pu, Xiangyang Xue

机构 * School of Computer Science, Fudan University(复旦大学计算机科学学院) Institute of Science and Technology for Brain-Inspired Intelligence, Fudan University(复旦大学脑启发智能科学与技术研究院)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 VL-Anomaly通过结合视觉-语言模型的语义先验,提出了一种新的道路异常分割框架,有效提升异常检测的准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00285 2026-03-03 cs.AI 57%

TraderBench: How Robust Are AI Agents in Adversarial Capital Markets?

TraderBench: AI代理在对抗性资本市场中的鲁棒性如何?

Xiaochuang Yuan, Hui Xu, Silvia Xu, Cui Zou, Jing Xiong

机构 * Amazon.com Inc.(亚马逊公司) Stony Brook University(石溪大学) Stanford University(斯坦福大学) University of Oklahoma(俄克拉荷马大学) UC Santa Cruz(加州大学圣克鲁兹分校)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 TraderBench通过结合静态任务与对抗性交易模拟,评估AI代理在动态市场中的鲁棒性,发现现有模型在加密交易中表现稳定但缺乏真实适应性。

Comments Equal Contribution: Xiaochuang Yuan and Hui Xu contributed equally to this work. All correspondence should be directed to yxc20098@gmail.com. Submitted to Agents in the Wild Workshop, ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21333 2026-03-03 cs.CV 57%

HorizonForge: Driving Scene Editing with Any Trajectories and Any Vehicles

HorizonForge: 通过任意轨迹和任意车辆驱动场景编辑

Yifan Wang, Francesco Pittaluga, Zaid Tasneem, Chenyu You, Manmohan Chandraker, Ziyu Jiang

机构 * NEC Labs America(NEC美国实验室) Stony Brook University(石溪大学) UC San Diego(圣地亚哥大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.CV

AI总结 HorizonForge通过任意轨迹和车辆实现驾驶场景的可控编辑,利用高斯溅射体和网格表示,结合视频扩散技术,提升生成场景的真实性和可控性。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12813 2026-03-03 cs.RO cs.SY eess.SY 57%

Bridging Perception and Planning: Towards End-to-End Planning for Signal Temporal Logic Tasks

连接感知与规划:面向信号时序逻辑任务的端到端规划

Bowen Ye, Junyue Huang, Yang Liu, Xiaozhen Qiao, Xiang Yin

机构 * School of Automation & Intelligent Sensing, Shanghai Jiao Tong University(自动化与智能感知学院,上海交通大学) University of Minnesota, Twin Cities(明尼苏达大学,双城分校) School of Information Science and Technology, University of Science and Technology of China(信息科学与技术学院,中国科学技术大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本文提出了一种端到端的STL规划器,通过结构感知的混合专家模型,实现对信号时序逻辑任务的高效规划与执行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09663 2026-03-03 cs.CV 57%

PD$^{2}$GS: Part-Level Decoupling and Continuous Deformation of Articulated Objects via Gaussian Splatting

PD$^{2}$GS: 关节物体的部件级解耦与连续变形 via 高斯点散布

Haowen Wang, Xiaoping Yuan, Zhao Jin, Zhen Zhao, Zhengping Che, Yousong Xue, Jin Tian, Yakun Huang, Jian Tang

机构 * Anhui University(安徽大学) Beijing University of Posts and Telecommunications(北京邮电大学) Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心) Beijing Institute of Architectural Design(北京建筑院设计研究院)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 PD$^{2}$GS通过高斯点散布实现关节物体的部件级解耦与连续变形,无需手动监督,提升几何和运动学准确性及连续控制一致性。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏