arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 8666 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 8666 篇

2607.28645 2026-08-03 cs.HC cs.AI 新提交 57%

Looks Right, Works Right: A Project-Level Benchmark for Multi-Screen Mobile App Generation

看起来对,运行起来对:面向多屏移动应用生成的项目级基准测试

Fan Wu, Cuiyun Gao, Yiming Huang, Yang Xiao, Yujia Chen, Qing Liao

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI

AI总结 针对现有设计转代码基准的局限,提出首个项目级多屏移动应用生成基准MobileForge,通过五轴评估及两种测试方法,发现前沿多模态LLM构建的应用存在导航、保真度和可维护性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29225 2026-08-03 cs.LG physics.chem-ph physics.comp-ph 新提交 57%

Frugal Bayesian Optimization: Scalable Surrogates for Data- and Resource-Limited Discovery

节俭型贝叶斯优化:面向数据与资源受限发现的可替代代理模型

Panagiotis Krokidas, Christoforos Rekatsinas, Vassilis Sioros, Grigorios M. Chatziathanasiou, Efi-Maria Papia, George Giannakopoulos

机构 * National Centre for Scientific Research "Demokritos"(希腊德谟克利特国家科学研究中心) University of Patras(帕特雷大学) National and Kapodistrian University of Athens(雅典国立卡波迪斯特里亚大学) Hellenic Mediterranean University(希腊地中海大学) SciFY PNPC

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.LG

AI总结 针对数据与资源受限的优化场景,该研究通过测试4种代理模型提出感知计算的贝叶斯优化基线FruBO,给出代理推荐框架,为有限预算下的代理选择提供实用指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00847 2026-08-03 cs.GT cs.AI 版本更新 57%

Pay for The Second-Best Service: A Game-Theoretic Approach Against Dishonest LLM Providers

为次优服务付费:一种对抗不诚实大语言模型提供者的博弈论方法

Yuhan Cao, Yu Wang, Sitong Liu, Miao Li, Yixin Tao, Tianxing He

机构 * Shanghai Qi Zhi Institute(上海启智研究院) ShanghaiTech University(上海科技大学) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) Beijing Institute for General Artificial Intelligence(北京通用人工智能研究院) Shanghai University of Finance(上海财经大学) Tsinghua University(清华大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 本文提出了一种博弈论方法,通过设计近似激励相容机制,解决大语言模型服务提供者可能存在的不诚实行为问题,并保证用户效用的次优性。

Comments Published as a conference paper at WWW 2026; 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13732 2026-07-31 cs.RO 版本更新 57%

SUNSET - A Sensor-fUsioN based semantic SegmEnTation exemplar for ROS-based self-adaptation

SUNSET -- 一种基于传感器融合的语义分割示例,用于基于ROS的自适应系统

Andreas Wiedholz, Rafael Paintner, Alwin Hoffmann, Carlos Hernandez, Tobias Huber

机构 * XITASO GmbH(XITASO公司) German Aerospace Center (DLR) Institute of Flight Systems(德国航空航天中心(DLR)飞行系统研究所)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 SUNSET是一种基于ROS2的自适应系统示例,通过传感器融合语义分割流水线和训练好的机器学习模型,实现对动态环境中的不确定性进行严格评估和自适应处理。

Comments Accepted at RoSE Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04680 2026-07-31 cs.RO math.OC 版本更新 57%

A Three-Stage Offline SDRE-Based Control Framework for Human Motion Reproduction on a Suspended Bipedal Robot

用于悬挂式双足机器人人体运动复现的三阶段离线SDRE控制框架

Ping-Kong Huang, Chien-Wu Lan, Chin-Tien Wu, Ching-Kai Lin

机构 * Department of Applied Mathematics, National Yang Ming Chiao Tung University(应用数学系,阳明交通大学) Department of Electrical Engineering, National Central University(电气工程系,国立中央大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文针对下肢外骨骼人体评估的安全风险,提出三阶段离线SDRE控制框架,结合PID-LQR补偿,在悬挂式双足机器人上实现行走、下蹲运动的高精度可重复复现,性能优于基准控制器。

Comments 14 pages, 11 figures. Preliminary version submitted for documentation purposes on arXiv

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27169 2026-07-30 cs.LG 新提交 57%

When Do Learned Diffusion Proposals Help Constraint Solving? A Controlled Study on Continuous Algebraic Systems

学习到的扩散提议何时有助于约束求解?针对连续代数系统的对照研究

Quang Bui, Sparsh Roy, Akash Gundimeda, Davin Yin

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.LG

AI总结 本研究针对连续代数系统开展对照实验,发现学习到的扩散提议仅在高维、变量未耦合的场景下,才比随机多起点更有助于约束求解,且其优势并非适用于所有真实系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26646 2026-07-30 cs.CV 新提交 57%

Genie Sim PanoWorld: An Infinite Indoor 3D World Generation Pipeline via Panoramic Scene Modeling and Simulation

Genie Sim PanoWorld:基于全景场景建模与仿真的无限室内3D世界生成流水线

Yongxin Su, Linjie Hou, Feng Wang, Jialin Tang, Zhijun Li, Qian Wang, Maoqing Yao

专题命中 机器人数据与评测 :embodied AI(abstract);分类 cs.CV

AI总结 Genie Sim PanoWorld是两阶段前馈流水线,从单张360°全景生成可自由导航的高保真3D高斯场景,优于几何条件基线,且能零样本泛化至未见室内场景

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26583 2026-07-30 cs.CV 新提交 57%

R-SLPR: Region-based Small-to-Large Point-cloud Registration with Contrastive Learning

R-SLPR:基于区域的小到大点云配准对比学习框架

Yusen Wan, Zeyuan Chen, Qianshi Zou, Xu Chen

机构 * University of Washington(华盛顿大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 针对小到大尺度不匹配的点云配准难题,提出R-SLPR三阶段框架,结合斐波那契网格分割与对比学习,在ModelNet40上实现最优精度,大幅降低位置和旋转MAE。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26481 2026-07-30 cs.LG eess.SP 新提交 57%

Conformal Changepoint Localization and Root Cause Analysis with Corrupted Observations

含损坏观测值的保序变点定位与根因分析

Seunghun Yu, Meiyi Zhu, Petar Popovski, Joonhyuk Kang, Osvaldo Simeone

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院) King’s College London(伦敦国王学院) Aalborg University(奥尔堡大学) Northeastern University London(伦敦东北大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.LG

AI总结 本文针对含损坏观测值的系统,提出加权CONCH与加权CROC方法,结合元学习优化权重,可在保证置信集目标覆盖率的前提下缩小其规模,提升变点定位与根因分析的实用性。

Comments 34 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26473 2026-07-30 cs.LG cs.CL 新提交 57%

Learning Dynamic User Personas from Implicit Interaction Streams via Iterative Refinement

通过迭代优化从隐式交互流中学习动态用户画像

Haifeng Wu

机构 * PayPal(贝宝)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.LG

AI总结 针对现有个性化LLM依赖显式偏好监督的局限,提出IRIS框架,通过隐式交互流迭代优化用户画像,在Reddit AITA数据上的100位作者测试中,其决策预测准确率达61.0%,优于多种基线方法。

Comments 23 pages, 1 figure, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03701 2026-07-30 cs.CV 版本更新 57%

VidNum: Diagnosing VLM Failure Modes in Video-Grounded Numerical Reasoning

VidNum-1.4K:一个全面的视频基于数值推理基准

Shaoyang Cui, Lingbei Meng, Yaodi Luo, Peize He

机构 * Department of Psychological and Cognitive Sciences, Tsinghua University(清华大学心理与认知科学系) Shenzhen Loop Area Institute(深圳河套学院)

专题命中 机器人数据与评测 :world model(abstract);分类 cs.CV

AI总结 本文提出VidNum-1.4K基准,通过1379个严格人工标注的视频问题对,评估视频基于的数值推理能力,揭示当前VLMs在多步骤逻辑推理上的不足。

Comments 7 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17166 2026-07-30 cs.RO cs.SY eess.SY 57%

Geometric Inverse Flight Dynamics on SO(3) and Application to Tethered Fixed-Wing Aircraft

三维逆飞行动力学与 tethered 固定翼飞机的应用

Antonio Franchi, Chiara Gabellieri

机构 * Robotics and Mechatronics lab, Faculty of Electrical Engineering, Mathematics & Computer Science, University of Twente(代尔夫特理工大学机器人与机电实验室,电气工程、数学与计算机科学学院,代尔夫特理工大学) Department of Computer, Control and Management Engineering, Sapienza University of Rome(罗马大学计算机、控制与管理工程系,罗马萨皮恩扎大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本文提出一种坐标无关的逆飞行动力学方法,用于固定翼飞机在SO(3)上的建模,通过几何定义气动方向,推导轨迹到输入的映射,并应用于 tethered 飞行,揭示了气动协调与重力矢量的解耦。

Comments ACCEPTED ICUAS 2026

Journal ref 2026 International Conference on Unmanned Aircraft Systems, ICUAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25918 2026-07-29 cs.RO 新提交 57%

DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models

DC-WAM:用于世界-动作模型的以动态为中心的视觉监督与推理

Haoyuan Ji, Lingxiang Fan, Shang Su, Yinqiao Lu, Mengkai Shi, Jun Gao, Shuo Feng

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 研究如何让基于RGB的世界-动作模型从外观主导的重建转向交互诱导的视觉动态,提出DC-WAM框架,通过重新分配监督和计算,结合时间差分流匹配等方法,提升策略性能,尤其在多种分布外扰动下表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25140 2026-07-29 cs.AI cs.CL cs.GR cs.MA 新提交 57%

How Affect Propagates among LLM Agents: Emergent Emotional Contagion in Crowd Simulation

情感如何在大语言模型智能体之间传播:人群模拟中的涌现情感传染

Funda Durupinar

机构 * University of Massachusetts(马萨诸塞大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI

AI总结 研究多智能体人群模拟中情感传播,通过感知 - 评估 - 表达循环及借鉴相关模型构建架构,在多场景评估,揭示情感传染动态,包括警报扩散、个性影响等,还发现评估步骤动态依赖后端。

Comments 31 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24016 2026-07-29 cs.CV 版本更新 57%

DailyBench: A Unified Benchmark for AI-Generated and Manipulated Images from Modern Generative Models

DailyBench:用于评估现代生成模型生成和处理的人工智能图像的统一基准

Xin Jiang, Hao Tang, Junyao Gao, Meiqi Cao, Fei Shen, Dongming Zhang, Yongdong Zhang

机构 * People’s Daily Online(人民网) Nanyang Technological University(南洋理工大学) Tongji University(同济大学) Nanjing University of Science and Technology(南京理工大学) National University of Singapore(新加坡国立大学) University of Science and Technology of China(中国科学技术大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.CV

AI总结 研究针对现有生成模型图像检测基准与现实差距问题,提出统一基准DailyBench,含FakeBench和ManipulationBench两个子集,通过实验揭示当前检测器鲁棒性差,凸显其可用于开发更强大的人工智能生成图像检测方法。

Comments Some errors must be corrected

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16123 2026-07-29 cs.RO 版本更新 57%

BayesContact: Uncertain Pose Estimation via Visuo-Tactile Proposals and Simulation-based Inference

BayesContact:通过视觉触觉提议和基于模拟的推理进行不确定姿态估计

Aditya Kamireddypalli, Matias Mattamala, Joao Moura, Russell Buchanan, Sethu Vijayakumar, Subramanian Ramamoorthy

机构 * School of Informatics, University of Edinburgh(爱丁堡大学信息学院) Department of Mechanical and Mechatronics Engineering, University of Waterloo(滑铁卢大学机械与机电工程系)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 针对富含接触操作中姿态估计难题,提出BayesContact框架,通过融合视觉与触觉信息及基于模拟的推理来维护物体姿态信念,经模拟预测与真实观测对比更新信念,提升了姿态可观测性与插入成功率。

Comments Update funding sources

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23870 2026-07-28 cs.MA cs.AI 新提交 57%

MulRobBench: A Decision-Level Benchmark for Safe and Security-Policy-Compliant Multimodal UAV Agents

MulRobBench:用于安全且符合安全策略的多模态无人机智能体的决策级基准测试

Belal S. Alsinglawi, Weizheng Wang, Junyi Wu, Yi Jiang, Lianhai Lin, Merouane Debbah, Izzat Alsmadi

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI

AI总结 智慧城市中无人机需在复杂条件下决策,MulRobBench作为决策级基准测试,将多模态观测、安全策略等集成,含多任务样本和评分维度,评估结合多种方式,给出模型得分,通过研究找出决策不稳定原因,为无人机多模态决策提供可重复基准。

Comments 22 pages, 18 figures, 17 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23694 2026-07-28 cs.CV 新提交 57%

Parameter-Efficient Adaptation of SAM3 for Prompt-Driven Surgical Concept Segmentation

用于提示驱动手术概念分割的 SAM3 的参数高效适配

Changjing Liu, Yiming Huang, Beilei Cui, Liangjing Shao, Long Bai, Yanheng Li, Haoxuan Che, Hongliang Ren

机构 * The Chinese University of Hong Kong(香港中文大学) XGEN Labs(XGEN实验室)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 针对手术数据与预训练数据的领域差距及现有方法计算消耗大效率低的问题,提出用低秩适配(LoRA)对 SAM3 进行参数高效适配用于手术概念分割,该方法在单个 GPU 上训练且性能优于主流基线,结果可支持下游手术场景重建和模拟。

Comments Accepted by The 2nd MICCAI Workshop on Efficient Medical AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22832 2026-07-28 cs.LG 新提交 57%

MEMENTO: Memory-Guided Memetic Code-as-Policy Evolution

MEMENTO:内存引导的基于代码的策略进化的模因算法

Alkis Sygkounas, Victor Aregbede, Amy Loutfi, Andreas Persson

机构 * Center for Applied Autonomous Sensor Systems (AASS), Örebro University(应用自主传感器系统中心(AASS),于默奥大学) Örebro University(于默奥大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.LG

AI总结 研究长期具身任务中基于代码的策略进化问题,提出内存引导单精英模因框架MEMENTO,通过进化展开评估器及利用反馈指标改进策略,在相关领域实验中性能优于基线,还证明了模拟到现实转移的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15263 2026-07-28 cs.CR cs.AI 版本更新 57%

Beyond Success Rate: Cost-Aware Evaluation of Offensive and Defensive Security Agents

超越成功率:攻防安全代理的成本感知评估

Paul Kassianik, Blaine Nelson, Yaron Singer

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI

AI总结 研究通过成本-成功率视角评估语言模型安全代理,在攻防挑战中比较固定成本下模型性能,发现红蓝队任务扩展模式不同,进攻性CTF性能与测试时计算量有关,防御性SOC调查更依赖工具使用等,强调安全代理基准应考量经济效率与运营契合度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28736 2026-07-28 cs.RO 版本更新 57%

Imitation Learning for Robot Assistance in Open Surgery: A Multi-Policy Evaluation on Suture Following

开放手术中机器人辅助的模仿学习:针对缝合跟随的多策略评估

Xucheng Wang, Zhizhou Yang, Xiaoman Zhang, Sung Eun Kim, Romain Hardy, Pranav Rajpurkar

机构 * Harvard Medical School(哈佛医学院) Massachusetts General Hospital(麻省总医院)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本研究首次评估通用模仿学习在开放手术中用于外科医生-机器人协作辅助的可行性,以缝合跟随(每次缝合时助手执行的抓取-拉动-释放动作)为任务,通过比较四种策略(ACT、Diffusion Policy、SmolVLA、π₀)在28个训练模型上的表现,发现π₀在数据效率、背景鲁棒性和轨迹平滑性上最优,并在机器人缝合试验中达到92%的缝合完成率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22030 2026-07-27 cs.RO 新提交 57%

Impedance Control of Ship-Borne Manipulators via Optimization-based Task-Space Inverse Dynamics

基于优化的任务空间逆动力学的舰载机械手阻抗控制

Lingxiao Meng, Bi-Ke Zhu, Xuheng Gao, Zhe Zhang, Jiankun Yang, Jiankun Wang, Haibo Lu, Max Q. -H. Meng

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 针对舰载机械手受波浪基座运动影响问题,提出基于扭矩水平优化控制框架,结合任务空间逆动力学和误差状态卡尔曼滤波器,经仿真与实验验证,有效降低跟踪误差,实现动态销孔插入,提升操作成功率并减少接触力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21986 2026-07-27 cs.RO 新提交 57%

Mag4D-SLAM Dataset: A Repeated-Traversal Multi-Modal 4D Geomagnetic Dataset for Localization and Mapping

Mag4D-SLAM数据集:用于定位和映射的重复遍历多模态4D地磁数据集

Bibhutibhusan Nayak, Hyoseok Ju, Giseop Kim

机构 * Department of Robotics and Mechatronics Engineering, DGIST(大邱庆北科学技术院机器人与机电工程系)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 该研究提出Mag4D-SLAM这一首个大规模室外地磁SLAM数据集,含多传感器同步测量与地面真值姿态。通过重复遍历实验分析磁场重复性等特性,支持偏航漂移缓解等研究,还能开启地磁传感补充其他模态及应对特殊情况的新研究。

Comments Accepted to IROS 2026. 8 pages, 8 figures. *Bibhutibhusan Nayak and Hyoseok Ju contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19596 2026-07-27 cs.CV 57%

PC2Model: ISPRS benchmark on 3D point cloud to model registration

PC2Model:ISPRS基准在点云到模型配准

Mehdi Maboudi, Said Harb, Jackson Ferrao, Kourosh Khoshelham, Yelda Turkan, Karam Mawas

机构 * 1 Institute of Geodesy

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 本文提出PC2Model基准,通过结合模拟点云与真实扫描数据,解决点云到模型配准中的稀疏性、噪声等问题,提升跨领域模型泛化能力。

Comments ISPRS Congress 2026, Toronto

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21571 2026-07-24 cs.RO 新提交 57%

Beyond Episodic Evaluation: Memory Architectural Bottlenecks in Sequential Embodied Question Answering

超越情节性评估:序列式具身问答中的内存架构瓶颈

Zikui Cai, Kaushal Janga, Tan Dat Dao, Seungjae Lee, Shivin Dass, Mingyo Seo, Kaiyu Yue, Mintong Kang, Nandhu Pillai, Monte Hoover, Aadi Palnitkar, Ruchit Rawal, Ruijie Zheng, Bo Li, Yuke Zhu, Roberto Martín-Martín, Tom Goldstein, Furong Huang

机构 * University of Maryland, College Park(马里兰大学帕克分校) The University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO

AI总结 研究序列式具身问答中不同内存架构表现,发现仅保留现有记忆不足,短视情节数据训练的智能体有时间不匹配问题。强调结构化、基于空间记忆的必要性,实验表明其能打破准确性-效率权衡,对真实机器人连续智能操作至关重要。

Comments Accepted to IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21309 2026-07-24 cs.RO 新提交 57%

Factorized Spatio-Temporal Convolutions for Human Pose Estimation from Planar Lidar

用于基于平面激光雷达的人体姿态估计的分解时空卷积

Simone Arreghini, Mirko Nava, Nicholas Carlotti, Antonio Paolillo, Alessandro Giusti

机构 * Dalle Molle Institute for Artificial Intelligence (IDSIA), USI-SUPSI(瑞士意大利语区大学提契诺大学人工智能达勒莫利研究所)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO

AI总结 针对服务机器人仅配备平面激光雷达和普通处理器的情况,提出基于时空块的轻量级网络,用于全向人体检测和相对2D姿态估计,通过跨模态自监督训练,优于基线模型,适用于计算受限的服务机器人空间感知。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04038 2026-07-24 cs.RO 版本更新 57%

Force-Aware Residual DAgger via Trajectory Editing for Precision Insertion with Impedance Control

具备力感知的残差数据集聚合轨迹编辑用于阻抗控制的精确插入

Yiou Huang, Ning Ma, Weichu Zhao, Zinuo Liu, Jun Sun, Qiufeng Wang, Yaran Chen

机构 * Xi’an Jiaotong-Liverpool University(西交利物浦大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 本文提出TER-DAgger框架,通过优化轨迹编辑学习残差策略,减少协变量偏移,结合力感知的失败预判机制和阻抗控制框架,提升精确插入任务的成功率。

Comments 8 pages, 3 figures. Accepted to the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16900 2026-07-23 cs.AI 版本更新 57%

Environment-free Synthetic Data Generation for API-Calling Agents

用于 API 调用智能体的无环境合成数据生成

Seanie Lee, Sanjoy Chowdhury, Chao Jiang, Cheng-Yu Hsieh, Ting-Yao Hu, Alexander T Toshev, Oncel Tuzel, Raviteja Vemulapalli

专题命中 机器人数据与评测 :world model(abstract);分类 cs.AI

AI总结 研究针对训练 API 调用 LLM 智能体数据收集瓶颈问题,提出无环境合成数据生成方法,利用 LLMs 生成任务、响应等,经评判器过滤轨迹,在相关基准上评估,结果表明此方法可有效训练智能体,是实用可扩展方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19243 2026-07-22 cs.CL cs.AI 新提交 57%

Inference-Time Steering for Cross-Lingual Factual Consistency in LLMs

大语言模型中跨语言事实一致性的推理时引导

Alexander Manev

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 研究大语言模型跨语言事实不一致问题,评估零样本上下文引导、CAA、DPO四种干预策略,通过实验发现角色提示是最强干预方式,CAA对配置敏感,DPO适配器收益窄且可转移性低,表明跨语言不一致部分是选择问题,简单干预可能更优。

Comments 8 pages (21 in total), 2 figures, 4 tables. Original manuscript for a Guided Research project conducted at the Technical University of Munich, detailing the complete methodology, full data pipeline, and comprehensive experimental results. A related, condensed subset of this work was subsequently adapted and published at the StereACuLT 2026 workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19196 2026-07-22 eess.SY cs.RO cs.SY 新提交 57%

STL-GCS: A Planner-Controller Framework for Signal Temporal Logic via Graphs of Time-varying Convex Sets

STL-GCS:一种基于时变凸集图的信号时序逻辑规划器-控制器框架

Nicola De Carli, Gregorio Marchesini, Dimos V. Dimarogonas

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 提出用于满足凸谓词上STL规范的统一轨迹规划与控制框架,规划层将任务编码为时变凸集,结合GCS框架并由B样条参数化轨迹,控制层据此设计反馈控制器,通过仿真和实际实验验证了该方法。

详情

展开后加载摘要…

URL PDF HTML 收藏