arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 996 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 996 篇

2608.20946 2026-08-24 cs.RO 新提交 57%

Fast Coordinated Bimanual Motion Planning With Hard Constraints

带硬约束的快速双协作机械臂运动规划

Borna Paro, Luka Petrović, Ivan Marković

机构 * University of Zagreb(萨格勒布大学) Faculty of Electrical Engineering and Computing(电气工程与计算机学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 针对双臂操作的相对变换硬约束问题,提出主从参数化的快速规划流水线,仿真中规划速度提升19.4倍,实际实验验证轨迹可直接迁移至硬件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20433 2026-08-24 cs.RO cs.HC cs.MM cs.SD 新提交 57%

Humanoid Musical Robots as Experimental Interfaces for Music-Evoked Emotion

类人音乐机器人作为音乐诱发情绪研究的实验接口

Vincent K.M. Cheung, Jia-Yeu Lin

机构 * Sony Computer Science Laboratories(索尼计算机科学实验室) Waseda University(早稻田大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 本文提出将类人音乐机器人作为音乐诱发情绪研究的实验接口,通过WAS-5案例验证其技术可行性,为该领域可控研究提供方法论平台。

Comments Opinion paper accepted for presentation at the Sound and Music Computing (SMC) Conference 2026 (5-7 November in Zagreb, Croatia)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20251 2026-08-21 cs.RO 新提交 57%

Video2DoorTraversal: Push Door Traversal via Simulated Door Twins

Video2DoorTraversal:通过模拟门孪生体实现推门穿越

Xincheng Tang, Yiji Chen, Youhan Xie, Wanyu Li, Zhengjie Shu, Lai Jiang, Wenkang Hu, Yitong Li, Jinchuang Zhang, Xibin Song, Ruigang Yang

机构 * Shanghai Jiao Tong University(上海交通大学) NeoWa Robotics(NeoWa机器人公司) Shandong University(山东大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 本文提出Video2DoorTraversal框架,通过DoorTwin重构门孪生体,训练ArticuACT策略,实现轮腿式移动机械手开门穿越,在真实门与未见门上分别达到96.57%和80.95%的成功率。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19188 2026-08-20 cs.RO 新提交 57%

PartialBiGrasp: Inferring Hidden Local Geometry for Bimanual Grasping from Partial Views

PartialBiGrasp:从部分视角推断隐藏局部几何以实现双臂抓取

Ayush Kaura, Vignesh Vembar, Md Faizal Karim, Keshab Patra, K Madhava Krishna

机构 * Robotics Research Center IIIT Hyderabad(印度信息技术研究所海得拉巴分校机器人研究中心)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 PartialBiGrasp是基于部分点云的双臂抓取生成框架,通过卷积占用网络学习几何特征生成抓取对并优化,经实验验证可实现鲁棒稳定的抓取。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18230 2026-08-20 cs.LG 新提交 57%

Allocating Recurrent Compute in Looped Language Models

在循环语言模型中分配循环计算

Ruhai Lin, Yiyang Guo, Rui-Jie Zhu, Hao Ye, Jason K. Eshraghian

机构 * University of California, Santa Cruz(加州大学圣克鲁兹分校)

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 该研究针对循环语言模型,提出仅重复混合器、单次执行密集FFN的MixerLoop,在不同参数规模下验证其性能,可保留循环深度优势并降低计算量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16251 2026-08-18 cs.CV 新提交 57%

SCOUT: Semantic Concept Discovery for Open-Vocabulary Editing of face Recognition Templates

SCOUT:面向人脸识别模板开放词汇编辑的语义概念发现

Leon Todorov, Peter Rot, Peter Peer, Vitomir Štruc, Klemen Grm

机构 * University of Ljubljana(卢布尔雅那大学) Faculty of Electrical Engineering(电气工程学院) Faculty of Computer and Information Science(计算机与信息科学学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 SCOUT是一个端到端框架,可通过机械可解释性发现人脸识别模板中的语义概念,实现可控的身份感知模板编辑,且对身份匹配影响极小。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16196 2026-08-18 cs.AI cs.HC 新提交 57%

Beyond Asking: A Pipeline for Personalized Game Generation that Reads Players from Behavior

超越询问:一种从玩家行为读取数据的个性化游戏生成流水线

Yifan Lu, Xiaopeng Yuan, Haohan Wang

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 该研究构建了带真实特质的合成玩家基准,提出机会感知决策时刻表示,对比了LLM等方法的推断效果,将推断画像用于游戏难度自适应并开展人类研究验证。

Comments 16 pages, 3 figures, 6 tables. Includes technical appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16003 2026-08-18 cs.AI cs.CL 新提交 57%

Prior Audit-Repair Context Shifts LLM Verifier Thresholds Toward Leniency

先验审计-修复上下文调整大语言模型验证器阈值以趋向宽松

Parsa Mazaheri, Kasra Mazaheri

机构 * University of California, Santa Cruz(加州大学圣克鲁兹分校) Massachusetts Institute of Technology(麻省理工学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 该研究发现,LLM检查器上下文中的审计→修复事件会降低误报率,调整了验证器阈值趋向宽松,且该效应与负性不对称性预测相反,不随推理启用而消失。

Comments 12 pages, 2 figures, 4 tables. Code and analysis artefacts: https://github.com/parsa-mz/crtitxer

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15893 2026-08-18 cs.AI 新提交 57%

Breaking and Defending LLM-Powered Social Media Bot Detection Systems

突破与防御:基于大语言模型的社交媒体机器人检测系统

Nof Orenstein, Yoni Birman

机构 * Reichman University(莱希曼大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本研究针对基于大语言模型的社交媒体机器人检测系统,提出两种新型对抗攻击策略使其准确率降48%,并开发多LLM防御框架LSABRE,在强自适应对抗下仍维持86%准确率,相关方法可推广至其他LLM网络安全系统。

Comments Accepted at ACISP 2026 (Australasian Conference on Information Security and Privacy). Also accepted as a poster at IEEE Symposium on Security and Privacy (S&P) 2026. Published in Pragmatic Cybersecurity 2026, 1(2), 10, https://doi.org/10.53941/pc.2026.100010. 19 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15888 2026-08-18 cs.AI cs.CR 新提交 57%

Bounded Agents: Delegation Security for Multi-Agent AI Systems

有界智能体:多智能体AI系统的委托安全

Xabier Muruaga

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 该研究针对多智能体AI系统的委托安全问题,提出智能体委托链(APC)架构,经实验可有效阻止提示注入攻击,降低数据窃取、破坏及操纵风险,授权延迟低且效用损失可控。

Comments 14 pages, 4 figures, 18 tables. Code and data: https://github.com/xmuruaga/bounded-agents

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15461 2026-08-18 cs.RO 新提交 57%

Detachable Wire Drive : Reconfigurable Robot Architecture with Shared Actuators

可分离钢丝驱动:采用共享执行器的可重构机器人架构

Takahiro Hattori, Kento Kawaharazuka, Kei Okada

机构 * The University of Tokyo(东京大学) AI Center, Graduate School of Information Science and Technology, The University of Tokyo(东京大学信息科学与技术研究院AI中心)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 该研究提出可分离钢丝驱动的可重构机器人架构,通过钢丝分离单元实现执行器共享,开发出多种可互换部件,经实验验证其机械可靠性与构型转换能力,为高效多功能机器人提供新方案。

Comments Accepted at IROS2026, website - https://hatofly.github.io/detachable-wire-drive/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14731 2026-08-18 cs.CV cs.DL 新提交 57%

Emergence of Transfer Learning towards Specific Identification of Alzheimer's Disease A Prospective Approach

面向阿尔茨海默病特定识别的迁移学习的涌现:一种前瞻性方法

Soumik Podder, Chandramouli Haldar

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 本综述探讨迁移学习在阿尔茨海默病诊断中的应用,评估其优势与局限,结合可解释人工智能,为该领域新研究者提供指导。

Journal ref 2025 AI-Driven Smart Healthcare for Society 5.0, Kolkata, India, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12377 2026-08-14 q-bio.NC cs.AI cs.CL 新提交 57%

From Observation to Intervention: Memory in Brains and Large Language Models

从观察到干预:大脑与大型语言模型中的记忆

Morteza Salehjahromi, Shayan A. Zadegan, Amgad Muneer, Jia Wu

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 该研究对比大脑与LLMs的记忆系统,提出可利用LLMs在实验访问上的优势,将记忆相关功能问题转化为更精准的生物学假设,核心是转移实验逻辑而非解剖结构。

Comments Perspective article, 11 pages, 3 figures, 1 table, and 1 key terms box. Submitted for consideration to Nature Machine Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13220 2026-08-14 cs.RO 新提交 57%

FAM-DQ: A Dual-Quadrotor-Based Fully Actuated Aerial Manipulator for High-Torque Interaction

FAM-DQ:一种基于双四旋翼的全驱动空中操纵器,用于高力矩交互

Xuwei Yang, Ruoyu Ren, Ziqian Guo

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 针对空中物理交互的高力矩需求,本文提出基于双四旋翼的全驱动空中操纵器FAM-DQ,通过特定结构设计实现解耦6自由度控制,实验验证其具备高力矩输出能力。

Comments 7 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13064 2026-08-14 cs.CV 新提交 57%

Learning Unified Video and Image Representation for Video Face Forgery Detection

用于视频人脸伪造检测的统一视频与图像表示学习

Haotian Liu, Yang Liu, Guoying Zhao, Xiaobai Li

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 针对部分伪造视频检测难题,提出UVIF框架,通过统一编码器、伪标注及特征对齐策略联合建模视频与图像,检测性能优于现有最优方法且无额外计算开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12864 2026-08-14 cs.CR cs.LG 新提交 57%

Discovering Persistent Behavioural Patterns for Interpretable Blockchain Forensics

面向可解释区块链取证的持久性行为模式发现

Dorottya Zelenyanszki, Zhe Hou, Kamanashis Biswas, Vallipuram Muthukkumarasamy

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 该研究提出一种可扩展、应用无关的区块链行为模式发现框架,结合两步嵌入与可解释分析,可在以太坊超3000万笔交易中发现常规与恶意模式,支持区块链取证等应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12719 2026-08-14 cs.GT cs.AI 新提交 57%

Error-Aware Reverse Auction Mechanism for Large Language Model Routing

面向大语言模型路由的误差感知反向拍卖机制

Haolong Chen, Zhengyuan Xin, Liang Zhang, Lei Xue, Guangxu Zhu

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 针对大语言模型路由的信息风险不匹配与可扩展性瓶颈,提出EA-RAM反向拍卖机制,证明其相关特性,实验显示该机制鲁棒且性能优于集中式基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12346 2026-08-14 cs.AI cs.CY 新提交 57%

Position: The Alignment Community is Unintentionally Building a Censor's Toolkit

立场:对齐社区正在无意之中构建审查者的工具包

Sarah Ball, Phil Hackemann

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 该立场论文指出现代AI对齐方法是两用技术,可能被恶意滥用,呼吁社区讨论其滥用风险并提出缓解策略。

Comments Accepted as oral paper at ICML 2026

Journal ref Proceedings of the 43rd International Conference on Machine Learning, Seoul, South Korea. PMLR 306, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12273 2026-08-13 cs.CR cs.AI 新提交 57%

Convergent Detour Hijacking: Task-Preserving Resource Amplification in Skill-Based LLM Agents

收敛式绕路劫持:基于技能的大语言模型智能体中的任务保留型资源放大

Junliang Liu, Ruoyu Li, Wenxin Tang, Jingyu Xiao, Zhenyu Liu, Jingheng Xu, Laizhong Cui

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 该研究提出收敛式绕路劫持攻击,耦合LLM智能体技能选择与规划阶段,可放大任务资源消耗,在DeepSeek-V4-Pro上80.02%的任务会被选中攻击者控制的协调器,任务完成率不变但成本显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11574 2026-08-13 cs.CV 新提交 57%

Hand Visibility Detector: Per-Keypoint Visibility Estimation for Hands

手部可见性检测器:针对手部关键点的逐点可见性估计

Ryosei Hara, Masashi Hatano, Rintaro Yanagi, Atsushi Hashimoto, Takuma Yagi, Mariko Isogawa

机构 * OMRON SINIC X Corporation(欧姆龙SINIC X公司) The University of Tokyo(东京大学) Keio University(庆应义塾大学) National Institute of Advanced Industrial Science Technology (AIST)(日本产业技术综合研究所)

专题命中 机器人操作 :robotics(abstract);分类 cs.CV

AI总结 本研究提出Hand Visibility Detector,将逐关节手部可见性估计作为独立任务研究,利用预训练HPE模型作骨干实现高性能,其可见性加权三角化可降低3D手部姿态标注的重投影误差。

Comments Code: https://github.com/ryhara/hand_visibility_detector

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10997 2026-08-12 cs.RO 新提交 57%

Seeing above the waves: A modular sensing framework for data acquisition at sea

洞察海面之上:一种用于海上数据采集的模块化感知框架

Jonathan E. Schmidt, Julius Wirbel, P. Nicholas Hansen, Morgan Louédec, Christian L. H. Westerdahl, Dimitrios Dagdilelis, Roberto Galeazzi

机构 * Technical University of Denmark(丹麦技术大学)

专题命中 机器人操作 :navigation(abstract);分类 cs.RO

AI总结 针对海洋环境下水面船只自主性研发中的传感器数据采集难题,提出融合多模态传感器的模块化平台,依托ROS2框架实现长时数据采集与可复现性,为自主海洋导航提供标准化数据集基础。

Comments Submitted and accepted to the IFAC WC 2026 as an invited session paper for track 7.2 Transportation and Vehicle Systems - Marine Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10920 2026-08-12 cs.AI 新提交 57%

IO Factory: Simulating AI-Enabled Influence Campaigns at Scale

IO Factory:大规模模拟AI驱动的影响力行动

Lukasz Olejnik, Wenchao Dong, Jonas R. Kunst, Signe Riemer-Sørensen, Tobias Herb, Meeyoung Cha, Daniel Thilo Schroeder

机构 * King’s College London(伦敦国王学院) Max Planck Institute for Security and Privacy(马克斯·普朗克安全与隐私研究所) BI Norwegian Business School(挪威商学院) University of Oslo(奥斯陆大学) SINTEF Digital(SINTEF数字研究所) Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 IO Factory是AI驱动的大规模影响力行动模拟框架,可在受控平台中关联多环节数据,在10万智能体配置下可执行行动并生成可检查证据,支持可重复研究与红队分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10870 2026-08-12 cs.CV 新提交 57%

NullEdit: Stealthy Image Protection via VLM Condition Redirection

NullEdit:通过视觉语言模型条件重定向实现隐秘图像保护

Weiyao Huang, Liqin Wang, Ziqi Sheng, Wei Lu

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 NullEdit针对VLM表示进行重定向,可隐秘抑制图像编辑且保留源内容,在基准模型上平均降低EditReward IF分数0.813,实现了高效的图像保护。

Comments 9 pages, 6 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10716 2026-08-12 cs.SD cs.AI cs.CL 新提交 57%

DuplexWorld: Can voice agents help you get through the day?

DuplexWorld:语音智能体能帮你度过一天吗?

Aryan Vijay Bhosale, Harshit Rajgarhia, Akhil Pothanapalli, Asif Shaik, Abhishek Mukherji, Dinesh Manocha

机构 * Centific Global Solutions Inc.(森蒂菲克全球解决方案公司) University of Maryland(马里兰大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 DuplexWorld针对现有语音智能体评估基准的不足,构建含六大领域的156个场景开展评估,发现现有最优语音智能体在多维度仍有较大改进空间,并分析了相关性能与失败模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10405 2026-08-12 cs.SD cs.AI 新提交 57%

Never Stop Speaking: a Denial-of-Service Attack on End-to-End Speech Language Models

永不停止说话:针对端到端语音语言模型的拒绝服务攻击

Shuozhe Cheng, Kunlan Xiang, Mingxuan Li, Ji Zhang, Dongxiao Liu, Wenbo Jiang

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本研究针对端到端语音语言模型提出基于扰动的拒绝服务攻击,通过优化声学扰动抑制EOS生成以延长解码,在三类开源模型上验证了其攻击有效性及安全风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09547 2026-08-11 cs.RO 新提交 57%

Model-Based Systems Engineering Framework for SysML-Driven Design of Autonomous UAVs

面向自主无人机SysML驱动设计的基于模型的系统工程框架

Deekshitha Angadi, Naveena Budda, Vikas Agarwal, Mohamed Samshad, Bharath Kumar Suryadevara, Narsimlu Kemsaram

机构 * Autonomous Robotics Systems Limited(自主机器人系统有限公司) University of Hyderabad(海得拉巴大学) Ideabytes Software India Private Limited(Ideabytes软件印度私人有限公司) Georgia Institute of Technology(佐治亚理工学院) Akkodis AS&D GmbH(Akkodis AS&D有限公司) Universiti Malaya(马来亚大学)

专题命中 机器人操作 :navigation(abstract);分类 cs.RO

AI总结 本文提出一种面向自主无人机SysML驱动设计的MBSE框架,以SysML为设计主干整合开发流程,将逻辑架构映射至ROS 2,通过典型任务场景示例,实现需求分配等功能,提升早期设计的可追溯性与一致性。

Comments Accepted for presentation at the 2026 International Conference on Autonomous Aerial Vehicles (ICAAV-2026), 20-21 Aug 2026, Bengaluru, India

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08871 2026-08-11 cs.RO cs.SY eess.SY 新提交 57%

Hierarchical Topology-Aware Planning and Control of Underwater Vehicle-Manipulator Systems in Confined Environments

受限环境下水下机器人-机械臂系统的分层拓扑感知规划与控制

Mohamed Abdelwahab, Ruggero Carli, Damiano Varagnolo, Alberto Dalla Libera

机构 * University of Padova(帕多瓦大学) Polytechnic University of Bari(巴里理工大学) Norwegian University of Science and Technology(挪威科技大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 针对受限环境下UVMS自主干预的风险问题,提出三层分层框架MANTA,经实验验证其任务成功率更高、安全余量更大,可实现更安全高效的水下自主干预。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08749 2026-08-11 cs.RO 新提交 57%

OnEvoMemory: Evolving Memory through Online Robot Rollouts for Pretrained Robot Policies

OnEvoMemory:通过机器人在线试跑演化预训练机器人策略的记忆机制

Zhongxi Chen, Shenqi Zong

机构 * Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 针对现有机器人记忆机制依赖外部模型的问题,提出OnEvoMemory价值引导记忆模块,结合离线初始化与在线试跑优化记忆选择,提升了基础VLA策略在长时程机器人操作中的性能。

Comments 6 pages, 1 figure. Accepted as a poster at the ECCV 2026 Workshop on Embodied Multimodal Reasoning in Physical Environments (EMR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08303 2026-08-11 cs.AI cs.MA 新提交 57%

Query-Only Backdoor Attacks on Self-Evolving Skills via Trajectory Poisoning

通过轨迹投毒对自进化技能实施仅查询式后门攻击

Yuyang Luo, Haoran Wang, Kai Shu

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本研究针对自进化技能系统提出仅查询式轨迹后门攻击TBA,通过构造查询诱导生成带后门技能,实验证实其可可靠植入条件后门且效果优于直接注入。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08125 2026-08-11 cs.CV 新提交 57%

Staying True to the Origin: Continuous Image Stylization with Smooth Transitions

忠于本源:具有平滑过渡的连续图像风格化

Rui Xu, Hanmo Zhang, Songhua Liu

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 该研究针对图像风格化的内容保留与过渡问题,提出两阶段训练策略及风格强度感知样条插值方法,让基于DiT的模型实现精确连续的风格强度控制,生成高保真结果。

Comments 14 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏