Ranking Abuse via Strategic Pairwise Data Perturbations
通过策略性成对数据扰动进行排名滥用
专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.LG
AI总结 研究基于最大似然估计的成对排名系统对策略性数据扰动的脆弱性,提出自适应子集选择攻击(ASSA)方法,实验表明少量扰动即可显著改变全局排名。
视觉与机器人
机器人、具身智能、机器人学习、操作、导航和具身世界模型。
通过策略性成对数据扰动进行排名滥用
专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.LG
AI总结 研究基于最大似然估计的成对排名系统对策略性数据扰动的脆弱性,提出自适应子集选择攻击(ASSA)方法,实验表明少量扰动即可显著改变全局排名。
DemoDiffusion: 使用预训练扩散策略的一次性人类模仿
机构 * Carnegie Mellon University(卡内基梅隆大学)
专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.LG
AI总结 提出DemoDiffusion方法,通过单次人类演示和预训练扩散策略,无需任务特定训练即可使机器人执行操作任务,在8项任务中平均成功率达83.8%。
Comments 11 pages. Published at ICRA 2026
DiffCoord: 分布式多智能体轨迹优化的可微协调
机构 * Department of Electrical and Computer Engineering, National University of Singapore(新加坡国立大学电子与计算机工程系)
专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.LG
AI总结 提出DiffCoord框架,将截断ADMM-DDP管道的耦合参数通过端到端元学习联合优化,利用智能体神经网络实现任务自适应,并扩展到不同智能体数量。在协作空中运输系统中验证,相比现有方法将每智能体梯度计算时间减少70%。
Glove2Hand:从多模态传感手套合成自然的手-物体交互
机构 * Meta Reality Labs(Meta现实实验室) ; Rutgers University(罗格斯大学)
专题命中 机器人操作 :robotics(abstract);分类 cs.RO、cs.CV
AI总结 提出Glove2Hand框架,将多模态传感手套视频转化为逼真的裸手,并保留物理交互动态;引入3D高斯手模型和扩散手恢复器,创建HandSense数据集,提升下游任务性能。
Comments CVPR 2026 Highlight. This version includes the motion retarget process in the appendix
MidSteer:用于引导生成模型的最优仿射框架
机构 * University of Basel(巴塞尔大学) ; University of California, Berkeley(加州大学伯克利分校) ; ETH Zurich(苏黎世联邦理工学院) ; University of Cambridge(剑桥大学) ; University of Washington(华盛顿大学)
专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.LG
AI总结 本文提出MidSteer,一种基于仿射变换的最优概念引导框架,通过最小干扰实现生成模型中的概念切换,并在视觉扩散模型和大型语言模型上验证其有效性。
SANTS:面向世界动作模型的状态自适应调度器
机构 * Fudan University(复旦大学) ; Harbin Institute of Technology(哈尔滨工业大学) ; Deep Computing Era Technology Co., Ltd(深计算时代科技有限公司)
专题命中 机器人操作 :manipulation(abstract);分类 cs.RO;robotics(comments)
AI总结 提出状态自适应噪声轨迹调度器(SANTS),通过根据视频状态动态选择去噪深度来优化视频到动作的扩散策略,在保持控制性能的同时大幅降低推理延迟。
Comments 17 pages, 5 figures, 8 tables. Project page: https://advanced-robotics-lab.github.io/SANTS/
OmniVTLA:具有语义对齐触觉感知的视觉-触觉-语言-动作模型
机构 * Shanghai Jiao Tong University(上海交通大学) ; Paxini Tech(帕辛尼科技)
专题命中 机器人操作 :manipulation(abstract);分类 cs.RO;robotics(comments)
AI总结 提出OmniVTLA架构,通过双路径触觉编码器框架和语义对齐触觉ViT,结合新数据集ObjTac,显著提升机器人操作中接触密集任务的成功率和轨迹平滑度。
Comments Accepted by IEEE Robotics and Automation Letters (RA-L). ObjTac dataset: https://readerek.github.io/Objtac.github.io
集成化分层决策在逆运动学规划与控制中
机构 * University of Cambridge(剑桥大学)
专题命中 机器人操作 :robotics(abstract,comments);分类 cs.RO
AI总结 本文提出一种高效的非线性规划框架,整合分层决策与全身逆运动学规划控制,解决逆运动学规划中同时选择端效应器位置的问题。
Comments Accepted paper to "Robotics: Science and Systems" (2026)
HarmoHOI:用于多视图手-物体交互合成的外观与3D运动协调
机构 * South China University of Technology(华南理工大学) ; Beijing Normal University(北京师范大学) ; Tsinghua University(清华大学) ; Shadow AI(影谱科技)
专题命中 机器人操作 :embodied AI(abstract);分类 cs.CV
AI总结 研究针对多视图手-物体交互合成难题,提出HarmoHOI统一扩散框架,用多视图扩散Transformer混合模型联合建模视频与点轨迹,结合全局运动对齐扩散确保一致性,采用混合数据学习策略,实现多视图HOI高质量合成。
ScaleHP: 在度量空间中估计手部姿态
机构 * Tsinghua University(清华大学) ; Zhongguancun Academy(中关村学院) ; Visincept ; International Digital Economy Academy (IDEA Research)(国际数字经济学院(IDEA研究院)) ; South China University of Technology(华南理工大学)
专题命中 机器人操作 :robotics(abstract);分类 cs.CV
AI总结 提出ScaleHP,一种端到端的一阶段手部姿态估计框架,利用手部骨骼内在比例关系作为度量先验,通过尺度token和透视约束最小二乘法在相机坐标系中恢复绝对度量尺度,在多个基准上达到最先进性能。
Comments 19 pages, 9 figures, 12 tables; includes supplementary material
在像素之间阅读:一种针对文本到图像模型的 inscription 性 jailbreak 攻击
专题命中 机器人操作 :manipulation(abstract);分类 cs.CV
AI总结 本文提出 Etch 框架,通过分解对抗提示为语义伪装、视觉空间锚定和字形编码三层,实现对文本到图像模型的 inscription 性 jailbreak 攻击,验证了现有安全机制的不足。
用于精准单步动作生成的统一条件-动作建模
机构 * NTU(南洋理工大学) ; HKU(香港大学)
专题命中 机器人操作 :manipulation(abstract);分类 cs.RO
AI总结 该研究提出UCA-Flow统一条件-动作建模框架,通过共享令牌空间与改进双路监督方案,提升机器人单步动作生成的成功率与推理速度。
WARP: 从离线人类演示中学习的全身重定向
专题命中 机器人操作 :manipulation(abstract);分类 cs.RO
AI总结 提出WARP离线管线,通过闭式肩-肘-腕几何求解器精确跟踪末端执行器并保持全身结构意图,实现从人类演示到机器人动作的零样本全身移动操作。
ORV:基于占用的4D机器人视频生成
机构 * Beijing Academy of Artificial Intelligence(北京人工智能研究院) ; IIIS, Tsinghua University(清华大学人工智能研究院) ; Shanghai Jiao Tong University(上海交通大学) ; Eastern Institute of Technology, Ningbo(宁波工程技术院) ; The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) ; S-Lab, Nanyang Technological University(南洋理工大学S实验室) ; ByteDance(字节跳动) ; Kling, Kuaishou Technology(Kling,快手科技) ; GigaAI ; AIR, Tsinghua University(清华大学人工智能研究院)
专题命中 机器人操作 :manipulation(abstract);分类 cs.CV
AI总结 ORV提出一种基于占用的4D机器人视频生成框架,通过结合动作先验与占用视觉先验,提升视频生成质量与可控性,实现多视角一致合成和仿真到现实的迁移。
Comments CVPR 2026. Project page: https://orangesodahub.github.io/ORV/ Code: https://github.com/OrangeSodahub/ORV
基于交互式笔画的神经SDF雕刻
专题命中 机器人操作 :manipulation(abstract);分类 cs.CV
AI总结 本文提出一种交互式笔画神经SDF雕刻框架,解决传统网格工具无法高效雕刻神经SDF的问题,实现直观、高性能的三维形状编辑。
Journal ref High-Performance Graphics - Symposium Papers, 2025
长视野多智能体大语言模型商业环境中涌现的对齐失效通信
专题命中 机器人操作 :manipulation(abstract);分类 cs.AI
AI总结 该研究在Vending-Bench Arena环境中发现,竞争多智能体LLM交易场景会涌现与操作稀缺性、对手行为相关的可测量对齐失效通信,且该现象不受模型能力排名直接影响。
VOLT: 面向超演示速度策略的视觉与语言轨迹分割
机构 * Collab , Dept. of Mechanical Engineering, Virginia Tech, Blacksburg, VA 24061(机械工程系,弗吉尼亚理工学院,布莱克斯堡,VA 24061) ; Mitsubishi Electric Research Laboratories ( MERL ), Cambridge, MA 02139(三菱电机研究实验室(MERL),剑桥,MA 02139)
专题命中 机器人操作 :manipulation(abstract);分类 cs.RO
AI总结 提出VOLT方法,通过视觉与语言线索对演示轨迹进行分割,选择性下采样安全加速部分,保留需要精细操作的慢速段,从而训练出比演示更快的机器人策略。
手稿中的隐藏提示利用AI辅助同行评审
机构 * Department of Psychology, Yonsei University(延世大学心理学系) ; Department of Psychology, University of Science and Technology of China(中国科学技术大学心理学系)
专题命中 机器人操作 :manipulation(abstract);分类 cs.AI
AI总结 研究探讨了手稿中隐藏指令对AI同行评审的影响,分析了提示注入技术及学术出版物政策的不一致,指出需加强技术筛查与政策协调。
Journal ref Communications of the ACM, 69(7), 53-56 (2026)
大型语言模型在规则应用中展现出概念掌握能力的证据
专题命中 机器人操作 :manipulation(abstract);分类 cs.AI
AI总结 本文通过两项心理学实验发现,Gemini Pro等部分LLMs在规则应用上展现类人表现,证实LLMs掌握规则概念,对法律决策与哲学探究有启示。
红队测试代理型红队
机构 * Cracken ; Information Protection Department, Lviv Polytechnic National University(利沃夫理工学院信息保护系)
专题命中 机器人操作 :manipulation(abstract);分类 cs.AI
AI总结 本文首次深入分析主流进攻性安全代理系统的安全漏洞,揭示其设计缺陷可导致API密钥泄露、持久化控制及宿主机失陷,并提出架构级缓解设计原则。
Comments v0.1
虚假朋友困境:信任与对话AI的政治经济学
专题命中 机器人操作 :manipulation(abstract);分类 cs.AI
AI总结 本文提出虚假朋友困境框架,探讨拟人化AI如何通过隐蔽手段影响用户自主权,分析其在信任与政治经济学中的作用。
Comments Manuscript under review
MusicLayout:用于可控文本生成音乐的显式结构规划
机构 * College of Artificial Intelligence, Zhejiang University(浙江大学人工智能学院) ; College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) ; Innovation Center of Yangtze River Delta, Zhejiang University(浙江大学长三角创新中心) ; The Chinese University of Hong Kong(香港中文大学) ; Shandong University(山东大学) ; Chu Kochen Honors College, Zhejiang University(浙江大学竺可桢学院) ; Ant Group(蚂蚁集团)
专题命中 机器人操作 :manipulation(abstract);分类 cs.AI
AI总结 针对文本生成音乐结构隐含难控的问题,提出MusicLayout显式中间表示,将其集成到统一自回归框架实现布局级控制,实验证实该方法可改进音乐长程结构组织并支持布局级控制。
响应性验证:预测会改变吗?改变多少?改变频率如何?
专题命中 机器人操作 :manipulation(abstract);分类 cs.LG
AI总结 本研究提出测量响应性的算法与交互模型框架,搭配统计保证,可用于检测累犯预测的排除情况、估计内容审核博弈成本、测试LLM基准鲁棒性,提升模型安全性与可靠性。
视网膜图像的算法统计学
专题命中 机器人操作 :manipulation(abstract);分类 cs.CV
AI总结 本文针对三维视网膜图像的分析问题,提出结合归一化压缩距离与各向异性结构增强滤波器的度量学习方法,其预测误差优于非度量深度学习方法,还提出归一化压缩向量用于可视化变化模式。
可变形手内滑移感知触觉传感器,集成速度、力/力矩和压力图传感
机构 * Chalmers University of Technology(查尔姆斯理工大学) ; Lund University(隆德大学)
专题命中 机器人操作 :manipulation(abstract);分类 cs.RO
AI总结 提出一种新型触觉传感器,通过可变形接触垫集成速度、力/力矩和压力图传感,实现手内操作的滑移感知控制,并支持快速低成本制造。
HindsightBench:用于时间索引语言模型决策任务中参数后见之明的黑盒行为审计协议
机构 * University College Dublin(都柏林大学学院)
专题命中 机器人操作 :manipulation(abstract);分类 cs.LG
AI总结 研究针对大语言模型在金融决策任务中泄露参数知识的问题,提出HindsightBench黑盒行为审计协议,通过特定矩阵、探测及指标分析参数后见之明,应用于多模型获三个主要模式,揭示模型特性及审计结果与服务的关系,还发布相关数据。
Comments 17 pages, 3 figures. Code, panel, and per-model audit rows: https://github.com/Khaozhe/hindsightbench (v1.0 release archived at doi:10.5281/zenodo.21453191)
FlashRT:用于引导智能体部署实时多模态应用的智能体框架
机构 * Carnegie Mellon University(卡内基梅隆大学) ; AMD(超威半导体公司) ; University at Buffalo(纽约州立大学水牛城分校)
专题命中 机器人操作 :world model(abstract);分类 cs.LG
AI总结 研究实时多模态应用部署难题,提出FlashRT智能体框架。通过新范式引导编码智能体多阶段转换,将参考实现转为高效部署,在不同GPU上显著提升性能,尤其在专家优化不成熟平台更具扩展性。
DiSCo:用于共享自主的扩散序列助手
机构 * University of California, Los Angeles(加州大学洛杉矶分校)
专题命中 机器人操作 :robotic(abstract);分类 cs.RO
AI总结 DiSCo通过扩散策略规划与用户动作一致的动作序列,提升复杂系统控制性能,适用于模拟驾驶和机械臂任务。
Comments 10 pages, 5 figures, HRI '26: Proceedings of the 21st ACM/IEEE International Conference on Human-Robot Interaction
Calib3R:基于三维基础模型的手眼标定与三维度量尺度场景重建
机构 * Department of Information Engineering (DEI) at the University of Padova(帕多瓦大学信息工程系)
专题命中 机器人操作 :manipulation(abstract);分类 cs.RO
AI总结 Calib3R是一种基于3D基础模型的无标定板方法,通过统一优化联合完成手眼标定与度量尺度三维重建,仅用不到10张图像即可实现精确标定,性能优于同类方法。
Tactile-WAM:具有触觉非对称注意力的触觉感知世界动作模型
机构 * Ant Group(蚂蚁集团) ; Zhejiang University(浙江大学) ; The University of Hong Kong(香港大学) ; Shenzhen Loop Area Institute(深圳河套学院) ; Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
专题命中 机器人操作 :manipulation(abstract);分类 cs.RO
AI总结 针对接触丰富操作中视觉预测不完整的问题,提出Tactile-WAM,通过触觉非对称注意力机制(TAAM)在保护视觉预测的同时利用触觉信息生成动作,整体成功率提升38.9%。
Comments Submitted to RSS2026 WorkShop Tactile for FM