arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-26 至 2026-08-26 共收录 44 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 2 篇

2608.23994 2026-08-26 cs.RO cs.HC 新提交 79%

Bridging Teacher Expectations and Robot Learning via Coupling Dynamics

通过耦合动力学弥合教师期望与机器人学习之间的差距

Evan Dallas, Sean Dallas, Wing-Yue Geoffrey Louie

机构 * Oakland University(奥克兰大学)

专题命中 机器人学习 :robot learning(title,abstract);分类 cs.RO

AI总结 本文提出一种基于耦合动力学的人机教学交互分类量表,应用于相关文献以探究耦合动力学与教师心智模型不匹配对教学有效性及人类感知的影响。

Comments 8 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23927 2026-08-26 cs.CV 新提交 57%

GlanceWAM: Sparse Test-Time Imagination for World-Action Models

GlanceWAM:面向世界-动作模型的稀疏测试时想象方法

Linhan Wang, Zijian An, Mingyuan Zhang, Chen Dai, Yi Xu, Can Cui, Zichong Yang, Yinlin Chen, Lifeng Zhou, Chang-Tien Lu

机构 * Virginia Tech(弗吉尼亚理工大学) Drexel University(卓克索大学) Northeastern University(东北大学) Purdue University(普渡大学)

专题命中 机器人学习 :robot learning(abstract);分类 cs.CV

AI总结 该研究提出GlanceWAM,通过异步解耦视频DiT的想象与控制,打破世界-动作模型的速度-成功率困境,在RoboCasa、LIBERO基准测试中表现优异,推理速度达48ms/块。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 14 篇

2608.24741 2026-08-26 cs.RO 新提交 88%

One-Shot Learning from Demonstration of Contact-Rich Robotic Manipulation by Identifying Physical Interactions

通过识别物理交互实现接触丰富的机器人操作的演示一次性学习

A. H. G. Overbeek, H. van der Kooij, M. Vlutters

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 该研究提出一种明确建模物理交互的机器人操作演示学习方法,仅用单次演示即可复现复杂接触型任务,提升了对环境几何变化的鲁棒性、泛化性与在线自适应能力,填补了可解释少样本LfD的空白。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24111 2026-08-26 cs.RO 新提交 88%

Trajectory-Level Continuous Action Representation for Robotic Manipulation

面向机器人操作的轨迹级连续动作表示

Tong Yang, Jingkai Jia, Yuecheng Xu, Xueyao Chen, Chi Zhang, Wenqiang Zhang

机构 * Fudan University(复旦大学) TeleAI, China Telecom(中国电信TeleAI)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 该研究提出CAT轨迹级连续动作表示框架,通过频率感知位置编码等技术解决现有视觉运动系统的动作表示冗余问题,在LIBERO等数据集上显著提升机器人操作任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24242 2026-08-26 cs.RO 新提交 86%

A Durable Vision-Based Tactile Fingertip for Robotic Manipulation

用于机器人操作的耐用型基于视觉的触觉指尖

F. Richard Cottrell, Megha H. Tippur, Edward H. Adelson

机构 * MIT CSAIL(麻省理工学院计算机科学与人工智能实验室)

专题命中 机器人操作 :robotic(title,abstract);manipulation(title);分类 cs.RO

AI总结 本研究开发了一种耐用型基于视觉的触觉指尖,其耐用性较商用传感器提升两个数量级以上,可通过更换传感模块实现高要求机器人应用中的可维护触觉传感。

Comments 22 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24572 2026-08-26 cs.RO 新提交 83%

Fiber Optic Sensing Glove for High Performance Dexterous Manipulation Capture

用于高性能灵巧操作捕捉的光纤传感手套

J.D. Peiffer, Taylor Niehues, Li Guan, Ziyi Kou, Ergys Ristani

机构 * Meta Northwestern University(西北大学)

专题命中 机器人操作 :manipulation(title,abstract);robotics(abstract);分类 cs.RO

AI总结 该研究针对现有手部姿势捕捉技术的缺陷,开发了光纤传感手套,通过多芯形状传感光纤与逆运动学求解器实现60Hz全手部姿势跟踪,在5名受试者的2小时数据集上指尖位置平均误差达7.2mm,经校准后降至4.9mm,可用于高保真数据捕捉与双手虚拟遥操作,助力机器人领域发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24535 2026-08-26 cs.CV cs.HC 新提交 79%

VizAnchor: Decoding Manipulation Intent from Tampering Visualizations via Dual-Anchor Reasoning

VizAnchor:通过双锚推理从篡改可视化中解码操纵意图

Xiaotian Zhang, Huayuan Ye, Haiyang Zhang, Chenhui Li, Changbo Wang, Sicheng Song

机构 * School of Data Science and Engineering, East China Normal University(华东师范大学数据科学与工程学院) Division of Emerging Interdisciplinary Areas, The Hong Kong University of Science and Technology(香港科技大学新兴跨学科领域分部) School of Computer Science and Technology, East China Normal University(华东师范大学计算机科学与技术学院)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.CV

AI总结 本文提出VizAnchor框架,通过双锚构建与VLM推理实现可视化操纵理解,含三个专用智能体,构建相关数据集,可准确定位篡改并生成忠实解释。

Comments 39 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24062 2026-08-26 econ.TH 新提交 78%

Rating Manipulation: Credibility Inversion and Audit Leakage

评分操纵:可信度倒置与审计泄漏

Van-Quy Nguyen

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 该研究针对在线评分操纵问题,构建含低质量卖家、买家与平台的模型,发现评分可信度可倒置、针对性执法会转移虚假评论,提出买家导向排名需考虑评分传达信息。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24714 2026-08-26 cs.RO 新提交 70%

GaussianWAM: Distilling Geometry and Semantics from 3D Gaussian Fields into World-Action Models

GaussianWAM:将三维高斯场的几何与语义知识蒸馏至世界-动作模型

Zijian Zhang, Yuqing Jiang, Weitao Zhou, Minglei Li, Jinhao Zhang, Yao Mu, Xiaofan Li, Hao Zhao, Haibao Yu

机构 * Tuojing Intelligence(拓境智能) University of Chinese Academy of Sciences(中国科学院大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Tsinghua University(清华大学) Simple AI(简智人工智能) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院) The University of Hong Kong(香港大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 GaussianWAM是训练时的表征增强框架,通过三维高斯场蒸馏几何与语义监督,在LIBERO-Plus等任务上显著提升了WAM类模型的机器人操作性能,且不改变部署架构。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24162 2026-08-26 cs.RO 新提交 70%

Robust Slip Detection and Material Classification via Spatiotemporal Transformers on a Uniformly-Illuminated Visuo-Tactile Sensor

基于均匀照明视觉-触觉传感器的时空Transformer的鲁棒滑移检测与材料分类

Ziyang Ma, Yuhao Sun, Zichen Ai, Xiangyang Ji, Bin Fang

机构 * School of Artificial Intelligence, Beijing University of Posts and Telecommunications(北京邮电大学人工智能学院)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本研究开发了带均匀RGB照明的视觉-触觉传感器与统一感知框架,采用双头部TimeSformer网络和ResNet-50主干,实现高精度滑移检测与物体分类,为机器人操作提供多模态感知基线。

Comments Accepted at IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026. 8 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23863 2026-08-26 cs.RO 新提交 70%

DreamLedger: Execution-Settled Credit Files for World-Model Imagination in Robot Decision Loops

DreamLedger:机器人决策回路中用于世界模型想象的执行结算信用文件

Xianyao Li, Ruitong Tian, Rui Min, Fang Xu, Jing Du

机构 * University of Florida(佛罗里达大学)

专题命中 机器人操作 :manipulation(abstract);navigation(abstract);分类 cs.RO

AI总结 该研究提出DreamLedger执行结算信用文件,管控机器人世界模型预测的消耗,在多模拟域和真实机械臂上验证,可减少无效想象、降低验证探测次数,适用于多模型与硬件场景。

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23629 2026-08-26 cs.RO cs.AI 新提交 62%

Macro-Operator Generation and Predicate Selection for TAMP Operator Learning

TAMP算子学习的宏算子生成与谓词选择

Can Emir Bora, Emre Ugur

机构 * Bogazici University(博加齐奇大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.AI

AI总结 本文针对TAMP算子学习的效率问题,提出自动生成宏算子并剪枝未被引用谓词的系统,在四个TAMP领域实现最高4.6倍规划加速,还解决了基线无法处理的长序列任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23983 2026-08-26 cs.RO 新提交 57%

Sensorless damage-safe grasping

无传感器的防损伤抓取

Yusei Shuto, Danilo Vasconcellos Vargas

机构 * Kyushu University(九州大学)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 本文提出一种无传感器的防损伤抓取控制器,仅用编码器位置和电机出力信号,通过限定压缩应变ε实现防损伤,在仿真和实物测试中均优于固定力基线,大幅降低软物体损伤。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23952 2026-08-26 cs.CR cs.AI 新提交 57%

STAIN-FL: Stealthy Targeted Attack Injection with Contextual Triggers in Federated Learning

STAIN-FL:联邦学习中基于上下文触发器的隐蔽定向攻击注入

Ashlinder Kaur, Purnima Murali Mohan, Zengxiang Li, Tram Truong-Huu

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本文提出STAIN-FL框架,利用自然监控场景作为上下文触发器,在联邦视频异常检测中实现隐蔽定向后门攻击,稀疏攻击兼具低检测率与高持续性,可在保持低干净准确率下降的同时达成较高后门准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23906 2026-08-26 cs.AI 新提交 57%

Quantifying System-Level Harms from AI Adoption in Complex Sociotechnical Systems

量化复杂社会技术系统中采用AI带来的系统层面危害

Paul Vautravers, Oliver Chalkley, Gabriel Downer, Kate S, Damian Ruck

机构 * Advai Ltd(Advai有限公司) UK National Cyber Security Centre(英国国家网络安全中心)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 该研究提出结合STPA等的框架,以RTGS为案例量化复杂社会技术系统中AI的系统层面危害,发现AI采用会降低金融系统韧性、增加银行倒闭风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23835 2026-08-26 cs.LG cs.SI 新提交 57%

Generating Intervention Hypotheses using Explainable Explanations on Graphs: G2I, a Two-Stage Greedy Framework

基于图的可解释解释生成干预假设:G2I,一个两阶段贪心框架

Mulin Tian, Ajitesh Srivastava

机构 * University of Southern California(南加州大学) Northeastern University(东北大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 该研究提出两阶段贪心框架G2I,将反事实解释转化为干预设计问题,在节点层面生成可操作反事实、网络层面解决预算约束下的DNF覆盖问题,实验显示其干预策略效率优于掩码方法。

Comments 11 pages, 3 figures. Accepted at the 35th ACM International Conference on Information and Knowledge Management (CIKM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 4 篇

2608.24618 2026-08-26 cs.RO 新提交 86%

VIP: Variation-based Iterative-learning Planning for Robotic Navigation

VIP:面向机器人导航的基于变分的迭代学习规划

Shuli Lv, Pengda Mao, Chen Min, Li Hong, Runxiao Liu, Shuai Wang, Quan Quan

机构 * School of Automation Science and Electrical Engineering, Beihang University(北京航空航天大学自动化科学与电气工程学院) Tianmushan Laboratory, Beihang University(北京航空航天大学天目山实验室)

专题命中 具身导航 :robotic(title,abstract);navigation(title);分类 cs.RO

AI总结 该研究针对机器人导航规划的计算成本问题,提出VIP框架,通过变分迭代学习优化规划命令,在单/多机器人场景中高效生成并改进运动规划,兼具有效性与可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24764 2026-08-26 cs.AI 新提交 79%

Evidence Blindness in Direct Corpus Interaction: Persistent Navigation with AtlasNav

直接语料库交互中的证据失明:基于AtlasNav的持久导航

Hongyu Guo, Zhiyu Zheng, Zhao Cao

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 针对直接语料库交互中存在的证据失明问题,提出AtlasNav框架,通过一次性构建语料库图谱实现自适应导航,在BrowseComp-Plus等数据集上提升了准确率并降低了推理成本。

Comments 27 pages, 7 figures. Code, data, and trajectories will be released

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24155 2026-08-26 cs.RO 新提交 79%

Coverage Planning for Robotic Tooth Preparation in Densely Constrained Environments

密集受限环境下机器人牙齿预备的覆盖规划

Yunwen Li, Chen Chen, Xiangjie Yan, Chang Shu, Jianxia Hou, Shiji Song, Xiang Li

机构 * Tsinghua University(清华大学) ETH Zürich(苏黎世联邦理工学院) Tsingscribe Medical Ltd.(清scribe医疗有限公司) Peking University School and Hospital of Stomatology(北京大学口腔医学院) Beijing National Research Center for Information Science and Technology(北京信息科学与技术国家研究中心)

专题命中 具身导航 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出一种用于自主全冠牙齿预备的机器人系统,通过感知解剖结构的刀具路径规划算法和面向间隙的末端执行器偏航角分配策略,实现精准牙面铣削,平均几何偏差0.117mm,经仿真和头模实验验证其可行性与有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23836 2026-08-26 cs.CV cs.AI cs.LG 新提交 67%

Predicting Radiologist Expertise from 3D Gaze Patterns During CT Interpretation

从CT阅片时的三维注视模式预测放射科医生的专业水平

Leila Khaertdinova, Anna Anikina, Claudia Mello-Thoms, Bulat Ibragimov

机构 * University of Copenhagen(哥本哈根大学) University of Iowa(爱荷华大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 该研究提出基于注视信息的Transformer框架,利用放射科医生CT阅片的三维注视模式,在182次阅片会话数据上实现0.91的ROC-AUC和0.86的F1分数,可客观评估放射科医生专业水平。

Comments Accepted at MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 具身推理 7 篇

2608.24885 2026-08-26 cs.RO cs.CV 新提交 87%

Do Robotic World Models Really Follow Actions? Diagnosing and Aligning Action-Conditioned Generation for Policy Learning

机器人世界模型真的会遵循动作吗?面向策略学习的动作条件生成诊断与对齐

Sixiang Chen, Jiaming Liu, Jixian Wu, Yichen Guo, Tinghao Wang, Siyuan Qian, Hao Chen, Jiajun Cao, Jian Tang, Shanghang Zhang

机构 * Peking University(北京大学) Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心) New York University(纽约大学) University of Electronic Science and Technology of China(电子科技大学) Nanyang Technological University(南洋理工大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 具身推理 :world model(title,abstract);robotic(title);分类 cs.RO、cs.CV

AI总结 本文针对动作条件世界模型的动作遵循问题,提出WorldEcho诊断工具与WorldSync改进方法,经实验验证WorldSync可提升动作遵循性能,作为可靠模拟器助力策略改进并提高任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24680 2026-08-26 cs.CV 新提交 81%

Game2World Engine: Unlocking In-the-Wild Gameplay Videos for World Model Training

Game2World引擎:解锁野外游戏视频用于世界模型训练

Wenxuan Shen, Dongna Jin, Dongping Chen

专题命中 具身推理 :world model(title,abstract);分类 cs.CV;robotics(comments)

AI总结 针对游戏视频界面干扰世界模型训练的问题,提出GameUI-Taxonomy与G2WEngine框架构建Game2World数据集,研发无掩码UI去除模型GameCleaner,提升了世界模型训练效果与UI去除性能。

Comments We are currently building Gaming World Model and data engine that transfers game dynamics to robotics. Feel free to contact Dongping Chen (dongpingchen0612@gmail.com) if you are interested in research collaboration or financial support

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24855 2026-08-26 cs.CV 新提交 79%

LeFlow: Generative Latent Flow Planning for World Models

LeFlow:面向世界模型的生成式潜在流规划

Hsiang-Wei Huang, Jianxu Shangguan, Junbin Lu, Jenq-Neng Hwang

机构 * University of Washington(华盛顿大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 本研究提出LeFlow,它从世界模型学习可复用潜在轨迹先验,将规划转为条件潜在轨迹生成,在四个目标条件像素控制基准中提升规划成功率并大幅减少规划时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23720 2026-08-26 cs.CV 新提交 79%

Platonic Representation Hypothesis on World Models

世界模型的柏拉图式表征假说

Wenhow Li (1), Chengwei MA (1), Hui Xiong (1), Ying-Cong Chen (1), Lei Zhang (1) ((1) The Hong Kong University of Science and Technology (Guangzhou), Guangzhou, China)

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 该研究针对世界模型的表征性质,提出预测一致性假设,通过DINO-WM实验发现性能良好的世界模型会形成几何相似的内部结构,且模型特征可跨模型映射,证实预测一致性能促进共享潜在结构的形成。

Comments 18 pages, 10 figures, 2 tables. Wenhow Li and Chengwei MA contributed equally. Project page: this https URL (https://sellerbubble.github.io/platonic-representation-hypothesis-on-world-models/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24044 2026-08-26 cs.LG 新提交 57%

XP-JEPA: Cross-Predictive Physics Grounding for Forecastable Latent Dynamics

XP-JEPA:用于可预测潜在动力学的交叉预测物理基础

Kehan Wen, Ziming Li, Siyuan Luo, Fan Shi

专题命中 具身推理 :world model(abstract);分类 cs.LG

AI总结 XP-JEPA通过将视觉与物理表征交叉预测,提升了潜在动力学的可预测性,在多任务套件上降低了展开漂移并提高了控制成功率,无需特权输入即可实现更优的基于展开的控制性能。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23790 2026-08-26 cs.CV q-bio.NC 新提交 57%

Primate vision reveals a missing principle for robust dynamic AI

灵长类视觉揭示了鲁棒动态人工智能缺失的原理

Matteo Dunnhofer, Christian Micheloni, Kohitij Kar

专题命中 具身推理 :world model(abstract);分类 cs.CV

AI总结 该研究对比人类与猕猴视觉及相关神经网络,发现预测世界模型兼具跨外观泛化与高神经保真度,提出将运动逐步整合到物体表征是鲁棒动态视觉的关键原理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23706 2026-08-26 cs.AI 新提交 57%

Do LLMs Understand Limit Order Book Dynamics?

大型语言模型(LLM)是否理解限价订单簿(LOB)动态?

Junxiao Chen, Paul Glasserman

机构 * Columbia Business School(哥伦比亚商学院)

专题命中 具身推理 :world model(abstract);分类 cs.AI

AI总结 本研究测试基于LOB数据训练的LLM,发现其隐式世界模型未掌握LOB状态,导致预测有偏且存在虚假可预测性,为此将相关测试扩展至LOB的随机动态环境。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 模仿学习与强化学习 2 篇

2608.23831 2026-08-26 cs.RO cs.LG 新提交 62%

Learning to Act While Waiting: RL Finetuning of Generalist Robot Policies Under Inference Latency

等待时学习行动:考虑推理延迟的通用机器人策略的强化学习微调

Brian Zhu (1), Momen Khalil (1), E Harrison (2), Emanuele Poggi (1), Philipp Schmitt (1), Bernd Kast (1), Philine Meister (1), Pranav Atreya (2), Qiyang Li (2), Finn Ferchau (1), Cesar Colmenero (1), Yash Shahapurkar (1), Gokul Narayanan (1), Melih Erdogan (1), Kai Wurm (1), Georg von Wichert (1), Oier Mees (3 and 4 and 2), Eugen Solowjow (1), Andrew Wagenmaker (2), Sergey Levine (2) ((1) Siemens (2) UC Berkeley (3) Microsoft (4) ETH Zurich)

机构 * Siemens(西门子) UC Berkeley(加州大学伯克利分校) Microsoft(微软) ETH Zurich(苏黎世联邦理工学院)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.LG

AI总结 本研究针对通用机器人策略因推理延迟破坏马尔可夫假设导致标准RL失效的问题,提出ARLI框架,通过状态增强等设计实现延迟下的RL微调,在模拟及真实任务中表现优异。

Comments 25 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24479 2026-08-26 cs.LG 新提交 57%

WarpSAC: Towards the Pinnacle of Scalable Off-policy RL by Rethinking Exploration and Exploitation

WarpSAC:通过重新思考探索与利用,迈向可拓展离线强化学习的顶峰

Zihao Wu, Hongyao Tang, Yi Ma, Huizhong Song, Pengyi Li, Yifu Yuan, Fei Ni, Jinyi Liu, Wei Wei, Jianrong Wang, Yan Zheng, Jianye Hao

机构 * Tianjin University(天津大学) Shanxi University(山西大学) Imperial College London(伦敦帝国学院)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.LG

AI总结 该研究针对大规模并行模拟下离线RL的数据 regime 变化问题,提出具 regime 感知的WarpSAC算法家族,适配不同数据规模场景,在多基准任务及现实部署上较FlashSAC实现显著性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 人机交互与遥操作 1 篇

2608.24043 2026-08-26 cs.CV 新提交 57%

ConsensusTAS: Self-Supervised Temporal Action Segmentation for Long-Horizon Construction Videos

ConsensusTAS:面向长时程施工视频的自监督时序动作分割

Xiaoshan Zhou, Yafei Sun

机构 * School of Project Management, University of Sydney(悉尼大学项目管理学院) School of Civil and Environmental Engineering, University of New South Wales(新南威尔士大学土木与环境工程学院)

专题命中 人机交互与遥操作 :robotic(abstract);分类 cs.CV

AI总结 本研究提出自监督时序动作分割模型ConsensusTAS,无需标注且可在CPU运行,在公开数据集及真实施工视频上的性能优于现有最优方法,可用于人机协同与视频监控。

详情

展开后加载摘要…

URL PDF HTML 收藏