arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 8666 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 8666 篇

2512.09056 2026-04-14 cs.CV 57%

ConceptPose: Training-Free Zero-Shot Object Pose Estimation using Concept Vectors

ConceptPose:基于概念向量的无训练零样本物体姿态估计

Liming Kuang, Yordanka Velikova, Mahdi Saleh, Jan-Nico Zaech, Danda Pani Paudel, Benjamin Busam

机构 * Technical University of Munich(慕尼黑工业大学) Munich Center for Machine Learning(慕尼黑机器学习中心)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 ConceptPose利用视觉语言模型生成开放词汇3D概念图,通过建立概念图间的3D-3D对应关系,实现无训练的零样本物体姿态估计,优于现有最佳基线62%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10058 2026-04-14 cs.RO cs.CG 57%

A Ray Intersection Algorithm for Fast Growth Distance Computation Between Convex Sets

用于凸集之间快速生长距离计算的射线相交算法

Akshay Thirugnanam, Koushil Sreenath

机构 * UC Berkeley(加州大学伯克利分校)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本文提出一种高效算法,通过迭代构造Minkowski差集的内外多面体近似,计算凸集之间的生长距离,该算法在运动规划和刚体模拟中具有广泛应用。

Comments 14 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09996 2026-04-14 cs.CV 57%

A Comparative Study of Modern Object Detectors for Robust Apple Detection in Orchard Imagery

现代目标检测器在果园图像中稳健苹果检测的比较研究

Mohammed Asad, Ajai Kumar Gautam, Priyanshu Dhiman, Rishi Raj Prajapati

机构 * Affiliation omitted for double-blind review

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 本文比较了六个现代目标检测器在苹果检测中的性能,发现YOLO11n在严格定位性能上表现最佳,同时分析了不同检测器在阈值鲁棒性和下游任务需求上的差异。

Comments Accepted at ICICV 2026; 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09746 2026-04-14 cs.MA cs.AI cs.CL 57%

CONSCIENTIA: Can LLM Agents Learn to Strategize? Emergent Deception and Trust in a Multi-Agent NYC Simulation

CONSCIENTIA:LLM代理能否学会策略性行为?多智能体纽约市模拟中的涌现欺骗与信任

Aarush Sinha, Arion Das, Soumyadeep Nag, Charan Karnati, Shravani Nag, Chandra Vadhan Raj, Aman Chadha, Vinija Jain, Suranjana Trivedy, Amitava Das

机构 * University of Copenhagen(哥本哈根大学) IIIT Ranchi(印度信息技术学院兰契分校) ISI Kolkata(印度统计学院加尔各答分校) NIT Andhra Pradesh(印度国家理工学院安得拉邦分校) IGDTUW(英迪拉·甘地德里技术女子大学) IIT Kharagpur(印度理工学院卡哈拉格普尔分校) Google DeepMind(谷歌DeepMind) Google(谷歌) AI Institute, University of South Carolina(南卡罗来纳大学人工智能研究所)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI

AI总结 研究通过多智能体模拟探讨LLM在对抗性环境中的策略行为,发现智能体在导航中表现出有限的策略性,包括选择性信任与欺骗,但易受对抗性说服影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09649 2026-04-14 cs.HC cs.AI eess.SP 57%

WearBCI Dataset: Understanding and Benchmarking Real-World Wearable Brain-Computer Interfaces Signals

WearBCI 数据集:理解和评估真实世界可穿戴脑机接口信号

Haoxian Liu, Hengle Jiang, Lanxuan Hong, Xiaomin Ouyang

机构 * Hong Kong University of Science and Technology(香港科技大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI

AI总结 本文提出WearBCI数据集,通过同步多模态记录和系统性评估,研究运动伪影对可穿戴BCI信号的影响,并探索跨模态信号增强和多维行为理解的新应用。

Comments Accepted by Sensys 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09578 2026-04-14 cs.AI 57%

Explainable Planning for Hybrid Systems

混合系统的可解释规划

Mir Md Sajid Sarwar

机构 * School of Mathematical and Computational Sciences, Indian Association for the Cultivation of Science, Kolkata(印度科学培育协会数学与计算科学学院,加尔各答)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.AI

AI总结 研究针对混合系统中的可解释人工智能规划,探讨生成AI系统解释的方法,以应对自动化规划在复杂安全领域中的应用需求。

Comments PhD thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18976 2026-04-14 cs.CV cs.HC 57%

Ninja Codes: Neurally Generated Fiducial Markers for Stealthy 6-DoF Tracking

Ninja Codes: 由神经生成的隐匿式六自由度跟踪标记

Yuichiro Takeuchi, Yusuke Imoto, Shunya Kato

机构 * Osaka University(大阪大学) Kyoto University(京都大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 本文提出Ninja Codes,一种由神经网络生成的隐匿式标记,能自然融入真实环境,通过编码网络将任意图像转换为标记,用于机器人和增强现实等领域的隐匿六自由度跟踪。

Comments CVPR 2026 Findings; Project page: https://sento.net/research/ninjacodes

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09352 2026-04-13 cs.CV 57%

LuMon: A Comprehensive Benchmark and Development Suite with Novel Datasets for Lunar Monocular Depth Estimation

LuMon:用于月球单目深度估计的综合基准和开发套件及其新数据集

Aytaç Sekmen, Fatih Emre Gunes, Furkan Horoz, Hüseyin Umut Işık, Mehmet Alp Ozaydin, Onur Altay Topaloglu, Şahin Umutcan Üstündaş, Yurdasen Alp Yeni, Halil Ersin Soken, Erol Sahin, Ramazan Gokberk Cinbis, Sinan Kalkan

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.CV

AI总结 本文提出LuMon基准,通过新数据集评估月球单目深度估计方法,分析了领域迁移差距并建立仿真到现实的适应基线。

Comments This paper will be published in CVPRW2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08987 2026-04-13 cs.AI 57%

PilotBench: A Benchmark for General Aviation Agents with Safety Constraints

PilotBench:一个具有安全约束的一般航空智能体基准

Yalun Wu, Haotian Liu, Zhoujun Li, Boyang Wang

机构 * School of Computing National University of Singapore China School of Informatics Xiamen University China CESS Beihang University China

专题命中 机器人数据与评测 :embodied AI(abstract);分类 cs.AI

AI总结 PilotBench通过对比LLM与传统预报器,评估飞行轨迹和姿态预测,揭示了传统方法在精度上的优势与LLM在指令遵循上的优势,指出LLM在高负荷阶段表现下降,推动混合架构的发展。

Comments Accepted at the 2026 IEEE International Joint Conference on Neural Networks (IJCNN 2026). 6 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19704 2026-04-13 cs.CV 57%

RADSeg: Unleashing Parameter and Compute Efficient Zero-Shot Open-Vocabulary Segmentation Using Agglomerative Models

RADSeg: 通过凝聚模型提升参数和计算效率的零样本开放词汇分割

Omar Alama, Darshil Jariwala, Avigyan Bhattacharya, Seungchan Kim, Wenshan Wang, Sebastian Scherer

机构 * Carnegie Mellon University(卡内基梅隆大学) IIIT Hyderabad(海得拉巴国际信息技术学院)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 RADSeg利用凝聚视觉基础模型RADIO,同时提升mIoU、延迟和参数效率,实现更高效的零样本开放词汇分割。

Comments Accepted to CVPR'26 Findings Code at https://radseg-ovss.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08455 2026-04-10 cs.AI 57%

KnowU-Bench: Towards Interactive, Proactive, and Personalized Mobile Agent Evaluation

KnowU-Bench: 向交互式、主动式和个性化移动代理评估迈进

Tongbo Chen, Zhengxi Lu, Zhan Xu, Guocheng Shao, Shaohan Zhao, Fei Tang, Yong Du, Kaitao Song, Yizhou Liu, Yuchen Yan, Wenqi Zhang, Xu Tan, Weiming Lu, Jun Xiao, Yueting Zhuang, Yongliang Shen

机构 * Zhejiang University(浙江大学) Apple(苹果公司) Tencent(腾讯)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI

AI总结 KnowU-Bench通过Android仿真环境评估个性化移动代理,涵盖42个通用GUI任务、86个个性化任务和64个主动任务,验证代理在交互中获取用户偏好和主动干预的能力,发现前沿模型在模糊指令下表现下降,揭示偏好获取和干预校准的关键瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08184 2026-04-10 cs.SD cs.AI 57%

AT-ADD: All-Type Audio Deepfake Detection Challenge Evaluation Plan

AT-ADD:所有类型音频深度伪造检测挑战评估计划

Yuankun Xie, Haonan Cheng, Jiayi Zhou, Xiaoxuan Guo, Tao Wang, Jian Liu, Weiqiang Wang, Ruibo Fu, Xiaopeng Wang, Hengyan Huang, Xiaoying Huang, Long Ye, Guangtao Zhai

机构 * Communication University of China(中国传媒大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Beijing Institute of Technology(北京理工大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 针对现有音频深度伪造检测方法在鲁棒性和泛化能力上的不足,AT-ADD挑战旨在通过标准化数据集和评估协议提升音频伪造检测的实用性和鲁棒性。

Comments Accepted to the ACM Multimedia 2026 Grand Challenge

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07901 2026-04-10 cs.CV 57%

PanoSAM2: Lightweight Distortion- and Memory-aware Adaptions of SAM2 for 360 Video Object Segmentation

PanoSAM2:轻量级的失真和内存感知的SAM2改进用于360视频对象分割

Dingwen Xiao, Weiming Zhang, Shiqi Wen, Lin Wang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Nanyang Technological University(南洋理工大学)

专题命中 机器人数据与评测 :embodied AI(abstract);分类 cs.CV

AI总结 本文提出PanoSAM2,通过改进SAM2以应对360视频中的失真和内存问题,提升分割可靠性,同时保持用户友好的提示设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07882 2026-04-10 cs.CV 57%

ReconPhys: Reconstruct Appearance and Physical Attributes from Single Video

ReconPhys:从单个视频中重建外观和物理属性

Boyuan Wang, Xiaofeng Wang, Yongkang Li, Zheng Zhu, Yifan Chang, Angen Ye, Guosheng Zhao, Chaojun Ni, Guan Huang, Yijie Ren, Yueqi Duan, Xingang Wang

机构 * GigaAI Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Tsinghua University(清华大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 本文提出ReconPhys,首个能从单目视频联合学习物理属性估计和3D高斯点云重建的端到端框架,实现快速高效的目标检测与生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07759 2026-04-10 cs.CV 57%

WUTDet: A 100K-Scale Ship Detection Dataset and Benchmarks with Dense Small Objects

WUTDet: 一艘船检测数据集和基准测试,包含10万尺度的密集小物体

Junxiong Liang, Mengwei Bao, Tianxiang Wang, Xinggang Wang, An-An Liu, Ryan Wen Liu

机构 * School of Navigation, Wuhan University of Technology(武汉理工大学航运学院) Sanya Science and Education Innovation Park, Wuhan University of Technology(武汉理工大学三亚科教创新园) School of Electronic Information and Communications, Huazhong University of Science and Technology(华中科技大学电子信息与通信学院) School of Electrical and Information Engineering, Tianjin University(天津大学电气与信息工程学院)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.CV

AI总结 本文提出WUTDet数据集,包含10万张图像和38万艘船实例,涵盖港口、锚地等多种场景,评估了20种基线模型,发现Transformer在复杂海上场景中表现更优,CNN在推理效率上更胜一筹,Mamba在准确性和效率之间取得良好平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07574 2026-04-10 cs.CV cs.NA math.NA 57%

Mathematical Analysis of Image Matching Techniques

图像匹配技术的数学分析

Oleh Samoilenko

机构 * Institute of Mathematics, National Academy of Sciences of Ukraine(乌克兰国家科学院数学研究所)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 本文分析了经典局部特征图像匹配算法在卫星图像中的表现,评估SIFT和ORB在关键点检测、描述子匹配及几何验证中的性能,探讨关键点数量对匹配质量的影响。

Comments 16 pages, 5 figures, 1 table

Journal ref Proceedings of the Institute of Applied Mathematics and Mechanics NAS of Ukraine, 39 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06505 2026-04-09 cs.CL cs.AI 57%

MedConclusion: A Benchmark for Biomedical Conclusion Generation from Structured Abstracts

MedConclusion:一个用于从结构化摘要中生成生物医学结论的基准数据集

Weiyue Li, Ruizhi Qian, Yi Li, Yongce Li, Yunfan Long, Jiahui Cai, Yan Luo, Mengyu Wang

机构 * Harvard AI and Robotics Lab, Harvard Medical School(哈佛大学医学院哈佛人工智能与机器人实验室) University of Southern California(南加州大学) Carnegie Mellon University(卡内基梅隆大学) Stanford University(斯坦福大学) Kempner Institute for the Study of Natural and Artificial Intelligence, Harvard University(哈佛大学肯普纳自然与人工智能研究所)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.AI

AI总结 本文提出MedConclusion数据集,包含570万篇PubMed结构化摘要,用于生物医学结论生成。通过配对摘要非结论部分与原始结论,提供证据到结论推理的自然监督。数据集还包含期刊级元数据,支持跨生物医学领域的子组分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04911 2026-04-09 cs.CV 57%

SpatialEdit: Benchmarking Fine-Grained Image Spatial Editing

SpatialEdit:细粒度图像空间编辑基准测试

Yicheng Xiao, Wenhu Zhang, Lin Song, Yukang Chen, Wenbo Li, Nan Jiang, Tianhe Ren, Haokun Lin, Wei Huang, Haoyang Huang, Xiu Li, Nan Duan, Xiaojuan Qi

机构 * The University of Hong Kong(香港大学) JD Explore Academy(京东探索研究院) Tsinghua University(清华大学) The Hong Kong University of Science and Technology(香港科技大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.CV

AI总结 本文提出SpatialEdit-Bench基准测试,结合视角重建和框架分析评估空间编辑的感知合理性和几何精度,并构建了SpatialEdit-500k合成数据集和SpatialEdit-16B基线模型,实现细粒度空间编辑的高效训练与评估。

Comments Code: https://github.com/EasonXiao-888/SpatialEdit

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18100 2026-04-09 cs.CV 57%

Spatial-Conditioned Reasoning in Long-Egocentric Videos

长时自体视频中的空间条件推理

James Tribble, Hao Wang, Si-En Hong, Chaoyi Zhou, Ashish Bastola, Siyu Huang, Abolfazl Razi

机构 * Clemson University(克莱姆森大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.CV

AI总结 本文研究了在不修改模型架构的情况下,显式空间信号如何影响基于VLM的视频理解,通过引入Sanpo-D数据集和评估多个VLM在导航导向的空间查询上的表现,发现深度感知和空间化表示能提升安全关键任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2008.01574 2026-04-09 cs.CV 57%

A Robust 3D Registration Method via Simultaneous Inlier Identification and Model Estimation

一种通过同时识别内点和模型估计的鲁棒3D配准方法

Xianyun Qian, Fei Wen, Peilin Liu

机构 * School of Information Science and Electronic Engineering / School of Integrated Circuits, Shanghai Jiao Tong University(上海交通大学电子信息与电气工程学院/集成电路学院)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 本文提出了一种基于截断损失的鲁棒3D配准方法,通过同时识别内点和模型估计,降低拟合残差,采用交替最小化算法和半正定松弛方法提升鲁棒性,实验显示在高噪声和多异常情况下性能优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02779 2026-04-08 cs.RO 57%

Vision-Based End-to-End Learning for UAV Traversal of Irregular Gaps via Differentiable Simulation

基于视觉的端到端学习:通过可微模拟实现无人机穿越不规则缝隙

Linzuo Zhang, Yu Hu, Feng Yu, Yang Deng, Wenxian Yu, Danping Zou

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO

AI总结 本文提出一种纯视觉端到端框架,通过可微模拟实现无人机在未知环境中穿越复杂不规则缝隙,采用SE(3)空间、停止梯度操作和双模初始化分布提升稳定性,结合辅助预测模块增强导航连续性和安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05780 2026-04-08 cs.CV 57%

Sparsity-Aware Voxel Attention and Foreground Modulation for 3D Semantic Scene Completion

稀疏感知体素注意力与前景调节用于3D语义场景补全

Yu Xue, Longjun Gao, Yuanqi Su, HaoAng Lu, Xiaoning Zhang

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 本文提出VoxSAMNet,通过稀疏感知和语义引导设计,解决单目语义场景补全中体素分布不平衡和泛化能力差的问题,实现更高效准确的3D场景补全。

Comments Accepted at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05475 2026-04-08 cs.CV 57%

A Synthetic Eye Movement Dataset for Script Reading Detection: Real Trajectory Replay on a 3D Simulator

用于脚本阅读检测的合成眼动数据集:在3D模拟器上的真实轨迹回放

Kidus Zewde, Yuchen Zhou, Dennis Ng, Neo Tiangratanakul, Tommy Duong, Ankit Raj, Yuxin Zhang, Xingyu Shen, Simiao Ren

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 本文提出一种生成合成眼动视频的 pipeline,通过回放真实人类虹膜轨迹生成12小时的合成数据,用于脚本阅读检测任务,验证了生成轨迹在时间动态上的有效性。

Comments Synthetic eye movement dataset generation via 3D eye simulator; iris trajectory replay; script reading detection; behavioral data augmentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05015 2026-04-08 cs.CV 57%

Video-MME-v2: Towards the Next Stage in Benchmarks for Comprehensive Video Understanding

Video-MME-v2:迈向综合视频理解基准的下一阶段

Chaoyou Fu, Haozhi Yuan, Yuhao Dong, Yi-Fan Zhang, Yunhang Shen, Xiaoxing Hu, Xueying Li, Jinsen Su, Chengwu Long, Xiaoyao Xie, Yongkang Xie, Xiawu Zheng, Xue Yang, Haoyu Cao, Yunsheng Wu, Ziwei Liu, Xing Sun, Caifeng Shan, Ran He

专题命中 机器人数据与评测 :world model(abstract);分类 cs.CV

AI总结 Video-MME-v2通过三级层次结构和非线性评估策略,评估视频理解的鲁棒性和准确性,揭示当前模型与人类专家间的差距及多模态推理瓶颈。

Comments Homepage: https://video-mme-v2.netlify.app/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24935 2026-04-08 cs.RO 57%

SABER: A Stealthy Agentic Black-Box Attack Framework for Vision-Language-Action Models

SABER:一种针对视觉-语言-动作模型的隐秘代理黑盒攻击框架

Xiyang Wu, Guangyao Shi, Qingzi Wang, Zongxia Li, Amrit Singh Bedi, Dinesh Manocha

机构 * University of Maryland, College Park(马里兰大学帕克分校) University of Southern California(南加州大学) University of Central Florida(中佛罗里达大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 SABER通过生成最小有效指令修改,评估VLA模型的鲁棒性,展示小幅度指令扰动可显著降低机器人执行效果,且代理黑盒方法在红队测试中表现高效且可扩展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22560 2026-04-07 cs.RO 57%

Allometric Scaling Laws for Bipedal Robots

双足机器人的等比定律

Naomi Oke, Aja M. Carter, Ben Gu, Steven Man, Cordelia Pride, Sarah Bergbreiter, Aaron M. Johnson

机构 * Department of Mechanical Engineering, Carnegie Mellon University(卡内基梅隆大学机械工程系) Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文研究双足机器人腿部长度与质量、速度等参数的等比关系,发现机器人质量与腿部长度平方成正比,与生物等比定律不同。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03766 2026-04-07 cs.RO cs.SY eess.SY 57%

A Novel Hybrid PID-LQR Controller for Sit-To-Stand Assistance Using a CAD-Integrated Simscape Multibody Lower Limb Exoskeleton

一种用于坐-立转换辅助的新型混合PID-LQR控制器:基于CAD集成的Simscape Multibody下肢外骨骼

Ranjeet Kumbhar, Rajmeet Singh, Appaso M Gadade, Ashish Singla, Irfan Hussain

机构 * Thapar Institute of Engineering and Technology(塔帕尔工程技术学院) Khalifa University Center for Autonomous Robotic Systems (KUCARS)(哈利法大学自主机器人系统中心) Khalifa University(哈利法大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本文提出一种混合PID-LQR控制器,用于下肢外骨骼坐-立转换辅助,通过CAD集成Simscape Multibody建立高保真动态模型,并通过仿真验证其在关节轨迹跟踪中的优越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03558 2026-04-07 cs.CV 57%

LOGER: Local--Global Ensemble for Robust Deepfake Detection in the Wild

LOGER:用于野外鲁棒深度伪造检测的局部-全局集成

Fei Wu, Dagong Lu, Mufeng Yao, Xinlei Xu, Fengjun Guo

机构 * Shanghai Jiao Tong University(上海交通大学) INTSIG Information(INTSIG信息)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.CV

AI总结 LOGER通过局部-全局集成框架提升深度伪造检测鲁棒性,利用多尺度视觉基础模型捕捉全局异常,结合多实例学习策略提取局部伪造痕迹,有效应对真实世界退化。

Comments 2nd place (out of 94 teams) in the NTIRE 2026 Robust Deepfake Detection Challenge

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03377 2026-04-07 cs.CV 57%

ViBA: Implicit Bundle Adjustment with Geometric and Temporal Consistency for Robust Visual Matching

ViBA: 基于几何和时间一致性的隐式捆绑调整用于鲁棒视觉匹配

Xiaoji Niu, Yuqing Wang, Yan Wang, Hailiang Tang, Tisheng Zhang

机构 * GNSS Research Center, Wuhan University(武汉大学卫星导航定位技术研究中心) Electronic Information School, Wuhan University(武汉大学电子信息学院) Hubei Technology Innovation Center for Spatiotemporal Information and Positioning Navigation(湖北省时空信息与定位导航技术创新中心) Hubei Luojia Laboratory(湖北珞珈实验室)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.CV

AI总结 ViBA结合几何优化与特征学习,实现连续在线训练,通过隐式可微的几何残差框架提升视觉匹配的鲁棒性和精度,实测在EuRoC和UMA数据集上显著降低位移和旋转误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03944 2026-04-07 cs.CV 57%

SCP: Spatial Causal Prediction in Video

SCP:视频中的空间因果预测

Yanguang Zhao, Jie Yang, Shengqiong Wu, Shutong Hu, Hongbo Qiu, Yu Wang, Guijia Zhang, Tan Kai Ze, Hao Fei, Chia-Wen Lin, Mong-Li Lee, Wynne Hsu

机构 * National University of Singapore(新加坡国立大学) Shenzhen University(深圳大学) Sichuan University(四川大学) National Tsing Hua University(国立清华大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 本文提出SCP任务,挑战模型超越观察预测空间因果结果,并构建SCP-Bench基准测试,揭示人类与模型性能差距及因果推理局限。

Comments 30 pages, 21 figures, 17 tables, CVPR findings

详情

展开后加载摘要…

URL PDF HTML 收藏