arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-03-30 至 2026-03-30 共收录 36 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 11 篇

2603.26322 2026-03-30 cs.RO 85%

DiffusionAnything: End-to-End In-context Diffusion Learning for Unified Navigation and Pre-Grasp Motion

DiffusionAnything: 端到端的上下文扩散学习用于统一导航和预抓取运动

Iana Zhura, Yara Mahmoud, Jeffrin Sam, Hung Khang Nguyen, Didar Seyidov, Miguel Altamirano Cabrera, Dzmitry Tsetserukou

机构 * Intelligent Space Robotics Laboratory, Center for Digital Engineering, Skolkovo Institute of Science and Technology(斯科尔科沃科学技术学院数字工程中心智能空间机器人实验室)

专题命中 机器人操作 :navigation(title,abstract);robotics(abstract);manipulation(abstract);分类 cs.RO

AI总结 本文提出一种端到端的上下文扩散学习方法,通过多尺度特征调制实现统一的导航与精细操控,仅需5分钟自监督数据即可实现零样本泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26631 2026-03-30 cs.GT cs.SI 78%

Learning From Social Interactions: Personalized Pricing and Buyer Manipulation

从社交互动中学习:个性化定价与买家操纵

Qinqi Lin, Lingjie Duan, Jianwei Huang

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 本文研究买家如何战略性地操纵社交互动信号以逃避个性化定价,分析卖家如何在考虑买家策略时设计定价方案,发现高偏好买家操纵行为可能使自身收益下降,但卖家仍能从中获益。

Comments Published in IEEE Transactions on Mobile Computing (a complete version with supplementary materials included)

Journal ref IEEE Transactions on Mobile Computing, vol. 23, no. 12, pp. 11871-11888, Dec. 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26403 2026-03-30 cs.RO 77%

T-800: An 800 Hz Data Glove for Precise Hand Gesture Tracking

T-800:一种用于精确手部姿态追踪的800Hz数据手套

Haoyang Luo, Zihang Zhao, Leiyao Cui, Saiyao Zhang, Liu Yang, Zhi Han, Xiyuan Tang, Yixin Zhu

机构 * Peking University(北京大学) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) School of Integrated Circuits, Peking University(北京大学集成电路学院) School of Psychological and Cognitive Sciences, Peking University(北京大学心理与认知科学学院) Beijing Key Laboratory of Behavior and Mental Health, Peking University(北京大学行为与心理健康北京市重点实验室) LeapZenith AI Research(跃升人工智能研究院) State Key Laboratory of Robotics and Intelligent Systems, Shenyang Institute of Automation, Chinese Academy of Sciences(中国科学院沈阳自动化研究所机器人学国家重点实验室)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 T-800通过800Hz高带宽数据手套实现同步全手运动追踪,解决高频率动态捕捉难题,恢复细粒度操作细节,为机器人控制提供丰富行为数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26412 2026-03-30 cs.RO 61%

Generalizable task-oriented object grasping through LLM-guided ontology and similarity-based planning

通过LLM引导的本体和基于相似性的规划实现通用任务导向物体抓取

Hao Chen, Takuya Kiyokawa, Weiwei Wan, Kensuke Harada

机构 * Graduate School of Engineering Science, The University of Osaka(大阪大学工学研究科)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO;robotics(comments)

AI总结 本文提出基于LLM的本体和相似性规划方法,解决任务导向抓取中部分识别和抓取区域选择的稳定性问题,提升抓取的通用性和鲁棒性。

Comments Accepted by Robotics and Autonomous Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26659 2026-03-30 cs.RO 57%

Partial Motion Imitation for Learning Cart Pushing with Legged Manipulators

部分模仿学习用于通过腿部操作器学习推车操作

Mili Das, Morgan Byrd, Donghoon Baek, Sehoon Ha

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 本文提出一种部分模仿学习方法,通过将运动风格从运动任务转移到推车运动中,实现稳定的运动与精确操作的结合,实验显示其在IsaacLab和MuJoCo中的有效性。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26621 2026-03-30 eess.SY cs.SY 50%

Inclusion conditions for the Constrained Polynomial Zonotopic case

约束多项式扎诺拓扑情况的包含条件

Bogdan Gheorghe, Amr Alanwar, Florin Stoican

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出新的非线性编码,用于测试两个约束多项式扎诺拓扑的包含条件,并将其应用于优化框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26520 2026-03-30 cs.HC cs.CY 50%

Characterizing Scam-Driven Human Trafficking Across Chinese Borders and Online Community Responses on RedNote

跨境人口贩卖中的诈骗行为特征及在线社区反应研究

Jiamin Zheng, Yue Deng, Jessica Chen, Shujun Li, Yixin Zou, Jingjie Li

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究通过分析158篇RedNote帖子,揭示了跨境诈骗人口贩卖中利用文化纽带进行网络犯罪的机制,以及受害者重新融入社会的障碍,提出平台治理与国际合作的应对策略。

Comments Accepted at the CHI Conference on Human Factors in Computing Systems (CHI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26242 2026-03-30 cond-mat.mtrl-sci 50%

Probing deuterium-induced magnetic phase transitions in TbCo alloys with in-situ polarized neutron reflectometry

利用原位极化中子反射仪探测TbCo合金中氘诱导的磁相变

Robbie G. Hunt, Gunnar K. Pálsson, Matías P. Grassi, Victoria Kabanova, Alexey Vorobiev, Gabriella Andersson

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究通过原位极化中子反射仪探讨氘对TbCo合金磁性相变的影响,发现Tb-rich合金中厚度膨胀是磁相变主机制,而Co-rich合金则无此现象,同时氧化界面对氘敏感但可间接调控。

Comments 12 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26229 2026-03-30 cond-mat.mtrl-sci 50%

Photoinduced strain and polarization switching in barium titanate in the far-infrared spectral range

远红外波段中钡钛酸盐的光诱导应变与极化切换

Maarten Kwaaitaal, Daniel Lourens, Carl S. Davies, Andrei Kirilyuk

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究远红外激发下钡钛酸盐的应变和极化切换行为,发现其主要由光学吸收主导,而非长声子或介电接近零条件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17080 2026-03-30 cs.CL 50%

Not Minds, but Signs: Reframing LLMs through Semiotics

并非心灵,而是符号:通过符号学重新审视大语言模型

Davide Picca

机构 * University of Lausanne(洛桑大学)

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文挑战将大语言模型视为认知系统的倾向,提出符号学视角,强调模型通过符号操作和意义生成参与文化过程,而非模拟人类思维。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25883 2026-03-30 cs.SI 50%

Beyond Disinformation: Strategic Misrepresentation across Content, Actors, Processes, and Covertness

超越虚假信息:内容、行为者、过程和隐蔽性中的战略误表

Arttu Malkamäki, Daniel Balinhas, Letizia Iannucci, Megan Vine, Frederik Temmermans, Adrien Coppen, Nikos Deligiannis, Mikko Kivelä, Michael Quayle, Onur Varol, Fintan McGee

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文重新审视在线社交网络中虚假信息问题,提出战略误表概念,涵盖内容、行为者、过程和隐蔽性四个维度,整合机器学习、网络科学和可视化分析方法,为信息活动的检测和评估提供新基础。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身导航 7 篇

2603.25981 2026-03-30 cs.RO cs.AI cs.CL 90%

Policy-Guided World Model Planning for Language-Conditioned Visual Navigation

基于策略引导的世界模型规划用于语言条件的视觉导航

Amirhosein Chahe, Lifeng Zhou

机构 * Drexel University(德雷塞尔大学)

专题命中 具身导航 :navigation(title,abstract);world model(title,abstract);embodied AI(abstract);分类 cs.RO、cs.AI

AI总结 本文提出PiJEPA框架,结合学习导航策略与潜在世界模型规划,通过微调Octo策略和冻结预训练视觉编码器,提升语言指导下的视觉导航准确性与指令遵循性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21723 2026-03-30 cs.RO cs.MA 84%

Can a Robot Walk the Robotic Dog: Triple-Zero Collaborative Navigation for Heterogeneous Multi-Agent Systems

机器人能否行走:异构多智能体系统的三零协同导航

Yaxuan Wang, Yifan Xiang, Ke Li, Xun Zhang, BoWen Ye, Zhuochen Fan, Fei Wei, Tong Yang

机构 * Yuanpei College, Peking University(北京大学元培学院) School of Computer Science, Peking University(北京大学计算机学院) School of Computer Science, Beijing University of Posts and Telecommunications(北京邮电大学计算机学院) Pengcheng Laboratory(鹏城实验室) Beijing Jinruyi Large Model Technology Co., Ltd.(北京金如意大模型科技有限公司)

专题命中 具身导航 :navigation(title);robotic(title);分类 cs.RO

AI总结 本文提出三零路径规划框架,通过协调者-探索者架构实现无需训练、无需先验知识和无需模拟的异构多机器人系统协作导航,实验显示其在复杂环境中具有鲁棒性和适应性。

Comments 8 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26441 2026-03-30 cs.RO 84%

120 Minutes and a Laptop: Minimalist Image-goal Navigation via Unsupervised Exploration and Offline RL

120分钟与一台笔记本:通过无监督探索和离线强化学习实现极简图像目标导航

Xiaoming Liu, Borong Zhang, Qingbiao Li, Steven Morad

机构 * Faculty of Science and Technology, University of Macau(澳门大学科技学院)

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO;robotics(comments)

AI总结 本文提出MINav方法,通过无监督数据收集与 hindsight 目标重标记,实现高效图像目标导航,在120分钟内使用消费级笔记本完成训练与部署,无需人工干预。

Comments 8 pages, 8 figures, submitted to IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26314 2026-03-30 cs.RO 80%

Line-of-Sight-Constrained Multi-Robot Mapless Navigation via Polygonal Visible Regions

视距约束下的多机器人无图导航:基于多边形可见区域

Ruofei Bai, Shenghai Yuan, Xinhang Xu, Xingyu Ji, Xiaowei Li, Hongliang Guo, Wei-Yun Yau, Lihua Xie

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出一种基于多边形可见区域的多机器人无图导航方法,通过分布式通信建立视距约束,提升在障碍物密集环境下的连接稳定性与导航效率。

Comments 10 pages, 7 figures. See videos and code: https://github.com/bairuofei/LoS_constrained_navigation

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22498 2026-03-30 cs.RO 70%

HELIOS: Hierarchical Exploration for Language-Grounded Interaction in Open Scenes

HELIOS:面向开放场景的语言引导交互的分层探索

Katrina Ashton, Chahyon Ku, Shrey Shah, Saumit Vedula, Tingrui Zhang, Wen Jiang, Kostas Daniilidis, Bernadette Bucher

机构 * University of Pennsylvania(宾夕法尼亚大学) University of Michigan(密歇根大学)

专题命中 具身导航 :manipulation(abstract);navigation(abstract);分类 cs.RO

AI总结 HELIOS通过分层场景表示和搜索目标,解决开放环境中语言指令与部分观测场景的语义关联及动态更新问题,实现高仿真实验和现实场景中的语言引导抓取放置任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06909 2026-03-30 cs.CV 57%

Gaussian Mapping for Evolving Scenes

高斯映射用于动态场景

Vladimir Yugay, Thies Kersten, Luca Carlone, Theo Gevers, Martin R. Oswald, Lukas Schmid

机构 * University of Amsterdam(阿姆斯特丹大学) University of Technology Nuremberg(纽伦堡工业大学) Massachusetts Institute of Technology(麻省理工学院)

专题命中 具身导航 :robotics(abstract);分类 cs.CV

AI总结 本文提出GaME方法,通过动态场景适应机制持续更新3DGS,结合新颖的关键帧管理机制,提升动态场景重建性能,在PSNR和L1深度误差上分别提升29.7%和3倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20432 2026-03-30 cond-mat.mtrl-sci 50%

Autonomous epitaxial atomic-layer synthesis via real-time computer vision of electron diffraction

通过实时电子衍射计算机视觉实现自主自组装原子层合成

Haotong Liang, Yunlong Sun, Ryan Paxson, Chih-Yu Lee, Alex T. Hall, Zoey Warecki, John Cumings, Hideomi Koinuma, Aaron Gilad Kusne, Mikk Lippmaa, Ichiro Takeuchi

专题命中 具身导航 :navigation(abstract)

AI总结 本文通过实时计算机视觉实现电子衍射的多维合成参数空间自主导航,显著减少实验次数,用于制备稳定的非稳态功能氧化物相的单相 epitaxial 薄膜。

Comments 30 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 机器人基础模型 1 篇

2603.26360 2026-03-30 cs.RO 57%

Realtime-VLA V2: Learning to Run VLAs Fast, Smooth, and Accurate

Realtime-VLA V2:学习以快速、平滑和准确地运行VLAs

Chen Yang, Yucheng Hu, Yunchao Ma, Yunhuan Yang, Jing Tan, Haoqiang Fan

专题命中 机器人基础模型 :robotic(abstract);分类 cs.RO

AI总结 本文提出Realtime-VLA V2,通过校准、规划与控制及学习方法,实现机器人在真实任务中高速、高精度和高灵活性的VLAs运行。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 模仿学习与强化学习 2 篇

2603.26666 2026-03-30 cs.RO 70%

VLA-OPD: Bridging Offline SFT and Online RL for Vision-Language-Action Models via On-Policy Distillation

VLA-OPD: 通过在线策略蒸馏连接离线SFT与在线RL以构建视觉-语言-动作模型

Zhide Zhong, Haodong Yan, Junfeng Li, Junjie He, Tianran Zhang, Haoang Li

专题命中 模仿学习与强化学习 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出VLA-OPD框架,通过在线策略蒸馏结合离线SFT与在线RL,解决预训练模型在部署中的分布偏移和灾难性遗忘问题,提升样本效率与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26467 2026-03-30 cs.RO 57%

Addressing Ambiguity in Imitation Learning through Product of Experts based Negative Feedback

通过专家产品负反馈解决模仿学习中的歧义

John Bateman, Andy M. Tyrrell, Jihong Zhu

机构 * University of York(约克大学)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

AI总结 本文提出一种利用次优示范解决歧义任务的系统,通过自身失败学习,显著提升成功率,优于传统正反馈模仿学习,且在效能和效率上更优。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 机器人数据与评测 13 篇

2603.23376 2026-03-30 cs.CV cs.RO 88%

ABot-PhysWorld: Interactive World Foundation Model for Robotic Manipulation with Physics Alignment

ABot-PhysWorld:用于机器人操作的交互世界基础模型,具有物理对齐

Yuzhi Chen, Ronghan Chen, Dongjie Huo, Yandan Yang, Dekang Qi, Haoyun Liu, Tong Lin, Shuang Zeng, Junjin Xiao, Xinyuan Chang, Feng Xiong, Xing Wei, Zhiheng Ma, Mu Xu

专题命中 机器人数据与评测 :manipulation(title,abstract);robotic(title);world model(abstract);分类 cs.RO、cs.CV

AI总结 ABot-PhysWorld通过物理对齐的交互世界模型,生成物理合理且可控的视频,解决了传统方法在物理仿真中的不足,通过新框架和基准测试提升了性能。

Comments Code: https://github.com/amap-cvlab/ABot-PhysWorld.git

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15219 2026-03-30 cs.CV cs.LG cs.MA cs.MM cs.RO 85%

Out-of-Sight Embodied Agents: Multimodal Tracking, Sensor Fusion, and Trajectory Forecasting

视线外的具身智能体:多模态跟踪、传感器融合与轨迹预测

Haichao Zhang, Yi Xu, Yun Fu

机构 * Department of Electrical and Computer Engineering, Northeastern University(东北大学电气与计算机工程系) Khoury College of Computer Sciences, Northeastern University(东北大学库里计算机科学学院)

专题命中 机器人数据与评测 :embodied agent(title);robotics(abstract);world model(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 本文提出改进的视线外轨迹预测方法,通过视觉定位去噪模块提升轨迹预测性能,实验表明在Vi-Fi和JRDB数据集上达到最优效果,为自动驾驶、机器人和监控提供新方向。

Comments Published in IEEE Transactions on Pattern Analysis and Machine Intelligence (Early Access), pp. 1-14, March 23, 2026

Journal ref IEEE Transactions on Pattern Analysis and Machine Intelligence, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20620 2026-03-30 cs.CV cs.RO 84%

Wanderland: Geometrically Grounded Simulation for Open-World Embodied AI

Wanderland: 为开放世界具身AI提供几何学基础的模拟

Xinhao Liu, Jiaqi Li, Youming Deng, Ruxin Chen, Yingjia Zhang, Yifei Ma, Li Guo, Yiming Li, Jing Zhang, Chen Feng

机构 * New York University(纽约大学) Cornell University(康奈尔大学)

专题命中 机器人数据与评测 :embodied AI(title,abstract);navigation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出Wanderland框架,通过多传感器采集和高精度几何重建,解决开放世界具身AI中模拟与现实差距大的问题,并展示其在导航政策学习中的应用。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26543 2026-03-30 cs.HC cs.RO 79%

User Involvement in Robotic Wheelchair Development: A Decade of Limited Progress

机器人轮椅开发中的用户参与:十年有限进展

Mario Andres Chavarria, Santiago Price Torrendell, Aude Billard, Samia Hurst, Sébastien Kessler, Michael Stein, Kenji Suzuki, Sophie Weerts, Diego Paez-Granados, Minerva Rivas Velarde

机构 * Geneva School of Health Science, University of Applied Sciences and Arts Western Switzerland(日内瓦健康科学学院,瑞士西部应用科学与艺术大学) Institute of Systems and Information Engineering, University of Tsukuba(系统与信息工程研究所,筑波大学) Learning Algorithms and Systems Laboratory, Ecole Polytechnique Fédérale de Lausanne(学习算法与系统实验室,洛桑联邦理工学院) Institute of Ethics, History, and Humanities, University of Geneva(伦理、历史与人文学研究所,日内瓦大学) Grand Conseil, État de Vaud(沃州大议会) id-Geo Sàrl(id-Geo有限责任公司) Harvard Law School Project on Disability, Harvard University(哈佛法学院残疾项目,哈佛大学) Swiss Graduate School of Public Administration, University of Lausanne(瑞士公共管理研究生院,洛桑大学) SCAI-Lab, Department of Health Sciences and Technology (D-HEST), ETH Zurich(SCAI实验室,健康科学与技术系,苏黎世联邦理工学院) Swiss Paraplegic Research (SPF)(瑞士截瘫研究)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 本文回顾了过去十年中机器人轮椅设计开发中用户参与的现状,发现用户参与有限,多集中在后期评估而非早期需求定义和迭代共设计,且研究多依赖小样本和非标准化方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26174 2026-03-30 cs.CV 79%

CREval: An Automated Interpretable Evaluation for Creative Image Manipulation under Complex Instructions

CREval: 一种自动化可解释的评估方法用于复杂指令下的创意图像操纵

Chonghuinan Wang, Zihan Chen, Yuxiang Wei, Tianyi Jiang, Xiaohe Wu, Fan Li, Wangmeng Zuo, Hongxun Yao

机构 * Harbin Institute of Technology(哈尔滨工业大学) Huawei Noah’s Ark Lab(华为诺亚方舟实验室) Pengcheng Lab, Guangzhou(广州鹏城实验室)

专题命中 机器人数据与评测 :manipulation(title,abstract);分类 cs.CV

AI总结 本文提出CREval,一种基于问答的自动化评估框架,用于评估复杂指令下的创意图像编辑任务,通过CREval-Bench基准测试揭示模型在复杂创意任务中的表现及挑战。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18746 2026-03-30 cs.CV cs.AI 73%

Any4D: Open-Prompt 4D Generation from Natural Language and Images

Any4D: 从自然语言和图像生成开放提示的4D生成

Hao Li, Qiao Sun

专题命中 机器人数据与评测 :world model(abstract);robotic(abstract);分类 cs.AI、cs.CV

AI总结 本文提出Primitive Embodied World Models,通过限制视频生成时间范围,实现语言与视觉表示的细粒度对齐,降低学习复杂度,提升数据效率,并减少推理延迟,支持复杂任务的组合泛化。

Comments The authors identified issues in the 4D generation pipeline and evaluation that affect result validity. To ensure scientific accuracy, we will revise the methodology and experiments thoroughly before resubmitting. This version should not be cited or relied upon

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14375 2026-03-30 cs.CV cs.AI 62%

The Pulse of Motion: Measuring Physical Frame Rate from Visual Dynamics

运动的脉搏:从视觉动态测量物理帧率

Xiangbo Gao, Mingyang Wu, Siyuan Yang, Jiongze Yu, Pardis Taghavi, Fangzhou Lin, Zhengzhong Tu

机构 * Texas A\&M University

专题命中 机器人数据与评测 :world model(abstract);分类 cs.AI、cs.CV

AI总结 本文提出Visual Chronometer,通过视觉动态直接恢复物理帧率,解决视频生成中因训练数据帧率不一致导致的物理运动速度模糊问题,提升生成视频的自然度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26036 2026-03-30 cs.CV 57%

Face2Parts: Exploring Coarse-to-Fine Inter-Regional Facial Dependencies for Generalized Deepfake Detection

Face2Parts: 探索粗到细的区域间面部依赖关系以实现通用深度伪造检测

Kutub Uddin, Nusrat Tasnim, Byung Tae Oh

机构 * School of Electronics and Information Engineering, Korea Aerospace University(韩国航空大学电子与信息工程学院)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.CV

AI总结 本文提出Face2Parts方法,通过粗到细的区域间依赖关系提升深度伪造检测性能,采用层次特征表示和通道注意力机制,在多个数据集上取得高AUC成绩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23866 2026-03-30 cs.CR cs.LG 57%

A Channel-Triggered Backdoor Attack on Wireless Semantic Image Reconstruction

面向无线语义图像重建的通道触发后门攻击

Jialin Wan, Jinglong Shen, Nan Cheng, Zhisheng Yin, Yiliang Liu, Wenchao Xu, Xuemin, Shen

机构 * School of Telecommunications Engineering, Xidian University(西安电子科技大学通信工程学院) Department of Computing, Hong Kong Polytechnic University(香港理工大学计算学系) Department of Electrical and Computer Engineering, University of Waterloo(滑铁卢大学电气与计算机工程系)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.LG

AI总结 本文提出一种利用无线信道特性作为激活触发器的后门攻击框架,解决传统输入级触发器在严格输入约束下的局限性,通过信道统计参数提升隐蔽性与灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏