arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

IEEE TPAMI

IEEE Transactions on Pattern Analysis and Machine Intelligence · 期刊 · Computer Vision

2026-09-01 至 2026-09-01 共收录 3
2608.30839 2026-09-01 cs.CV 新提交

Physical Adversarial Examples for Person Detectors in Thermal Images Based on 3D Modeling

基于3D建模的热图像行人检测器的物理对抗样本

Xiaopei Zhu, Siyuan Huang, Zhanhao Hu, Jianmin Li, Jun Zhu, Xiaolin Hu

机构 * Tsinghua University(清华大学) Chinese Institute for Brain Research (CIBR)(中国脑科学研究院)

AI总结 该研究基于3D建模制作红外对抗服装,针对YOLOv9等热图像行人检测器实现高攻击成功率,且具有良好的可迁移性。

Comments Accepted by TPAMI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29230 2026-09-01 cs.CV 新提交

Compact Snapshot Spectral Imaging with Calibration-Free Aperture Diffraction

无校准孔径衍射的紧凑型快照光谱成像

Tao Lv, Quan Yuan, Shiqiao Li, Chenglong Huang, Linsen Chen, Chongde Zi, Shuming Wang, Xun Cao

机构 * Nanjing University(南京大学)

AI总结 该研究针对快照光谱成像系统复杂、需重复校准的问题,提出无校准的ADIS方法,结合ODAUVST框架实现紧凑型全分辨率光谱成像,验证了其性能优势。

Comments Submitted to IEEE TPAMI. Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13073 2026-09-01 cs.RO cs.CV 版本更新

Large VLM-based Vision-Language-Action Models for Robotic Manipulation: A Survey

用于机器人操作的基于大型VLM的视觉-语言-动作模型:综述

Rui Shao, Wei Li, Lingsen Zhang, Renshan Zhang, Zhiyang Liu, Ran Chen, Liqiang Nie

机构 * School of Computer Science and Technology, Harbin Institute of Technology (Shenzhen)(计算机科学与技术学院,哈尔滨工业大学(深圳))

AI总结 本综述首次系统分类梳理用于机器人操作的基于大型VLM的VLA模型,明确其定义与两类架构,考察其与先进领域的集成等内容,整合进展并提供更新项目页面

Comments Under Minor Revision at IEEE TPAMI, Project Page: https://github.com/JiuTian-VL/Large-VLM-based-VLA-for-Robotic-Manipulation

详情

展开后加载摘要…

URL PDF HTML 收藏