arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

共收录 6072 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 6072 篇

2608.07643 2026-08-11 cs.CV cs.LG 新提交 57%

Data collection from highways: a geometric, class-agnostic approach to embedded vehicle counting

高速公路数据采集:一种用于嵌入式车辆计数的几何、类别无关方法

Lucas Gouveia Omena Lopes, William W. M. Lira, Alexandre M. Lima, Thales M. A. Vieira

机构 * Universidade Federal de Alagoas(阿拉戈斯联邦大学)

专题命中 感知 :occupancy(abstract);分类 cs.CV

AI总结 本文提出一种面向嵌入式设备的类别无关几何车辆计数方法,无需物体模型与训练集,在树莓派硬件上快于实时运行,实地部署准确率达91%,适用于无标注数据等场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00854 2026-08-11 cs.RO 版本更新 57%

Minute-Scale Training for Microrobot Navigation

微型机器人导航的分钟级训练

Yinghan Sun, Aoji Zhu, Xiang Ji, Yamei Li, Jiachi Zhao, Yun Wang, Li Zhang, Huijun Gao, Lidong Yang

机构 * The Hong Kong Polytechnic University(香港理工大学) The Chinese University of Hong Kong(香港中文大学) Shenzhen Loop Area Institute(深圳河套学院) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 感知 :LiDAR(abstract);分类 cs.RO

AI总结 本文针对微型机器人DRL导航训练耗时久的问题,提出含全向量化模拟器与TSR奖励框架的学习框架,将训练缩至10分钟内,支持零样本部署,可缩短设计周期、加速部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09245 2026-08-11 cs.CV 版本更新 57%

Bridging Object Detection and Segmentation with Polygon Detection Transformers

面向多实例分割的多边形检测变换器

Jiacheng Sun, Jiaqi Lin, Wenlong Hu, Haoyang Li, Xinghong Zhou, Chenghai Mao, Xinliang Zhang, Jianya Guo, Yuqiang Zhai, Yan Peng, Xiaomao Li

机构 * Shanghai University(上海大学)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 Poly-DETR通过极坐标表示将实例分割转化为稀疏顶点回归,实现更轻量的高分辨率分割,优于现有极坐标方法并在特定领域表现更优。

Comments Substantially revised and extended version with a new title, additional co-authors, new methodology, expanded experiments and analyses, and supplementary material in the appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00367 2026-08-11 cs.CR cs.AI 57%

PatchBlock: A Lightweight Defense Against Adversarial Patches for Embedded EdgeAI Devices

PatchBlock: 一种轻量级对抗性补丁防御方法用于边缘边缘AI设备

Nandish Chattopadhyay, Abdul Basit, Amira Guesmi, Muhammad Abdullah Hanif, Bassem Ouni, Muhammad Shafique

机构 * eBRAIN Lab, Division of Engineering, New York University (NYU) Abu Dhabi, UAE(eBRAIN实验室,工程系,纽约大学(NYU)阿布扎赫德分校) DakAI, Dubai, UAE(DakAI,迪拜,阿联酋)

专题命中 感知 :autonomous driving(abstract);分类 cs.AI

AI总结 PatchBlock是一种轻量级防御方法,通过异常检测和降维技术有效检测并中和对抗性补丁,提升边缘AI设备的鲁棒性与效率。

Comments 7 pages, 5 figures, 5 tables, Accepted to DATE 2026

Journal ref 2026 Design, Automation & Test in Europe Conference (DATE), Verona, Italy, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09062 2026-08-11 cs.CV cs.LG 版本更新 57%

SIP: Site in Pieces- A Dataset of Disaggregated Construction-Phase 3D Scans for Semantic Segmentation and Scene Understanding

SIP: 构建阶段碎片化3D扫描数据集——用于语义分割和场景理解

Seongyong Kim, Yong Kwon Cho

专题命中 感知 :LiDAR(abstract);分类 cs.CV

AI总结 SIP数据集通过碎片化3D扫描反映施工现场实际约束,为建筑场景的语义分割和理解提供高质量基准数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06434 2026-08-10 cs.RO cs.LG 新提交 57%

Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection

快速且精准:一种通过环境感知模型选择的自适应VLA推理框架

Yuewei Sun, Lang Qin, Zechuan Tian, Jingwen Li, Guiqin Wang, Shengzeng Huo, Wenxin Ren, Tao Fang, Xiaochen Zhang, Guanqing Deng, Xiang Wang, Xiaowen Dong, Qinghai Guo, Yuxin Ma

专题命中 感知 :trajectory planning(abstract);分类 cs.RO

AI总结 本文提出环境感知模型选择(EMS)自适应VLA推理框架,通过解耦双系统与强化学习切换策略,在LIBERO基准及真实双臂任务中平衡了VLA的推理速度与任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21638 2026-08-10 cs.CV 版本更新 57%

SparseVoxelDet: Fully Sparse Voxel Networks for Efficient Event-Based Drone Detection

无需密集张量:在事件相机体素网格上实现完全稀疏目标检测

Mohamad Yazan Sadoun, Sarah Sharif, Yaser Mike Banad

机构 * University of Oklahoma(俄克拉荷马大学)

专题命中 感知 :occupancy(abstract);分类 cs.CV

AI总结 本文提出SparseVoxelDet,首个基于事件相机的完全稀疏目标检测器,通过稀疏体素卷积在占用体素上进行特征提取和检测,显著降低内存和存储开销,验证了稀疏处理在事件相机目标检测中的可行性。

Comments 38 Pages, 9 Figures, 4 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05560 2026-08-07 cs.CV cs.CL 新提交 57%

From Sports to Safety: Benchmarking Proactive Risk Inference in MLLMs

从运动到安全:多模态大语言模型(MLLM)主动风险推理基准测试

Jiawei Qiu, Yichen Xu, Jianzhe Ma, Mingyang Yu, Wenbin Zhu, Yang Han, Pinzheng Lv, Wenxuan Wang

机构 * School of Information, Renmin University of China(中国人民大学信息学院)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 该研究构建了运动主动风险推理基准SPRINT,评估发现当前MLLM危险感知率高但原因识别率低,仅具备表层主动安全能力,缺乏稳定的基于原因的早期预警。

Comments Preprints

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04865 2026-08-06 cs.CV 新提交 57%

Cooking beyond Frames: A Stereo Event Camera Dataset in the Kitchen

超越帧的烹饪:厨房中的立体事件相机数据集

Chengming Feng, Hesam Araghi, Liming Zheng, Julien Dupeyroux, Xucong Zhang, Jan van Gemert, Nergis Tömen

机构 * Delft University of Technology(代尔夫特理工大学) STMicroelectronics(意法半导体)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 本文推出EventKitchen数据集,以第一人称视角从10名参与者在13个厨房中收集5.5小时的烹饪相关多传感器数据,训练基线模型完成动作识别等任务,为神经形态视觉提供新基准。

Comments Accepted at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04776 2026-08-06 cs.AI 新提交 57%

NSF-HRPT: Neural Semantic Field meets Hierarchical Risk Perception Tree for Safety-Critical Scenario Assessment

NSF-HRPT:神经语义场结合分层风险感知树的安全关键场景评估方法

Yu Zhao, Jiangyu Pan, Tao Hu, Ming Yin, Fan Yang, Jiangfan Liu, Xiubo Liang

机构 * Zhejiang University(浙江大学) Beihang University(北京航空航天大学)

专题命中 感知 :autonomous driving(abstract);分类 cs.AI

AI总结 该研究提出NSF-HRPT框架,结合神经语义场与分层风险感知树,引入Sim2Real策略,实现单目视觉输入下安全关键场景的高效风险评估,在合成与现实数据集上均取得优异性能。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03738 2026-08-05 cs.AI 新提交 57%

AgenticECO: An Agentic Framework for ECO on 3D Integrated Circuits

AgenticECO:面向三维集成电路工程变更指令(ECO)的智能体框架

Shuo Ren, Yaohui Han, Libo Shen, Zhiqiang Jia, Rongliang Fu, Bei Yu, Tsung-Yi Ho

专题命中 感知 :occupancy(abstract);分类 cs.AI

AI总结 针对3D-IC布线后ECO手动操作的缺陷,提出AgenticECO智能体框架搭配EcoRoute最小干扰布线层,在9个缺陷案例中表现优于基准方法,且所有结果通过各类设计检查,相关材料已开源。

Comments 20 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03728 2026-08-05 cs.AI 新提交 57%

SAT-Edge-Agent: Hardware-in-the-Loop Edge-Agent Orchestration for Onboard Satellite Intelligence

SAT-Edge-Agent:用于星载智能的硬件在环边缘智能体编排系统

Longji He, Jeto Xu

专题命中 感知 :occupancy(abstract);分类 cs.AI

AI总结 该研究提出SAT-Edge-Agent硬件在环边缘智能体系统,部署于ARM异构边缘片上系统,通过实验验证其星载边缘编排可行性,为相关研究提供可复现的HIL边界。

Comments 17 pages, 4 figures, and 10 tables. Code and sanitized research artifacts are available at SAT-Edge-Agent" target="_blank" rel="noopener">https://github.com/keithhegit/SAT-Edge-Agent

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02200 2026-08-04 cs.CV 新提交 57%

RSC-GestureNet: Reliability-Aware Selective Causal Recognition of Chinese Traffic Police Gestures

RSC-GestureNet:面向中国交通警察手势的可靠性感知选择性因果识别模型

Cheng Li, Renjun Gao, Boyi Fu

机构 * Academy of Interdisciplinary Studies, The Hong Kong University of Science and Technology(香港科技大学跨学科研究学院) Faculty of Innovation Engineering, Macau University of Science and Technology(澳门科技大学创新工程学院)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 本研究提出RSC-GestureNet,通过对不可靠姿态关节降权、因果聚合时序证据等方式提升中国交通警察手势识别的早期性、稳定性与鲁棒性,在CTPGesture数据集上取得最优性能。

Comments 2026 PRCV Oral; Project Page: https://github.com/chengli24/rsc-gesturenet-prcv2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02177 2026-08-04 cs.CV 新提交 57%

GSRAIN: Physically Calibrated High-/Low-Frequency Rainfall Synthesis for 3D Gaussian Driving Scenes

GSRAIN:面向3D高斯溅射(3DGS)驾驶场景的物理校准高低频降雨合成方法

Fanyu Wang, Longgao Zhang, Junyi Chen

机构 * College of Automotive and Energy Engineering, Tongji University(同济大学汽车与能源工程学院)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 GSRAIN针对自动驾驶降雨模拟的物理可控性与多视图一致性局限,结合实测数据与几何感知扩散模型生成可控降雨场景,在FID指标上优于现有方法,可用于自动驾驶算法的雨天测试。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30239 2026-08-04 cs.CV 版本更新 57%

CA-World: Multi-Object Counterfactual Alignment for Efficient Interactive-Ready Reconstruction

SAM3D-Phys:迈向真实世界中的多物体交互仿真

Xin Dong, Weijian Deng, Lihan Zhang, Tianru Dai, Wenfeng Deng, Yansong Tang

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Pengcheng Laboratory(鹏城实验室)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 提出SAM3D-Phys框架,结合场景重建与SAM3D生成式先验,从部分观测中恢复完整可仿真物体几何,并通过物理约束优化和掩码引导外观蒸馏实现场景一致性,支持多物体同时交互仿真。

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29471 2026-08-04 cs.CV 版本更新 57%

V2VCrafter: Consistent Street-View Image Generation Across Vehicles

V2XCrafter:学习生成跨智能体的驾驶场景

Yihang Tao, Yu Guo, Senkang Hu, Yanan Ma, Zihan Fang, Sam Kwong, Yuguang Fang

机构 * Hong Kong JC STEM Lab of Smart City(香港JC智能城市STEM实验室) City University of Hong Kong(香港城市大学) Lingnan University(岭南大学)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 提出V2XCrafter框架,通过渐进式多智能体扩散模型和跨智能体注意力模块,生成跨智能体相机视角的一致可控协作驾驶场景,以增强数据并提升下游协作3D目标检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08163 2026-08-04 cs.CV 版本更新 57%

Accuracy Does Not Guarantee Human-Likeness: Cross-Domain Human-Centered Benchmark in Monocular Depth Estimation

单目深度估计器中准确性并不保证人类化

Yuki Kubota, Taiki Fukiage

机构 * Communication Science Laboratories, NTT, Inc.(NTT通信科学实验室)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 研究发现单目深度估计器的准确性与人类相似性之间存在复杂权衡,提升准确性不一定增强人类化行为。

Comments 21 pages, 14 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10167 2026-08-03 cs.CV 版本更新 57%

FlexPath: Adapting Learned Connectivity Guidance to Path Preferences

FlexPath: 基于图像规划的学习语义路径先验

Taehyoung Kim, Tim Schoenbrod, David Eckel, Henri Meeß

机构 * Fraunhofer IVI(弗劳恩霍夫研究所) Technische Hochschule Ingolstadt(因戈尔施塔特技术大学)

专题命中 感知 :occupancy(abstract);分类 cs.CV

AI总结 提出FlexPath两阶段框架,将可行性先验与偏好解耦,通过可微路径形状目标实现任务自适应,在最短路径规划中搜索代价降低14.3%,并支持零样本泛化与多目标适配。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28483 2026-07-31 cs.CV 新提交 57%

Towards Real-Time PixOOD: Efficient Anomaly Segmentation for Autonomous Vehicles

面向实时PixOOD:自动驾驶的高效异常分割

Luca de Martino, Federico Aromolo, Federico Nesti, Giorgio Buttazzo

机构 * Scuola Superiore Sant’Anna(圣安娜高等学校)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 该研究针对自动驾驶和铁路领域,提出优化PixOOD的高效异常分割流水线,经TensorRT编译后在桌面GPU和嵌入式平台实现高帧率,解决了实时部署的计算成本问题。

Comments 12 pages, 2 figures, 3 tables. Accepted at the Efficient Deep Learning: Methods and Applications workshop, 35th International Conference on Artificial Neural Networks (ICANN 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28256 2026-07-31 cs.RO 新提交 57%

When Robots Exchange Meaning: A Demo of Goal-Oriented Semantic Communications for Collaborative Robotics

当机器人交换意义:面向协作机器人的目标导向语义通信演示

Peizheng Li, Xinyi Lin, Sajida Gufran, Adnan Aijaz

专题命中 感知 :LiDAR(abstract);分类 cs.RO

AI总结 本文提出一种机器人-边缘端语义通信测试平台,通过VQ-VAE等技术实现视觉压缩与语义建图,为协作机器人及相关6G网络研究提供了实用演示平台。

Comments 3 pages, 3 figures. This paper has been accepted for presentation as a demo paper at IEEE CSCN 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19412 2026-07-31 cs.CV cs.CL 57%

VCE: A zero-cost hallucination mitigation method of LVLMs via visual contrastive editing

VCE:通过视觉对比编辑实现LVLMs的零成本幻觉抑制方法

Yanbin Huang, Yisen Li, Guiyao Tie, Xiaoye Qu, Pan Zhou, Hongfei Wang, Zhaofan Zou, Hao Sun, Xuelong Li

机构 * Huazhong University of Science and Technology(华中科技大学) Institute of Artificial Intelligence (TeleAI)(人工智能研究院) China Telecom(中国电信)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 本文提出VCE方法,通过分析模型对对比视觉扰动的响应,利用SVD分解激活模式以抑制幻觉倾向,有效减少多基准测试中的物体幻觉,同时保持计算效率。

Comments ICASSP 2026

Journal ref 2026 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), 2026, pp. 16657-16661

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.08324 2026-07-31 cs.RO 57%

Object-Oriented Grid Mapping in Dynamic Environments

Matti Pekkanen, Francesco Verdoja, Ville Kyrki

专题命中 感知 :occupancy(abstract);分类 cs.RO

Comments IEEE-MFI 2024

Journal ref 2024 IEEE International Conference on Multisensor Fusion and Integration for Intelligent Systems (MFI), Pilsen, Czech Republic, 2024, pp. 1-8

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21831 2026-07-29 cs.CV 版本更新 57%

End-to-End 3-D Spatiotemporal Perception with Multimodal Fusion and V2X Collaboration

端到端3D时空感知与多模态融合及V2X协作

Zhenwei Yang, Yibo Ai, Weidong Zhang

机构 * National Center for Materials Service Safety(材料服务安全国家中心) University of Science and Technology Beijing(北京科技大学)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 XET-V2X通过多模态融合与V2X协作,实现端到端3D时空感知,提升复杂交通场景下的检测与跟踪性能。

Comments 21 pages, 10 figures

Journal ref IEEE Internet of Things Journal, vol. 13, no. 15, pp. 33456-33475, 1 Aug.1, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24692 2026-07-28 cs.NI cs.AI cs.CR cs.DC 新提交 57%

Denial of Deadline: Network-Driven Accuracy Collapse in Distributed Inference Pipelines

拒绝期限:分布式推理管道中网络驱动的精度崩溃

Jhonatan Tavori, Gur-Eyal Sela, Ion Stoica, Gil Zussman

专题命中 感知 :autonomous driving(abstract);分类 cs.AI

AI总结 研究分布式推理管道中网络驱动的精度崩溃问题,通过模拟自动驾驶中的两层边缘云多目标跟踪管道,发现shaped workload攻击可致精度崩溃,如使良性p99延迟增加,降低跟踪质量,促使相关攻击与防御研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24199 2026-07-28 cs.CV 新提交 57%

Reasoning to Regulate: Chain-of-Thought for Traffic Rule Understanding

推理以规范:用于交通规则理解的思维链

Yueru Luo, Xu Yan, Changqing Zhou, Yiming Yang, Chao Zhan, Shuqi Mei, Chao Zheng, Zhen Li

机构 * CUHK-SZ, Shenzhen-FNii(香港中文大学(深圳),深圳高等金融研究院) HKUST(GZ)(香港科技大学(广州)) Tencent T Lab(腾讯T实验室)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 针对交通规则理解这一自动驾驶关键挑战,提出为视觉语言模型配备思维链能力的框架,设计整理管道,采用两阶段训练方案,显著提升了可解释性和准确性,建立首个基于推理的自动驾驶框架。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23758 2026-07-28 cs.CV 新提交 57%

RoadVGGT: Road-Structure-Aware Feed-Forward Road Surface Reconstruction

RoadVGGT:基于道路结构感知的前馈式路面重建

Han Jiao, Chen Liu, Jiakai Sun, Zhanjie Zhang, Mengyuan Yang, Yimeng Li, Mofan Zhou, Kun Zhan, Lei Zhao

专题命中 感知 :driving perception(abstract);分类 cs.CV

AI总结 针对现有道路重建方法需逐场景训练及场景依赖覆盖设计的局限,提出RoadVGGT框架,利用几何基础模型结合多视图图像等,经高斯头预测、坐标对齐及融合等重建紧凑高斯路面,提升多方面性能,证明几何基础模型在路面重建中的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20662 2026-07-28 cs.RO cond-mat.mtrl-sci 版本更新 57%

Scalable Low-Cost Laboratory Automation: A Digital Twin-Integrated Robotic Platform for Autonomous Liquid Handling (RAINBOT)

可扩展的低成本实验室自动化:用于自主液体处理的数字孪生集成机器人平台(RAINBOTTM)

Mohamed Rami Ayeche, Souhil Sid, Ahyen Mostofa, Rehaan Hussain, Ali Shayesteh, Fadwa El Mellouhi

机构 * Acceleration Consortium, University of Toronto(多伦多大学加速联盟) AISCIA Informatics(AISCIA信息学公司) Hamad Bin Khalifa University (HBKU)(哈马德·本·哈利法大学)

专题命中 感知 :self-driving(abstract);分类 cs.RO

AI总结 研究针对商业液体处理系统的局限,提出将消费级3D打印机改装为低成本液体处理机器人RAINBOTTM的方法,通过数字孪生实现远程监控,结合CEIDTM框架进行目标导向实验,成本低,建立了可访问的物理 - 虚拟实验室自动化框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10760 2026-07-28 cs.RO 版本更新 57%

MAGS-SLAM: Monocular Multi-Agent Gaussian Splatting SLAM for Geometrically and Photometrically Consistent Reconstruction

MAGS-SLAM:单目多智能体高斯点云SLAM用于几何和光度一致的重建

Zhihao Cao, Qi Shao, Shuhao Zhai, Jing Zhang, Anh Nguyen, Hesheng Wang, Baoru Huang

机构 * ETH Zurich(苏黎世联邦理工学院) Harbin Engineering University(哈尔滨工程大学) University of Liverpool(利物浦大学) University of Macau(澳门大学) University of Ottawa(多伦多大学) Wuhan University(武汉大学) Imperial College London(伦敦帝国学院)

专题命中 感知 :occupancy(abstract);分类 cs.RO

AI总结 MAGS-SLAM通过单目视觉实现多智能体高斯点云SLAM,无需RGB-D传感器即可完成几何和光度一致的场景重建,实验表明其跟踪精度和渲染质量可与现有RGB-D方法媲美。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10562 2026-07-28 cs.CV cs.SE 57%

Natural Adversaries: Fuzzing Autonomous Vehicles with Realistic Roadside Object Placements

自然对抗者:利用真实道路边物体布局进行自动驾驶车辆模糊测试

Yang Sun, Haoyu Wang, Christopher M. Poskitt, Jun Sun

机构 * School of Computing and Information Systems(计算与信息系统学院)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 本文提出TrashFuzz算法,通过操控道路边常见物体布局生成符合道路设计规范的现实对抗场景,以测试自动驾驶车辆感知系统的鲁棒性,并引发交通违规。

Comments Accepted by the 19th IEEE International Conference on Software Testing, Verification and Validation (ICST 2026)

Journal ref Proc. ICST'26, pages 40-51. IEEE, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22494 2026-07-27 cs.MM cs.CV 新提交 57%

CARA: Concept-Aware Risk Attention for Interpretable Collision Anticipation

CARA:用于可解释碰撞预测的概念感知风险注意力

Zhishan Tao, Ruoyu Wang, Yucheng Wu, Enjun Du, Yilei Yuan, Sherwin Ho, Yue Su, Jinbo Su, Yi Hong

机构 * Shanghai Jiao Tong University(上海交通大学) The University of Hong Kong(香港大学) Fudan University(复旦大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) University of Pennsylvania(宾夕法尼亚大学) Renmin University of China(中国人民大学)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 研究自动驾驶碰撞预测问题,提出CARA框架,从事故叙述中获取风险概念并与视频帧对齐成轨迹,将语义风险因素作为动态证据,结合可解释性与预测过程,实验证明其能提高预测准确性和预警及时性。

Comments Accepted to ACM Multimedia 2026(Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏