arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

Conference on Computer Vision and Pattern Recognition · 会议 · Computer Vision

2026-09-01 至 2026-09-01 共收录 3
2608.30653 2026-09-01 cs.CV cs.AI cs.LG 新提交

Fine-Grained Multi Image Object Hallucination Benchmark

细粒度多图像物体幻觉基准测试

Joonki Min, Chaeyun Kim, Hyungwook Choi, Yejin Kim, Kihyun Kim, Yohan Jo, Joonseok Lee

机构 * Seoul National University(首尔大学) AIM Intelligence(AIM智能公司)

AI总结 本研究针对多模态大语言模型的物体幻觉问题,推出细粒度多图像物体幻觉基准测试MIOH,评估29个模型后发现顶尖模型仍存在明显失败模式,为开发可靠多模态AI提供关键评估工具。

Comments Accepted at CVPR 2026

Journal ref Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2026, pp. 18295-18305

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29759 2026-09-01 cs.CV cs.AI 新提交

SynCrash: A Multi-Stage Pipeline for Zero-Shot Accident Detection and Localization in Traffic Surveillance Video

SynCrash:面向交通监控视频零样本事故检测与定位的多阶段流水线

Arkya Jyoti Bagchi, Ritul Jangir, Varun Raskar

机构 * Indian Institute of Technology Jodhpur(印度焦特布尔印度理工学院)

AI总结 提出SynCrash多阶段流水线,针对CVPR2026挑战赛ACCIDENT任务,在无真实标注数据下,结合VideoMAEv2、YOLO及物理启发式算法,实现交通监控视频零样本事故检测、定位与碰撞分类。

Comments Accepted at the CVPR 2026 AUTOPILOT Workshop (non-archival)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29252 2026-09-01 cs.AI 新提交

Dynamic Important Example Mining for Reinforcement Finetuning

用于强化微调的动态重要示例挖掘

Haoru Tan, Sitong Wu, Yanfeng Chen, Shizhen Zhao, Yang-Tian Sun, Tianjia Liu, Chirui Chang, Shaofeng Zhang, Samm Sun, Xiuzhe Wu, Ruobing Xie, Xiaojuan Qi

机构 * HKU(香港大学) Tencent(腾讯) CUHK(香港中文大学) Stanford(斯坦福大学)

AI总结 该研究针对强化微调中样本价值固定假设的缺陷,提出DIEM框架,整合梯度对齐重要性估计器与约束批量重加权方案,在多个推理基准中优于相关基线。

Journal ref CVPR-2026

详情

展开后加载摘要…

URL PDF HTML 收藏