arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Hikvision(海康威视)

共收录 6
2603.04288 2026-08-18 cs.CV 版本更新

A multi-center analysis of deep learning methods for video polyp detection and segmentation

多中心分析深度学习方法在视频息肉检测和分割中的应用

Noha Ghatwary, Pedro Chavarias Solano, Mohamed Ramzy Ibrahim, Adrian Krenzer, Frank Puppe, Stefano Realdon, Renato Cannizzaro, Jiacheng Wang, Liansheng Wang, Thuy Nuong Tran, Lena Maier-Hein, Amine Yamlahi, Patrick Godau, Quan He, Qiming Wan, Mariia Kokshaikyna, Mariia Dobko, Haili Ye, Heng Li, Ragu B, Antony Raj, Hanaa Nagdy, Osama E Salem, James E. East, Dominique Lamarque, Thomas de Lange, Sharib Ali

机构 * Computer Engineering Department, Arab Academy for Science and Technology(阿拉伯科学与技术学院计算机工程系) AI in Medicine and Surgery Group, School of Computer Science, University of Leeds(莱斯特大学计算机科学学院医学与外科AI小组) Department of Artificial Intelligence and Knowledge Systems, University of Würzburg(维尔茨堡大学人工智能与知识系统系) CRO Centro Riferimento Oncologico IRCCS(肿瘤研究中心IRCCS) Department of Computer Science at School of Informatics, Xiamen University(厦门大学信息学院计算机科学系) Div. Intelligent Medical Systems, German Cancer Research Center (DKFZ)(德国癌症研究中心(DKFZ)智能医疗系统部) Hangzhou Hikvision Digital Technology Co.,ltd(杭州海康威视数字技术有限公司) The Machine Learning Lab, Ukrainian Catholic University(乌克兰天主教大学机器学习实验室)

AI总结 本研究通过多中心数据集评估深度学习在实时结肠镜检查中提高息肉检测和分割精度的应用。

Comments 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14277 2026-06-15 cs.CV 新提交

One Layer's Trash is Another Layer's Treasure: Adaptive Layer-wise Visual Token Selection in LVLMs

一层的垃圾是另一层的宝藏:LVLMs中自适应逐层视觉标记选择

Yongru Chen, Kai Zhang, Zeliang Zong, Yuchen Lu, Wenming Tan, Ye Ren, Jilin Hu

机构 * Hikvision Research Institute(海康威视研究院) Peking University(北京大学) East China Normal University(华东师范大学)

AI总结 提出自适应逐层视觉标记选择(ALVTS),通过轻量级选择器为不同层路由重要标记,实现高效压缩,在89%压缩率下保留96.7%精度。

Comments Accepted by CVPR 2026 (highlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29167 2026-05-19 cs.CV

JDCNet: Confidence-Gated Privileged-Modality Distillation for Cost-Preserving X-ray Inference

JDCNet:基于置信度门控的特权模态蒸馏用于成本保持的X射线推断

Bo Ma, Jinsong Wu, Weiqi Yan, Hongjiang Wei, Kun Liu

机构 * Auckland University of Technology(奥克兰技术大学) Guilin University of Electronic Technology(桂林电子科技大学) Hikvision Technology Co., Ltd(海康威视技术有限公司) Hebei University of Technology(河北工业大学)

AI总结 JDCNet通过置信度门控的CT到X射线蒸馏框架,在保持固定成本的单模态部署路径下,利用特权模态进行训练。在510名患者配对的BIMCV队列中,两种配置在固定转移门下优于ResNet-18基线,证明置信度门控辅助目标比均匀软化的CT日志更可转移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14625 2026-01-22 cs.CV stat.ML

Diffusion Epistemic Uncertainty with Asymmetric Learning for Diffusion-Generated Image Detection

扩散epistemic不确定性与非对称学习用于扩散生成图像检测

Yingsong Huang, Hui Guo, Jing Huang, Bing Bai, Qi Xiong

机构 * Tencent Inc.(腾讯公司) Hikvision(海康威视) Microsoft MAI(微软MAI)

AI总结 本文提出DEUA框架,通过非对称学习和扩散epistemic不确定性估计,提升扩散生成图像检测的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06726 2025-12-09 cs.CV cs.AI cs.CL

The Role of Entropy in Visual Grounding: Analysis and Optimization

熵在视觉定位中的作用:分析与优化

Shuo Li, Jiajun Sun, Zhihao Zhang, Xiaoran Fan, Senjie Jin, Hui Li, Yuming Yang, Junjie Ye, Lixing Shen, Tao Ji, Tao Gui, Qi Zhang, Xuanjing Huang

机构 * Fudan University(复旦大学) Hikvision Research Institute(海康威视研究院)

AI总结 本文提出ECVGPO算法,通过熵控制优化视觉定位任务,提升探索与利用的平衡,实现多基准的性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12575 2025-11-18 cs.CV

Beyond Pixels: Semantic-aware Typographic Attack for Geo-Privacy Protection

Jiayi Zhu, Yihao Huang, Yue Cao, Xiaojun Jia, Qing Guo, Felix Juefei-Xu, Geguang Pu, Bin Wang

机构 * Hangzhou Institute of Technology, Xidian University, China(杭州科技学院,西安电子科技大学,中国) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学) Nankai University(南开大学) New York University(纽约大学) East China Normal University(华东师范大学) Hikvision Digital Technology Co., Ltd(海康威视数字技术有限公司) Shanghai Industrial Control Safety Innovation Tech. Co., Ltd(上海工业控制安全创新技术有限公司)

详情

展开后加载摘要…

URL PDF HTML 收藏