arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Harvard University(哈佛大学)

2026-08-31 至 2026-08-31 共收录 2
2608.28455 2026-08-31 cs.CV cs.AI 新提交

ARC-CT: Anatomy-Routed Contrastive Vision-Language Learning for 3D Chest CT

ARC-CT:用于3D胸部CT的解剖路由对比视觉-语言学习

Huseyin Umut Isik, Mehmet Alp Ozaydin, Sila Kurugol, Şeyda Ertekin

机构 * Harvard Medical School(哈佛医学院) METU-DTX Digital Transformation and Innovation Center(METU-DTX数字转型与创新中心)

AI总结 ARC-CT是一种基于LLM提取的报告标签、无需人工标注的区域感知对比视觉-语言框架,通过三个组件解决胸部CT全局对比学习的局限,在18种异常上实现0.86无掩码宏观AUC,性能优于高效基线和大Transformer模型。

Comments Accepted to the Thoracic Image Analysis (TIA) Workshop at MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28218 2026-08-31 cs.CV 新提交

Focus Where It Counts: A Salience-Driven Vision-Language Model for Low Vision Assistance

聚焦关键之处:面向低视力辅助的显著性驱动视觉-语言模型

Jiazhao Liang, Hao Huang, Shuaihang Yuan, Congcong Wen, Geeta Chandra Raju Bethala, Giles Hamilton-Fletcher, Yu Hao, John-Ross Rizzo, Mengyu Wang, Anthony Tzes, Yi Fang

机构 * New York University Tandon School of Engineering(纽约大学坦登工程学院) New York University Abu Dhabi(纽约大学阿布扎比分校) NYU Grossman School of Medicine(纽约大学格罗斯曼医学院) NYU Langone Health(纽约大学兰贡医疗中心) Harvard University(哈佛大学)

AI总结 针对现有视觉-语言模型未建模人类感知优先级的问题,提出显著性驱动的Salience-LLaVA模型,构建三个显著性数据集并引入SCMI评估,部署于辅助眼镜实现低视力辅助。

详情

展开后加载摘要…

URL PDF HTML 收藏