From Bench to Bedside: A DeepSeek-Powered AI System for Automated Chest Radiograph Interpretation in Clinical Practice
专题命中 视觉定位与Grounding :multimodal large language model(abstract)
AI 大模型
视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。
专题命中 视觉定位与Grounding :multimodal large language model(abstract)
机构 * MIT(麻省理工学院) ; MIT-IBM Watson AI Labs(麻省理工-IBM沃森人工智能实验室) ; IBM Research(IBM研究院)
专题命中 文档图表理解 :vision-language model(abstract);VLM(abstract);分类 cs.CV、cs.AI
专题命中 文档图表理解 :vision-language model(abstract);分类 cs.AI
机构 * Imperial College London(伦敦帝国理工学院) ; Shanghai AI Laboratory(上海人工智能实验室) ; UC San Diego(加州大学圣地亚哥分校) ; VIVO ; South China University of Technology(华南理工大学)
专题命中 GUI与屏幕智能体 :vision-language model(abstract);分类 cs.CV、cs.AI
Comments Project website: https://robotic-visual-instruction.github.io/
机构 * Beijing Institute of Technology, Beijing, P. R. China(北京理工大学) ; The University of Hong Kong, Hong Kong, P. R. China(香港大学)
专题命中 GUI与屏幕智能体 :vision language model(abstract)
Comments accepted to International Journal of Robotics Research(IJRR)
机构 * IIT Kharagpur(印度理工学院Kharagpur分校)
专题命中 幻觉与鲁棒性 :vision-language model(abstract);分类 cs.CV、cs.AI
机构 * Beihang University(北洋大学) ; National University of Singapore(新加坡国立大学) ; Huazhong University of Science and Technology(华中科技大学) ; Henan University of Science and Technology(河南科技大学)
专题命中 幻觉与鲁棒性 :multimodal large language model(abstract);分类 cs.CV
Comments 16 pages, 5 figures
专题命中 VLM训练与架构 :vision-language model(title,abstract);VLM(abstract);分类 cs.CV
Comments ICCV 2025
机构 * Technical University of Munich, Germany(慕尼黑技术大学,德国) ; Helmholtz Munich, Munich Center for Machine Learning, Germany(海德堡慕尼黑,慕尼黑机器学习中心,德国) ; University of Tübingen, Tübingen AI Center, Germany(图宾根大学,图宾根人工智能中心,德国) ; University of Trento, Italy(特伦托大学,意大利) ; Beijing University of Posts and Telecommunications, China(北京邮电大学,中国)
专题命中 VLM训练与架构 :multimodal large language model(title,abstract);LLaVA(abstract);分类 cs.CV
Comments Accepted at GCPR 2025
专题命中 VLM训练与架构 :vision-language model(title,abstract);VLM(abstract);分类 cs.CV
Comments Accepted by ICCV 2025
专题命中 VLM训练与架构 :VLM(title);vision-language model(abstract);LLaVA(abstract);分类 cs.CV
Comments ICCV 2025
专题命中 VLM训练与架构 :vision language model(title,abstract);分类 cs.CV
Comments Accepted by ICCV 2025
机构 * School of Electrical and Electronic Engineering(电气与电子工程学院) ; Nanyang Technological University(南洋理工大学) ; School of Computer Science and Technology(计算机科学与技术学院) ; University of Chinese Academy of Sciences(中国科学院大学)
专题命中 VLM训练与架构 :visual language model(abstract);multimodal large language model(abstract);分类 cs.CV、cs.AI、cs.LG
Comments **14 pages, 3 figures, 2 tables
机构 * Humain Riyadh, KSA(利雅得人类,沙特阿拉伯)
专题命中 VLM训练与架构 :vision-language model(abstract);VLM(abstract);分类 cs.CV、cs.AI
机构 * Samsung AI Center(三星AI中心) ; Mountain View University of California, Santa Barbara(山景城加州大学圣巴巴拉分校)
专题命中 VLM训练与架构 :vision-language model(abstract);LLaVA(abstract);分类 cs.CV
Comments International Conference on Computer Vision (ICCV) 2025
专题命中 VLM训练与架构 :vision-language model(abstract);VLM(abstract)
机构 * University of Michigan(密歇根大学) ; Johns Hopkins University(约翰霍普金斯大学) ; Central South university(中南大学) ; HKGAI
专题命中 VLM训练与架构 :LLaVA(abstract);分类 cs.AI、cs.LG
Comments 6 pages
机构 * EPFL(苏黎世联邦理工学院) ; Mila - Quebec AI Institute Mcgill University(蒙特利尔麦吉尔大学人工智能研究所) ; Westlake University(西湖大学)
专题命中 VLM训练与架构 :vision-language model(abstract);分类 cs.CV、cs.AI
Comments Accepted by ACM MM 2025
机构 * Flipkart Data Science(Flipkart数据科学)
专题命中 VLM训练与架构 :vision language model(abstract);分类 cs.CV、cs.AI
专题命中 VLM训练与架构 :MLLM(abstract);分类 cs.CV
Comments Project page: https://kitten-project.github.io/
机构 * Fudan University(复旦大学) ; Zhejiang University(浙江大学) ; Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) ; Stanford University(斯坦福大学) ; The Chinese University of Hong Kong(香港中文大学) ; S-Lab, Nanyang Technological University(南洋理工大学S实验室)
专题命中 其他VLM :MLLM(abstract);分类 cs.CV
Comments Page: https://zyh482.github.io/3DGen-Bench/ ; Code: https://github.com/3DTopia/3DGen-Bench