CapRecover: A Cross-Modality Feature Inversion Attack Framework on Vision Language Models
机构 * New York University(纽约大学)
专题命中 其他VLM :vision language model(title);vision-language model(abstract);分类 cs.CV、cs.AI
Comments 9 pages, accepted by the 2025 ACM Multimedia Conference. Code is available at https://jus1mple.github.io/Image2CaptionAttack