From Understanding to Engagement: Personalized pharmacy Video Clips via Vision Language Models (VLMs)
从理解到参与:通过视觉语言模型(VLMs)生成个性化药学视频片段
机构 * Roche(罗氏) ; Accenture(埃森哲) ; Involead
专题命中 VLM训练与架构 :vision language model(title,abstract);VLM(abstract,comments);分类 cs.CV、cs.LG
AI总结 本文提出基于视觉语言模型和音频语言模型的个性化药学视频片段生成方法,通过剪切合并算法和个性化机制提升生成效率与质量,实现制药行业内容处理的高效自动化。
Comments Contributed original research to top tier conference in VLM; currently undergoing peer review