InternSVG: Towards Unified SVG Tasks with Multimodal Large Language Models
InternSVG:通过多模态大语言模型实现统一的SVG任务
机构 * Shanghai Jiao Tong University(上海交通大学) ; Shanghai AI Laboratory(上海人工智能实验室) ; Nanjing University(南京大学) ; Donghua University(东华大学) ; The Chinese University of Hong Kong(香港中文大学)
专题命中 其他VLM :multimodal large language model(title,abstract);MLLM(abstract);分类 cs.CV
AI总结 InternSVG通过多模态大语言模型实现统一的SVG任务建模,结合大规模数据集和两阶段训练策略,提升SVG理解、编辑和生成性能。