Reinforcement Learning-Based Prompt Template Stealing for Text-to-Image Models
机构 * Xiaotian Zou
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
Comments 10 pages, 3 figures
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
机构 * Xiaotian Zou
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
Comments 10 pages, 3 figures
机构 * Teamreboott Inc.(Teamreboott公司) ; MIRI D.I.H Inc.(MIRI D.I.H公司)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.CL
机构 * Midjourney ; Northwestern University(西北大学) ; University of California, Santa Cruz(加州大学圣克鲁兹分校)
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CV、cs.CL
Comments Accepted at EMNLP 2025
专题命中 多模态生成 :audio-visual(abstract);分类 cs.CV、cs.MM
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
Comments text-to-image generation, automatic prompt, DPO, Counterfactual
专题命中 多模态生成 :MLLM(abstract);分类 cs.CL、cs.AI
Comments 31 pages, 16 figures, 12 tables
机构 * UT Austin(得克萨斯大学) ; Technion, Israel Institute of Technology(技术学院,以色列技术学院) ; Brown University(布朗大学) ; Meta AI
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV、cs.AI
机构 * Sports Vision, Inc.(体育视觉公司) ; Vizworld, Inc.(Vizworld公司)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
Comments 13 pages, 7 Figures
机构 * Rutgers University(新泽西罗格斯大学)
专题命中 多模态生成 :MLLM(abstract);分类 cs.CV、cs.AI
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
机构 * Southern University of Science and Technology(南方科技大学) ; Pengcheng Laboratory(鹏城实验室)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
机构 * University of Amsterdam(阿姆斯特丹大学)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV、cs.AI
Comments The paper is accepted by the Conference on Information and Knowledge Management (CIKM), 2025
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CV、cs.AI
机构 * School of Computer Science(计算机科学学院) ; School of Science(科学学院) ; Faculty of Information Technology(信息技术学院)
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CL、cs.MM
机构 * The Alan Turing Institute(艾伦·图灵研究所) ; Heriot-Watt University(赫瑞-沃德大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
机构 * Mila, University of Montreal(蒙特利尔大学Mila) ; McGill University(麦吉尔大学) ; University of Pennsylvania(宾夕法尼亚大学) ; University of Toronto(多伦多大学) ; University of California, Los Angeles(加州大学洛杉矶分校) ; Southwestern University of Finance and Economics(西南财经大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.CL
Comments Accepted as a main conference paper at EMNLP 2025
机构 * Lab for AI in Medical Imaging, Technical University of Munich, Munich, Germany(人工智能医学影像实验室,慕尼黑技术大学,慕尼黑,德国) ; Munich Center for Machine Learning, Munich, Germany(慕尼黑机器学习中心,慕尼黑,德国)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV、cs.AI
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
机构 * Chengdu Techman Software Co., Ltd.(成都技漫软件有限公司) ; Sichuan University(四川大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
机构 * School of Computer Science and Engineering, South China University of Technology(华南理工大学计算机科学与工程学院) ; South China University of Technology(华南理工大学) ; Guangdong Engineering Center for Large Model and GenAI Technology(广东省大模型与生成式人工智能技术工程中心) ; Guangdong Provincial Key Lab of Computational Intelligence and Cyberspace Information(广东省计算智能与网络信息重点实验室) ; Centre for Smart Health, Hong Kong Polytechnic University(香港理工大学智能健康研究中心) ; CAS-Hong Kong Joint Laboratory for Multimodal Medical Molecular Imaging(中国科学院-香港联合多模态医学分子成像联合实验室) ; School of Electronic and Information Engineering, South China University of Technology(华南理工大学电子与信息学院) ; Pazhou Lab, Guangzhou, Guangdong, China(广州琶洲实验室) ; School of Computing and Information Systems, Singapore Management University(新加坡国立大学计算机与信息系统学院)
专题命中 多模态生成 :multimodal(abstract);分类 cs.AI、cs.MM
机构 * ONE Lab, HUST(华中科技大学 ONE 实验室) ; ONE Lab, HUST University of Maryland(华中科技大学 与 马里兰大学 ONE 实验室) ; University of Washington(华盛顿大学) ; Zhejiang University(浙江大学)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV、cs.CL
Comments Technical Report
机构 * Peking University(北京大学) ; The Hong Kong University of Science and Technology(香港科技大学) ; Beijing University of Posts and Telecommunications(北京邮电大学)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV、cs.MM
Journal ref ICCV 2025
机构 * School of Computer Science and Engineering, University of Electronic Science and Technology of China(计算机科学与工程学院,电子科技大学)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV、cs.AI
机构 * Paris-Saclay University(巴黎-萨克雷大学) ; ONERA - The French Aerospace Lab(法国航空航天实验室)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV、cs.AI
机构 * Michigan State University(密歇根州立大学) ; Seoul National University(首尔国立大学) ; Rutgers University(罗格斯大学) ; Brookhaven National Laboratory(布鲁赫斯国家实验室)
专题命中 多模态生成 :audio-visual(abstract);分类 cs.AI、eess.AS
Comments Accepted at the ACM MM 2025 - The 1st CogMAEC Workshop (Oral)
机构 * Boston University(波士顿大学) ; Georgetown University(乔治城大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
机构 * Research Institute, National Cancer Center Korea(韩国国家癌症中心研究所) ; Department of Radiology, National Cancer Center Korea(韩国国家癌症中心放射科)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI