From Imitation to Innovation: The Emergence of AI Unique Artistic Styles and the Challenge of Copyright Protection
机构 * WeChat AI, Tencent Inc(腾讯公司)
专题命中 其他VLM :multimodal large language model(abstract);分类 cs.CV、cs.AI
AI 大模型
视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。
机构 * WeChat AI, Tencent Inc(腾讯公司)
专题命中 其他VLM :multimodal large language model(abstract);分类 cs.CV、cs.AI
专题命中 其他VLM :vision-language model(abstract);分类 cs.CV、cs.LG
Comments 30 pages
专题命中 其他VLM :vision-language model(abstract);分类 cs.CV、cs.LG
Comments An earlier version appeared in the CVPR 2025 Workshop on Generative Models for Computer Vision
机构 * Seoul National University(首尔国立大学)
专题命中 其他VLM :vision-language model(abstract);分类 cs.CV、cs.AI
Comments Accepted at ACL 2025 Findings
机构 * Peking University(北京大学) ; UC San Diego(加州大学圣地亚哥分校) ; Renmin University of China(中国人民大学) ; BeingBeyond
专题命中 其他VLM :multimodal large language model(abstract);分类 cs.CV、cs.AI
机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) ; University of Chinese Academy of Sciences(中国科学院大学) ; Hamad Bin Khalifa University(哈马德·本·卡西姆大学) ; Central South University(中南大学)
专题命中 其他VLM :vision-language model(abstract);分类 cs.CV、cs.LG
机构 * Zhejiang University(浙江大学) ; Southeast University(东南大学) ; Alibaba(阿里巴巴) ; Shanghai Jiao Tong University(上海交通大学)
专题命中 其他VLM :multimodal large language model(abstract);分类 cs.AI、cs.LG
机构 * Peking University(北京大学) ; Shenzhen Graduate School(深圳研究生院) ; Peng Cheng Laboratory(鹏城实验室) ; Rabbitpre AI
专题命中 其他VLM :multimodal large language model(abstract);分类 cs.CV、cs.AI
机构 * Dipartimento di Scienze Matematiche, Politecnico di Torino(都灵理工大学数学科学系) ; CENTAI Institute(CENTAI研究院) ; Network Science Institute, Northeastern University(东北大学网络科学研究所) ; Institute for Experiential AI, Northeastern University(东北大学体验人工智能研究所) ; NP Lab, Network Science Institute, Northeastern University London(东北大学伦敦网络科学研究所NP实验室) ; Department of Psychology, Princeton University(普林斯顿大学心理学系) ; Program in Cognitive Science, Dartmouth College(达特茅斯学院认知科学项目) ; Department of Psychology, University of Michigan(密歇根大学心理学系) ; Microsoft Research(微软研究院) ; Princeton Neuroscience Institute(普林斯顿神经科学研究所) ; Department of Physics, Northeastern University(东北大学物理系)
专题命中 其他VLM :vision-language model(abstract);分类 cs.AI、cs.LG
机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,计算机学院,北京大学) ; WeChat AI, Tencent Inc., China(微信AI,腾讯公司,中国)
专题命中 其他VLM :multimodal large language model(abstract);分类 cs.CV、cs.AI
Comments This is the camera-ready version for ACL 2025
机构 * Department of Information Engineering, University of Padova(帕多瓦大学信息工程系) ; ABB Corporate Research(ABB企业研究)
专题命中 其他VLM :visual language model(abstract);分类 cs.AI、cs.LG
机构 * Tsinghua University(清华大学) ; Beijing University of Posts and Telecommunications(北京邮电大学)
专题命中 其他VLM :vision-language model(abstract);分类 cs.CV、cs.AI
机构 * Seoul National University(首尔国立大学) ; University of California San Diego(加州大学圣地亚哥分校) ; Chung-Ang University(Chung-Ang 大学)
专题命中 其他VLM :multimodal large language model(abstract);分类 cs.AI、cs.LG
Comments 18 pages, 3 figures, 3 tables
专题命中 其他VLM :vision language model(abstract);分类 cs.CV、cs.AI
Journal ref International Journal of Advanced Computer Science and Applications(ijacsa), 15(7), 2024
专题命中 其他VLM :vision-language model(abstract);分类 cs.CV、cs.LG
Comments 15 pages, 5 figures
机构 * Department of Electronic Engineering, BNRist, Tsinghua University(电子工程系、北京理工大学、清华大学) ; School of Electronic and Information Engineering, Beijing Jiaotong University(电子信息工程学院、北京交通大学) ; Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院、清华大学)
专题命中 其他VLM :vision-language model(abstract);分类 cs.AI、cs.LG
Comments Accepted by KDD 2025 D&B Track, https://github.com/tsinghua-fib-lab/CityBench
机构 * University of Modena and Reggio Emilia(摩德纳和雷吉奥艾米利亚大学) ; IIT-CNR(意大利国家研究委员会IIT)
专题命中 其他VLM :multimodal large language model(abstract);分类 cs.CV、cs.AI
Comments IJCAI 2025. Repo GitHub: https://github.com/aimagelab/awesome-captioning-evaluation
机构 * CVIT, IIIT Hyderabad, India(计算机视觉研究所,印度海得拉巴印度理工学院)
专题命中 其他VLM :vision-language model(abstract);分类 cs.CV、cs.AI
Comments Accepted to MIV at CVPRW 2025 (Oral)
机构 * Tsinghua University(清华大学) ; Kuaishou Technology(快手科技)
专题命中 其他VLM :vision language model(abstract);分类 cs.CV、cs.AI
机构 * University of Waterloo(滑铁卢大学)
专题命中 其他VLM :vision language model(abstract);分类 cs.CV、cs.AI
Comments 5 pages, 2 figures, Working paper
机构 * Institute of Artificial Intelligence and Robotics(人工智能与机器人研究所) ; Xi’an Jiaotong University(西安交通大学) ; School of Electrical Engineering(电气工程学院)
专题命中 其他VLM :vision-language model(abstract);分类 cs.CV、cs.LG
机构 * Dept. of Computer Science and Artificial Intelligence, DaSCI, University of Granada(计算机科学与人工智能系,DaSCI,格拉纳达大学) ; Interuniversity Institute of Earth System Research in Andalusia (IISTA), University of Granada(安达卢西亚地球系统研究中心(IISTA),格拉纳达大学) ; Dept. of Botany, University of Granada(植物学系,格拉纳达大学) ; Andalusian Center for Global Change (ENGLOBA), University of Almería(安达卢西亚全球变化中心(ENGLOBA),阿尔梅里亚大学) ; Dept. of Ecology, University of Granada(生态学系,格拉纳达大学) ; EDUCA EDTECH Group, Camino de la Torrecilla, 30, 18220, Granada, Spain(EDUCA EDTECH集团,Torrecilla路30号,格拉纳达,西班牙)
专题命中 其他VLM :visual language model(abstract);分类 cs.CV、cs.AI
Comments 23 pages, 7 figures
机构 * Georgia State University(佐治亚州立大学) ; Adobe MDSR ; Wright State University(怀特州立大学) ; California Polytechnic State University(加州州立大学帕克校区)
专题命中 其他VLM :visual language model(abstract);分类 cs.CV、cs.AI
Comments Accepted at IEEE International Conference on Big Data 2024 (IEEE BigData 2024)
Journal ref IEEE International Conference on Big Data 2024 (IEEE BigData 2024)
机构 * Sun Yat-sen University(中山大学) ; Lanzhou University(兰州大学)
专题命中 其他VLM :vision language model(abstract);分类 cs.CV、cs.AI
机构 * Université Paris-Cité(巴黎-cite大学) ; Pôle d’Expertise de la Régulation Numérique (PEReN)(数字监管专家中心)
专题命中 其他VLM :vision-language model(abstract);分类 cs.CV、cs.LG
机构 * Peking University(北京大学) ; ARC Lab, Tencent PCG(腾讯PCG ARC实验室) ; The Chinese University of Hong Kong(香港中文大学) ; Tsinghua University(清华大学)
专题命中 其他VLM :multimodal large language model(abstract);分类 cs.CV、cs.AI
Comments WebPage available at https://liyaowei-stu.github.io/project/BrushEdit/
机构 * University of California, Berkeley(加州大学伯克利分校)
专题命中 其他VLM :vision-language model(abstract);分类 cs.AI、cs.LG
机构 * Google DeepMind(谷歌DeepMind) ; Stanford University(斯坦福大学)
专题命中 其他VLM :vision language model(abstract);分类 cs.AI、cs.LG
Comments ICRA 2025
专题命中 其他VLM :vision-language model(abstract);分类 cs.CV、cs.AI
专题命中 其他VLM :vision language model(abstract);分类 cs.CV、cs.AI
Comments Published at ICLR 2025. 24 pages. The first three authors contributed equally