InstructAttribute: Fine-grained Object Attributes editing with Instruction
机构 * Zhejiang University(浙江大学)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
机构 * Zhejiang University(浙江大学)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
机构 * National University of Singapore(新加坡国立大学) ; UT Austin(德克萨斯大学奥斯汀分校) ; University of St. Gallen(圣加尔登大学) ; Oxford University(牛津大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.AI
Comments We propose a method that can generate LoRA parameters in seconds
机构 * MIT(麻省理工学院) ; NUS(国立大学新加坡) ; McGill(麦吉尔大学) ; HKUST(香港科技大学) ; UFL(佛罗里达大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CL
机构 * Indian Institute of Technology Guwahati(印度理工学院古瓦哈提)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.AI
Comments Adarsh Gupta and Bhabesh Mali contributed equally to this work
机构 * Anhui University, Hefei, China(安徽大学) ; TReNDS Center (GSU, Gatech, Emory), Atlanta, GA, USA(TReNDS中心)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(abstract);分类 cs.CL
机构 * The Robotics Institute, Carnegie Mellon University, United States(卡内基梅隆大学机器人研究所)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
Comments 15 pages, 11 figures
机构 * The Chinese University of Hong Kong(香港中文大学) ; Xi’an Jiaotong University(西安交通大学) ; Tsinghua University(清华大学) ; The University of Hong Kong(香港大学) ; Johns Hopkins University(约翰霍普金斯大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments 43 pages. Preprint
机构 * Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments Accepted to NeurlPS 2024
专题命中 多模态生成 :multimodal(abstract);分类 cs.AI
Comments 48 pages, 10 figures
机构 * Hefei University of Technology(合肥工业大学) ; University of Science and Technology of China(中国科学技术大学)
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CV
机构 * University of California Berkeley(加州大学伯克利分校) ; California Institute of Technology(加州理工学院) ; University of Toronto(多伦多大学) ; University of Wisconsin-Madison(威斯康星大学麦迪逊分校) ; Morgridge Institute for Research(莫里格研究所) ; Université de Montréal(蒙特利尔大学) ; Mila-Québec Artificial Intelligence Institute(魁北克人工智能研究所) ; Texas A&M University(德克萨斯农工大学) ; Nvidia Research(Nvidia研究部) ; Argonne National Laboratory(阿贡国家实验室) ; National Research Council Canada(加拿大国家研究委员会) ; HEC Montréal(蒙特利尔HEC商学院)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.AI
机构 * University of Edinburgh(爱丁堡大学) ; Canon Medical Research Europe Ltd.(佳能医疗欧洲有限公司)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
Comments 14 pages, 6 figures
机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) ; ARC Lab, Tencent PCG(腾讯PCG ARC实验室) ; The Chinese University of Hong Kong(香港中文大学) ; The University of Hong Kong(香港大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.AI
Comments Code: https://github.com/TencentARC/MindOmni
机构 * Department of Computer Science, The University of Toronto(多伦多大学计算机科学系) ; College of Future Information Technology, Fudan University(复旦大学未来信息技术学院) ; Division of Natural and Applied Sciences, Duke Kunshan University(杜克昆山大学自然与应用科学系) ; Department of Electrical and Computer Engineering, The University of British Columbia(不列颠哥伦比亚大学电气与计算机工程系) ; School of Computer Science, University of Sydney(悉尼大学计算机科学学院) ; Department of Chemical Engineering, Massachusetts Institute of Technology(麻省理工学院化学工程系) ; School of Future Science and Engineering, Soochow University(苏州大学未来科学与工程学院) ; School of Computer Science and Artificial Intelligence, Zhengzhou University(郑州大学计算机科学与人工智能学院) ; Department of Computer Science, St. Francis Xavier University(圣弗朗西斯科大学计算机科学系) ; Department of Computer Science and Engineering, State University of New York at Buffalo(纽约州立大学布法罗分校计算机科学与工程系)
专题命中 多模态生成 :multimodal(abstract);分类 cs.AI
Comments 20 pages, 11 figures, 13 tables
机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) ; University of Washington(华盛顿大学)
专题命中 多模态生成 :image-text(abstract);分类 cs.CV
Comments 41 pages, 22 figures, 17 tables
机构 * Tsinghua University(清华大学) ; University of Washington(华盛顿大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
机构 * Wuhan University(武汉大学) ; National University of Defense Technology(国防科技大学)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.AI
机构 * Department of Radiology, Weill Cornell Medicine, New York City, NY, USA(韦尔·科恩医学中心放射科) ; School of Electrical and Computer Engineering, Cornell University, Ithaca, NY, USA(康奈尔大学电气与计算机工程学院) ; Computer Science and Artificial Intelligence Lab at the Massachusetts Institute of Technology, Cambridge, MA, USA(麻省理工学院计算机科学与人工智能实验室)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
Comments Accepted for publication at the Journal of Machine Learning for Biomedical Imaging (MELBA) https://melba-journal.org/2025:010
Journal ref Machine.Learning.for.Biomedical.Imaging. 3 (2025)
专题命中 多模态生成 :multimodal(abstract);分类 cs.AI
Comments ICML 2025
机构 * Department of Computer Engineering, Bogazici University(计算机工程系,博雅大学) ; SISReC, OTRI, Osaka University(SISReC、OTRI、大阪大学) ; Department of Computer Science, Ozyegin University(计算机科学系,奥兹格伦大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.AI
Comments Published in IEEE RA-L with IROS presentation option (2024 IEEE/RSJ International Conference on Intelligent Robots and Systems), 8 pages, 7 figures
Journal ref IEEE Robotics and Automation Letters, Volume: 9, Issue: 4, 3116 - 3123 (April 2024)
机构 * Faculty of Engineering, University of Porto(葡萄牙波尔图大学工程学院) ; INESC TEC(葡萄牙INESC TEC)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
机构 * CUHK MMLab(香港大学MMLab)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments Code is released at https://github.com/xinyan-cxy/MINT-CoT
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
Comments 13 pages, 9 figures
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments ICML 2025 camera ready
机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) ; Kuaishou Technology(快手科技)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
Comments The project page is at \href{https://zixuan-ye.github.io/UNIC}{https://zixuan-ye.github.io/UNIC}
机构 * Jilin University(吉林大学) ; National Taiwan University(国立台湾大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
机构 * City University of Hong Kong(香港城市大学) ; Zhejiang University(浙江大学) ; KTH Royal Institute of Technology(皇家理工学院) ; Hangzhou Dianzi University(杭州电子科技大学)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.AI
机构 * HKUST(GZ)(香港科技大学(广州)) ; Quwan(启文) ; HKUST(香港科技大学)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
Comments 11 pages, 10 figures in main paper, 10 pages, 12 figures in supplementary
机构 * Shanghai Business School(上海商学院) ; Shanghai Jiaotong University(上海交通大学) ; Cisco Systems Inc.(思科系统公司) ; Beijing Shangruitong Education Technology Co., Ltd.(北京尚润通教育科技有限公司)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.AI
Comments To Appear in ACL'25