TINA: Text-Free Inversion Attack for Unlearned Text-to-Image Diffusion Models
TINA:无文本逆向攻击用于未学习的文本到图像扩散模型
Qianlong Xiang, Miao Zhang, Haoyu Zhang, Kun Wang, Junhui Hou, Liqiang Nie
机构
*
Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))
;
City University of Hong Kong(香港城市大学)
;
Shenzhen Loop Area Institute(深圳河套学院)
;
Peng Cheng Laboratory(鹏城实验室)
;
Shandong University(山东大学)
机构
*
State Key Laboratory of Multimodal Artificial Intelligence Systems, CASIA(多模态人工智能系统国家重点实验室,中国科学院自动化所)
;
School of Artificial Intelligence, UCAS(人工智能学院,中国科学院大学)
;
Beijing National Research Center for Information Science and Technology(北京信息科学研究中心)
;
Institute of Artificial Intelligence, USTB(信息科学技术大学人工智能学院)
;
School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院)
;
Zhongguancun Academy(中关村学院)
Does YOLO Really Need to See Every Training Image in Every Epoch?
YOLO真的需要在每个epoch中都看到每张训练图像吗?
Xingxing Xie, Jiahua Dong, Junwei Han, Gong Cheng
机构
*
School of Automation, Northwestern Polytechnical University(西北工业大学自动化学院)
;
School of Artificial Intelligence, Chongqing University of Posts and Telecommunications(重庆邮电大学人工智能学院)
FINER: MLLMs Hallucinate under Fine-grained Negative Queries
FINER:MLLMs在细粒度负查询下产生幻觉
Rui Xiao, Sanghwan Kim, Yongqin Xian, Zeynep Akata, Stephan Alaniz
机构
*
Technical University of Munich(慕尼黑技术大学)
;
Munich Center for Machine Learning(慕尼黑机器学习中心)
;
Helmholtz Munich(海德堡-慕尼黑亥姆霍尔茨中心)
;
Google(谷歌)
;
LTCI, Télécom Paris, Institut Polytechnique de Paris(LTCI,巴黎电信学院,巴黎理工学院)
机构
*
German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心(DFKI))
;
RPTU University Kaiserslautern-Landau(科布伦茨-兰道大学(RPTU))
;
University of Modena and Reggio Emilia(摩德纳和雷吉奥-艾米利亚大学)
Learning Coordinate-based Convolutional Kernels for Continuous SE(3) Equivariant and Efficient Point Cloud Analysis
学习基于坐标的卷积核以实现连续SE(3)等价性和高效的点云分析
Jaein Kim, Hee Bin Yoo, Dong-Sig Han, Byoung-Tak Zhang
机构
*
Interdisciplinary Program in Neuroscience, Seoul National University(首尔国立大学神经科学跨学科项目)
;
Département d’Informatique, École Normale Supérieure (ENS)(规范高等学校计算机系)
;
Department of Computing, Imperial College London(伦敦帝国学院计算系)
;
Department of Computer Science and Engineering, Seoul National University(首尔国立大学计算机科学与工程系)
机构
*
Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学北京校区人工智能学院)
;
Beijing Key Laboratory of Research on Large Models and Intelligent Governance(北京大型模型与智能治理研究重点实验室)
;
Engineering Research Center of Next-Generation Intelligent Search and Recommendation, MOE(教育部下一代智能搜索与推荐工程研究中心)
;
Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)
;
Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院)
CineSRD: Leveraging Visual, Acoustic, and Linguistic Cues for Open-World Visual Media Speaker Diarization
CineSRD:利用视觉、听觉和语言线索进行开放世界视觉媒体说话人聚类
Liangbin Huang, Xiaohua Liao, Chaoqun Cui, Shijing Wang, Zhaolong Huang, Yanlong Du, Wenji Mao
机构
*
Hujing Digital Media and Entertainment Group(华景数字媒体与娱乐集团)
;
MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS部门)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
School of Computer Science and Technology, Beijing Jiaotong University(北京交通大学计算机科学与技术学院)
F2HDR: Two-Stage HDR Video Reconstruction via Flow Adapter and Physical Motion Modeling
F2HDR:通过流适配器和物理运动建模的两阶段HDR视频重建
Huanjing Yue, Dawei Li, Shaoxiong Tu, Jingyu Yang
机构
*
School of Electrical and Information Engineering, Tianjin University(天津大学电气与信息工程学院)
;
State Key Laboratory of Smart Power Distribution Equipment and System, Tianjin University(天津大学智能电力分配设备与系统国家重点实验室)
;
Huawei Technologies Co., Ltd.(华为技术有限公司)
VL-RouterBench: A Benchmark for Vision-Language Model Routing
VL-RouterBench:一种用于视觉-语言模型路由的基准测试
Zhehao Huang, Baijiong Lin, Jingyuan Zhang, Jingying Wang, Yuhang Liu, Ning Lu, Tao Li, Xiaolin Huang
机构
*
Institute of Image Processing and Pattern Recognition, Shanghai Jiao Tong University(1 图像处理与模式识别研究所,上海交通大学)
;
The Hong Kong University of Science and Technology (Guangzhou)(2 香港科学与技术大学(广州))
;
The Hong Kong University of Science and Technology(3 香港科学与技术大学)
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Department of Computer Science, Hong Kong Baptist University(香港 Baptist 大学计算机科学系)
;
College of Computing and Data Science, NTU(NTU 计算与数据科学学院)
;
Huawei(华为)
;
School of Flexible Electronics, SYSU(SYSU 灵活电子学院)
;
School of Cyber Science and Technology, Shenzhen Campus of Sun Yat-sen University(Sun Yat-sen 大学深圳校区计算机科学与技术学院)
机构
*
Sun Yat-sen University(中山大学)
;
Pengcheng Laboratory(鹏城实验室)
;
Nanyang Technological University(南洋理工大学)
;
Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究院,中国科学院)
;
X-Era AI Lab(X-Era AI实验室)
Benchmarking Endoscopic Surgical Image Restoration and Beyond
内窥手术图像修复与更广泛的评估
Jialun Pei, Diandian Guo, Donghui Yang, Zhixi Li, Yuxin Feng, Long Ma, Bo Du, Pheng-Ann Heng
机构
*
The Chinese University of Hong Kong(香港中文大学)
;
Dalian University of Technology(大连理工大学)
;
Southern Medical University(南方医科大学)
;
Xidian University(西安电子科技大学)
;
Wuhan University(武汉大学)