AffordGrasp: Cross-Modal Diffusion for Affordance-Aware Grasp Synthesis
AffordGrasp:跨模态扩散用于感知意识抓取合成
Xiaofei Wu, Yi Zhang, Yumeng Liu, Yuexin Ma, Yujiao Shi, Xuming He
机构
*
ShanghaiTech University(上海科技大学)
;
Shanghai Engineering Research Center of Intelligent Vision and Imaging(上海智能视觉与成像工程技术研究中心)
;
University of Science and Technology of China(中国科学技术大学)
机构
*
Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心)
;
Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(中国科学院大学杭州高等研究院)
;
LLM Team, Shopee Pte. Ltd.(Shopee私人有限公司大语言模型团队)
Echoes of ownership: Adversarial-guided dual injection for copyright protection in MLLMs
所有权的回声:对抗引导的双注入用于MLLMs中的版权保护
Chengwei Xia, Fan Ma, Ruijie Quan, Yunqiu Xu, Kun Zhan, Yi Yang
机构
*
School of Information Science and Engineering, Lanzhou University(兰州大学信息科学与工程学院)
;
College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)
;
College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
;
Nanjing University of Science and Technology(南京理工大学)
;
City University of Hong Kong(香港城市大学)
Beyond Recognition: Evaluating Visual Perspective Taking in Vision Language Models
超越识别:评估视觉语言模型中的视觉视角理解
Gracjan Góral, Alicja Ziarko, Piotr Miłoś, Michał Nauman, Maciej Wołczyk, Michał Kosiński
机构
*
University of Warsaw(华沙大学)
;
Polish Academy of Sciences(波兰科学院)
;
Stanford University(斯坦福大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
IDEAS NCBR
;
Lute