机构
*
Autolab, Westlake University(Autolab,西拉丘吉大学)
;
Tianjin University(天津大学)
;
Zhejiang University(浙江大学)
;
Capital Normal University(首都师范大学)
;
University of Hong Kong(香港大学)
PhotoArtAgent: Intelligent Photo Retouching with Language Model-Based Artist Agents
Haoyu Chen, Keda Tao, Yizao Wang, Xinlei Wang, Lei Zhu, Jinjin Gu
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))
;
Xidian University(西安电子科技大学)
;
Sun Yat-sen University(中山大学)
;
The University of Sydney(悉尼大学)
;
INSAIT, Sofia University(INSAIT,索菲亚大学)
SURDS: Benchmarking Spatial Understanding and Reasoning in Driving Scenarios with Vision Language Models
Xianda Guo, Ruijun Zhang, Yiqun Duan, Yuhang He, Dujun Nie, Wenke Huang, Chenming Zhang, Shuai Liu, Hao Zhao, Long Chen
机构
*
School of Computer Science, Wuhan University(武汉大学计算机学院)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Waytous
;
University of Technology Sydney(悉尼大学)
;
Microsoft Research(微软研究院)
;
IAIR, Xi’an Jiaotong University(西安交通大学IAIR)
;
TikTok
;
AIR, Tsinghua University(清华大学AIR)
机构
*
Mohamed bin Zayed University of Artificial Intelligence(莫扎伊德·本·扎耶德人工智能大学)
;
ByteDance(字节跳动)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
The Australia National University(澳大利亚国立大学)
;
Renmin University of China(中国人民大学)
;
Wuhan University(武汉大学)
机构
*
Center for Research in Computer Vision, University of Central Florida(计算机视觉研究中心,中央佛罗里达大学)
;
Microsoft Research(微软研究院)
;
Indian Institute of Technology, Kharagpur(印度克里希纳布尔理工学院)
机构
*
School of Control Science and Engineering, Shandong University(山东大学控制科学与工程学院)
;
Department of Computer Science, The University of Manchester(曼彻斯特大学计算机科学系)
HyperSIGMA: Hyperspectral Intelligence Comprehension Foundation Model
Di Wang, Meiqi Hu, Yao Jin, Yuchun Miao, Jiaqi Yang, Yichu Xu, Xiaolei Qin, Jiaqi Ma, Lingyu Sun, Chenxing Li, Chuan Fu, Hongruixuan Chen, Chengxi Han, Naoto Yokoya, Jing Zhang, Minqiang Xu, Lin Liu, Lefei Zhang, Chen Wu, Bo Du, Dacheng Tao, Liangpei Zhang
机构
*
Wuhan University(武汉大学)
;
Chongqing University(重庆大学)
;
The University of Tokyo(东京大学)
;
National Engineering Research Center of Speech and Language Information Processing(语音与语言信息处理国家工程研究中心)
;
Nanyang Technological University(南洋理工大学)