Omni-Reward: Towards Generalist Omni-Modal Reward Modeling with Free-Form Preferences
Zhuoran Jin, Hongbang Yuan, Kejian Zhu, Jiachun Li, Pengfei Cao, Yubo Chen, Kang Liu, Jun Zhao
机构
*
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
Benchmarking Egocentric Multimodal Goal Inference for Assistive Wearable Agents
Vijay Veerabadran, Fanyi Xiao, Nitin Kamra, Pedro Matias, Joy Chen, Caley Drooff, Brett D Roads, Riley Williams, Ethan Henderson, Xuanyi Zhao, Kevin Carlberg, Joseph Tighe, Karl Ridgeway
SafeEraser: Enhancing Safety in Multimodal Large Language Models through Multimodal Machine Unlearning
Junkai Chen, Zhijie Deng, Kening Zheng, Yibo Yan, Shuliang Liu, PeiJun Wu, Peijie Jiang, Jia Liu, Xuming Hu
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
The Hong Kong University of Science and Technology(香港科技大学)
;
Southeast University(东南大学)
;
Ant Group, Alibaba(蚂蚁集团)
机构
*
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
University at Buffalo, State University of New York(纽约州立大学布法罗分校)
;
Nanjing University of Posts and Telecommunications(南京邮电大学)
Zero-Shot Multi-modal Large Language Model v.s. Supervised Deep Learning: A Comparative Study on CT-Based Intracranial Hemorrhage Subtyping
Yinuo Wang, Yue Zeng, Kai Chen, Cai Meng, Chao Pan, Zhouping Tang
机构
*
Image Processing Center, Beihang University(北京航空航天大学图像处理中心)
;
School of Mechanical Engineering and Automation, Beihang University(北京航空航天大学机械工程与自动化学院)
;
Department of Neurology, Tongji Hospital, Tongji Medical College, Huazhong University of Science and Technology(华中科技大学同济医学院神经内科,同济医院)
机构
*
Department of Electrical Engineering and Computer Science, University of Missouri(密苏里大学电气工程与计算机科学系)
;
Christopher S. Bond Life Sciences Center, University of Missouri(密苏里大学克里斯托弗·S·邦德生命科学中心)
;
Department of Computer Science, Northwestern University(西北大学计算机科学系)
;
Department of Computer Science and Mathematics, Truman State University(特拉华州立大学计算机科学与数学系)
;
Marquette High School(马基特高中)
;
Community Health Service Center, Shanghai Pudong New Area(上海浦东新区社区卫生服务中心)
;
School of Engineering and Applied Science, University of Pennsylvania(宾夕法尼亚大学工程与应用科学学院)
;
Department of Endocrinology, Seventh People’s Hospital of Shanghai University of Traditional Chinese Medicine(上海中医药大学第七人民医院内分泌科)
;
School of Acupuncture-Moxibustion and Tuina, Shanghai University of Traditional Chinese Medicine(上海中医药大学针灸推拿学院)
机构
*
Department of Electrical Engineering, National Taiwan University(国立台湾大学电子工程系)
;
GARMIN (ASIA) CORPORATION(GARMIN(亚洲)公司)
;
Institute of Artificial Intelligence Innovation, National Yang Ming Chiao Tung University(国家阳明交通大学人工智能创新研究所)
;
Department of Information Management, National Dong Hwa University(国立东吴大学资讯管理系)
Understanding What Is Not Said:Referring Remote Sensing Image Segmentation with Scarce Expressions
Kai Ye, Bowen Liu, Jianghang Lin, Jiayi Ji, Pingyang Dai, Liujuan Cao
机构
*
Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China(教育部多媒体可信感知与高效计算重点实验室)
;
Institute of Artificial Intelligence, Xiamen University(厦门大学人工智能研究院)
;
Xiamen University(厦门大学)
;
School of Informatics, Xiamen University(厦门大学信息学院)
MedXplain-VQA: Multi-Component Explainable Medical Visual Question Answering
Hai-Dang Nguyen, Minh-Anh Dang, Minh-Tan Le, Minh-Tuan Le
机构
*
Faculty Of Information Technology VNU University of Engineering(信息科技学院越南工程大学)
;
IT-BT Convergence Technology Division Vietnam-Korea Institute of Science(IT-BT融合技术部门越南-韩国科学技术院)
;
TADI Global Lab TADI Global Company Limited(TADI全球实验室TADI全球有限公司)
;
Faculty of Finance Banking Academy of Vietnam(金融学院越南银行学院)
专题命中
多模态评测
:multi-modal(abstract);分类 cs.CV
Comments10 pages, 4 figures, IEEE conference format
LRW-Persian: Lip-reading in the Wild Dataset for Persian Language
Zahra Taghizadeh, Mohammad Shahverdikondori, Arian Noori, Alireza Dadgarnia
机构
*
Department of Mechanical Engineering(机械工程系)
;
Sharif University of Technology(谢里夫科技大学)
;
Department of Mathematical Sciences(数学科学系)
;
Department of Computer Engineernig(计算机工程系)
机构
*
ZJU-Angelalign R&D Center for Intelligence Healthcare(浙江大学智能医疗研发中心)
;
Zhejiang University(浙江大学)
;
Zhejiang Key Laboratory of Medical Imaging Artificial Intelligence(浙江省医学影像人工智能重点实验室)
;
Guangdong Institute of Intelligence Science and Technology(广东省智能科学与技术研究院)
Emotion Recognition with Minimal Wearable Sensing: Multi-domain Feature, Hybrid Feature Selection, and Personalized vs. Generalized Ensemble Model Analysis
Muhammad Irfan, Anum Nawaz, Ayse Kosal Bulbul, Riku Klen, Abdulhamit Subasi, Tomi Westerlund, Wei Chen