The Illusion of Competence: Evaluating the Effect of Explanations on Users' Mental Models of Visual Question Answering Systems
Judith Sieker, Simeon Junker, Ronja Utescher, Nazia Attari, Heiko Wersing, Hendrik Buschmeier, Sina Zarrieß
机构
*
Computational Linguistics, Department of Linguistics, Bielefeld University(语言学计算系,语言学系,比勒菲尔德大学)
;
Honda Research Institute Europe(本田欧洲研究院)
;
Digital Linguistics Lab, Department of Linguistics, Bielefeld University(数字语言学实验室,语言学系,比勒菲尔德大学)
专题命中
视觉问答
:visual question answering(title)
Comments17 pages (including Appendix). Accepted at EMNLP 2024 main
Journal refProceedings of the 2024 Conference on Empirical Methods in Natural Language Processing, pp. 19459-19475
TrustRoboReward: Preference-Ordered Isotonic Score Editing for Multi-Paradigm Robot Reward Models
TrustRoboReward:面向多范式机器人奖励模型的偏好有序保序分数编辑方法
Yidong Wang, Yan Zhan, Ziteng Feng, Zhenyu Cui, Ziyi Zhou, Renzhao Liang, Jiaxuan Zhu, Zilei Yang, Yiran Zhao, Zhongkuan Mao, Bo Jia, Hanchu Ni, Chenggang Xie, Biao Liu, Yi Zhang, Yong Dai, Xiaozhu Ju, Wei Ye, Shikun Zhang
机构
*
Peking University(北京大学)
;
Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心)
;
University of Science and Technology of China(中国科学技术大学)
;
Southeast University(东南大学)
;
Southern University of Science and Technology(南方科技大学)
;
Beijing University of Aeronautics and Astronautics(北京航空航天大学)
;
Beijing Language and Culture University(北京语言大学)
;
Sichuan University(四川大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
NeuroSymActive: Differentiable Neural-Symbolic Reasoning with Active Exploration for Knowledge Graph Question Answering
NeuroSymActive:基于主动探索的可微神经符号推理用于知识图谱问答
Rong Fu, Yang Li, Zeyu Zhang, Jiekai Wu, Yaohua Liu, Shuaishuai Cao, Yangchen Zeng, Yuhang Zhang, Xiaojing Du, Simon Fong
机构
*
University of Macau(澳门大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
The Australian National University(澳大利亚国立大学)
;
Juntendo University(静冈大学)
;
Guangdong Institute of Intelligence Science and Technology(广东智能科学与技术研究院)
;
Central South University(中南大学)
;
Southeast University(东南大学)
;
China Agricultural University(中国农业大学)
;
Adelaide University(阿德莱德大学)
EvoGraph-R1: Self-Evolving Multimodal Knowledge Hypergraphs for Agentic Retrieval
EvoGraph-R1:用于智能检索的自进化多模态知识超图
Jiashi Lin, Changhong Jiang, Xiangru Lin, Ruifei Zhang, Xinyi Zhu, Jiyao Liu, Cheng Tang, Ye Du, Shujian Gao, Junzhi Ning, Lihao Liu, Ziyan Huang, Tianbin Li, Jin Ye, Junjun He
机构
*
Northwestern Polytechnical University(西北工业大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
The University of Hong Kong(香港大学)
;
Monash University(莫纳什大学)
;
The Chinese University of Hong Kong (Shenzhen)(香港中文大学(深圳))
专题命中
视觉问答
:grounding(abstract);multimodal large language model(abstract);分类 cs.CV
机构
*
State Key Laboratory of Networking and Switching Technology, Beijing University of Posts and Telecommunications, Beijing 100876, China(网络与交换技术国家重点实验室,北京邮电大学,中国)
;
City University of HongKong, Hong Kong 999077, China(香港城市大学,中国)
;
School of Geographic Sciences, Hunan Normal University, Changsha 410081, China(地理科学学院,湖南师范大学,中国)
专题命中
视觉问答
:visual question answering(abstract);multimodal large language model(abstract);分类 cs.CV
Wiki-R1: Incentivizing Multimodal Reasoning for Knowledge-based VQA via Data and Sampling Curriculum
Wiki-R1: 通过数据和采样课程激励基于知识的多模态推理用于VQA
Shan Ning, Longtian Qiu, Xuming He
机构
*
ShanghaiTech University(上海科技大学)
;
Shanghai Engineering Research Center of Intelligent Vision and Imaging(上海智能视觉与成像工程研究中心)
;
Lingang Laboratory(临港实验室)
专题命中
视觉问答
:visual question answering(abstract);multimodal large language model(abstract);分类 cs.CV
Multimodal Graph RAG for Long-range Visually Rich Document Understanding
多模态图RAG用于长程视觉丰富文档理解
Yi-Cheng Wang, Chu-Song Chen
机构
*
Department of Computer Science and Information Engineering, National Taiwan University(国家台湾大学计算机科学与信息工程系)
;
FinTech Center, National Taiwan University(国家台湾大学金融科技中心)
专题命中
视觉问答
:visual question answering(abstract);multimodal large language model(abstract);分类 cs.CV