ImagenWorld: Stress-Testing Image Generation Models with Explainable Human Evaluation on Open-ended Real-World Tasks
ImagenWorld: 通过可解释的人类评估对图像生成模型进行压力测试,针对开放性现实任务
Samin Mahdizadeh Sani, Max Ku, Nima Jamali, Matina Mahdizadeh Sani, Paria Khoshtab, Wei-Chieh Sun, Parnian Fazel, Zhi Rui Tam, Thomas Chong, Edisy Kin Wai Chan, Donald Wai Tong Tsang, Chiao-Wei Hsu, Ting Wai Lam, Ho Yin Sam Ng, Chiafeng Chu, Chak-Wing Mak, Keming Wu, Hiu Tung Wong, Yik Chun Ho, Chi Ruan, Zhuofeng Li, I-Sheng Fang, Shih-Ying Yeh, Ho Kei Cheng, Ping Nie, Wenhu Chen
机构
*
University of Waterloo(滑铁卢大学)
;
G-G-G
;
Comfy Org
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Independent(独立研究者)
机构
*
University of California, Los Angeles(加利福尼亚大学洛杉矶分校)
;
DEVCOM Army Research Laboratory(DEVCOM陆军研究实验室)
;
University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
MM-DADM: Multimodal Drug-Aware Diffusion Model for Virtual Clinical Trials
MM-DADM:多模态药物感知扩散模型用于虚拟临床试验
Qian Shao, Bang Du, Zepeng Li, Qiyuan Chen, Jiahe Chen, Hongxia Xu, Jimeng Sun, Jian Wu, Jintai Chen
机构
*
Zhejiang University(浙江大学)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
BRIDGE: Benchmarking Large Language Models for Understanding Real-world Clinical Practice Text
BRIDGE:用于评估大语言模型理解现实世界临床实践文本的基准测试
Jiageng Wu, Bowen Gu, Ren Zhou, Kevin Xie, Doug Snyder, Yixing Jiang, Valentina Carducci, Richard Wyss, Rishi J Desai, Emily Alsentzer, Leo Anthony Celi, Adam Rodman, Sebastian Schneeweiss, Jonathan H. Chen, Santiago Romero-Brufau, Kueiyu Joshua Lin, Jie Yang
机构
*
Brigham and Women's Hospital(布莱根妇女医院)
;
Harvard Medical School(哈佛医学院)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Massachusetts Institute of Technology(麻省理工学院)
;
Mayo Clinic(梅奥诊所)
;
Harvard T.H. Chan School of Public Health(哈佛大学陈曾熙公共卫生学院)
;
Harvard University(哈佛大学)
;
Stanford University(斯坦福大学)
;
Beth Israel Deaconess Medical Center(贝斯以色列女执事医疗中心)
;
Kempner Institute for the Study of Natural and Artificial Intelligence(肯普纳自然与人工智能研究所)
;
Broad Institute of MIT and Harvard(博德研究所)
;
Harvard Data Science Initiative(哈佛数据科学计划)
CommentsAccepted by NeurIPS 2024. BICCOS is part of the alpha-beta-CROWN verifier, the VNN-COMP 2024 winner; fixed Theorem 3.2 and clarified experimental results