AI-Assisted Systematization for Evaluating GenAI Systems
AI辅助的系统化方法用于评估生成式AI系统
Dhruv Agarwal, Emily Sheng, Chad Atalla, Jean Garcia-Gathright, Hussein Mozannar, Hannah Washington, Alexandra Chouldechova, Solon Barocas, Hanna Wallach
机构
*
Cornell University(康奈尔大学)
;
Microsoft Research(微软研究院)
Virchow: A Million-Slide Digital Pathology Foundation Model
Virchow:百万级数字病理学基础模型
Eugene Vorontsov, Alican Bozkurt, Adam Casson, George Shaikovski, Michal Zelechowski, Siqi Liu, Kristen Severson, Eric Zimmermann, James Hall, Neil Tenenholtz, Nicolo Fusi, Philippe Mathieu, Alexander van Eck, Donghun Lee, Julian Viret, Eric Robert, Yi Kan Wang, Jeremy D. Kunz, Matthew C. H. Lee, Jan Bernhard, Ran A. Godrich, Gerard Oakley, Ewan Millar, Matthew Hanna, Juan Retamero, William A. Moye, Razik Yousfi, Christopher Kanan, David Klimstra, Brandon Rothrock, Thomas J. Fuchs
机构
*
Paige
;
Microsoft Research(微软研究院)
;
NSW Health Pathology(新南威尔士州卫生病理学)
;
St George Hospital(圣乔治医院)
;
Memorial Sloan Kettering Cancer Center(纪念斯隆凯特琳癌症中心)
;
University of Rochester(罗切斯特大学)
TS-Skill: A Benchmark for Evaluating Analytical Skills in Time-Series Question Answering
TS-Skill: 用于评估时间序列问答中分析技能的基准
Liying Han, Kang Yang, Oliver Wang, Jason Wu, Pengrui Quan, Gaofeng Dong, Ozan Baris Mulayim, Sizhe Ma, Yuyang Yuan, Dezhi Hong, Mario Berges, Mani Srivastava
机构
*
University of California, Los Angeles(加州大学洛杉矶分校)
;
Samsung Research America(三星美国研究院)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Microsoft(微软)
;
Amazon(亚马逊)
AI in the Enterprise: How People Use M365 Copilot Chat
企业中的AI:人们如何使用M365 Copilot Chat
Scott Counts, Yan Chen, Jing Dong, Himanshu Sharma, Andrey Zaikin, Rui Hu, Alperen Kok, Gorkem Ozer Yilmaz, Siddharth Suri, Kiran Tomlinson, Sonia Jaffe, Will Wang