Position: AI Agents in Scientific Teams Should Be Studied as Human-Agent Systems
立场:科学团队中的智能体应作为人机系统(HAS)进行研究
Patrick Emami, Sameera Horawalavithana, Truc Nguyen, Gihan Panapitiya, Bruno Jacob, Siddhisanket Raskar, Saumya Sinha, Jared D. Willard, Andrew Glaws, Nithin Somasekharan, Ling Yue, Brian Lu, Shaowu Pan, Jason Eisner
MonteRET: AI Agent Enhancing Multimodal LLMs with Multi-granularity Knowledge Retrieval for Chest CT Report Generation
MonteRET:通过多粒度知识检索增强多模态大语言模型以生成胸部CT报告的人工智能代理
Yi Lin, Yihao Ding, Elana Benishay, Elefterios Trikantzopoulos, David Nauheim, Hanley Ong, Jiang Bian, Hua Xu, Yuzhe Yang, George Shih, Yifan Peng
机构
*
Weill Cornell Medicine(威尔康乃尔医学院)
;
University of Western Australia(西澳大利亚大学)
;
Indiana University(印第安纳大学)
;
Regenstrief Institute(瑞根斯特里夫研究所)
;
Yale University(耶鲁大学)
;
University of California, Los Angeles(加州大学洛杉矶分校)
CommentsThis is the author's accepted version of the paper accepted to appear at IEEE AIIoT 2025. The final version will be available via IEEE Xplore. \c{opyright}2025 IEEE. Personal use of this material is permitted
机构
*
MMLab, The Chinese University of Hong Kong(中大香港实验室)
;
CPII under InnoHK(创新香港 CPII)
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
Shenzhen Loop Area Institute(深圳河套学院)
;
Shandong University(山东大学)
;
Huawei Technologies(华为技术)
LoopTrap: Termination Poisoning Attacks on LLM Agents
LoopTrap: 对 LLM agent 的终止污染攻击
Huiyu Xu, Zhibo Wang, Wenhui Zhang, Ziqi Zhu, Yaopeng Wang, Kui Ren, Chun Chen
机构
*
The State Key Laboratory of Blockchain and Data Security(区块链与数据安全国家重点实验室)
;
Zhejiang University(浙江大学)
;
School of Cyber Science and Engineering(网络安全与工程学院)
;
Southeast University(东南大学)
End-to-End Evaluation and Governance of an EHR-Embedded AI Agent for Clinicians
面向临床医生的嵌入式电子健康记录(EHR)AI代理的端到端评估与治理
Aaryan Shah, Andrew Hines, Alexia Downs, Denis Bajet, Paulius Mui, Fabiano Araujo, Laura Offutt, Aida Rutledge, Elizabeth Jimenez
机构
*
Canvas Medical
;
Department of Biomedical Data Science, Stanford University(斯坦福大学生物医学数据科学系)
;
XPC (X Primary Care)(XPC(X初级医疗))
;
FCA Consulting(FCA咨询)
;
Department of Pediatrics, University of Nevada(内华达大学儿科系)
机构
*
School of Computer Science, Peking University(北京大学计算机科学学院)
;
The University of Hong Kong(香港大学)
;
National Key Laboratory for Multimedia Information Processing, Peking University(北京大学多媒体信息处理国家重点实验室)
MAESTRO: Multi-Agent Evaluation Suite for Testing, Reliability, and Observability
MAESTRO:多智能体评估套件用于测试、可靠性与可观测性
Tie Ma, Yixi Chen, Vaastav Anand, Alessandro Cornacchia, Amândio R. Faustino, Guanheng Liu, Shan Zhang, Hongbin Luo, Suhaib A. Fahmy, Zafar A. Qazi, Marco Canini
LLM Agent Meets Agentic AI: Can LLM Agents Simulate Customers to Evaluate Agentic-AI-based Shopping Assistants?
Lu Sun, Shihan Fu, Bingsheng Yao, Yuxuan Lu, Wenbo Li, Hansu Gu, Jiri Gesi, Jing Huang, Chen Luo, Dakuo Wang
机构
*
University of California San Diego La Jolla California United States
;
Northeastern University Boston Massachusetts United States
;
North Carolina State University Raleigh North Carolina United States
;
Independent Researcher Seattle Washington United States
;
Independent Researcher Palo Alto California United States
;
University of California San Diego
;
Northeastern University
;
North Carolina State University
;
Independent Researcher
Deep Generative Multi-Agent Imitation Model as a Computational Benchmark for Evaluating Human Performance in Complex Interactive Tasks: A Case Study in Football