Do AI chatbots find what experts would? Effects of model, user role, and sample size on study retrieval for medical questions
AI聊天机器人能否找到专家会选择的研究?模型、用户角色和样本量对医学问题研究检索的影响
专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 该研究评估Claude Sonnet 5、Gemini 3.1 Pro、ChatGPT GPT-5.5三款LLM聊天机器人在模拟三种用户角色下的医学研究检索表现,发现其召回率因模型、角色差异显著,且存在偏向大样本临床试验的偏差。