Why Chain of Thought Fails in Clinical Text Understanding
为什么链式思维在临床文本理解中失效
机构 * Harvard Medical School(哈佛医学院) ; MIT(麻省理工学院) ; Broad Institute of MIT and Harvard(MIT与哈佛大学Broad研究所)
AI总结 本研究发现链式思维在临床文本理解中导致性能下降,揭示了其在临床任务中可靠性与可解释性的矛盾。
高校专区
为什么链式思维在临床文本理解中失效
机构 * Harvard Medical School(哈佛医学院) ; MIT(麻省理工学院) ; Broad Institute of MIT and Harvard(MIT与哈佛大学Broad研究所)
AI总结 本研究发现链式思维在临床文本理解中导致性能下降,揭示了其在临床任务中可靠性与可解释性的矛盾。
通过单次强化学习训练多轮任务规划的LLM代理
机构 * Carnegie Mellon University(卡内基梅隆大学) ; Harvard University(哈佛大学) ; Mitsubishi Electric Research Laboratories (MERL)(三菱电机研究实验室(MERL))
AI总结 本文通过单次强化学习训练LLM代理进行多轮任务规划,利用GRPO实现高效策略优化,实验显示其在复杂任务规划中的表现优于大参数基线模型。
Comments Accepted by IEEE Control Systems Letters (L-CSS)
未来你:设计和评估多模态AI生成的数字双胞胎以加强未来自我连续性
机构 * MIT Media Lab(MIT媒体实验室) ; Harvard University(哈佛大学) ; Stanford University(斯坦福大学) ; KASIKORN Labs(KASIKORN实验室)
AI总结 本研究通过多模态AI生成的未来自我探索其对自我连续性、情绪和动机的影响,发现avatar效果最佳,但各模态无显著差异,互动质量是关键因素。