When Is an Agent Evaluation Over? Outcome Finality and Cross-Unit Separation
智能体评估何时结束?结果终局性与跨单元分离
机构 * University of Michigan Law School(密歇根大学法学院)
AI总结 针对现有智能体评估将终点分数视为最终结果的问题,该研究提出结果终局性与跨单元分离两个条件,通过实验和协议审查指出当前评估的不足,并提出开放效应记录方案以完善评估。
高校专区
智能体评估何时结束?结果终局性与跨单元分离
机构 * University of Michigan Law School(密歇根大学法学院)
AI总结 针对现有智能体评估将终点分数视为最终结果的问题,该研究提出结果终局性与跨单元分离两个条件,通过实验和协议审查指出当前评估的不足,并提出开放效应记录方案以完善评估。
机器中的CASPER:LLM生成故事中角色多样性的洞察
机构 * UNC Chapel Hill(北卡罗来纳大学教堂山分校) ; Georgia Institute of Technology(佐治亚理工学院) ; University of Michigan(密歇根大学)
AI总结 本文借用叙事学定义,从八个维度分析LLM与人类创作故事中角色的刻画,发现两者在角色类型和多样性上既有相似也有差异。
Comments Proceedings of ACL, 2026
学习快速的单项式顺序用于格雷勃纳基计算
机构 * Georgia Institute of Technology(佐治亚理工学院) ; The University of Texas at San Antonio(德克萨斯大学圣安东尼奥分校) ; San Diego State University(圣地亚哥州立大学) ; Emory University(埃默里大学) ; University of Michigan–Dearborn(密歇根大学迪尔伯恩分校)
AI总结 本文提出利用深度强化学习学习快速单项式顺序以提高格雷勃纳基计算效率,通过领域指导的奖励信号和高效估计方法,在系统生物学和计算机视觉任务中实现计算成本的显著降低。
Comments added more experiments against baselines, corrected a few typos and cosmetics
在遮挡下利用生成先验和接触诱导约束进行物体重建
机构 * University of Pennsylvania(宾夕法尼亚大学) ; University of Michigan(密歇根大学)
AI总结 本文提出了一种结合生成先验和接触诱导约束的方法,用于在遮挡下提高物体重建的准确性。
Comments IROS 2026. Project page: this https URL (https://contactgen3d.github.io/)