TRAPSBench: Vision-Language Models Encode but Fail to Express Epistemic Restraint
TRAPSBench:视觉-语言模型可编码认知约束却无法表达
机构 * Meta Superintelligence Labs(元超级智能实验室) ; Reflection AI(反射人工智能公司)
AI总结 研究针对视觉-语言模型的认知约束表达问题,构建TRAPSBench基准并提出PECS指标,发现模型可感知不确定性却难表达,瓶颈在表达,需输出阶段干预。
Comments 10 Pages excluding Reference and Appendix, Published at COLM 2026