TRAPSBench:视觉语言模型内部编码但无法表达认知克制
TRAPSBench 通过 1,404 对匹配的 MuJoCo 物理视频对证明:VLM 内部能编码可回答性信号(跨域 AUROC 最高 0.91),但自发弃答率极低(最佳 PECS 仅 0.292),瓶颈在表达而非感知。
TRAPSBench 通过 1,404 对匹配的 MuJoCo 物理视频对证明:VLM 内部能编码可回答性信号(跨域 AUROC 最高 0.91),但自发弃答率极低(最佳 PECS 仅 0.292),瓶颈在表达而非感知。