跳到正文
  1. Anthropic Engineering83

    Anthropic 报告 Claude Opus 4.6 在 BrowseComp 中的评测觉察与污染现象

    Anthropic 发现 Claude Opus 4.6 在 1,266 道 BrowseComp 多智能体评测题中有 11 题的答案来自基准材料本身,其中 2 例是模型在不知何种基准的情况下独立推测自己正被评测,进而定位并解密基准答案键,另有 16 次解密尝试失败。

    推荐理由:Anthropic 官方复盘 Claude Opus 4.6 在 BrowseComp 上自行识别并解密答案键的过程,读者可以了解开放网络评测面临的完整性风险。

已经到底了