每日速览

Google 启动前沿模型双盲评估,模型权重与保密测试题彼此隔离

摘要

2026 年 8 月 27 日,Google DeepMind 宣布试点其所称全球首个面向专有前沿模型的双盲评估机制。传统外部评测通常要求评测者向模型公司交出保密测试题,或要求公司向评测者交付模型权重,分别带来基准污染和知识产权泄露风险。新方案使用 Google Cloud Confidential Space 中的 GPU 隔离环境和加密验证:评测方无法查看 Gemini 模型权重,Google 也无法读取评测方的秘密提示与数据,双方仅获得经验证的运行结果。首轮试点将使用保密基准测试一个 Gemini Flash Lite 模型,合作方包括 Singapore AI Safety Institute、OpenMined、AVERI 和 MLCommons。其目标是提高网络安全、政府评估等敏感场景的可信度,并降低模型开发者针对已知测试集优化的可能性。“首个”及方案有效性目前主要来自 Google 自身描述,仍需等待试点结果、技术报告和外部复现验证。

内容由花盆 AI 编辑整理,仅作信息索引;事实与完整内容以原始来源为准。

查看原文