IT之家 8 月 27 日消息,谷歌宣布推出全球首个针对前沿专有 AI 模型的双盲评估,将外部评估限制在加密“黑箱”环境中,避免模型提前获取测试信息来优化性能。
谷歌联合新加坡人工智能安全研究所、OpenMined、AVERI 以及 MLCommons,在隐私保护环境中对 Gemini Flash Lite 模型进行机密基准测试,提升评估结果的完整性。
双盲评估通过谷歌云保密计算产品组合中的 Confidential Space,保证外部评估数据和专有模型分别对各自所有者保持隐私:评估方无法看到 Gemini 模型权重,谷歌也无法看到评估方的测试提示词。这种加密手段可防止基准污染,并保护敏感数据,对网络安全或政府机构的高敏感度评估尤为重要。
谷歌表示,希望这一试点能够为模型监督开辟新方向,帮助整个行业构建更安全、更可靠、更受公众信任的 AI 系统。
