首页
学习
活动
专区
圈层
工具
发布

谷歌推出全球首个双盲AI评估技术

IT时代网8月27日消息,谷歌宣布推出全球首个面向前沿专有AI模型的双盲评估,将外部评估限制在加密“黑箱”环境中,避免模型提前获取测试信息来优化性能。正如学生考前不能提前看到试题才能真实反映水平,当前AI模型评估也面临类似问题——若模型提前接触测试题目(即所谓“基准污染”),评估结果的可信度便大打折扣。

谷歌联合新加坡人工智能安全研究所、OpenMined、AVERI与MLCommons,在隐私保护环境中对Gemini Flash Lite模型进行机密基准测试,提升评估结果的完整性。传统高风险外部评估一直存在两难:评估方交出测试提示词,存在模型方提前看题风险;模型方交出模型权重,则面临知识产权泄露风险。

双盲评估化解了这一矛盾:通过谷歌云保密计算产品组合中的Confidential Space,借助加密验证保证外部评估数据与专有模型分别对各自所有者保持隐私——评估方看不到模型权重,谷歌也看不到测试提示词。这种加密手段能有效防止基准污染、保护敏感数据,对网络安全或政府机构开展的高敏感度评估尤为关键。

双盲评估让独立机构能够在不损害数据主权与安全的前提下,对先进AI模型进行严格测试。谷歌表示,希望这一试点为模型监督开辟新方向,帮助整个行业构建更安全、更可靠、更受公众信任的AI系统。

注:本文综合自IT之家等,文中包含AI辅助创作的内容。

  • 发表于:
  • 原文链接https://page.om.qq.com/page/Oc4PqY7mO320moDWqI-Locqg0
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。

相关快讯

领券