谷歌AI漏洞悬赏计划详情
上线新计划与漏洞类型
本周一,谷歌正式上线针对AI产品漏洞的悬赏奖励计划。此计划详细列出了符合条件的漏洞类型,比如通过间接注入AI提示,使Google智能家居执行异常操作,像自动解锁门;或者通过数据挟持提示,让AI总结受害者邮箱内容并发送至攻击者账户等。
明确“AI漏洞”界定
此次悬赏计划首次明确界定了“AI漏洞”,主要聚焦于利用大型语言模型或生成式AI系统实施危害或利用安全漏洞的行为。其中,最受关注的是可导致用户账户或数据被恶意修改并影响安全的情况,就像之前通过被“投毒”的Google日历事件让智能家居设备卷帘窗自动开启或灯光关闭的漏洞。

奖励标准与特殊情况说明
不同产品的奖金差异
根据公布的奖励标准,发现“旗舰产品”如Google搜索、Gemini应用、Gmail和Drive等Workspace核心服务上的“异常操作”漏洞,奖金为两万美元。若报告质量突出或发现创新型漏洞,单项奖金可提升至三万美元。而Google其他产品如Jules或NotebookLM和较低级别漏洞如窃取模型参数,奖金则相应降低。
“幻觉”情况不属于奖励范围
值得注意的是,若只是让Gemini等AI出现“幻觉”则不属于奖励范围。谷歌指出,涉及AI生成内容的安全问题,如仇恨言论或侵犯版权内容,应通过产品内反馈渠道直接报告,这样AI安全团队才能对模型输出进行诊断和长期训练改进。
谷歌在AI安全领域的布局
漏洞猎人已获超43万美元奖励
自谷歌两年前邀请AI安全研究者帮助寻找AI产品潜在漏洞以来,漏洞猎人们已累计获得超43万美元奖励。这显示出谷歌对AI安全研究的重视以及该计划已取得的成效。
推出CodeMender工具
除了奖励计划,谷歌当天还宣布推出名为CodeMender的AI安全工具,它可以自动修补代码漏洞。迄今为止,CodeMender已在人类安全研究员审核下为开源项目修复了72项安全问题。该计划强化了谷歌在AI安全领域的前沿布局,并鼓励全球安全人士积极参与谷歌AI产品的安全维护工作。

相关问答
谷歌此次AI漏洞悬赏计划针对哪些漏洞类型?
包括通过间接注入AI提示使Google智能家居执行异常操作,如自动解锁门;通过数据挟持提示让AI总结受害者邮箱内容并发送至攻击者账户等。
怎样的情况属于此次计划界定的“AI漏洞”?
主要聚焦利用大型语言模型或生成式AI系统实施危害或利用安全漏洞的行为,尤其可导致用户账户或数据被恶意修改并影响安全的情况。
发现不同产品的AI漏洞,奖金是如何设定的?
发现“旗舰产品”上的“异常操作”漏洞,奖金为两万美元,报告质量突出或有创新型漏洞可提至三万;其他产品和较低级别漏洞奖金相应降低。
让Gemini等AI出现“幻觉”为何不在奖励范围内?
谷歌规定涉及AI生成内容的安全问题,如仇恨言论或侵犯版权内容,应通过产品内反馈渠道报告,以便AI安全团队进行诊断和训练改进。
谷歌此前邀请AI安全研究者寻找漏洞的情况如何?
自两年前邀请以来,漏洞猎人们已累计获得超43万美元奖励,体现出该计划在推动AI安全研究方面取得了一定成果。
CodeMender工具在AI安全方面有什么作用?
CodeMender是谷歌推出的AI安全工具,能自动修补代码漏洞,已在人类安全研究员审核下为开源项目修复了72项安全问题。
简短标题:谷歌为何悬赏最高3万美元征集AI系统漏洞?
转载声明:欢迎分享本文,转载请保留出处!发布者 财云量化
