谷歌发布Gemini 3.8 Flash Cyber安全模型
IT时代网9月3日消息,当地时间9月2日,谷歌宣布推出Gemini 3.8 Flash Cyber模型,通过Fairwind计划向首批受信任的安全防护团队开放。
这款模型瞄准的是漏洞挖掘。在行业权威基准测试CyberGym上,谷歌称其展现出顶尖水平的自主漏洞挖掘能力,不仅超越前代3.5 Flash Cyber,还把多款体量显著更大的前沿模型甩在身后。谷歌还在更全面的内部基准上做了评测,测试要求模型在涵盖20种编程语言的复杂代码工程中挖掘各类型安全漏洞,结果显示其漏洞挖掘成功率突破了70%。
研发思路也值得玩味。谷歌表示,这款模型的核心目标是为安全防御方赋予专业级能力,让其在面对攻击方时占据主导优势,因此从一开始就把重点放在漏洞修复上,将这项能力置于漏洞利用等攻击性手段之上。在CWE-Bench测试中,该模型稳居帕累托前沿,首选正确率达到47.2%,与顶尖前沿模型的47.8%几乎持平,调用成本却明显更低,在性能与成本之间取得了平衡。
防护策略上,Gemini 3.8 Flash内置了完善的安全机制,在支持合规良性用例的同时,严密防范模型在化学、生物、放射性与核武器以及网络攻击领域的滥用风险;Flash Cyber则适度放宽了网络安全领域的策略拦截限制,故而仅面向需要更完备网络攻防能力的合规安全团队开放。
谷歌内部已经全面部署这款模型用于代码安全防护。Chrome安全团队的评估显示,针对Chrome浏览器中的安全漏洞,3.8 Flash Cyber生成有效修复补丁的数量达到顶尖商业模型的2.6倍,而这些顶尖商业模型的参数规模要庞大得多。安全机构Wiz的评测表明,在其内部基准上,相较其他顶尖前沿模型,该模型的召回率提高了7.5%至9.7%,调用成本降至原先的1/5.2到1/2.3。Google云漏洞研究团队还借助它在不到2小时内成功挖掘出一处严重的底层架构漏洞,这类漏洞的调研与排查过去通常需要数月之久。

注:本文综合自IT之家等,文中包含AI辅助创作的内容。