9月3日消息,当地时间9月2日,谷歌宣布推出Gemini 3.8 Flash Cyber模型,通过Fairwind计划面向首批受信任的安全防护团队开放。
官方表示,在漏洞挖掘行业权威基准测试CyberGym上,Gemini 3.8 Flash Cyber展现出顶尖水平的自主漏洞挖掘能力,不仅超越了前代3.5 Flash Cyber,还将多款体量显著更大的前沿模型甩在身后。

在谷歌更全面的内部基准测试中,该模型需在涵盖20种编程语言的复杂代码工程中挖掘各类安全漏洞。结果表明,其相较谷歌此前的模型实现大幅跨越,漏洞挖掘成功率突破70%。
谷歌表示,研发Gemini 3.8 Flash Cyber的核心目标是为安全防御方赋予专业级能力,使其在面对攻击方时占据主导优势,因此从一开始就重点投入漏洞修复领域,并将该项能力置于漏洞利用等攻击性手段之上。
在CWE-Bench测试中,该模型稳居帕累托前沿:首选正确率(Pass@1)达到47.2%,紧追顶尖前沿模型的47.8%,同时调用成本显著更低。
安全策略方面,Gemini 3.8 Flash内置完善的安全防护机制,严密防范模型在化学、生物、放射性与核武器(CBRN)及网络攻击领域的滥用风险;而Cyber版本适度放宽了网络安全领域的策略拦截限制,因此仅面向需要更完备网络攻防能力的合规安全团队开放。
目前,谷歌内部已全面部署该模型用于代码安全防护,具体落地案例包括:
Chrome安全团队:针对Chrome浏览器安全漏洞,3.8 Flash Cyber生成有效修复补丁的数量达到顶尖商业模型的2.6倍,而后者的参数规模要庞大得多;
安全机构Wiz:在其内部基准测试中,相较其他顶尖前沿模型,该模型召回率提高7.5%-9.7%,调用成本大幅降低至原先的1/5.2到1/2.3;
Google云漏洞研究团队:借助该模型,耗时不到2小时便成功挖掘出一处严重的底层架构漏洞,而此前这类漏洞的调研与排查通常需要数月。

微信扫一扫
支付宝扫一扫 