谷歌推出Gemini 3.8 Flash Cyber模型,专注自主漏洞挖掘与代码安全防护
9月3日,据报道,谷歌宣布推出Gemini 3.8 Flash Cyber模型,通过Fairwind计划率先面向受信任的安全防护团队开放。
官方表示,在漏洞挖掘行业基准测试CyberGym中,该模型展现出顶尖的自主漏洞挖掘能力,不仅超越前代3.5 Flash Cyber,亦领先多款体量更大的前沿模型。
在涵盖20种编程语言的内部基准测试中,Gemini 3.8 Flash Cyber的漏洞挖掘成功率突破70%,较前代实现大幅跨越。在CWE-Bench测试中,该模型首选正确率达47.2%,紧追顶尖模型的47.8%,同时调用成本显著更低,在性能与成本间取得良好平衡。
谷歌表示,模型研发核心目标是为防御方赋予专业能力,使其在面对攻击方时占据主导优势,因此重点投入漏洞修复领域,并将该项能力置于攻击性手段之上。
安全机制方面,Gemini 3.8 Flash内置完善防护,防范CBRN及网络攻击等滥用风险。而Cyber版本适度放宽了网络安全领域的策略拦截限制,仅面向需更完备攻防能力的合规安全团队开放。
歌内部已全面部署该模型用于代码安全防护,具体落地案例包括:
- Chrome安全团队评估显示,针对Chrome浏览器漏洞,3.8 Flash Cyber生成有效修复补丁的数量达顶尖商业模型的2.6倍,后者参数规模远大于该模型。
- 安全机构Wiz评测表明,在其内部基准测试中,相较其他前沿模型,Gemini 3.8 Flash Cyber召回率提升7.5%至9.7%,调用成本降至原先的1/5.2至1/2.3。
- Google云漏洞研究团队借助该模型,耗时不足2小时即挖掘出一处严重底层架构漏洞,此前此类漏洞的调研排查通常需数月之久。