
谷歌宣布推出全新的Gemini 3.8 Flash Cyber模型,这是一款专为网络安全防御设计的专业级AI模型,目前已通过Fairwind计划面向首批受信任的安全防护团队开放。该模型在漏洞挖掘领域展现了顶尖水平,其核心目标是赋予安全防御方专业级能力,使其在面对攻击方时能够占据主导优势,因此谷歌从一开始就重点投入漏洞修复领域,并将该项能力置于漏洞利用等攻击性手段之上。
在针对漏洞挖掘的行业权威基准测试CyberGym上,Gemini 3.8 Flash Cyber展现出了卓越的自主漏洞挖掘能力,不仅超越了前代3.5 Flash Cyber,还将多款体量显著更大的前沿模型甩在身后。谷歌在更全面的内部基准测试中,要求模型在涵盖20种编程语言的复杂代码工程中挖掘各类型安全漏洞,结果表明该模型相较于谷歌此前的模型实现了大幅跨越,漏洞挖掘成功率突破了70%。在CWE-Bench测试中,Gemini 3.8 Flash Cyber稳居帕累托前沿,其首选正确率达到47.2%,紧追顶尖前沿模型的47.8%,同时它的调用成本显著更低,在性能与成本之间实现了极佳的平衡。
谷歌表示,Gemini 3.8 Flash内置了完善的安全防护机制,在支持合规良性用例的同时,严密防范模型在化学、生物、放射性与核武器以及网络攻击领域的滥用风险。相比之下,Gemini 3.8 Flash Cyber适度放宽了网络安全领域的策略拦截限制,因此仅面向需要更完备网络攻防能力的合规安全团队开放,确保了模型在专业领域内的安全可控应用。
目前谷歌内部已全面部署Gemini 3.8 Flash Cyber用于代码安全防护,并取得了显著成效。Chrome安全团队评估发现,针对Chrome浏览器中的安全漏洞,3.8 Flash Cyber生成有效修复补丁的数量达到了顶尖商业模型的2.6倍,而这些顶尖商业模型的参数规模要比它庞大得多。安全机构Wiz的评测表明,在其内部基准测试中,相较于其他顶尖的前沿模型,Gemini 3.8 Flash Cyber的召回率提高了7.5%到9.7%,同时调用成本大幅降低至原先的五分之一到二点三分之一。谷歌云漏洞研究团队借助3.8 Flash Cyber模型,耗时不到2小时便成功挖掘出一处严重的底层架构漏洞,而在此之前,这类漏洞的调研与排查通常需要数月之久,充分展现了该模型在提升安全防护效率和降低成本方面的巨大潜力。






