原创谷歌正式推出Gemini 3.8 Flash,安全漏洞挖掘成功率突破70%
当地时间9月2日,谷歌正式推出Gemini 3.8 Flash及Gemini 3.8 Flash Cyber两款全新大模型。其中,标准版模型在上一代3.7 Flash基础上全面升级,重点提升了软件工程与智能体知识工作流等核心能力,旨在满足开发者与企业用户对高效生产级智能体的部署需求,进一步巩固谷歌在AI领域的领先地位。
谷歌正式推出Gemini 3.8 Flash,安全漏洞挖掘成功率突破70%
据介绍,Gemini 3.8 Flash最高可支持100万Token的上下文窗口,文本输出能力达64K Token,可广泛应用于软件工程开发、AI智能体任务以及复杂知识处理等多种场景。不过作为基础大模型,它仍存在幻觉问题。谷歌表示正在持续强化模型的抗越狱攻击能力,并升级前沿安全防护策略。同时提醒用户,在高推理强度场景下,模型Token消耗会增加,偶发响应缓慢或请求超时的情况。
另一款Gemini 3.8 Flash Cyber则走“定向开放”路线,通过Fairwind计划仅向首批通过信任审核的安全防护团队提供服务。在漏洞挖掘权威基准CyberGym的测试中,该模型展现出顶尖的自主挖洞实力,不仅超越了前代3.5 Flash Cyber,还击败了众多参数量更大的主流前沿模型,表现十分亮眼。
谷歌内部开展的覆盖20种编程语言的复杂代码漏洞挖掘评测显示,Gemini 3.8 Flash Cyber的漏洞挖掘成功率突破70%,较过往模型有明显提升。该模型研发定位是赋能安全防御人员,开发优先级偏向漏洞修复而非攻击利用。在CWE-Bench测试中,其Pass@1首选正确率达47.2%,逼近头部模型47.8%的水平,且调用成本更低,实现了性能与成本的良好平衡。