01081312385
网安资讯

谷歌:发布新版网安模型,性能比肩Claude Mythos,但效率更高!

#网安头条 ·2026-07-22 16:40:45

近日,谷歌DeepMind丢下了网安圈的重磅炸弹——

正式发布专门面向网络安全的大模型Gemini 3.5 Flash Cyber ​​。该模型在漏洞挖掘与修复上表出惊人天赋,其性能完全比肩Claude Mythos,而在效率与成本表现更优

Gemini 3.5 Flash Cyber的横空出世,让专业网安模型正式成为“轻量化与高人道主义博弈”的新阶段。虽然它的参数体量远不如那些通用大模型,但在海量安全语料的“精准喂养”下,它在寻找代码漏洞时的敏锐程度,甚至在部分场景下超越了昂贵的传统模型。这种用“闪电速度”实现火力压制的能力,让苦于算力成本的安全团队在CI/CD中看到了实现降维打击的可能。

口说无凭,数据是检验模型杀伤力的唯一标准。在针对复杂的V8 JavaScript引擎的权威基准测试中,谷歌展示了轻量级安全模型的实战爆发力:

评估维度

Gemini 3.5 Flash Cyber

Claude  (Opus 4.6 基座)

核心差异分析

模型定位

轻量化、高算安全智能体

超大规模、深度逻辑推理模型

谷歌主打最大化效率与可见性,Claude主打全局逻辑严密性

V8引擎漏洞检测出数

55个(独占发现10个盲区漏洞)

36个

Flash Cyber​​ 借助 CodeMender 的多频次并发扫描实现强烈反超

实战响应速度

2小时内完成扫描、定位并生成PoC

一周,适用于离线单次深度分析

Flash Cyber​​流量近乎零延迟的响应速度,完美契合海量攻击的实时防御

调用成本与机制

极低,基于3.5 Flash底座

昂贵,确定为千亿级参数体量

Flash Cyber​​ 允许充足预算运行上百次测试,大幅降低防御 TCO

部署形态

锁定于智能体沙箱(CodeMender)

独立 API 提供复杂的上下文推演

谷歌关注“多智能体分发汇总”的自动化安全闭环

(数据来源:2026年7月21日谷歌DeepMind官方发布数据及市场实测)

伴随着这种性能与效率的平衡技术,谷歌网安模型方面的发展也引发了业界的深思。模型具有天然的“双刃剑”属性,谷歌没有选择全面开源,而是将其锁在名为 CodeMender 的智能体沙箱中。多位行业顶尖专家对这一创新工具给出了评价:

DeepMind Gemini 安全负责人 Raluca Ada Popa 与安全隐私副总裁 Four Flynn: 

“鉴于此技术的双刃剑属性,我们对 3.5 Flash Cyber​​ 的部署采取了精确的态度。作为制定访问共识计划的一部分,它最初将仅通过 CodeMender 独家提供给政府和受信任的合作伙伴,以确保一线防御方能够在漏洞被利用前完成修复。”

Wiz 早期测试人员与 Google Cloud CISO 团队:

“近期于通用的3.5 Flash,独有的网安版本模型在安全性能上实现了巨大的飞跃。在实战测试中,它不仅在2小时内发现了公用API的RCE漏洞,更生成了利用概念验证(PoC)的100%可靠的漏洞,成功绕过了标准的内存保护机制。”

谷歌这次精准踩中了网安人的痛点——

我们不需要只写基础代码的“文科生”,更需要需要懂业务、知进退能快速响应的“数字战友”。

我们必须承认,Claude Mythos早年的技术巅峰,其核心优势在于对复杂逻辑的深度推演。在处理大规模跨文件审计时,它的全局观依然是行业标准。但在一线攻防中,安全官面临的是海量的误报警报和瞬间爆发的0探测,此时Gemini 3.5 Flash Cyber​​的优势就彻底凸显

它的核心价值不是单点逻辑比Mythos更完美,而能够以极好的自动化覆盖那些高频、枯燥的同步任务。

对于正在构建人工智能防御体系的企业,我强烈建议采用高低搭配的“混编模式”应对挑战:

第一道防线(敏捷阻击): 利用Gemini 3.5 Flash Cyber​​结合CodeMender处理海量实时的代码提交扫描、基础漏洞拦截并进而复核,用它高效的廉价筑起实时过滤网。

纵向核心深度防御(深度博弈):把涉及核心权限商场、需要深度对抗上下文和复杂全局审计的任务转向Claude Mythos

总而言之,网安模型的争霸才刚刚开始。谷歌用“效率”撕开了旧防御体系的缺口,而人类则继续在“高精尖”领域坚守防线。

 

Copyright © 2025 北京中联旭诚科技有限公司 版权所有  Sitemap 备案号:京ICP备2021025338号-2