谷歌:发布新版网安模型,性能比肩Claude Mythos,但效率更高!
#网安头条 ·2026-07-22 16:40:45
近日,谷歌DeepMind丢下了网安圈的重磅炸弹——
正式发布专门面向网络安全的大模型Gemini 3.5 Flash Cyber 。该模型在漏洞挖掘与修复上表现出惊人天赋,其性能完全比肩Claude Mythos,而在效率与成本表现更优。

Gemini 3.5 Flash Cyber的横空出世,让专业网安模型正式成为“轻量化与高人道主义博弈”的新阶段。虽然它的参数体量远不如那些通用大模型,但在海量安全语料的“精准喂养”下,它在寻找代码漏洞时的敏锐程度,甚至在部分场景下超越了昂贵的传统模型。这种用“闪电速度”实现火力压制的能力,让苦于算力成本的安全团队在CI/CD中看到了实现降维打击的可能。
口说无凭,数据是检验模型杀伤力的唯一标准。在针对复杂的V8 JavaScript引擎的权威基准测试中,谷歌展示了轻量级安全模型的实战爆发力:
|
评估维度 |
Gemini 3.5 Flash Cyber |
Claude (Opus 4.6 基座) |
核心差异分析 |
|
模型定位 |
轻量化、高算安全智能体 |
超大规模、深度逻辑推理模型 |
谷歌主打最大化效率与可见性,Claude主打全局逻辑严密性 |
|
V8引擎漏洞检测出数 |
55个(独占发现10个盲区漏洞) |
36个 |
Flash Cyber 借助 CodeMender 的多频次并发扫描实现强烈反超 |
|
实战响应速度 |
2小时内完成扫描、定位并生成PoC |
一周,适用于离线单次深度分析 |
Flash Cyber流量近乎零延迟的响应速度,完美契合海量攻击的实时防御 |
|
调用成本与机制 |
极低,基于3.5 Flash底座 |
昂贵,确定为千亿级参数体量 |
Flash Cyber 允许充足预算运行上百次测试,大幅降低防御 TCO |
|
部署形态 |
锁定于智能体沙箱(CodeMender) |
独立 API 提供复杂的上下文推演 |
谷歌关注“多智能体分发汇总”的自动化安全闭环 |
(数据来源:2026年7月21日谷歌DeepMind官方发布数据及市场实测)
伴随着这种性能与效率的平衡技术,谷歌网安模型方面的发展也引发了业界的深思。模型具有天然的“双刃剑”属性,谷歌没有选择全面开源,而是将其锁在名为 CodeMender 的智能体沙箱中。多位行业顶尖专家对这一创新工具给出了评价:
DeepMind Gemini 安全负责人 Raluca Ada Popa 与安全隐私副总裁 Four Flynn:
“鉴于此技术的双刃剑属性,我们对 3.5 Flash Cyber 的部署采取了精确的态度。作为制定访问共识计划的一部分,它最初将仅通过 CodeMender 独家提供给政府和受信任的合作伙伴,以确保一线防御方能够在漏洞被利用前完成修复。”

Wiz 早期测试人员与 Google Cloud CISO 团队:
“近期于通用的3.5 Flash,独有的网安版本模型在安全性能上实现了巨大的飞跃。在实战测试中,它不仅在2小时内发现了公用API的RCE漏洞,更生成了利用概念验证(PoC)的100%可靠的漏洞,成功绕过了标准的内存保护机制。”
谷歌这次精准踩中了网安人的痛点——
我们不需要只写基础代码的“文科生”,更需要需要懂业务、知进退能快速响应的“数字战友”。
我们必须承认,Claude Mythos早年的技术巅峰,其核心优势在于对复杂逻辑的深度推演。在处理大规模跨文件审计时,它的全局观依然是行业标准。但在一线攻防中,安全官面临的是海量的误报警报和瞬间爆发的0日探测,此时Gemini 3.5 Flash Cyber的优势就彻底凸显。

它的核心价值不只是单点逻辑比Mythos更完美,而是能够以极好的自动化覆盖那些高频、枯燥的同步任务。
对于正在构建人工智能防御体系的企业,我强烈建议采用高低搭配的“混编模式”应对挑战:
第一道防线(敏捷阻击): 利用Gemini 3.5 Flash Cyber结合CodeMender处理海量实时的代码提交扫描、基础漏洞拦截并进而复核,用它高效的廉价筑起实时过滤网。
纵向核心深度防御(深度博弈):把涉及核心权限商场、需要深度对抗上下文和复杂全局审计的任务转向Claude Mythos。
总而言之,网安模型的争霸才刚刚开始。谷歌用“效率”撕开了旧防御体系的缺口,而人类则继续在“高精尖”领域坚守防线。