摘要 9 月 2 日发布:3.8 Flash 人人能上,3.8 Flash Cyber 只给可信防御方 同一个核心,两副访问信封 黑粉科技 · 官方公告核对 · 2026-09-03
9 月 2 日,谷歌一口气发了两个模型:Gemini 3.8 Flash 和 Gemini 3.8 Flash Cyber。前者是那种“又快又便宜、什么活都能干”的主力模型,今天你就能用上;后者是个专门找漏洞、补漏洞的网络安全版,听着更猛,但它只发给一小撮“可信防御方”,绝大多数人连申请入口都够不着。

这已经是谷歌六周里第三次发 Flash 了——上一个 3.7 Flash 才发了三周。密集到这个程度,单看“又快了一点、又强了一点”其实没多大意思。我盯的是另一件事:**同样一个大脑,为什么要拆成两副面孔发出来,而且把更锋利的那副藏起来。**这条分界线画在哪、为什么这么画,比跑分有意思得多。
建议 先给结论:**3.8 Flash 是一次实打实的便宜升级,今天就能接;3.8 Flash Cyber 你多半用不上——它不是技术不行,是谷歌故意不给你。**这次真正的产品,是那条访问边界。
🧩 先搞清楚:Flash、Cyber、Fairwind 各是什么
先把三个词拆开。Flash 是谷歌 Gemini 家族里“走量”的那一档——不是最贵最强的旗舰,而是主打速度和低价、拿去批量干活的主力型号。你可以理解成餐厅里那道翻台率最高的招牌菜,不是最贵的那桌,但绝大多数订单都是它。
Cyber 版则是同一个核心专门为网络安全场景调过的版本。官方给它的定位很克制:主攻“找漏洞”和“自动打补丁”,而且明说是优先做防御、把攻击能力(比如写利用代码)往后放。换句话说,它被设计成给蓝队(防守方)用的工具,不是给红队递刀子。
**Fairwind 则是发放 Cyber 版的那道门。**它是谷歌新设的一个限制访问计划,只面向“可信防御方”——官方点名的是政府主管部门、关键基础设施运营者和软件维护者,得申请、得被认可才能拿到优先访问权。你不是这几类身份,基本就在门外。这道门,就是这次的主角。
⚡ 3.8 Flash:便宜没变,但它开始“更卖力”了
先说人人能用的这个。价格上,3.8 Flash 沿用了 3.7 Flash 的入门定价:每百万输入 token 0.75 美元、每百万输出 3.75 美元。同价位下,官方摆出来的进步集中在“自己动手干完一整件事”的能力上。官方还透露了一个训练侧的细节:两个版本共享同一个核心,而这个核心是靠长时间运行的智能体循环反复自我评估、自我打磨练出来的——不是喂完数据就收工,而是让模型在一轮轮任务里自己纠错、迭代。
| 官方基准 | 3.8 Flash 表现 | 说的是什么能力 |
|---|---|---|
| DeepSWE v1.1(长程软件工程) | 超过多数更大的前沿模型 | 端到端自主解决复杂工程问题 |
| HLE-Verified | 54.9% | 跨 STEM、人文、专业领域的多步推理 |
| Vals Finance Agent V2 | 超过 3.7 Flash 与其他前沿模型 | 金融领域的分析与报告 |
| Harvey 法律 Agent 基准 | 超过 3.7 Flash 与其他前沿模型 | 法律领域的专业自主任务 |
数据来自谷歌官方公告,非本文独立复测。基准设置与口径以官方方法为准。
但有一句话得单独拎出来,因为它关系到你的账单。官方明说:3.8 Flash 的进步来自一个核心设计——“它更卖力了”。面对复杂任务,它会多走几步推理、反复调用工具,在高强度档位下,为了把成绩拉满,它会用掉更多 token。
警告 这句话翻译成人话:**单价没涨,甚至没变,但同一件活它可能吃掉更多 token,账单不一定跟着“便宜”下来。**谷歌也把退路写清楚了——对成本敏感的场景,可以调低它的“用力档位”,或者继续用更省的 3.7 Flash(老型号仍然维护)。省钱这件事,从选型变成了调参。
🛡️ 3.8 Flash Cyber:它的战果,是拿谷歌自己的代码换来的
再说那个你多半摸不到的。Cyber 版的分数不是在演示环境里刷的,官方直接报了它在谷歌自家生产代码上的实战数据,这比跑分实在。

| 谁在用 | 实测结果 | 对照 |
|---|---|---|
| Chrome 安全团队 | 补对的漏洞补丁数是对方的 2.6 倍 | 对比“大得多”的最佳商用模型 |
| 安全公司 Wiz | 渗透测试召回率高出 7.5–9.7% | 成本却低 2.3–5.2 倍 |
| 谷歌云漏洞研究团队 | 不到 2 小时找出一个关键底层漏洞 | 同类漏洞通常要研究几个月 |
以上为谷歌官方公告披露的合作方实测数据,第三方基准包括 CyberGym、Collinear 的 CWE-Bench。
标准基准上它同样能打:在业界找漏洞的基准 CyberGym 上,它的自主漏洞发现达到前沿水平,超过了上一代 3.5 Flash Cyber,也超过明显更大的前沿模型;谷歌还拿一套覆盖 20 种编程语言的内部基准测它,漏洞发现成功率超过 70%。补丁能力上,在外部的 CWE-Bench 上它 pass@1 是 47.2%,和领先前沿模型的 47.8% 几乎贴平,但成本低得多。
建议 有个反直觉的细节值得记:官方说,正是**在网络安全这个极其严苛的领域做了硬训练,反过来把共享核心的编码和推理能力也一起拉高了。**安全不是这次的一个副产品,它是把整个模型练强的“磨刀石”。
🔍 泼三盆冷水:跑分、账单、门槛
热闹归热闹,有三件事别被公告带过去。**第一,这些分数全是谷歌自评。**Chrome 团队、Wiz、云漏洞研究团队的数字都出自官方口径,对照的“最佳商用模型”“更大的前沿模型”具体是谁、怎么设的题,公告没有逐一摊开。不是说它假,而是它还没经过独立第三方在同一套题上的复测。
**第二,“更卖力”是把双刃剑。**对追求极限成绩的人是好事,对按 token 付费的人是隐形成本。真接进生产前,你得自己拿真实负载测一遍,看看省下来的单价,会不会被涨上去的 token 量吃回去。
**第三,也是最关键的——Cyber 版你基本用不上。**它锁在 Fairwind 里,只发给可信防御方。所以那些漂亮的漏洞数字,对绝大多数开发者来说是“别人家的战果”,不是你能立刻上手的能力。这种“强能力先给一小撮可信方”的做法,当年杀毒引擎的深度检测规则、某些安全厂商的高级威胁情报,也是先供给政府和大客户、普通用户只能用阉割版——看它,得用看新闻的姿态,不是看工具的姿态。
💰 谁赚、谁被挡在门外、谁不说话
把这次发布当成一次布局看,账就清楚了。**谁赚:谷歌。**它用 3.8 Flash 死死守住“便宜前沿”这个心智——六周三连发,就是不给对手留出“我比你更便宜”的窗口;同时用 Cyber 版和 Fairwind,把政府、关键基础设施这些最看重安全、也最舍得付费的客户,提前圈进自己的关系网。
**谁被挡在门外:绝大多数开发者和中小团队。**你能用的是那个“更卖力、可能更费 token”的通用版;那个真正锋利的、能两小时挖出关键漏洞的 Cyber 版,你连排队的资格都要先证明身份。能力的分配,第一次这么明确地跟“你是谁”绑在了一起。
**谁不说话:那笔“更多 token”的成本账。**公告把 0.75 美元的单价放在最显眼的地方,把“它会用掉更多 token”写在解释性能提升的段落里——两句话都真实,但读者的注意力被引到了便宜那一头。沉默的地方,往往才是账单真正会疼的地方。
🎯 谷歌为什么现在做、图什么
为什么是现在?看节奏就懂了:**六周里第三个 Flash,这是在用发布频率抢一个位置。**AI 便宜前沿这条赛道上,谁能持续地“又快又便宜又不弱”,谁就占住了开发者的默认选择。谷歌不是在发新功能,是在用密集迭代把这个位置焊死,不给别人喘息。
而 Cyber 版加 Fairwind,图的是另一样东西——**在监管落地之前,先把“负责任的强能力提供方”这个身份坐实。**它主动把攻击能力往后压、把访问权限收紧、只发给防御方,这套动作既是安全姿态,也是政治资本:等各国对 AI 安全能力立规矩的时候,一个“我早就只给防御方、还帮政府补漏洞”的谷歌,天然站在有利的一侧。这套抢跑并不新鲜——早在互联网刚要被监管的年代,大平台也是抢先喊“我们自律”,用自我克制去换立规矩时的话语权。克制本身,就是一种卡位。
往大里看,这套“强能力只发给可信方”的逻辑一直在重演。当年加密技术强到一定程度,美国曾把它当军火管制、限制出口,直到民用需求彻底压过来才松口;核相关技术、某些高风险生物实验数据成熟时,通行做法也都是先划一个“可信名单”,名单外的人只能听说、不能上手。谷歌这次把 AI 的攻防能力关进 Fairwind,走的是同一条老路:**一样东西越可能被用来造成伤害,它的分配就越不会按“谁想要就给谁”来。**区别只在于,这一次被这么对待的,是一个软件模型。
🧭 该不该用,怎么用
落到你手上,判断其实很干脆。3.8 Flash 值得今天就试:单价没涨,长程编码和多步推理这类“让它自己干完一件事”的活确实更扛得住,接口是现成的 Gemini API,Gemini App 的 Pro/Ultra 订阅、AI Studio、Antigravity 里都能用上。唯一要盯的是账单——上生产前用真实负载测一轮 token 消耗,别只看那个 0.75 美元。
| 你的情况 | 建议 | 为什么 |
|---|---|---|
| 想要便宜的长程编码 / Agent | 上 3.8 Flash | 同价位下自主干活能力明显更强 |
| 对成本极度敏感 | 调低用力档,或继续用 3.7 Flash | 3.8“更卖力”会多吃 token,老型号仍维护 |
| 是政府 / 关基 / 软件维护方 | 去申请 Fairwind | 这是拿到 Cyber 版的唯一门 |
| 普通开发者想要 Cyber 能力 | 暂时死心 | 它只发可信防御方,不对外开放 |
至于那个网络安全版,接受一个现实:你能读到的,是它的战报,不是它的钥匙。这不一定是坏事——一个把挖漏洞、补漏洞的强能力优先交给防御方、而不是随手扔给所有人的做法,至少方向上是稳的。只是我们得清楚,从这次开始,“最强的那档 AI 能力”和“你能不能用上它”,正在变成两个越来越不重合的问题。
摘要:一句话收尾 谷歌这次发的不只是两个模型,是一条边界:3.8 Flash 把便宜前沿又焊紧了一圈,今天就能用,但记得盯着“更卖力”带来的 token 账单;3.8 Flash Cyber 规格更猛、战果更实,却锁在 Fairwind 里只给可信防御方。真正的信号是——AI 最锋利的那部分能力,开始明确地按“你是谁”来分配了。
📚 资料来源与复现入口
- 谷歌官方公告《Introducing Gemini 3.8 Flash and 3.8 Flash Cyber》:https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/
- Gemini API 开发者文档:https://ai.google.dev/gemini-api/docs
