
Gemini 3.8 Flash 与 Flash Cyber 发布:$0.75 起,安全版进入 Fairwind 受控访问
Google 发布 Gemini 3.8 Flash 与 Gemini 3.8 Flash Cyber:前者以 $0.75/$3.75 首发优惠价开放 API,后者通过 Fairwind Program 面向受信任的网络防守方提供访问。
先说结论
Google 于 2026 年 9 月 2 日发布 Gemini 3.8 Flash 与 Gemini 3.8 Flash Cyber。两款模型共享同一套基础智能:3.8 Flash 面向长程编码、自治智能体和企业工作流,已提供稳定版 API;3.8 Flash Cyber 把能力集中到漏洞发现与自动修复,只通过 Fairwind Program 向受信任的防守方开放。123
对读者来说,这次发布有三个直接动作:开发者可以用
gemini-3.8-flash 开始评测;安全团队需要先确认 Fairwind 的申请资格;所有团队都应把官方 benchmark 当作选题线索,再用自己的任务集复测。3.8 Flash 的 introductory price(首发优惠价)为每百万输入 tokens $0.75、每百万输出 tokens $3.75,优惠期到 2026 年 12 月 31 日,2027 年 1 月 1 日起恢复为 $1.50 / $7.50。1| 现在要判断什么 | 已确认的信息 | 动作窗口 |
|---|---|---|
| 是否开始一般开发评测 | gemini-3.8-flash 已是稳定版模型,支持 Gemini API;输入可用文本、图片、视频、音频和 PDF。2 | 今天就可以把长程编码、工具调用和专业文档任务加入评测集。 |
| 是否把 Cyber 版接入普通 API | 官方公开入口是 Fairwind Program,访问对象是获批的政府、关键基础设施运营方和核心技术平台。34 | 先核对机构类型、内部安全团队和访问控制,再提交申请。 |
| 是否沿用 3.7 Flash 的成本假设 | 3.8 Flash 的首发优惠价与 3.7 Flash 相同;Google 的对照图同时标注了 2027 年起的常规价。1 | 成本模型要同时测量 effort、输出 token 和工具调用次数。 |
两个变体,两个访问边界
Gemini 3.8 Flash 是通用的 Flash workhorse(主力模型),重点放在软件工程、智能体任务和专业领域的多步推理。Google 让模型在复杂任务上投入更多推理步骤,并反复调用工具;开发者可以把 thinking effort 调低,以减少 token 消耗。12
Gemini 3.8 Flash Cyber 沿用这套基础智能,训练重点转向网络安全。Google 把漏洞发现、漏洞验证和补丁生成放在同一条防守工作流里,并通过 CodeMender harness(用于组织代码安全智能体的执行框架)提供配套入口。Cyber 版本采用更宽的网络安全缓解措施,因此访问资格由 Fairwind Program 单独管理。14
规格、模型 ID 与价格
| 项目 | Gemini 3.8 Flash | Gemini 3.8 Flash Cyber |
|---|---|---|
| 发布时间 | 2026 年 9 月 2 日。1 | 2026 年 9 月 2 日。1 |
| 参数规模 | 官方未披露。12 | 官方公开材料未列参数规模。13 |
| 模型 ID / 访问方式 | 稳定版 ID 为 gemini-3.8-flash,可通过 Gemini API 使用。2 | Fairwind Program 专属访问,可单独使用,也可与 CodeMender 配合;官方公开材料未列普通 API 模型 ID。34 |
| 输入 / 输出 | 输入支持文本、图片、视频、音频、PDF;输出为文本。2 | Fairwind 页面聚焦代码安全智能体工作流,完整 API 模态规格待公开文档补齐。34 |
| 上下文 / 最大输出 | 1,048,576 / 65,536 tokens。2 | Fairwind 公开页面未列独立的上下文与最大输出字段。3 |
| Thinking | 支持 low、medium、high;minimal 会返回错误。2 | Fairwind 页面强调网络安全能力,未列独立 thinking 档位。3 |
| 价格 | 首发优惠价为输入 $0.75 / 输出 $3.75(每百万 tokens);2027 年 1 月 1 日起为 $1.50 / $7.50。价格表注明输入按 no caching 计算。1 | Fairwind 官方页面未列独立公开价格;访问资格与计费细则需要向 Google 申请时单独确认。34 |
| 可用范围 | Gemini API、Google AI Studio、Google Antigravity、Android Studio、Stitch;企业可在 Gemini Enterprise 使用,消费者可在 Google AI Pro / Ultra 支持的 Gemini 产品中使用。1 | 获批的政府与国家网络机构、关键基础设施运营方、核心技术平台及其他可信伙伴优先;申请需经过审核。34 |
这张表里最值得留意的是两个边界:3.8 Flash 的公开 API 信息已经足够开始工程评测,Cyber 版的关键变量仍然是访问资格、部署环境和安全条款。官方材料截至本次发布页核验时没有给出 Cyber 的单独公共价格。
Gemini 3.8 Flash:长程任务优先
Google 官方对照图显示,Gemini 3.8 Flash 在 DeepSWE v1.1 长程软件工程评测中得分 73.7%,Gemini 3.7 Flash 为 65.3%;在 Vals Finance Agent v2 中为 61.4%,在 Harvey's Legal Agent Benchmark 中为 10.0%。这些项目分别测试软件工程、金融分析和复杂法律工作流。1
同一张官方图还给出 Terminal-bench 2.1 89.4%、HLE-Verified 54.9% 和 GDPval-AA v2 1545 Elo。Google 将这些结果与 Claude、GPT、Grok、Kimi、GLM、Qwen 和 DeepSeek 等模型放在同一张对照图中;不同项目的任务、工具、推理设置和统计口径各不相同,读者应把分数当作能力方向的信号。1
3.8 Flash 的长程能力伴随更高的推理开销。Google 明确提示,复杂任务会执行额外推理步骤并迭代调用工具,高 effort 可能消耗更多 tokens。效率优先的工作负载可以调低 effort,或者继续使用仍获支持的 Gemini 3.7 Flash。12

Gemini 3.8 Flash Cyber:发现漏洞,也修漏洞
在 CyberGym 这个用于漏洞发现的行业基准上,Gemini 3.8 Flash Cyber 的 Pass@1 为 86.2%。Pass@1 可以理解为模型第一次尝试就完成目标的比例;这项图表只覆盖 C/C++,不能直接代表模型对所有语言和生产代码库的表现。3
Google 还用覆盖 20 种编程语言的内部评测检查真实代码库中的漏洞发现,Gemini 3.8 Flash Cyber 的成功率超过 70%。这项结果属于 Google 内部 benchmark,适合说明训练与产品定位,团队仍需用自己的代码库做独立复测。13
补丁生成的外部评测 CWE-Bench 给出另一种读法:Gemini 3.8 Flash Cyber 的 Pass@1 为 47.2%,对照的领先前沿模型为 47.8%。Google 用这组结果强调成本—效果关系,结果依然属于官方发布材料对外披露的比较,团队需要检查评测 harness、任务版本和执行预算后再复现。1
Google 同时披露了三类内部使用案例:Chrome Security 团队称 3.8 Flash Cyber 生成的正确补丁数量达到更大型商用模型的 2.6 倍;Wiz 称其内部渗透测试 benchmark 的 recall 高出 7.5—9.7%,成本低 2.3—5.2 倍;Google Cloud Vulnerability Research 团队称模型在两小时内发现了一项关键基础漏洞。三组数字都来自 Google 发布页中的厂商或合作伙伴披露,不能替代独立安全评估。1
Fairwind 的门槛
Fairwind Program 把 Gemini 3.8 Flash Cyber 放在受控访问路径中,优先服务政府与国家网络机构、医疗、电信、能源、金融等关键基础设施,以及维护大量软件基础设施的核心技术平台。Google DeepMind 的申请页提供了申请入口。34
获批组织需要把访问限定给内部网络安全、事件响应或渗透测试团队,并采用用户级认证、抗钓鱼多因素认证和访问追踪。允许的双用途任务包括授权威胁模拟、逆向工程和恶意软件分析,用途需要服务于防守或学术研究;恶意软件制作等恶意任务不在允许范围内。3
Fairwind 页面还说明,获批伙伴可以把 Cyber 版作为独立模型使用,或与 CodeMender 结合。暂时没有 Fairwind 资格的团队,可以用公开模型配合 CodeMender 和 Google AI Threat Defense 做代码安全工作;这条路径提供的是公开模型能力,访问层级与 Cyber 版不同。34
现在怎么评测
- 开发者团队: 使用
gemini-3.8-flash建立长程编码、工具调用、PDF 分析和专业文档任务集,记录成功率、端到端耗时、输入输出 tokens、工具调用次数和 effort。模型的官方规格支持 1,048,576 tokens 输入、65,536 tokens 输出,以及代码执行、函数调用、文件搜索和搜索 grounding 等能力。2 - 产品与企业团队: 把 introductory price 与 2027 年常规价都放进成本模型,分别测量低、中、高 thinking 设置下的任务完成率和 token 消耗。Google 的 benchmark 表明模型会在复杂任务上投入更多推理步骤,实际账单取决于工作流的任务长度和工具使用方式。12
- 防守型安全团队: 先整理授权范围、代码库类型、漏洞发现与补丁验证流程,再申请 Fairwind。评测记录需要把发现、验证、修复分开计分,同时保留人工复核和回滚步骤。3
Gemini 3.8 Flash 这次把公开 API 的重点推向长程编码与自治智能体,Gemini 3.8 Flash Cyber 则把同一基础能力放进了受控的网络防守计划。对大多数开发者,今天可执行的动作是从
gemini-3.8-flash 开始做自己的任务评测;对安全组织,先解决 Fairwind 资格与治理条件,再判断 Cyber 版能否进入生产流程。References
- 1
- 2Google AI for Developers:Gemini 3.8 Flash
ai.google.dev
- 3Google DeepMind:Fairwind Program
deepmind.google
- 4
This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.
Related content
More from this channel›
- GPT-6 Astra 可用性更新:Pro、企业 Work/Codex 与 API 已开放
- Qwen3.8-Max-0902 更新:同一基座、同一价格,编码后训练改写表现
- GPT-6 Astra 正式 rollout:模型 ID、价格与系统卡已上线,可用性仍分阶段
- OpenAI Astra 先公开安全评估:达到网络安全 Critical,API 与系统卡尚待上线
- Claude Fable 5.1 与 Mythos 5.1 发布:同一底座、两套护栏,缓存读取降至 $0.25/百万 tokens
- GLM-5.3-BF16 完整开放权重上线:753B 参数,代码与安全 benchmark 公开
- 腾讯混元 Hy4 preview 开源:770B 总参数、49B 激活,1M 上下文
- Qwen3.8-Flash API 已正式上线
