Gemini 3.8 Flash 与 Flash Cyber 发布:$0.75 起,安全版进入 Fairwind 受控访问

Gemini 3.8 Flash 与 Flash Cyber 发布:$0.75 起,安全版进入 Fairwind 受控访问

Google 发布 Gemini 3.8 Flash 与 Gemini 3.8 Flash Cyber:前者以 $0.75/$3.75 首发优惠价开放 API,后者通过 Fairwind Program 面向受信任的网络防守方提供访问。

先说结论

Google 于 2026 年 9 月 2 日发布 Gemini 3.8 Flash 与 Gemini 3.8 Flash Cyber。两款模型共享同一套基础智能:3.8 Flash 面向长程编码、自治智能体和企业工作流,已提供稳定版 API;3.8 Flash Cyber 把能力集中到漏洞发现与自动修复,只通过 Fairwind Program 向受信任的防守方开放。123
对读者来说,这次发布有三个直接动作:开发者可以用 gemini-3.8-flash 开始评测;安全团队需要先确认 Fairwind 的申请资格;所有团队都应把官方 benchmark 当作选题线索,再用自己的任务集复测。3.8 Flash 的 introductory price(首发优惠价)为每百万输入 tokens $0.75、每百万输出 tokens $3.75,优惠期到 2026 年 12 月 31 日,2027 年 1 月 1 日起恢复为 $1.50 / $7.501
现在要判断什么已确认的信息动作窗口
是否开始一般开发评测gemini-3.8-flash 已是稳定版模型,支持 Gemini API;输入可用文本、图片、视频、音频和 PDF。2今天就可以把长程编码、工具调用和专业文档任务加入评测集。
是否把 Cyber 版接入普通 API官方公开入口是 Fairwind Program,访问对象是获批的政府、关键基础设施运营方和核心技术平台。34先核对机构类型、内部安全团队和访问控制,再提交申请。
是否沿用 3.7 Flash 的成本假设3.8 Flash 的首发优惠价与 3.7 Flash 相同;Google 的对照图同时标注了 2027 年起的常规价。1成本模型要同时测量 effort、输出 token 和工具调用次数。

两个变体,两个访问边界

Gemini 3.8 Flash 是通用的 Flash workhorse(主力模型),重点放在软件工程、智能体任务和专业领域的多步推理。Google 让模型在复杂任务上投入更多推理步骤,并反复调用工具;开发者可以把 thinking effort 调低,以减少 token 消耗。12
Gemini 3.8 Flash Cyber 沿用这套基础智能,训练重点转向网络安全。Google 把漏洞发现、漏洞验证和补丁生成放在同一条防守工作流里,并通过 CodeMender harness(用于组织代码安全智能体的执行框架)提供配套入口。Cyber 版本采用更宽的网络安全缓解措施,因此访问资格由 Fairwind Program 单独管理。14

规格、模型 ID 与价格

项目Gemini 3.8 FlashGemini 3.8 Flash Cyber
发布时间2026 年 9 月 2 日。12026 年 9 月 2 日。1
参数规模官方未披露。12官方公开材料未列参数规模。13
模型 ID / 访问方式稳定版 ID 为 gemini-3.8-flash,可通过 Gemini API 使用。2Fairwind Program 专属访问,可单独使用,也可与 CodeMender 配合;官方公开材料未列普通 API 模型 ID。34
输入 / 输出输入支持文本、图片、视频、音频、PDF;输出为文本。2Fairwind 页面聚焦代码安全智能体工作流,完整 API 模态规格待公开文档补齐。34
上下文 / 最大输出1,048,576 / 65,536 tokens。2Fairwind 公开页面未列独立的上下文与最大输出字段。3
Thinking支持 low、medium、high;minimal 会返回错误。2Fairwind 页面强调网络安全能力,未列独立 thinking 档位。3
价格首发优惠价为输入 $0.75 / 输出 $3.75(每百万 tokens);2027 年 1 月 1 日起为 $1.50 / $7.50。价格表注明输入按 no caching 计算。1Fairwind 官方页面未列独立公开价格;访问资格与计费细则需要向 Google 申请时单独确认。34
可用范围Gemini API、Google AI Studio、Google Antigravity、Android Studio、Stitch;企业可在 Gemini Enterprise 使用,消费者可在 Google AI Pro / Ultra 支持的 Gemini 产品中使用。1获批的政府与国家网络机构、关键基础设施运营方、核心技术平台及其他可信伙伴优先;申请需经过审核。34
这张表里最值得留意的是两个边界:3.8 Flash 的公开 API 信息已经足够开始工程评测,Cyber 版的关键变量仍然是访问资格、部署环境和安全条款。官方材料截至本次发布页核验时没有给出 Cyber 的单独公共价格。

Gemini 3.8 Flash:长程任务优先

Google 官方对照图显示,Gemini 3.8 Flash 在 DeepSWE v1.1 长程软件工程评测中得分 73.7%,Gemini 3.7 Flash 为 65.3%;在 Vals Finance Agent v2 中为 61.4%,在 Harvey's Legal Agent Benchmark 中为 10.0%。这些项目分别测试软件工程、金融分析和复杂法律工作流。1
同一张官方图还给出 Terminal-bench 2.1 89.4%、HLE-Verified 54.9% 和 GDPval-AA v2 1545 Elo。Google 将这些结果与 Claude、GPT、Grok、Kimi、GLM、Qwen 和 DeepSeek 等模型放在同一张对照图中;不同项目的任务、工具、推理设置和统计口径各不相同,读者应把分数当作能力方向的信号。1
3.8 Flash 的长程能力伴随更高的推理开销。Google 明确提示,复杂任务会执行额外推理步骤并迭代调用工具,高 effort 可能消耗更多 tokens。效率优先的工作负载可以调低 effort,或者继续使用仍获支持的 Gemini 3.7 Flash。12
Google DeepMind 官方 CyberGym Pass@1 对照图,Gemini 3.8 Flash Cyber 得分 86.2%,其他柱形为 Gemini 3.5 Flash Cyber、GPT-5.6 Sol、Mythos 5 和 GPT-5.5-Cyber
图中比较的是 C/C++ 漏洞发现的 CyberGym Pass@1;Gemini 3.8 Flash Cyber 为 86.2%,Gemini 3.5 Flash Cyber 为 77.5%,GPT-5.6 Sol、Mythos 5 和 GPT-5.5-Cyber 分别为 83.6%、83.8% 和 85.6%。数据来自 Google DeepMind 的 Fairwind Program 页面。3

Gemini 3.8 Flash Cyber:发现漏洞,也修漏洞

在 CyberGym 这个用于漏洞发现的行业基准上,Gemini 3.8 Flash Cyber 的 Pass@1 为 86.2%。Pass@1 可以理解为模型第一次尝试就完成目标的比例;这项图表只覆盖 C/C++,不能直接代表模型对所有语言和生产代码库的表现。3
Google 还用覆盖 20 种编程语言的内部评测检查真实代码库中的漏洞发现,Gemini 3.8 Flash Cyber 的成功率超过 70%。这项结果属于 Google 内部 benchmark,适合说明训练与产品定位,团队仍需用自己的代码库做独立复测。13
补丁生成的外部评测 CWE-Bench 给出另一种读法:Gemini 3.8 Flash Cyber 的 Pass@1 为 47.2%,对照的领先前沿模型为 47.8%。Google 用这组结果强调成本—效果关系,结果依然属于官方发布材料对外披露的比较,团队需要检查评测 harness、任务版本和执行预算后再复现。1
Google 同时披露了三类内部使用案例:Chrome Security 团队称 3.8 Flash Cyber 生成的正确补丁数量达到更大型商用模型的 2.6 倍;Wiz 称其内部渗透测试 benchmark 的 recall 高出 7.5—9.7%,成本低 2.3—5.2 倍;Google Cloud Vulnerability Research 团队称模型在两小时内发现了一项关键基础漏洞。三组数字都来自 Google 发布页中的厂商或合作伙伴披露,不能替代独立安全评估。1

Fairwind 的门槛

Fairwind Program 把 Gemini 3.8 Flash Cyber 放在受控访问路径中,优先服务政府与国家网络机构、医疗、电信、能源、金融等关键基础设施,以及维护大量软件基础设施的核心技术平台。Google DeepMind 的申请页提供了申请入口34
获批组织需要把访问限定给内部网络安全、事件响应或渗透测试团队,并采用用户级认证、抗钓鱼多因素认证和访问追踪。允许的双用途任务包括授权威胁模拟、逆向工程和恶意软件分析,用途需要服务于防守或学术研究;恶意软件制作等恶意任务不在允许范围内。3
Fairwind 页面还说明,获批伙伴可以把 Cyber 版作为独立模型使用,或与 CodeMender 结合。暂时没有 Fairwind 资格的团队,可以用公开模型配合 CodeMender 和 Google AI Threat Defense 做代码安全工作;这条路径提供的是公开模型能力,访问层级与 Cyber 版不同。34

现在怎么评测

  1. 开发者团队: 使用 gemini-3.8-flash 建立长程编码、工具调用、PDF 分析和专业文档任务集,记录成功率、端到端耗时、输入输出 tokens、工具调用次数和 effort。模型的官方规格支持 1,048,576 tokens 输入、65,536 tokens 输出,以及代码执行、函数调用、文件搜索和搜索 grounding 等能力。2
  2. 产品与企业团队: 把 introductory price 与 2027 年常规价都放进成本模型,分别测量低、中、高 thinking 设置下的任务完成率和 token 消耗。Google 的 benchmark 表明模型会在复杂任务上投入更多推理步骤,实际账单取决于工作流的任务长度和工具使用方式。12
  3. 防守型安全团队: 先整理授权范围、代码库类型、漏洞发现与补丁验证流程,再申请 Fairwind。评测记录需要把发现、验证、修复分开计分,同时保留人工复核和回滚步骤。3
Gemini 3.8 Flash 这次把公开 API 的重点推向长程编码与自治智能体,Gemini 3.8 Flash Cyber 则把同一基础能力放进了受控的网络防守计划。对大多数开发者,今天可执行的动作是从 gemini-3.8-flash 开始做自己的任务评测;对安全组织,先解决 Fairwind 资格与治理条件,再判断 Cyber 版能否进入生产流程。

This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.

Related content

More from this channel