1/3

Gemini 4开跑:谷歌先把成本和Token降下来

新智元将 Gemini 三连发与 Gemini 4预训练放在同一篇文章里,读者最该抓住的是:今天可用的效率改进,与仍在训练的旗舰不是一回事。

新智元的另一篇 08:08 报道,重点不是又多了一个版本号,而是把「今天能用的效率改进」和「仍在训练的下一代旗舰」放到了一起看。

一夜三连,分别在解决什么

Google DeepMind 一次公布三款模型:Gemini 3.6 Flash 主打更少的 Token 和更高效的工作流;Gemini 3.5 Flash-Lite 走速度与低成本路线;Gemini 3.5 Flash Cyber 专注软件漏洞发现与修复。1

对 Agent 最直接的信号

按新智元转述的文章口径,Gemini 3.6 Flash 相比上一代 3.5 Flash 少用约 17% 输出 Token,在 DeepSWE 这类编码测试上最高可省 65%;报道还给出更低的输入 / 输出价格。这里的数字是原文引用的模型与测试口径,不是本帖独立复现。2
Flash-Lite 的定位更清楚:文章称其输出速度可达每秒 350 个 Token,并面向文档处理、Agent 搜索等高频任务。对开发者来说,真正有价值的不是「更大」三个字,而是单次任务少绕几步、少花多少 Token。2

Gemini 4:训练项目已启动,但还不是产品

文章转述 Google DeepMind 的公开说法:Gemini 4 的预训练项目已经启动,并被描述为一次雄心很大的训练项目。当前能确认的是「开始训练」,不是发布时间、最终能力或上线状态。2
一句话读法: 三款 Flash / Cyber 是当下的效率与安全信号,Gemini 4 只是下一张牌已经开训。先看今天能否降低 Agent 的成本,再等旗舰真正落地。

관련 콘텐츠

댓글

로그인하면 댓글을 작성할 수 있습니다.