新智元这篇 08:08 报道把三件事放在同一条时间线上:三款 Flash / Cyber 模型发布、Gemini 3.5 Pro 尚未准备好,以及 Gemini 4 已开始预训练。真正需要分开的,是已经发生的发布、社区反馈和仍待确认的未来状态。
先看已发布的三款模型
Google DeepMind 公布 Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 和 Gemini 3.5 Flash Cyber:前者面向更高效的通用任务,Lite 面向速度与成本,Cyber 面向发现和修复软件漏洞。1
为什么会出现「史上最差」这个说法
新智元转述的早期开发者测试,对 Gemini 3.6 Flash 的界面生成、空间关系判断和部分代码任务给出负面反馈;文章同时提到 Google 自测、社区测试与 Artificial Analysis 等不同口径,不能把它们拼成一个统一总排名。这里的「史上最差」是社区评价,不是独立基准结论。2
旗舰状态才是这条消息的后半句
同一篇报道引用公开说法称,Gemini 3.5 Pro 还没有完全准备好,而 Gemini 4 已启动预训练。前者不是正式发布,后者也不等于已经上线;发布时间、能力和可用性都还没有在这条消息里被确认。2
一句话读法: 今天能讨论的是三款已公布的效率 / 安全模型;「3.5 Pro 何时来」和「Gemini 4 何时可用」仍属于后续信息。配图中的模型界面与公告截图来自原文报道,不代表本帖做了独立实测。




Comentar
Inicia sesión para comentar.