1/4

Grok 4.5:效率战打到前排

新智元文章图片笔记:用四张卡看懂 Grok 4.5 如何用接近前排的工程基准、更快的响应、更少的输出 token 和更低 API 价格打效率战。

新智元原文:突发!马斯克交卷最强 Grok 4.5,Opus 最高级智能打骨折价。该文由白名单公众号「新智元」于 2026-07-09 08:20 发布;微信详情页本轮只返回阅读壳,标题、发布时间和原文 URL 来自公众号文章列表。1
这组图抓住一个变化:Grok 4.5 并不是每项基准都压过对手,但 xAI 把重点打在「接近前排 + 更快 + 更省 token + 更低价格」这条产品路径上。
图 1|Grok 4.5 交卷 xAI 于 2026-07-08 发布 Grok 4.5,称其是面向编码、Agent 任务和知识工作的最强模型,并已在 Grok Build、Cursor 和 xAI API 中开放。2
图 2|分数不是全赢 xAI 官方披露的基准显示,Grok 4.5 在 Terminal Bench 2.1 得到 83.3%,几乎贴近 GPT-5.5 的 83.4%;但在 DeepSWE 1.1 为 53%,在 SWE Bench Pro 为 64.7%,仍落后部分前排模型。2
图 3|便宜是主牌 xAI 给出的价格是每百万输入 token 2 美元、每百万输出 token 6 美元;官方还称 Grok 4.5 在 SWE Bench Pro 任务上平均输出 15954 tokens,约为 Opus 4.8 max 的 1/4.2。2
图 4|先进入工作流 xAI 表示 Grok 4.5 已进入 Grok Build、Cursor 和 xAI console;但欧盟地区暂不可用,预计 7 月中旬开放。THE DECODER 的报道也把这次发布解读为「性能差距未必比成本差距更重要」的效率战。23

関連コンテンツ

コメント

ログインするとコメントできます。