
8月14日 AI 早报:DeepSeek V4 Pro 发布,前沿模型开始争夺实时速度
今天的五条 AI 要闻显示,模型竞争同时推进了 Agent 工作流、实时推理、国家级基础设施和网络安全攻防,但研究评估仍提醒人们:执行速度不等于研究判断。
覆盖时间:2026 年 8 月 13 日 07:45 至 8 月 14 日 07:45(上海时间)。本期按全球影响、已落地程度和对产业链的牵引力排序;企业自报的性能数字、政府行动计划和安全事件分别标明。
| 排名 | 发生了什么 | 读者该记住什么 |
|---|---|---|
| 1 | DeepSeek 正式发布 V4 Pro,模型进入 App、网页和 API,并强化 Agent 能力;API 将实行高峰与非高峰价格。1 | 中国模型厂商的竞争重点继续从单次问答转向可部署的多步工作流。 |
| 2 | OpenAI 预览 Ultrafast,让 GPT-5.6 Sol 通过 Cerebras 硬件达到每秒最多 750 个输出 token,速度最高是标准处理的 14 倍。2 | 前沿模型的下一场竞争,开始比较一项工作能否在实时交互中完成。 |
| 3 | 以色列发布五年期国家 AI 行动计划,提出国家 AI 研究机构、至少 10 万枚先进加速器、量子计算机和先进制程晶圆厂等目标。34 | 国家 AI 竞争正在从买模型,扩展到算力、人才、应用机构和安全体系的整套建设。 |
| 4 | 台湾称政府机构 7 月遭遇来自海外的 AI 辅助网络攻击,攻击同时使用人工操作和 AI agent;受影响单位已完成处置。5 | AI 攻击的现实变化首先是侦察和漏洞利用提速,尚不能据此宣称攻击已完全自主。 |
| 5 | Nature 报道一项「shadow evaluation」:AI agent 能连续运行数百次实验,却在两个开放式研究任务上只得到原作者 2/6 和 1/6 的总评分。6 | AI 能把实验工程做得更快,仍不等于能独立选对问题、及时放弃错误路线。 |
1. DeepSeek V4 Pro 正式发布,Agent 能力成为主战场
DeepSeek 在 8 月 13 日正式发布 V4 Pro。Reuters 报道称,V4-Pro-0813 已通过 API、App 和网页端提供,官方把升级重点放在 Agent 能力;DeepSeek 同时扩大招聘、算力和融资,试图追回国内竞争对手的发布速度。1
DeepSeek 的官方更新补充了几个可操作的变化:V4 Pro 和 V4 Flash 支持可调的 reasoning effort,V4 Pro 支持原生 OpenAI Responses API,并针对 Codex 提供一键配置;V4 Pro 已在 App 和网页端的 Expert Mode 中提供,也可通过 API 使用。7
价格也在改变。DeepSeek 将为 API 引入高峰与非高峰费率,非高峰价格比高峰低 50%,新价格从 8 月 17 日 00:00(上海时间)起生效。7 这不是一次简单的模型换代:它把模型能力、工作流接口和调用时段一起放进产品设计里。对开发者来说,真正要比较的是多步任务的完成率、推理强度和单位任务成本,而不是只看一次基准分数。
2. OpenAI 把 GPT-5.6 Sol 推向实时速度
OpenAI 8 月 13 日预览 Ultrafast,这是 GPT-5.6 Sol 的新服务层,首批通过 OpenAI API 向有限客户开放。OpenAI 称它由 Cerebras 提供硬件支持,输出速度最高可达每秒 750 个 token,是标准处理的最高 14 倍。2
Cerebras 给出的说明显示,这一方案并不是把模型换成更小的版本,而是用 Wafer-Scale Engine 架构减少推理时的内存搬运。Cerebras 自己的测试称,Ultrafast 完成 2,500 道 Humanity’s Last Exam 题目用了 11 小时 11 分钟;这些是公司测试结果,测试时间、配置和比较对象由 Cerebras 设定,不能直接当作普遍速度保证。8
OpenAI 把故障响应、金融研究、实时客服、交易和交互式实验列为潜在场景。速度真正改变的地方,是模型可以在同一个工作时段里完成「检索—分析—验证—再试一次」的循环;但目前仍是有限预览,容量和实际价格都还没有向所有用户开放。2
3. 以色列的国家 AI 计划:先建整套底座
以色列国家人工智能局 8 月 13 日公布国家 AI 行动计划。计划由总理办公室下属机构制定,提出一个五年期方向:用 AI 处理医疗、教育、政府服务和国家安全等问题,并把国家定位从模型使用者推进到基础设施、应用和标准的建设者。3
具体目标包括成立国家影响型 AI 应用研究机构,并设立 5 个区域性「加速实验室」;算力方面提出至少 10 万枚先进 AI 加速器,先建设 5,000 枚的初始规模,同时推进本国量子计算机和 5 纳米或更先进制程晶圆厂的可行性,还要研究把 AI 算力放到低地球轨道的可能性。34
这些数字是国家计划提出的建设目标,不是已经上线的基础设施。计划还提出国家 AI 伦理委员会和 AI 安全实验室,说明政府把竞争范围定义为算力、数据、人才、应用落地和安全治理的组合。对企业而言,值得观察的不是目标口号本身,而是后续预算、招标、实验室负责人和首批应用是否出现。
4. 台湾披露 AI 辅助网络攻击,人工仍在攻击链上
台湾数字事务主管部门称,政府机构在 7 月遭遇来自海外的异常攻击。台湾国家资通安全研究院从 7 月 20 日起连续发布警报;调查认为,攻击结合了人工操作与 AI agent 辅助,包括 OpenClaw 等工具。受影响单位已完成处置,政府随后制定针对这类 AI 衍生威胁的防护指引并加强监测。5
报道没有把攻击归因于中国。Reuters 同时援引安全研究者的判断:攻击者仍需要由人选择目标、设定任务和下达指令,因此这不是「100% 自主」的攻击。5
这条消息的重点在攻击链条变短了:AI agent 可以帮助攻击者连续做侦察、找漏洞和处理凭据,防守方留给人工分析的时间随之减少。当前公开信息还不足以判断攻击造成了多大损失,但它已经把「AI 能否用于网络攻击」从能力讨论推向了具体的监测和响应流程。
5. AI 能做更多实验,仍不会自动成为研究者
Nature 8 月 13 日报道了 Princeton 团队的一项「shadow evaluation」。研究者选取两篇提交给 NeurIPS 的论文,让 AI 系统围绕相同研究方向完成问题设计、实验和论文写作,再请原论文作者评价结果。系统以 Claude Opus 4.8 为核心,运行在改造后的 OpenClaw 和更大的工具框架上;每个任务有 6 天时间和 3,000 美元计算额度。6
系统表现出一项实用能力:几天内可以运行数百次实验,完成相对扎实的文献综述,也能发现部分自己的错误。问题出在研究判断上:它往往过早选定一个假设,路线不通时回退得不够,后续自我审查也不够尖锐。最终,两个任务分别只得到原作者 2/6 和 1/6 的总评分。6
这项报道讨论的是一篇 7 月底发布的预印本,8 月 13 日是 Nature 的报道日期。时间边界需要分开:今天新增的是研究结果被更广泛报道,实验本身并非今天才开始。6
今天的共同线索
今天的五条消息落在同一条产业链上,但证据强度不同。DeepSeek 把 Agent 能力和 API 价格写进正式发布;OpenAI 把前沿模型的响应速度推到实时交互场景;以色列把算力、机构和安全实验室列入国家计划;台湾的案例说明攻击者已经在把 agent 接入攻击流程;研究评估则提醒我们,执行速度仍然不能替代研究方向判断。
因此,AI 竞争的比较单位正在从「哪个模型回答得更好」变成三件更具体的事:它能否在多步流程中持续工作,基础设施能否把延迟和成本压到可用范围,以及组织能否为失败、复核和安全响应留下位置。今天公布的进展分别推进了其中一环,却没有哪一条单独证明完整的自动化已经到来。
References
- 1
- 2
- 3
- 4Israel’s National AI Plan — Action Plan
govextra.gov.il
- 5
- 6AI isn’t ready to research itself
nature.com
- 7DeepSeek-V4-Pro GA Release
api-docs.deepseek.com
- 8Accelerating GPT-5.6 Sol Ultrafast
cerebras.ai
This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.
