DeepSeek V4 Pro、Databricks 50亿美元融资:AI开始验收系统里的成本与权限

DeepSeek V4 Pro、Databricks 50亿美元融资:AI开始验收系统里的成本与权限

DeepSeek 与 Google 把模型推向多步工作流,Databricks 和 Blacksmith 分别押注 Agent 底座与验收层,最新研究则提醒授权必须在动作落地前重新核对。

今日判断

AI 行业今天出现一条很清楚的主线:模型发布、融资和安全研究,都在回答同一个问题——能力进入真实系统后,谁来承担成本,谁来控制动作,谁能证明它没有越界。DeepSeek V4 Pro 和 Google Gemini 3.7 Flash 把模型推向多步工作流;Databricks 把 50 亿美元融资投向数据、Agent 和成本控制;最新研究则把「授权」从一次请求的判断,推进到动作真正发生前的状态核验。
本期覆盖 2026 年 8 月 13 日 08:00 至 8 月 14 日 08:00(北京时间)。融资金额、产品能力和论文结果均保留公司或作者口径;Anthropic 收购 Decart 仍是早期谈判,不能按已完成交易理解。

快速扫一眼

板块关键变化今天该看什么
大公司与产品DeepSeek 发布 V4 Pro,Google 发布 Gemini 3.7 Flash;两者都把重点放在 Agent、编码和多步任务。12看模型能力能否转成稳定的工具调用、价格优势和真实工作流,而不只是发布日的 benchmark。
创业与投资Databricks 完成 50 亿美元战略融资,估值 1900 亿美元;Blacksmith 完成 4500 万美元 B 轮,押注 AI 生成代码之后的测试与验证。34资本正在同时买「Agent 的底座」和「Agent 产出的验收层」;后续要看收入、客户留存和交付责任。
前沿研究与安全MasuGate 研究把过期授权定义为核心故障:预算、库存或审批状态变化后,旧授权仍可能被执行。5上线 Agent 时,授权不能只在请求发出时判断,还要在效果提交前重新核对共享状态。

大公司与模型产品

DeepSeek V4 Pro:正式版开始和价格一起竞争

DeepSeek 于 8 月 13 日正式发布 V4 Pro,称新模型强化了 Agent 能力,并通过 API、App 和网页端提供。公司同时宣布 V4 Pro 与 V4 Flash 将调整 API 价格,引入高峰与低谷时段定价。1
这次发布的看点有两层。第一,V4 Pro 不再只是模型名更新,而是同时改 API、产品入口和算力组织。第二,Reuters 报道称,价格更低的 V4 Flash 在一些独立测试中曾超过 4 月的 V4 Pro 预览版;正式版能否稳定拉开层级,决定了「Pro」这一级价格是否站得住。DeepSeek 还在扩充招聘、数据中心和自研芯片团队,模型竞争已经和基础设施投入绑在一起。
产品负责人今天更值得追踪三项数据:高峰时段的可用性、复杂任务的实际完成率,以及涨价后用户是否转向 Flash。发布时的能力描述,不能替代这三项经营证据。

Google Gemini 3.7 Flash:把低价模型放进自动化任务

Google 发布 Gemini 3.7 Flash,定位是更低成本的编码和自动化业务任务模型。Google 对外强调它可以规划任务、使用软件工具并完成多步工作流;Reuters 报道的限时价格是每百万输入 token 0.75 美元、每百万输出 token 3.75 美元,约为 Gemini 3.6 Flash 原始价格的一半。模型也立即进入 Gemini Spark,面向 160 多个国家的 Google AI Pro 和 Ultra 用户推出。2
Google 这一步的商业含义很直接:先用便宜的 Flash 承接编码、调试和业务 Agent,再把使用量导向更大的产品体系。它也暴露出一个验收问题——便宜一半只有在任务成功率、重试次数和人工接管率没有同步恶化时才成立。旗舰 Pro 的发布时间仍未公布,Google 目前先用 Flash 抢工作流入口。

创业与投资

Databricks:50 亿美元买的是 Agent 的数据与成本控制

Databricks 宣布完成 50 亿美元战略融资,估值 1900 亿美元,由 Coatue、Blackstone、MGX、T. Rowe Price 相关账户和 Sixth Street Growth 等投资方参与。公司同时披露,收入年化运行率超过 70 亿美元,第二季度同比增长超过 80%,过去 12 个月调整后自由现金流保持为正。3
资金将继续投入 Lakebase、Genie 和 Unity AI Gateway:前者是面向 Agent 的无服务器 Postgres 数据库,Genie 负责把企业数据转成回答与动作,Gateway 则管理多模型路由和成本控制。Databricks 官方称 Lakebase 的收入年化运行率已超过 1 亿美元,Lakehouse 超过 15 亿美元;这些数字是公司披露口径。6
这笔融资和上月按 1880 亿美元估值筹资的消息形成了新进展:估值提高的同时,交易已经完成。接下来要验证的是,Databricks 能否把「让 Agent 记住上下文、准确回答、控制 token 成本」变成客户愿意持续付费的产品,而不是把平台能力停留在架构图上。

Blacksmith:AI 写得越快,测试层越值钱

美国 AI 代码测试初创公司 Blacksmith 完成 4500 万美元 Series B,由 Peak XV Partners 领投,估值升至 5.5 亿美元;GV 和 Y Combinator 继续参与,公司累计融资达到 5850 万美元。TechCrunch 报道称,Blacksmith 的客户已超过 5000 家,平台从持续集成测试扩展到能自动修复失败检查的 Codesmith Agent。4
它押注的是一条很实际的产业链:Cursor、Codex 和 Claude Code 让团队更快生成代码,但生成速度上升会把测试、验证和合并变成新瓶颈。Blacksmith 自称年化收入已达数千万美元,部分大客户年支出超过 100 万美元;这些仍是创始人向媒体提供的经营口径。
对投资人来说,要看 Blacksmith 能否从 CI 工具变成 AI 代码交付的控制层;对研发负责人来说,真正要问的是自动修复是否降低了人工审查,而不是增加一层需要复核的代码。

前沿研究与安全

MasuGate:授权必须在动作落地前重新核对

arXiv 论文 Stateful Governance for Concurrent Agentic Systems 研究了一个容易被忽略的故障:Agent 发出请求时,预算、库存、审批状态和风险信号都可能是允许的;等系统真正提交退款、采购或资源分配时,共享状态已经改变,旧授权却仍被执行。论文把这个问题称为 过期授权,并提出「策略状态可串行化」条件,要求每个已提交的效果都能根据发生前一刻的状态解释为得到授权。5
作者用基于 PostgreSQL 的 MasuGate 原型测试采购工作流。论文摘要称,MasuGate 能阻止基线方案漏掉的过期授权,在其他工作继续进行时保留延迟审批,并在脚本化、没有 LLM 参与的采购流程中避免共享预算和库存上的策略违规。结果证明的是原型在论文设定下的行为,不是生产系统的安全保证。
这个研究对企业架构的提醒很具体:权限服务不能只给 Agent 一张「允许」的通行证。系统还要在写入库存、转账或提交采购单之前,重新检查授权、资源余额和审批版本;检查失败后,还要定义是重试、升级人工,还是安全退出。

接下来观察

  • DeepSeek V4 Pro 的价格与分流结果:V4 Pro 涨价后,用户会把复杂任务留在 Pro,还是转向更便宜的 Flash。1
  • Gemini 3.7 Flash 的单位经济性:低 token 价格是否被重试、人工接管和工具调用成本抵消。2
  • Databricks 的融资兑现:Lakebase、Genie 和 Unity AI Gateway 能否带来可持续的客户扩张,而不仅是平台叙事。3
  • Agent 的最后一道权限检查:预算、库存和审批状态是否会在效果落地前再次核验。5

This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.

Related content

  • Sign in to comment.