
Claude 领做 Anthropic 26% 的研发、OpenAI 发布法律版 Astra、Crusoe 融资 39 亿美元:硅谷 AI 过去 24 小时
本期梳理硅谷 AI 过去 24 小时的四条要闻:Anthropic 首次公开 Claude 在自家 AI 研发中的参与度并给出可对外报告的度量方法,OpenAI 发布法律专用的 Astra for Law,数据中心开发商 Crusoe 完成 39 亿美元融资,以及纽约时报诉 OpenAI 与微软版权案的一批解封取证材料。
截至北京时间 2026 年 9 月 18 日 09:00,本期覆盖 9 月 17 日 09:00 至 9 月 18 日 09:00 硅谷 AI 领域的动态。按原始发布时间落在窗口内、且能追溯到可点击原始信源的标准,本期纳入四条主单元:Anthropic 公布 Claude 在公司人工智能研发中的参与度,并给出前沿实验室可以对外报告的度量方法;OpenAI 把最前沿的模型打包成法律专用版本,向部分律所开放;数据中心开发商 Crusoe 完成 39 亿美元 F 轮融资;纽约时报诉 OpenAI 与微软的版权案解封一批取证材料。另有八条进展列在文末。文中公司自述、第三方基准、媒体报道与编辑判断分别注明。
先看结论
| 优先级 | 事件 | 已确认变化 | 关键数字 | 接下来观察 |
|---|---|---|---|---|
| 1 | Anthropic 首次量出 Claude 在自家研发里的分量 | 公司公开一组内部度量:把全部 AI 研发工作编成任务树,用自动化等级逐项打分,并给出 8 月的快照;同时表示将引入多机构的第三方常驻评估员核验这类数字。1 | 截至 2026 年 8 月,Claude「领做」26% 的 AI 研发工作,处于「协作」及以上超过 90%,完全自主为零;2026 年 2 月「领做」占比不到 1%。1 | 第三方评估员何时、以什么身份到位;其他前沿实验室是否按同一量表发布同类数字。 |
| 2 | OpenAI 发布 Astra for Law | 把 GPT‑6 Astra 与一套法律检索索引、面向法律分析与写作的指令打包,先通过 ChatGPT 与 Codex 的 Trusted Access 向选定律所开放,随后进入 API;同日上线 26 个合作方插件。2 | 检索语料超过 2.3 亿个 URL;在 Vals AI 法律研究基准的 200 题上整体正确率 54.0%,对照只用网页搜索的 GPT‑6 Astra 为 38.7%。2 | API 的开放时间与定价;检索索引的更新频率能否被事务所与第三方复核。 |
| 3 | Crusoe 完成 39 亿美元 F 轮 | 公司宣布本轮首次交割,资金用于自建 AI 工厂与模块化单元,同时扩张 Crusoe Cloud。3 | 投后估值 309 亿美元;公司称平台累计合同价值超过 1400 亿美元,已签约容量超过 6 吉瓦、其中 1 吉瓦已交付运行。3 | 合同价值的客户集中度与期限;模块化单元能否真把交付周期压到数周。 |
| 4 | 版权案解封取证材料 | 纽约时报等诉 OpenAI 与微软案中此前被遮盖的部分文件对外公开,原告方称这些材料抽掉了被告的合理使用抗辩。4 | 文件引述 ChatGPT 负责人称出版商面临「生存威胁」、产品「大体上是替代性的」;微软首席执行官在作证时承认对话产品替代了访问原站的需要。4 | 法院对合理使用争点的裁定时间;其他内容方诉讼是否援引这批材料。 |
Anthropic 首次量出 Claude 在自家研发里的分量
9 月 17 日,Anthropic 在其研究所专栏发布一组内部度量,用来回答三个问题:下一代模型有多少是 AI 自己做的、公司能不能看住自己的智能体、算力都花在了哪里。1 这个发布时间与公司此前呼吁给前沿研发减速的立场放在一起看更有意思:文中写明,如果真出现协同放缓,这些数字本来会跟着变。1
第一组叫 Anthropic R&D 自动化指数。做法是把公司全部的 AI 研发工作编成一棵任务树:2026 年 7 月每周随机抽取各部门 20% 的员工,由 Claude 研究智能体复盘他们的工作记录(含 Slack 消息与内部文档),整理出约 1.5 万项具体任务,再归并成 542 个节点、其中 378 个叶节点,并按人时给节点加权。每个节点由 Claude 评审按 Epoch AI 提出的自动化等级打分,量级从「无 AI 参与」到「完全自主」共六级。1
8 月的快照是:Claude 领做 26% 的 AI 研发工作,处于「协作」及以上的占比超过 90%,没有任何被测量的部分达到完全自主。公司给出的曲线显示,2026 年 2 月「领做」的比例还不到 1%。1 路透社与彭博社当天都报道了这组数字,彭博社的说法是从年初的几乎为零起步。56
方法本身的限度也写进了发布。评审用的是 Anthropic 自己的模型,公司于是请各工作领域的负责人独立打分做对照:模型与人的完全一致率为 59%,人与人之间为 35%,模型与人的评分有 97% 落在相邻一级以内;「协作」到「领做」的边界仍有争议空间。任务篮子冻结在 2026 年 7 月,指数上升只说明当时那批人的工作在自动化,公司计划定期重建任务篮子并重新发布版本。1
第二组是智能体监督。截至 8 月,公司在最常用的内部平台上同时运行着约 3 万个做研究与工程工作的智能体,这些动作 100% 先经过在线监控、100% 被离线监控摄取。8 月一个月里,公司分析了超过 10 亿次决策,其中 0.002%(约每 4.7 万次一次)被在线监控拦截;离线监控每周标记约 10 万条会话记录,其中约 50 条升级到人工复核。1
第三组是算力分配。7 月 13 日至 20 日这一周,流向 AI 研发的算力里约 6% 用于安全工作,流向 AI 驱动的 AI 研发的算力里约 12% 用于安全。公司说这是刻意保守的口径:一个 token 只要同时也算提升能力,就不计进这两个比例。1
发布里还有一个承诺:Anthropic 计划让来自多个机构的第三方常驻评估员进入公司,访问范围与内部风险评估团队相当,由他们核验安全实践、上报事件并监控上述指标。1
为什么值得看: AI 参与 AI 研发此前多是方向性描述,这次给出了可比较的量表、任务清单与加权方式,其他实验室照着同一量表也能报。26% 与 90% 处在两个不同的自动化档位——前者是给一个高层提示就能端到端做完大部分任务,后者仍需人密切指导,采购方与治理方在引用这些数字时要分清。这是编辑判断。
接下来观察: 一是第三方常驻评估员何时、以什么身份到位。二是其他前沿实验室是否采用同一量表发布同类数字,跨实验室对比是否成立。三是下一期这类数字的走势,以及 Anthropic 是否补上更细的分项。
OpenAI 把最强模型装进法律工作台
9 月 17 日,OpenAI 发布 Astra for Law,把 GPT‑6 Astra 与一套法律检索索引、一组面向法律分析与写作的指令打包在一起,面向律所与法律科技公司。2 检索索引覆盖美国判例法、成文法、法规、法院规则与行政裁决,语料超过 2.3 亿个 URL,来源每日新增;判例部分与 CourtListener 背后的非营利组织 Free Law Project 合作,纳入其覆盖美国已公开先例判例法 99.9% 以上的集合。2
性能上公司给了三组对照:在 Vals AI 的 Legal Research Bench 私密验证集的 200 个美国法律研究问题上,最高推理档下 Astra for Law 的整体正确率为 54.0%,只用网页搜索的 GPT‑6 Astra 为 38.7%,相对提升 40%;判例法问题上引用的参考案例多 24%;在受审计的目标段落集合里命中的相关段落最多多 54%。2 这些是公司自述的评测结果,基准由第三方机构 Vals AI 提供,验证集未公开。
交付方式上,Astra for Law 先通过 ChatGPT 与 Codex 的 Trusted Access 计划向选定律所开放,随后进入 API;符合条件的律所可在 API 上获得零数据留存,ChatGPT Enterprise 的使用默认不进入人工审核。模型选择器里的名字是 GPT‑6 Astra Law,API 名为 gpt-6-astra-law。2 生态侧同日上线 26 个合作方插件,包括 iManage、Intapp、DeepJudge,以及汤森路透的 HighQ 与即将推出的 CoCounsel Legal 连接器;还有 9 个来自 LegalQuants、LECG、Skills.law 的社区插件与 47 个自定义技能。API 客户名单里有 Harvey 与 Legora,ChatGPT for Word 同日正式可用。2
公司列出的试点事务所有 Sullivan & Cromwell(把所内谈判手册与先例做成协议分析器)、Ropes & Gray(交易尽调系统)、Cooley(上市流程应用 GO Public)、Latham & Watkins(共同设计信息权限、伦理墙与事务所监督机制)以及 Wachtell, Lipton, Rosen & Katz。2
为什么值得看: 法律是生成式 AI 落地最深、付费意愿最明确的专业服务之一。这次发布的形态是把检索语料、写作指令与合规控制打包成一层底座,再让 Harvey、Legora 这类应用方在它上面做产品,模型供应方在垂直行业里同时充当底座与供应商。这是编辑判断。
接下来观察: 一是 API 的开放时间与定价。二是那套检索索引的更新频率与覆盖范围,能否被事务所自己和第三方复核。三是律所采购时对零数据留存、伦理墙这些控制项的实际执行情况。
Crusoe 拿到 39 亿美元 F 轮,估值 309 亿美元
9 月 17 日,Crusoe 宣布完成 39 亿美元 F 轮的首次交割,投后估值 309 亿美元。本轮超额认购,由 Atreides Management、Mubadala Capital 与 Valor Equity Partners 共同领投,Founders Fund、GIC、NVIDIA、卡塔尔投资局、Radical Ventures 与 TPG 等新老投资方参与。3 《华尔街日报》当天报道了这笔融资,并把重点放在这家公司业务重心的变化上:它建了 OpenAI 最大的数据中心园区,现在同时在造更小的模块化单元。7
公司同时给出一组经营数字:纵向整合平台累计合同价值超过 1400 亿美元;已签约总容量超过 6 吉瓦,其中 1 吉瓦已交付运行;Crusoe Cloud 年内预订量同比增长 20 倍以上;去年底推出的 CrusoeManaged Inference 已签约超过 1 亿美元的年度经常性收入;公司在五个国家有 1800 多名员工。3 这些全是公司自述。新闻稿还提到,OpenAI 训练 Astra 所用的 Abilene 园区由 Crusoe 设计并建造。3
模块化是这轮融资讲的核心故事:Crusoe Spark 箱体在美国制造,公司称它把现场建设周期从数年缩短到数周,并能按需分批扩容,用来支撑 Crusoe Cloud 的增长。新闻稿点名的云客户有 Cognition、Figure 与 Perplexity。3
为什么值得看: 同一笔算力账单,现在有两条并行的融资路径:大型园区依赖长期合同与项目融资,模块化单元靠交付速度和分批投入降低单点风险。Crusoe 两条都在做,等于把交付速度当成可以计价的产品特性。这是编辑判断。
接下来观察: 一是 1400 亿美元合同价值的客户集中度与合同期限,公司没有公布明细。二是模块化单元能否真把交付压到数周并压低单位成本。三是 6 吉瓦签约容量里,已交付的比例何时提高。
版权案解封:高管自己的话进了法庭记录
9 月 17 日,纽约时报等新闻机构诉 OpenAI 与微软的版权案中,此前被遮盖的一部分取证文件对外公开。原告方称这些材料抽掉了被告的合理使用抗辩。4 案件在曼哈顿联邦法院审理,承办法官为 Sidney Stein。4
被公开的引述按报道整理如下:
- OpenAI 的 ChatGPT 负责人 Nick Turley 称,出版商面临来自这些产品的「生存威胁」,产品「大体上是替代性的」,并且「随着它们变得更好,会越来越具替代性」。4
- OpenAI 联合创始人兼总裁 Greg Brockman 写道,大语言模型「特别擅长预测新闻文章的文本」「在新闻上表现出色」「在任何新闻任务上都很好」;在被同事告知有人找到了绕过纽约时报付费墙的「办法」时,他的回复是「ah nice」。4
- 微软首席执行官 Satya Nadella 在宣誓作证时承认,与聊天机器人对话「已经替代了……到网站上去获取信息,因为信息就在 AI 平台上」。4
- 微软应用科学总监 Brent Hecht 说,「数百万人」会把 AI 公司「吸走」他们的作品看作「规模空前的惊人盗窃」。4
被告方作了回应。微软发言人说,Nadella 的证词与公司在案件中的立场一致,他谈的是人们查找和消费信息方式的广泛原则与正在发生的变化;Hecht 的说法只反映一名员工的个人观点,属于法律分析之外,不代表公司立场。OpenAI 的发言人对文件未立即回应,纽约时报发言人拒绝置评。代表纽约每日新闻等八家报纸的律师 Steven Lieberman 说,这批证据显示 OpenAI 与微软知道自己在做什么。4
背景是:这起诉讼 2023 年提起,指控两家公司在未经许可的情况下使用数百万篇文章训练 ChatGPT;特朗普政府 9 月 1 日告诉法官 Stein,AI 训练具有「极其」的转化性。4 解封后的文件本身也可以直接查。8
为什么值得看: 取证材料里的这些说法把行业争论变成了法庭记录——模型越强就越容易直接回答用户原本要去原站找的问题,这个判断由被告高管自己写出。对做内容授权、数据来源合规和模型采购的人来说,这决定了后续谈判里对方能援引的事实基础。这是编辑判断。
接下来观察: 一是法院对合理使用争点何时作出裁定。二是其他内容方的诉讼是否援引这批解封材料。三是 OpenAI 与出版方之间的授权交易是否会因此加速。
其他已核验进展
- Manus 拟以 40 亿美元估值融资 5 亿美元。 彭博社引述知情人士报道,这轮计划融资 5 亿美元、即将完成,估值较此前翻倍,会让这家智能体公司成为中国同领域估值最高的创业公司;交易仍在洽谈、条款可能变化,Manus、腾讯、HSG 与真格基金均未回应置评请求。9 已披露的背景是:Meta 去年 12 月宣布收购(当时 Manus 年化收入超过 1 亿美元),北京叫停后双方在 5 月完成运营拆分并停止数据共享;7 月彭博社报道创始人团队与腾讯、HSG、真格基金按 20 亿美元估值从 Meta 手中回购股份。10
- 世界模型初创公司 Emulate 洽谈最高 7 亿美元种子轮。 Emulate 由三名前 Google DeepMind 世界模型团队成员在 8 月创立,其中一位是 Genie 3 的主要研究者;金融时报与彭博社都报道 Index Ventures 与 Lightspeed Venture Partners 将领投、Creandum 参与,两家对估值的口径不同:金融时报说投前 37 亿美元,彭博社说融资前为 30 亿美元。111213 公司未回应置评请求,条款仍未确定。
- Comp AI 完成 3400 万美元 A 轮。 这家做安全与合规智能体的公司由 Roo Capital 与 Grand Ventures 领投,累计融资 3750 万美元;平台用智能体起草安全政策、收集审计证据、持续监控合规控制,并提供 AI 驱动的渗透测试,公司强调政策仍由人复核批准。14
- Anthropic 改版 Claude Projects,让一个协调线程调度多条并行线程。 用户描述目标后,Claude 负责拆解、分派、协调并行工作并汇总结果;每条线程是一段独立的 Claude Code 云会话,各自在自己的分支上运行,项目记忆与文件库跨线程共享。功能先在 Claude Code 云会话的 Pro 与 Max 订阅上以 beta 形式开放,随后扩到全部 Claude 与团队、企业档。15
- 皮尤研究中心:37 国调查中 34 国的多数人预期 AI 减少就业。 调查在 2026 年 2 月 8 日至 5 月 13 日访问 36 国的 42151 人,另加美国两轮共 8607 人;澳大利亚、韩国、美国等富裕国家约七成或更多受访者认为未来 20 年 AI 会导致就业减少,美国持这一看法的人两年内上升 7 个百分点。16
- 中美安全专家提议按核武器思路为 AI 设护栏。 布鲁金斯学会的 Melanie Sisson 与复旦大学的 Tianjiao Jiang 在美国—中国 AI 与国家安全对话框架下提出:核指挥系统周边设红线,AI 对另一国核指挥、控制与通信系统发起网络攻击须由人决定;为 AI 相关事件设立中美军事热线;并统一「有意义的人类控制」的定义。两国政府尚未公开背书这些建议。1718
- 硅谷数据中心扩张在本地遇阻。 路透社报道,圣何塞居民与环保团体正组织反对一批数据中心项目,要求更严格的公共审查、更透明的能耗与用水披露,以及健康与环境影响评估;加州参众两院已通过多项针对数据中心的法案,等待州长纽森在本月底前签署或否决,行业组织数据中心联盟认为这些法案单独针对数据中心并不公平。19
- 科技领袖说服白宫搁置一项 AI 监管机构方案。 《华尔街日报》引述知情人士报道,马斯克、扎克伯格与黄仁勋近期与特朗普沟通,反对设立新的联邦 AI 监管机构,方案因此停摆;该方案由 Google DeepMind 的 Demis Hassabis 与 Anthropic 的 Dario Amodei 提议。特朗普在 Truth Social 上把 AI 安全顾虑称为骗局,认为严格限制会让中国赶超;马斯克主张由企业互相审计未发布的前沿模型,黄仁勋公开表示现有法律已经够用。2021
编辑判断:模型接手工作,资本继续押注,阻力转向许可与选址
四条主单元和文末进展放在一起,这一天的硅谷 AI 新闻落在两条线上。
一条线是模型开始接手实际工作。 Anthropic 给出 Claude 领做 26% 研发的数字,说明研发这件事已经在被模型分担;OpenAI 把模型装进法律检索与写作的工作台,让应用公司在上面搭建产品;Anthropic 改版 Projects,让一个协调线程调度多条并行线程;Comp AI 把安全政策起草与审计取证交给智能体。四件事的共同点是把原本需要人分派、拼接的工作交给模型自己推进,差别在核验环节放在哪里:Anthropic 说要引入第三方常驻评估员,OpenAI 用第三方法律研究基准加受审计的段落集合,Comp AI 保留人工批准。核验放在哪里,决定了采购方能不能把责任写进合同。
另一条线是资本继续押注,落地阻力转向许可与选址。 Crusoe 的 39 亿美元、Manus 的 40 亿美元估值、Emulate 的 37 亿美元投后报价出现在同一个窗口;同一窗口里,圣何塞居民组织反对数据中心项目,加州多项数据中心法案等待州长签署,皮尤 37 国调查显示多数人预期 AI 减少就业,三位科技领袖则把一项联邦 AI 监管机构方案劝停在白宫。钱和芯片还在进来,要过的是电费、选址与许可这几道关。
本期数字的发布方不同,比较之前值得先看清。Anthropic 的 26%、90% 与算力比例是公司自述,第三方常驻评估员尚未就位;Crusoe 的 1400 亿美元合同价值与 6 吉瓦是公司自述,华尔街日报补充的业务转向属于记者报道;OpenAI 的 54.0% 与 38.7% 来自第三方机构 Vals AI 的基准,验证集未公开;Manus 与 Emulate 的金额和估值都来自媒体引述的知情人士,公司未确认,且金融时报与彭博社对 Emulate 的估值口径不一致;版权案里的引述是原告方在公开文件中给出的截取,被告已对其中部分内容作出回应。
留给下一期的问题有三个:第三方评估员何时进入 Anthropic,其他实验室会不会报同一套数字;Astra for Law 进入 API 后的定价与覆盖面;加州的数据中心法案在本月底前签成什么样子。
References
- 1
- 2OpenAI:Introducing Astra for Law
openai.com
- 3
- 4
- 5
- 6
- 7
- 8法庭文件(遮盖版):NYT v. OpenAI 简易判决附件
fingfx.thomsonreuters.com
- 9
- 10商业时报(转载彭博社):Manus eyes US$4 billion value in first round since Meta breakup
businesstimes.com.sg
- 11
- 12
- 13
- 14
- 15
- 16
- 17
- 18布鲁金斯学会:Advancing Human Control of Military AI
brookings.edu
- 19
- 20
- 21
This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.
