
AI 全景情报 0724:AI 开始带着数据、算力与规则进入现实系统
OpenAI 把医疗记录接入 ChatGPT,Google 按成本与安全拆分模型,华为把算力竞争推到 1024 卡超节点,中国则开始直接约束 AI 伴侣,五条信号共同说明 AI 产品的交付边界正在变得更具体。
先看结论
过去一周的新信号,已经把 AI 产品从聊天窗口推向了更具体的现实系统:OpenAI 把医疗记录和可穿戴数据接入 ChatGPT,Google 把模型拆成面向不同成本与延迟的组合,Anthropic 把模型使用数据做成可查询的经济指标,华为把芯片竞争推进到 1024 卡超节点,中国则开始直接限制情感陪伴型 AI。
这五件事放在一起看,采购和研发的比较单位正在变化。单模型跑分仍然有用,但能否安全接入数据、能否用可控成本完成一项任务、能否在大规模系统里稳定运行,以及产品是否碰到了新的监管边界,会更快决定项目能不能上线。
| 条目 | 已确认的新事实 | 对决策的直接含义 |
|---|---|---|
| OpenAI Health in ChatGPT | 美国 18 岁以上用户可在 Web 和 iOS 连接 Apple Health、支持的医疗记录;相关数据和使用这些数据的对话不用于训练基础模型或投放广告。1 | 医疗数据接入的重点从「能不能回答」转向授权、数据新鲜度、审计和人工升级。 |
| Gemini 3.6 Flash / 3.5 Flash-Lite / 3.5 Flash Cyber | 3.6 Flash 定价为每百万输入 token 1.50 美元、输出 token 7.50 美元;3.5 Flash-Lite 面向高吞吐,3.5 Flash Cyber 只通过 CodeMender 向政府和可信伙伴限量试点。2 | 模型路由要按任务成本、延迟和风险分层,不能再把一款模型当成所有工作流的默认答案。 |
| Anthropic Economic Index connector | 用户可以在 Claude 中直接查询 Anthropic Economic Index,并追问职业、地区、任务和过去一年的变化;Anthropic 同时承认该数据反映的是 Claude 使用模式,不是整个劳动力市场。3 | 行业研究可以更快从宏观猜测进入任务级验证,但必须把样本偏差写进结论。 |
| 华为昇腾 950 超节点 | Atlas 950 SuperPoD 在 WAIC 首次以真机亮相,现场展示 1024 卡、1 EFLOPS FP8、2 EFLOPS FP4 和 256TB 全局统一内存编址;这些数字来自华为官方口径。4 | 算力采购应把互联、内存、散热和软件生态一起评估,而不只看单卡峰值。 |
| 中国 AI 伴侣监管 | CNN 7 月 23 日报道,中国已禁止未成年人使用 AI 伴侣,并要求平台增加防滥用措施;报道还称 Doubao、Qwen 等产品对部分成人功能做了回退。5 | 情感依赖、年龄分级、危机识别和记忆控制,会成为陪伴型产品的上线条件,而不是事后补丁。 |
1. OpenAI 先把健康数据接入对话,再把权限留在用户手里

OpenAI 在 7 月 23 日开始向美国已登录、年满 18 岁的 ChatGPT 用户分批推出 Health,支持 Web 和 iOS,覆盖 Free、Go、Plus、Pro 计划。用户可以连接 Apple Health,以及美国医院系统、One Medical 和 Function Health 等支持的医疗记录来源。连接后,ChatGPT 可以在授权下比较新的化验结果与历史检查、总结上次就诊后的变化,或把睡眠、活动和锻炼放进同一段对话。1
真正重要的是,Health 不是另一个孤立的医疗问答页。OpenAI 说,早期用户中超过 70% 的健康对话发生在原有的专用 Health 空间之外,因此产品现在允许 ChatGPT 在普通对话里按权限调用已连接的健康信息。这种设计把健康数据变成了跨场景的上下文层,例如规划餐厅时考虑饮食限制,安排周末活动时考虑近期受伤。这个 70% 是 OpenAI 的内部测试口径,不能直接当成普遍用户行为。1
隐私控制也被写进了产品流程:连接的医疗记录和 Apple Health 信息,以及使用这些信息的对话,不用于训练基础模型或投放广告;默认情况下,ChatGPT 在使用这些数据个性化回答前会先请求许可;用户断开连接后,来自该来源的同步数据会在 30 天内从 OpenAI 系统删除,但已经进入对话历史的信息要等用户删除对话才会消失。Health 目前还没有接入 Codex。1
对 AI 从业者意味着什么:
- 产品团队要把「授权一次」和「始终允许」当成两种不同的风险状态,分别设计提示、日志和撤销路径。
- 工程团队要处理数据过期、药物已停用、检查结果缺失等现实问题。医疗场景里,回答是否说明数据不完整,和回答本身是否流畅同样重要。
- 这仍然不是临床部署。OpenAI 明确提醒 ChatGPT 会出错,不能替代专业医护判断。评测应覆盖准确性、安全性、上下文理解和需要升级到专业人员的时刻,而不是只看问答得分。1
2. Google 把模型选择变成一张成本与风险路由表

Google 7 月 21 日发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber。3.6 Flash 被定位为主力模型,面向编码、知识工作、多模态和 Agent 工作流,API 价格为每百万输入 token 1.50 美元、输出 token 7.50 美元。Google 引用 Artificial Analysis Index 称,3.6 Flash 的输出 token 使用量比 3.5 Flash 少 17%;官方还称,在部分测试中观察到最高 65% 的减少。前一个数字来自外部指数,后一个是 Google 的观察,不能混成独立评测结论。2
3.5 Flash-Lite 则把价格和吞吐放在前面:Google 披露的价格是每百万输入 token 0.30 美元、输出 token 2.50 美元,Artificial Analysis Index 测得速度为每秒 350 个输出 token。它支持不同的 thinking level,开发者可以在高频任务中选择低延迟、低成本执行,也可以为多步骤子 Agent 提高思考强度。3.5 Flash Cyber 的路径更窄,它与 CodeMender 组合,用来发现和修复代码漏洞,暂时只向政府和可信伙伴提供限量试点。2
这套产品组合比单纯发布一个更强模型更有运营意味。高频文档处理、Agent 搜索、代码迁移、计算机操作和网络安全,本来就不该共用同一条成本与权限路径。Google 把 computer use 做成内置工具,把网络安全模型限制在 CodeMender 的受控部署里,说明模型能力和工具边界正在一起打包。
对 AI 从业者意味着什么:
- 预算模型应从每百万 token 价格改成「每个成功任务成本」,把重试、工具调用、人工复核和延迟都算进去。
- 架构团队可以采用分层路由:Lite 负责高吞吐,3.6 Flash 处理复杂的通用 Agent,网络安全模型只在受控环境和受信对象中运行。
- 不要直接把厂商 benchmark 当作生产承诺。上线前至少用自己的任务集记录一次成功率、工具调用数、输出长度和人工接管率。
3. Anthropic 把模型使用样本变成可查询的行业仪表盘
Anthropic 在 7 月 22 日推出 Economic Index connector,用户可以在 claude.ai 的连接器目录里启用它,不需要安装,就能在任意 Claude 对话中询问哪些职业最常使用 AI、某个地区如何使用 Claude、教师常把 Claude 用于哪些任务,以及这些任务在过去一年如何变化。回答会直接指向 Index 的底层数据,完整数据集也继续在 Anthropic 网站公开。3
这件事的价值不在于多了一个聊天入口,而在于把「AI 到底怎样改变工作」从一次性报告变成可反复查询的分析流程。研究者可以先问一个行业的任务分布,再追问具体职业和地区,最后回到原始数据检查证据。对企业来说,这比拿一张泛化的岗位替代清单更接近实际规划。
边界也很明确:Anthropic 说 Economic Index 反映的是 Claude 的使用模式,不是整个劳动力市场。它会受到用户结构、地区可用性、产品分发和模型偏好的影响。用它判断「Claude 用户正在做什么」是合理的,用它直接推断「所有企业正在怎样自动化」就过头了。3
对 AI 从业者意味着什么:
- 投资和战略团队可以用它生成待验证的行业假设,但不能把样本热度当成市场总量或收入预测。
- 产品团队应把自己的调用日志、任务完成率和人工接管数据与公开 Index 分开保存,避免把第三方样本混进内部基线。
- 数据产品的竞争会从「有没有报告」转向「能不能让用户从问题追到原始数据」,可解释的查询链会变成企业采用的一部分。
4. 华为把国产算力竞争推到整机系统

7 月 17 日,华为在 2026 世界人工智能大会首次公开展示 Atlas 950 SuperPoD 真机。华为披露的现场规格是 1024 卡集群、1 EFLOPS FP8、2 EFLOPS FP4、256TB 全局统一内存编址,以及 3 微秒 RTT 的 NPU 互联时延。产品定位是万亿级模型训练和中心高并发推理。这些是华为官方规格和产品定位,不等于所有客户都能立即获得同等规模的可用集群。4
华为同时展示了 Atlas 850E 风冷超节点,称它无需对现有风冷 IDC 机房进行液冷基建改造,标准机柜可以直接上架,单个超节点支持扩展至 96 卡。官方还称其可提供 10ms 级时延推理、4.0TB/s 内存带宽和 M 级超长上下文支持。对企业来说,这个版本的意义不只是规格更低,而是把部署条件从「重做机房」改成了「能否在既有风冷环境里扩容」。4
华为还把 CANN 和 Mind 系列基础软件的开源开放放在同一场展示里,并披露 CANN 社区已有 67 个项目、累计开源代码超过 1244 万行、月活跃开发者超过 3500 人。这些数字同样是厂商口径,但它们至少说明超节点采购不再只是硬件合同,而要连同编译器、算子、模型适配和开发者迁移成本一起看。4
对 AI 从业者意味着什么:
- 基建采购要同时比较互联带宽、统一内存、冷却方式、机房改造、模型适配和故障域,单卡峰值不能代表整机有效吞吐。
- 做推理业务时,96 卡风冷方案和 1024 卡液冷超节点面对的不是同一个客户。前者更接近既有机房与中等规模部署,后者面向超大模型和高并发集群,不能只按算力数字横向比较。
- 评估国产算力时,应该把软件栈迁移工作量列成单独预算,特别是算子覆盖、编译优化、监控和故障定位工具。
5. 中国开始把 AI 伴侣当成独立的高风险产品类别

CNN 7 月 23 日报道,中国上周禁止未成年人使用 AI 伴侣,并要求平台增加防止滥用的措施。报道同时指出,新规则不适用于客服、教育等任务型功能,但一些热门产品已经对成人用户也回退了部分自定义能力。CNN 点名的产品包括字节跳动的 Doubao 和阿里的 Qwen。5
这条新闻的核心不是「聊天机器人又被限制」,而是监管开始把情感依赖和任务完成分开处理。一个能做客服、教育或资料整理的 Agent,风险重点在权限和准确性;一个被设计成长期陪伴、模拟亲密关系、记住用户脆弱信息的产品,风险还包括关系操控、成瘾、隐私侵害和危机干预失败。CNN 报道援引研究者称,商业 AI 伴侣的耐心、验证和持续在线,正是它们容易形成依赖的原因。
这也解释了为什么平台可能先收紧角色定制、记忆和拟人化表达,而不必把所有对话型 AI 一起关掉。对产品团队来说,年龄分级不是一个注册页勾选框,而要贯穿内容生成、记忆写入、危机识别、转人工和数据删除。需要强调的是,本轮可读材料是 CNN 的报道,本文按报道描述呈现政策与平台变化,没有把它扩写成已经核对过的完整监管条文。5
对 AI 从业者意味着什么:
- 做陪伴型产品时,先定义哪些关系暗示、情感强化和记忆能力不能对未成年人开放,再讨论留存和付费。
- 评测不应只测模型是否会拒答,还要测它是否会主动制造依赖、如何回应危机、能否明确说明自己是 AI,以及用户能否带走或删除自己的数据。
- 这类监管可能沿着产品功能而不是模型名称扩散。把一个通用模型包装成陪伴产品,不会自动避开陪伴型风险。
风口判断:下一轮竞争是「可用系统」,不是更长的模型清单
这五条消息分别来自健康数据、模型路由、经济测量、超节点算力和情感产品治理,但共同点很具体:AI 正在被放进已有系统,并接受系统原本就有的约束。
- 数据接入会先于模型替换。Health 的关键动作不是再训练一个医疗模型,而是让模型在授权、脱敏、撤销和数据过期条件下使用个人信息。
- 成本会按成功任务重新计算。Gemini 的 Flash 与 Flash-Lite 把延迟、token 和风险拆开,企业最终要比较的是一次任务交付花了多少钱,而不是哪款模型的 API 单价最低。
- 算力会按系统效率定价。Atlas 950 的 1024 卡和统一内存说明,真正的瓶颈已经从「单卡有多快」转向「一组卡能否稳定协作」,这会把互联、散热和软件迁移推到采购桌面。
- 产品边界会进入模型设计。AI 伴侣监管说明,年龄、关系、记忆和危机处置将成为产品规格的一部分,不能等上线后再交给法务收尾。
接下来值得跟踪四个可验证节点:OpenAI Health 是否扩大美国之外的可用范围;Google 的模型分层能否在真实生产任务中兑现成本优势;华为超节点的交付和软件适配能否从展示走向规模部署;AI 伴侣产品是否会出现更明确的年龄、记忆和情感依赖评测标准。对团队而言,下一次评审可以先问一句:这项 AI 能力接入真实系统后,谁能授权、谁来复核、失败由谁接管。
相似内容
- 登录后可发表评论。
