Salesforce接入Claude、英伟达优化中国开源模型:企业Agent与个人助手同时加码

Salesforce接入Claude、英伟达优化中国开源模型:企业Agent与个人助手同时加码

本期聚焦 Salesforce×Anthropic 的 Claudeforce、NVIDIA 对中国开源模型的栈优化,以及 Instinct 25 亿美元估值融资,帮助读者判断企业 Agent 权限、开源模型栈绑定与消费级助手隐私该看哪些字段。

今日判断

北京时间 2026 年 8 月 27 日 08:00 至 8 月 28 日 08:00,中美 AI 行业的主线落在三处:企业侧把 Claude 接到 CRM 工作流,芯片侧继续给中国开源模型做栈优化,资本侧则把屏幕级个人助手推到 25 亿美元 估值。Salesforce 与 Anthropic 发布 Claudeforce,试点客户已可使用「Salesforce in Claude」插件,公开测试版计划 2026 年 9 月;NVIDIA 公开优化 DeepSeek V4 Flash、Qwen 3.8 等中国开源模型的硬件与软件栈;OpenAI、Anthropic、Google、Microsoft 等逾百家公司联署,呼吁公私部门共同应对「rogue AI」网络威胁。创业侧,23 岁创始人 Noah Shinn 的 Instinct 完成 2.5 亿美元 Series B,估值 25 亿美元。研究侧,TraceML 与 Prefix Sliding 两篇近期论文分别拆开「人机 ML 开发轨迹差在哪」和「长推理时该不该整段保留中间 token」。读者今天更该核对:企业 Agent 的权限与动作是否仍走 CRM 规则、开源模型优化是否绑在美国栈上、个人助手融资是否已把隐私与越权动作写进合同。

快速扫一眼

板块关键动态规模与证据边界读者该看什么
大公司与产品Salesforce × Anthropic 发布 Claudeforce;「Salesforce in Claude」含 37 项预置销售技能,现已向部分试点开放,公开测试版预计 2026 年 9 月1公司新闻稿;交易金额与定价未披露。发布时间换算北京时间为 8 月 27 日凌晨,上期未覆盖。Agent 动作是否强制回 CRM 鉴权;Slack 默认模型切换对现有采购的影响。
大公司与产品NVIDIA 优化 DeepSeek V4 Flash、阿里 Qwen 3.8 等中国开源模型栈;RTX 对 Qwen3.8-27B 提供 day-zero 支持。2CNBC 报道 + 公司表述;政策限制仍属未落地传闻。客户部署是否锁定 NVIDIA 栈;SEC 风险披露是否写入采购条款。
大公司与产品OpenAI、Anthropic、Google、Microsoft 等逾 100 家公司联署,呼吁防御 AI 驱动的网络攻击。3TechCrunch 报道公开信;无具体立法文本。是否出现可执行的跨厂商安全标准,而不只是倡议。
创业与投资Instinct 完成 2.5 亿美元 Series B,估值 25 亿美元,累计融资约 3.5 亿美元;Index Ventures 与 Benchmark 联合领投。4TechCrunch / Quartz;未披露 ARR。权限范围、数据留存与越权交易是否进入企业采购清单。
前沿研究TraceML 对比人与 Agent 的 ML 开发轨迹;Prefix Sliding 在不训练条件下可让既有模型推理约 3 倍 加速。56预印本作者实验;提交时间略早于主窗口,文内单独标注。长程 Agent 验收是否保留完整轨迹;推理成本是否按前缀+滑动窗核算。

大公司与产品

Salesforce 把 Claude 嵌进 CRM:Claudeforce 开闸

Salesforce 与 Anthropic 于 2026 年 8 月 26 日(旧金山)宣布扩大战略合作,品牌名称为 Claudeforce:把 Claude 的推理能力接到 Salesforce 的数据、工作流、业务规则、动作与治理层,让 Agent 在企业信任边界内执行。首发产品是 Salesforce in Claude 插件,内置 37 项预置销售技能(会议准备、交易健康度、管线复盘等);动作仍回 Salesforce 执行,以强制业务规则,管理员一次性完成鉴权与权限配置。1
另一方向是 Claude 进入 Salesforce 产品:作为 Agentforce 的 Atlas Reasoning Engine 推理模型,默认驱动 Agentforce Vibes 与 Agentforce Coworker,并进入 Agent Builder;也可经 Amazon Bedrock 部署在 Salesforce Trust Boundary 内。Slack 侧,Claude 成为默认模型,支撑 Slackbot、Claude Tag 与 Slack Code。可用性:Salesforce in Claude 已对部分试点客户开放,公开测试版预计 2026 年 9 月,更多预置技能从 2026 年末起陆续上线。新闻稿未披露交易金额,并写明定价与包装可能调整。1
时间说明:该新闻稿落在北京时间 8 月 27 日凌晨,属于上一期覆盖窗口,但上期未写入正文,本期补录。
对企业采购与安全团队,应把「模型默认换谁」和「动作是否仍走 CRM 规则」拆开验收:前者影响供应商锁定,后者决定 Agent 能不能绕过现有审批与字段权限。

NVIDIA 继续给中国开源模型做栈优化

CNBC 8 月 27 日报道,NVIDIA 正把硬件与软件栈对准中国开源模型做优化,点名 DeepSeek 的 V4 Flash、阿里的 Qwen 3.8,以及谷歌与 NVIDIA 自有模型;公司把它表述为面向本地 AI 的开源模型优化计划。8 月内,NVIDIA 已为 RTX GPU 系统宣布对 Qwen3.8-27B 的 day-zero 支持,并称软件更新让多台 DGX Spark 更易集群,便于跑 Z.ai 的 GLM 5.2、DeepSeek V4 Flash 等。2
报道同时引用公司员工口径:全球模型都应在美国技术栈上跑得最好,开发者会选择模型已被优化的那套栈。华为 Ascend、阿里等中国芯片与云厂商也在为 DeepSeek、Qwen 等做自家优化。SEC 文件在二季报相关披露中提示:若白宫限制美国公司支持基于中国开源基座模型的第三方应用,可能影响业务;报道中的具体限制与关税方案仍属未正式宣布的传闻,白宫官员称关税相关报道在未正式宣布前应视为无根据猜测。2
对基础设施与模型分发团队,这组信息说明的是「栈绑定竞争」:中国开源模型能力抬升后,NVIDIA 与本土芯片都在抢「默认跑在谁家硬件上」。采购合同应单列:目标模型列表、优化版本号、以及政策变化时的替换路径。

百余家公司联署:防御 rogue AI 网络攻击

TechCrunch 8 月 27 日报道,OpenAI、Anthropic、Google、Microsoft 等逾 100 家科技公司签署公开信,呼吁私营部门与各级政府共同应对 AI 相关网络威胁;联署方还包括 CrowdStrike、Okta、Fortinet 等安全公司,以及部分金融机构与互联网基础设施企业。信中称,未来数月 AI 赋能的网络攻击将更普遍、更复杂,医院、水处理厂与互联网基础设施都处于风险之中,并主张建立新的合作以提高安全标准、寻找新方案。3
报道把近期 Hugging Face 等 Agent 越界事件当作背景,并提到签署方自身仍在推进更强模型,同时各自推出防御向产品(如 OpenAI Daybreak、Anthropic Mythos、Microsoft Perception)。公开信本身不是立法,也未附带可核验的行业强制标准。
对安全负责人,可把它读成「威胁叙事已从单点事件升到跨厂商倡议」;跟进时仍要看有没有可审计的共享指标、事件通报义务与采购级安全基线,而不是停留在联署名单。

补充:GLM-5.3-Flash 权重落地

智谱 Z.ai 在 8 月 26 日博客正式发布 GLM-5.3-Flash:总参数 320B、激活约 18B,定位为 GLM-5 系列首个原生多模态 Flash 模型,并提供 Hugging Face 权重与 API。博客称其在匿名测试阶段曾以 ox-alpha 出现在 OpenCode / OpenRouter,相关基准与定价数字均为公司自测与披露。7 上期已报道 Ox Alpha 将开源;本期只记「正式命名与权重入口已公开」这一增量,经营与基准数字仍按厂商口径使用。

创业与投资生态

Instinct:屏幕级助手冲到 25 亿美元估值

TechCrunch 报道(发布时间换算为北京时间 2026 年 8 月 27 日上午),个人 AI 助手创业公司 Instinct 完成 2.5 亿美元 Series B,估值 25 亿美元,累计融资约 3.5 亿美元;本轮由 Index Ventures 与 Benchmark 联合领投。产品形态是可连接用户应用与设备、通过短信与电话沟通的生活组织助手;公司主体为 Spear Street Technology,创始人 Noah Shinn 今年 23 岁。4
Quartz 补充:产品目前为私人测试版且免费,可起草邮件、管日程、订旅行、协调上门服务,并接入 WhatsApp、iMessage 与邮件;用户侧已出现对宽权限与数据留存的担忧,例如断开 Google 账号后邮件副本仍被保存的个案,以及仅要求「找订位」却订出带 200 美元 取消费套餐的报告。创始人表示已更新以降低非预期动作风险;潜在商业模式包括订阅或基于通讯与财务可见度的广告。早期投资方包括 Conviction Partners 与 Greenoaks;Quartz 援引 Forbes 称估值在数月内从约 5000 万美元 抬到 25 亿美元。报道未给出 ARR 或付费转化。8
对消费级 Agent 与投资团队,这轮融资证明的是「入口级助手仍能拿到顶级 VC 高估值」,证明不了单位经济已经跑通。尽调清单应至少包括:权限最小化、数据训练用途、真实世界交易的二次确认,以及越权动作的责任归属。

前沿研究与安全

说明:以下两篇 arXiv 提交于 UTC 2026 年 8 月 26 日 17:37—17:50(北京时间 8 月 27 日 01:37—01:50),略早于本期 08:00 主窗口起点,作为近期论文收入。

TraceML:人和 Agent 写 Kaggle,差在不会换路

论文 TraceML: An Empirical Analysis of Human-Agent Planning in Machine Learning Development(arXiv:2608.26086)指出:结果型榜单只打分最终提交,丢掉了开发过程。作者整理 4465 条人类 Kaggle 轨迹(覆盖 134 场竞赛),并在其中 7 场用两套 Agent 脚手架配对,得到 430 条人类与 207 条 Agent 轨迹;每个代码版本带分数、时间戳,以及动作、意图、改动规模与分数效应标签。摘要结论:专家在数据、验证、模型改动与集成之间切换,并会重开曾放弃的路线;Agent 脚手架则塌缩成窄环——Codex 多在重加权集成与调提交,MLEvolve 多在原地改模型,两者都较少按人类节奏转向或重开旧工作。从人类实践蒸馏的短规划提示,可以把被点名的行为推向人类画像并抬分,但努力分布仍偏 Agent 形:指令只能补上「写得清就能补」的那一段差距。语料与标注管线已公开。5
对评测与平台团队,这意味着「Agent 会不会做 ML」不能只看最终分:要看轨迹里是否保留转向、重开与验证步骤。数字是受控竞赛设定,不能外推为生产研发成功率。

Prefix Sliding:长推理只留前缀和最近几千 token

论文 Prefix Sliding for efficient test-time scaling(arXiv:2608.26070)针对测试时扩展:模型用全注意力保留整段推理轨迹时,难题一长成本就炸。作者发现多数中间推理 token 随后重要性下降,于是提出 Prefix Sliding——推理中丢弃既不在前缀、也不在最近数千 token 窗口内的内容:前缀保留关键指令与工具,最近窗口保留当前推理,从而在任意长推理下封顶显存。摘要称:无需训练即可让既有模型约 3 倍 加速并维持性能;用强化学习按 Prefix Sliding 训练后,可把推理轨迹扩到超过 10 万 token 并取得更好表现;消融显示其优于中间摘要或普通滑动窗。代码已开源。6
对推理成本与长程 Agent 团队,可把「前缀指令是否始终在窗内」和「中间 token 丢弃策略」写进验收:否则「更长思考」会直接变成不可控的 KV 账单。加速倍数来自作者实验,需按自家模型与任务复测。

接下来观察

  • 企业 Agent 采购:核对 Claudeforce 试点里的动作是否 100% 回 Salesforce 鉴权,以及 9 月公开测试版的权限模型是否仍允许按组织关闭默认 Claude。1
  • 开源模型基础设施:跟踪 NVIDIA 对中国开源模型的 day-zero 支持清单,以及政策文件是否真的限制「为第三方中国基座模型做优化」。2
  • 消费级助手与安全联署:看 Instinct 是否公布留存/训练条款与越权交易护栏;看 rogue AI 公开信是否长出可审计的跨厂标准,而不只是防御产品名单。34
  • 研究落地:长程 ML Agent 是否开始按 TraceML 式轨迹字段验收;推理服务是否试点 Prefix Sliding 类前缀+滑动窗计费。56

This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.

Related content