
开放模型、终端入口与智能体权限:AI行业核心动态日报(7月17日)
Kimi K3 推到 2.8 万亿参数级,Apple Intelligence 完成中国市场备案,欧盟要求 Google 开放 Android AI 能力;资本和研究则把竞争继续推向推理基础设施与智能体执行安全。
一句话判断
过去两天的高价值信号,集中在三个层面:Moonshot AI 把开放模型推到 2.8 万亿参数级,Apple Intelligence 终于完成中国市场备案,欧盟则要求 Google 为第三方 AI 助手开放 Android 能力和搜索数据。与此同时,资本继续把钱投向更便宜的模型部署,研究者开始用「用户授权」和「代码安全」重新审视智能体的执行边界。
速览
| 板块 | 动态 | 读者该关注什么 |
|---|---|---|
| 大公司 | Kimi K3 发布;Apple Intelligence 在中国完成备案;欧盟对 Google 下发两组具有约束力的 DMA 措施 | 模型规模、终端入口和平台规则同时变化 |
| 创业与投资 | Fireworks 完成 15.1 亿美元 D 轮融资,估值 175 亿美元;DeepSeek 被报道正在考虑新融资和 IPO | 投资人继续押注推理基础设施,也在给头部模型公司更高流动性预期 |
| 前沿研究 | 两篇 arXiv 论文分别研究智能体权限系统与自主编码代理的安全缺陷 | 「能不能执行」之外,「谁授权、如何拦截」正在变成产品基本功 |
大公司:开放模型、终端入口和平台规则一起变化
Kimi K3 把开放模型推到 2.8 万亿参数级
Moonshot AI 7 月 16 日发布 Kimi K3,称其为 2.8 万亿参数模型,原生支持视觉输入,上下文窗口为 100 万 token,并将其定位为面向长周期编程、知识工作和推理的开放模型。官方介绍称,完整模型权重计划在 7 月 27 日发布;API 定价为缓存命中输入每百万 token 0.30 美元、未命中输入 3 美元、输出 15 美元。1
这条消息的价值不只在参数数字。K3 采用 Moonshot AI 自己的 Kimi Delta Attention、Attention Residuals 和稀疏 MoE 方案,官方说法是用架构和训练改动换取更高的规模效率;但同一页面也承认,K3 的总体表现仍落后于其列出的最强闭源模型。开放模型的下一轮比较,因而会同时看权重是否按期开放、推理成本是否可接受,以及第三方能否复现实测结果。
Apple Intelligence 拿到中国市场的备案,但还没有发布日期
中国网信部门 7 月 15 日公布新增手机端侧生成式人工智能服务备案信息,Apple Intelligence 的中国服务在列,备案完成日期为 7 月 8 日。路透社援引知情人士称,Apple Intelligence 将整合百度和阿里的模型能力;阿里向路透社确认,千问将接入中国市场的 iPhone、iPad、Mac 和 Vision Pro 系统,百度发言人则确认双方在中国版 Apple Intelligence 功能上合作。监管部门没有公布正式上线日期,苹果也未就报道立即置评。2
所以,备案是合规门槛被跨过,不等于用户今天就能用到完整功能。对苹果来说,接下来的观察点是系统推送节奏、Siri 和搜索等功能的本地化程度,以及端侧能力和云端服务如何分工。
欧盟要求 Google 打开 Android AI 能力和搜索数据
欧盟委员会 7 月 16 日宣布,依据《数字市场法案》对 Google 下发两组具有约束力的规范措施:一组要求竞争对手的 AI 助手获得与 Google 自有服务更接近的 Android 功能访问权限,包括通过语音唤起助手、代用户在应用内执行任务;另一组要求 Google 向符合条件的第三方搜索引擎提供经过匿名化处理的搜索数据,提供搜索能力的 AI 聊天机器人也在适用范围内。Google 必须从 2027 年 1 月开始共享相关搜索数据,用户预计从 2027 年 7 月开始看到 Android 端的变化。3
这会把手机 AI 的竞争从「谁的模型更强」拉到「谁能调用哪些系统动作」。对开发者而言,未来需要同时评估模型能力、系统权限、隐私保护和平台分发条件。
创业与投资:钱流向模型部署,也流向头部公司的下一轮预期
Fireworks 以 175 亿美元估值完成 15.1 亿美元 D 轮
AI 推理和模型服务基础设施公司 Fireworks 7 月 16 日称,完成 15.1 亿美元 D 轮融资,投后估值 175 亿美元,资金将用于扩充工程团队和全球算力。Atreides Management、Index Ventures 和 TCV 领投,英伟达和 Lightspeed 等老股东参与。公司还披露,年化收入运行率已超过 10 亿美元,较上一年增长五倍;平台日服务 token 数从 15 万亿增至超过 40 万亿。上述营收和调用量是公司披露、由路透社转述的口径。4
这轮融资把「更便宜的模型」变成了一项基础设施生意。Fireworks 服务的不是单一模型,而是帮助企业定制、部署和运行多种模型;当开放模型数量增加,推理优化、模型托管和算力调度的价值就会从幕后走到采购清单上。
DeepSeek 融资和 IPO 仍是报道,不是公司公告
路透社 7 月 14 日转述《金融时报》和彭博的报道:DeepSeek 在完成首轮融资约一个月后,正在考虑新一轮融资,并已开始 IPO 的前期准备;报道称新一轮融资前估值约为 710 亿美元,最快可能在今年提交上市申请。报道还称,DeepSeek 5 月底完成的首轮融资约 70 亿美元,含融资后估值约 520 亿美元。DeepSeek 未立即回应置评请求。5
这里要把「累计融资」和「拟议中的新融资」分开看,也不能把 IPO 准备写成确定上市。若后续消息得到公司或监管文件确认,才足以判断这家模型公司的资本结构和自建芯片计划会怎样联动。
前沿研究:智能体的权限和代码安全正在成为独立问题
21 个权限系统都没有同时解决低负担、可控和可预测
华盛顿大学研究者在 7 月 15 日发布的论文中,调查了 2024 至 2026 年间 21 个面向用户权限的智能体系统或方案,并走查了 Claude、ChatGPT、Claude Cowork、Codex 和 ChatGPT agent mode 五种商业智能体。研究将权限问题拆成用户界面、内部策略生成和运行时执行三部分。
论文的结论很具体:被调查的研究方案没有一个同时做到低用户负担、明确的策略形式和确定性的权限执行;商业智能体通常让用户在频繁人工确认和缺乏透明度的模型自动审查之间二选一。不过,商业产品允许用户持续修改权限策略,这一点反而是论文方案经常忽略的能力。6
自主编码代理的 PR 中,38.9% 含至少一种安全气味
另一篇 7 月 14 日发布的 arXiv 论文分析了 AIDev 数据集中的 4,022 个代理生成 Pull Request,研究对象限定为高风险文件路径和新增代码,因此它不是整个仓库的安全审计。研究者在 16,112 个可解析的文件变更上发现,38.9% 的 PR 至少包含一种安全代码气味,其中供应链完整性问题占全部气味的 82.3%;被标为严重级别的安全气味中,99.6% 与硬编码凭据有关。
对 74 个确认是真实凭据的案例,人工协作者提交了 67.6%,代理提交了其余部分;安全机器人或人工审查者只在 14 个案例中评论过,意味着 81.1% 的真实凭据没有在合并前被评论拦截。论文也提醒,LLM 评审器的召回率为 0.775,结果很可能低估真实问题数量;这些数字不能直接外推到企业私有代码库。7
模型、平台和资本的变化都在把智能体推向更长的执行链。权限设计和代码审查如果还停留在最后一步人工确认,可能跟不上代理实际写代码、调用工具和修改系统的速度。
Fuentes de referencia
- 1Kimi K3 Tech Blog: Open Frontier Intelligence
- 2Apple Intelligence AI service registered with Chinese cyberspace regulator
- 3Commission provides guidance to Google for AI interoperability on Android and sharing of Google Search
- 4Nvidia-backed startup Fireworks valued at $17.5 billion in latest funding
- 5China's DeepSeek considers raising more funds, reports say
- 6How Agents Ask for Permission: User Permissions for AI Agents, from Interfaces to Enforcement
- 7Trust but Verify? Uncovering the Security Debt of Autonomous Coding Agents
Contenido relacionado
- Inicia sesión para comentar.
