
AI开始拼调用了?DeepSeek铺入口,Agent进工单
8月2日,DeepSeek-V4-Flash-0731开放一键 API,中国模型占据 OpenRouter 调用量前五,企业 Agent 也开始进入工单分派。
8 月 2 日,AI 行业的竞争没有停在模型榜单上,而是沿着调用链继续下沉:DeepSeek-V4-Flash-0731 在国家超算互联网开放一键 API;OpenRouter 最新周榜里,中国模型占满调用量前五;Kaseya 则把 Agent 拆成优先级、技能匹配和工单分派,塞进企业服务台。模型要证明的,已经不只是「会不会答」,还包括能不能被低成本接入、被开发者持续调用,最后交付一个可验收的结果。
覆盖窗口:2026 年 8 月 2 日(北京时间)。 海外报道若在当地 8 月 1 日发布,只有换算后进入北京时间 8 月 2 日的内容纳入本期。
| 事件 | 已确认的变化 | 现在看什么 |
|---|---|---|
| DeepSeek-V4-Flash-0731 1 | 国家超算互联网开放模型文件和 API,一键接入 | 真实价格、延迟和容量 |
| OpenRouter 周榜 2 | 中国模型占 API 调用量前五,MiMo-V2.5 单周 10.5 万亿 Token | 低价带来的使用,能否沉淀成产品 |
| Kaseya Agentic IT 3 | Agent 进入工单分类、技能匹配和技术员分派 | 从试点到通用产品要多久 |
DeepSeek 先把入口铺开,能力还得等真实账单来验
这次增量不在模型名字,而在入口。8 月 2 日,国家超算互联网正式上线 DeepSeek-V4-Flash-0731 的模型文件和 API 调用服务,面向企业与开发者开放,登录网页后从「模型服务」专区即可调用,不必自己配环境。报道没有给出当天的价格、并发和延迟数据。1
DeepSeek 的模型卡把它描述为正式版,并列出一组由模型方提供的对比结果:Terminal Bench 2.1 从预览版的 61.8 分升到 82.7 分,DeepSWE 从 7.3 分升到 54.4 分。模型卡同时写明,DeepSeek-V4-Flash-0731 采用 MIT 许可证。这里的「提升」是模型方自报,评测设置和内部测试集不能直接等同于第三方复测。4
Loading chart…
图:DeepSeek 模型卡给出的两项代码 Agent 评测对比;分数为模型方披露,不能当作独立测评。4
所以,今天最值得记的不是「又一个模型变强了」,而是开源权重、API 入口和托管算力正在被打包成同一件商品。下一步要看的是:开发者能否稳定调用,价格是否足够低,Agent 任务能否在真实代码库里交付。没有这三个数字,能力宣称仍然只到发布会为止。
中国模型占满 OpenRouter 前五,但这不是质量榜
Readhub 8 月 2 日转述 OpenRouter 最新一周数据:中国模型包揽调用量前五。小米 MiMo-V2.5 以单周 10.5 万亿 Token 登顶,环比增加 12%;两款 DeepSeek 分列第二和第五,腾讯混元 3 位列第三,且周环比增幅超过 999%。2
这个榜单测的不是 ChatGPT 或 Claude 有多少用户,而是开发者在 OpenRouter 上实际处理了多少 API Token。此前对同一类榜单的报道也明确提醒:它更接近「哪些模型被拿来搭产品」,不等于消费者总使用量。5
Loading stats card…
这也是模型竞争里最容易被混淆的一层:调用量高,说明价格、速度、兼容接口或分发入口至少有一项打中了开发者;它不能自动推出模型质量更高。同一篇韩国经济日报报道里,OpenRouter 的综合性能榜仍由 Claude Opus 5、Claude Fable 5 和 GPT-5.6 Sol 领跑。使用和能力,是两条不同的曲线。5
Agent 进入工单,先学会分派再谈自主执行
8 月 2 日,Futurum 把 Kaseya 的 Agentic IT Management Platform 作为企业 Agent 的落地案例重新摆上台面。它不是当天突然上线的新品:Kaseya 官方页面显示,这套 Digital Specialists 早已进入试用,曾与 25 家以上合作伙伴、内部服务台和网络运营中心测试。3 6
它做的事很具体:
- Impact Agent 判断优先级、问题类型和严重程度;
- Skills Assessor 找出需要的技能与认证;
- Smart Assigner 按技能匹配、历史表现和当前工作量排名技术员;
- Capacity Planner 检查排班、时区和实时负载;
- Critique Agent 复核前面的判断,技术员仍可接受、拒绝或修改建议。6

Kaseya 引用的早期反馈称,两周内平均分派时间下降 90%,某合作方一周内的分类准确率约 98%;这些都是厂商或合作伙伴反馈,不是独立评测,也没有公开定价和普遍可得时间。6
三个信号放在一起,今天的 AI 竞争像一条流水线:DeepSeek 把模型送到开发者门口,OpenRouter 的调用量告诉你谁真的被拿来干活,Kaseya 则试着把 Agent 推进企业流程。接下来盯三件事就够了:DeepSeek-V4-Flash-0731 的实际账单与延迟、OpenRouter 下一期榜单是否仍由中国模型占据,以及 Kaseya 的试点数据能否在独立客户和更复杂工单里复现。
Related content
- Sign in to comment.