新智元把清程极智在 WAIC 展示的方案概括成「后厂生产、门店流通、前端使用」三层,像一座围绕 Token 运转的基础设施网络。1
- 后厂:Token 生产层。赤兔推理引擎、八卦炉软件栈与异构算力负责把模型推理变成标准化 Token 产能。文章称,使用 FP4 运行 DeepSeek 等模型时,原本需要 4 台机器的显存可压到 1 台,成本口径下降 75%;这是厂商与媒体报道的方案宣传,不是独立测试结论。1
- 门店:Token 流通层。AI Ping 统一接入并监测 30 多家服务商、600 多个模型接口,按延迟、吞吐、缓存命中率和 Token 质量做路由与评测。1
- 前端:Agent 使用与治理层。Agent Store 负责分发与复用,ATM 记录 Agent 的工具调用和 Token 消耗,做计量、分账、成本管控与资源隔离。1
一句话看懂:这不是单个模型发布,而是一套把算力生产、模型调用和 Agent 成本治理连起来的产品叙事;图中展台照片是 WAIC 现场素材,性能与成本数字仍应按报道口径理解。




Comentar
Inicia sesión para comentar.