
GLM Flash、千问 Qwen4 预览、宇树跌破600:同一天对三笔成本账
知乎热榜三条高信号科技热点:智谱认领 Ox Alpha 并开源 GLM-5.3-Flash,千问放出 Qwen4 架构预览权重,宇树自上市高点回落到约591元。
本期覆盖窗口:2026 年 8 月 26 日 00:00—23:59(UTC+8)。北京时间 8 月 27 日 00:01 左右,知乎官方热榜接口返回 30 条读取时快照;接口没有提供上游榜单生成时间,所以本文把排名和热度当作这次读取的截面。与 AI、科技和产业直接相关、且能找到可核验材料的条目有三条:第 5 名的智谱 GLM-5.3-Flash,第 7 名宇树科技股价跌破 600 元,以及第 12 名千问开源的 Qwen3.8-Flash-Next。123
| 综合排序 | 知乎问题 | 读取时热度 | 这次真正发生的变化 | 当前证据状态 |
|---|---|---|---|---|
| 1 | 怎么看 GLM-5.3-Flash 发布,有什么值得关注的? | 131 万热度,64 个回答 | 智谱正式认领 Ox Alpha /「牛来」,上线并开源原生多模态 Flash 模型 | 官方博客、Hugging Face 与 X 公告可核验;厂商基准仍待第三方复测 |
| 2 | 宇树科技股价跌破 600 元,市值一周缩水超 2000 亿元 | 128 万热度,36 个回答 | 科创板 688836 自上市首日高点连续回撤,8 月 26 日收于约 591.53 元 | 路透可核验首日定价;日行情与半年报口径来自可读财经报道 |
| 3 | 千问开源基于 Qwen4 架构的 Qwen3.8-Flash-Next | 99 万热度,52 个回答 | 阿里千问开放 Qwen4 架构实验预览权重,并预告生产版 Flash API 定价 | Hugging Face 模型卡与官方 X 可核验规格;社区独立复测刚开始 |
1. GLM-5.3-Flash:Ox Alpha 揭晓,Flash 价位抢前沿能力
发布方实际交付了什么
2026 年 8 月 26 日,智谱发布 GLM-5.3-Flash,并把它写成 GLM-5 系列首个原生多模态模型:总参数 320B,激活参数 18B,上下文窗口 100 万 token,权重以 MIT 许可放到 Hugging Face。官方称它在基准与真实工作负载上超过 GLM-5.2,价格约为后者的十分之一,并在编程与智能体基准上接近 Claude Opus 4.8。45
正式发布前,智谱把同一模型以匿名名 Ox Alpha(中文社区常称「牛来」)放到 OpenCode 与 OpenRouter 收集反馈。官方博客写明:它很快成为当周最受欢迎模型,且测试期流量全部跑在国产 AI 芯片集群上。4
智谱官方账号 @Zai_org 同日在 X 上发布英文公告,重申原生多模态、1M 上下文、320B-A18B、MIT 许可,以及「此前以 Ox Alpha 预览、全程国产芯片推理」的口径。
Loading content card…
OpenCode 随后发帖称,GLM-5.3-Flash(前 Ox Alpha)已在 OpenCode Go 上线,并限时提供双倍用量。OpenCode 在揭晓前还发过一张统计图:Ox Alpha 六天处理约 42T tokens。这些帖文适合观察开发者侧采用节奏,不替代独立基准。67
架构与跑分分别承诺了什么
官方把效率改进写成三层:稀疏注意力与线性注意力的混合结构、流形约束超连接(mHC),以及约 30T token 的多模态预训练语料。相对 GLM-4.5,Flash 在相近总参数下把激活参数从约 32B 压到 18B,层数从 92 降到 45;相对 GLM-5.3,官方称注意力计算量与 KV 缓存分别降低约 3.0× 与 4.4×。4

在厂商自报的编程与智能体基准里,GLM-5.3-Flash 相对 GLM-5.2 拉开明显差距:DeepSWE v1.1 为 63.4 对 46.2,AutomationBench 为 48.8 对 26.2;自研 Z.ai Code Bench 在最大努力档接近 Claude Opus 4.8(29.0 对 29.5)。这些分数都带官方脚注,采样温度、超时与 harness 由发布方设定。4
价格侧,官方博客把折扣后的任务成本写成约 $0.045/task;中文媒体转述智谱口径称,常规定价约为 GLM-5.3 的十分之一,限时折扣期间约二十分之一,相对 Claude Opus 4.8 约四十分之一。开发者文档还写明:Coding Plan 用户可用 Flash,额度约为 GLM-5.3 的 3 倍,周末全天与工作日低谷时段按标准积分的 50% 计。48
证据边界
需要固定分开的是:
- 厂商自报基准 与第三方在同一 harness 上的复测。
- 匿名预览期热度(OpenRouter / OpenCode 调用量)与正式 API 账单、缓存命中成本。
- 国产芯片集群可服务大规模流量 与「单卡本地可跑满血 320B」不是同一句话。
- 视觉编码进模型、前端/办公自验证,属于能力叙事;长程任务成功率仍要看真实工作流。
知乎公开回答受限版
知乎这道题当前公开可见、按接口返回的赞同数排序,前 3 条分别为 94、67 和 45 个赞同;这里仍然采用频道约定的「公开回答受限版,非实时全量最高赞前三」口径。
- 小小将,94 个赞同。 回答确认 Ox Alpha 就是智谱自家 GLM-5.3-Flash,并整理 320B / 18B、与 Claude Opus 4.8 持平、AA 指数约 57 等官方口径。规格可与博客交叉;价值判断属于答主观点。9
- 恋猫,67 个赞同。 回答补充 MoE 结构细节(约 45 层、288 个 routed experts、每 token 选 8 个,以及线性注意力与稀疏注意力交错),并强调「价格约十分之一却超过 GLM-5.2」。细节来自答主整理,需回看官方技术说明。10
- 起步十档,45 个赞同。 回答把定位写成「斩杀涨价后的 DeepSeek Flash」,并提醒早期 Ox Alpha 部署曾不稳定。这是使用侧比较,不是独立实验室报告。11
接下来看四个节点
- 第三方 DeepSWE / Terminal-Bench / Agent 任务复测。 关注同一 harness、同一超时条件下的差距是否还在。
- 真实 API 账单。 尤其是缓存命中价、折扣结束后的常规定价,以及 Coding Plan 抵扣系数。
- 国产卡推理的持续可用性。 看高峰时段延迟、长上下文吞吐和故障恢复。
- 开源权重的推理栈。 SGLang / vLLM / TokenSpeed 之外,社区本地部署案例何时出现。
2. 宇树科技:首日神话之后,二级市场先把估值往下拽
已经发生的价格路径
宇树科技(科创板 688836)于 2026 年 8 月 19 日上市。路透报道:发行价 150.8 元,募资约 9 亿美元(约出售 10% 股份);首日开盘 1100 元,收盘 845 元,较发行价上涨约 460%,当日估值约 500 亿美元;创始人王兴兴持股约五分之一。12
可读的中文财经报道把随后交易日写成连续回撤:8 月 20 日收于 687 元,单日跌约 18.7%;8 月 21 日收于 672.41 元;8 月 24 日午间一度报 606.44 元,较首日开盘高点回撤逾 44%,市值跌破 2500 亿元。知乎热搜标题与行情摘要口径一致:到 8 月 26 日,股价报收约 591.53 元,跌约 1.87%,市值回落至约 2393 亿元,较上市开盘时缩水超 2000 亿元。21314
相对发行价,约 591 元仍高出约三倍;相对首日 1100 元高点,回撤才是这轮讨论的主变量。凤凰网转述快科技报道还写到:8 月 24 日午间市盈率约 419 倍,半日换手超 19%。一位基金经理对媒体表示,此前触及约 4400 亿元的市值「资金疯了」,其个人认为更合理的区间大约在 1000—1500 亿元。这是受访观点,不是交易所结论。14
基本面与降温信号
新浪转载报道引用上市材料口径:2026 年上半年营收 11.52 亿元,同比增约 48.54%;归母净利润 2.74 亿元(上年同期亏损约 3202 万元);扣非净利润 2.44 亿元,同比下降约 19.34%。一季度扣非净利润同比下降约 52.55%。报道还写到:2025 年前三季度人形机器人收入中,真实工业应用占比不到 10%,科研教育场景仍是主渠道。13
同一篇报道把 8 月 20 日王兴兴在世界机器人大会上的公开表态写成估值降温信号:机器人进工厂「目前效率与通用性仍不足」,具身大模型仍处早期,短期内难大批量进厂。宇树随后也说明,受研发与测试进度限制,第二届世界人形机器人运动会缩减了部分报名项目。1314
产品侧,报道提到 8 月 20 日发布仿生 7 轴灵巧机械臂,起售价 9900 元、自重 5.5 千克。这是新品发布事实,不能单独证明工厂级订单已经起来。14
证据边界
- 首日高点市值 与发行价对应市值、当前收盘市值,要分账,不能混用「腰斩」口头禅覆盖全部基准。
- 半年报「增收不增利」来自上市披露转述;后续完整季报与分部收入仍要看公司后续公告。
- 基金经理的「合理市值」是意见,不是基本面验收。
- 运动会缩项、机械臂上新,说明商业化叙事仍在进行;它们不自动解释股价每一天的跌幅。
知乎公开回答受限版
知乎这道题当前公开可见、按接口返回的赞同数排序,前 3 条分别为 68、47 和 21 个赞同;这里仍然采用「公开回答受限版,非实时全量最高赞前三」口径。
- 曹多鱼,68 个赞同。 回答从筹码结构解释:首日换手极高,打新资金高位兑现后,场内多为套牢盘,后续更可能缓慢磨底而非连续暴跌。这是交易结构假说,不是公司经营证明。15
- 尔坚石打碎,47 个赞同。 回答强调发行价已对应约 200 多倍市盈率,当前约 590 元仍比发行价高近 3 倍,并提到网下配售大量无限售股份可首日卖出。制度细节需与招股/发行文件交叉。16
- 35 号庇护所,21 个赞同。 回答称自己在上市当日已提示风险,并认为按现有盈利模式与人形机器人价值属性,股价「还有得跌」。这是个人判断。17
接下来看四个节点
- 下一份季报/半年报复核。 重点看人形机器人收入占比、扣非利润与研发费用。
- 工厂与服务场景订单。 真实交付、复购和毛利率,比首日市值更有信息量。
- 赛事与产品演示是否转成可比较任务成绩。 尤其是全自主、故障恢复与连续作业。
- 战略配售解禁与流通盘变化。 这会直接影响波动率,却不等于技术路线对错。
3. Qwen3.8-Flash-Next:先把 Qwen4 架构预览交给社区
开放了什么,还没开放什么
阿里千问于 2026 年 8 月 26 日前后开放 Qwen3.8-Flash-Next 权重。Hugging Face 模型卡把它写成「将支撑 Qwen4 的架构实验预览」:主模型约 125B 参数、每 token 激活约 6B,另有约 51B 的 N-gram Embedding 与约 4B MTP;以 BF16 计,整卡约 180B 总参数。原生上下文 262K,可用 YaRN 扩展到约 1M。18
官方 X 账号 @Alibaba_Qwen 同步说明:生产版 Qwen3.8-Flash 将很快通过 QwenCloud API 提供,预告价为输入 $0.16 / 1M tokens、输出 $0.47 / 1M tokens;训练成本口径约为 Qwen3.7-Plus 的九分之一;并给出 DeepSWE 1.1 58.7、SWE-bench Pro 62.5、CoWorkBench 73.9 等厂商分数。权重页与公告把 Flash-Next 定位成给社区提前适配新架构的入口,不等于完整 Qwen4 家族已经发布。
Loading content card…
架构关键词写在模型卡与官方帖里:Gated DeltaNet + Qwen Sparse Attention(QSA)混合注意力、Gated Residual、N-gram Embedding、Muon 优化器;48 层里以「三层线性注意力 + 一层稀疏注意力」循环。vLLM 官方账号宣布 day-0 支持,并提示 51B N-gram 表可用
VLLM_PLE_CPU_OFFLOAD=1 放到主机内存。1819YouTube 上已有发布日跟进与架构讲解视频。其中 Tech2WiLD 的发布日直播《Qwen 3.8 Flash-Next + GLM 5.3 Flash LAUNCH DAY》适合观察同日双模型热度;Knut Jägersberg 的短片《The Design and Architecture of Qwen3.8-Flash-Next》适合听架构拆解。视频元数据可核验,内容本身不升成基准证据。
Loading content card…
证据边界
- Flash-Next 权重 ≠ Qwen3.8-Flash 生产 API ≠ 完整 Qwen4。三者时间表与后训练完成度不同。
- 官方给出的 DeepSWE / SWE-bench 等分数是发布方口径;社区本地量化后的体感会再掉一层。
- 「读作 125B、写作约 180B」来自 N-gram / MTP 额外参数;部署显存账要按实际落盘体积算。
- 官网博客页本轮几乎只返回壳,规格以 Hugging Face 模型卡与官方 X 为准。
知乎公开回答受限版
知乎这道题当前公开可见、按接口返回的赞同数排序,前 3 条分别为 51、15 和 10 个赞同;接口本轮返回 15 条并显示已到末页,但仍不能据此宣称恢复了全站实时高赞排序。这里仍然采用「公开回答受限版,非实时全量最高赞前三」口径。
- 恋猫,51 个赞同。 回答整理 125B / 6B 激活、51B N-gram、4B MTP,以及 Attention / Residual / Embedding / Optimization 四方向改动,并认为 Agent 能力已可对比 DeepSeek V4 Flash 0731。规格与模型卡方向一致;对比判断属于答主。22
- quadzz,15 个赞同。 回答把关键点放在极稀疏 MoE 与「三层线性注意力 + 一层全/稀疏注意力」,认为这更接近长程智能体需求。这是架构解读。23
- xuemaoii,10 个赞同。 回答提醒:作为 Qwen4 架构预览,后训练未必完善,真正的 Qwen4 正式版还要再等。时间判断与官方「experimental preview」定位相符。24
接下来看四个节点
- 生产版 Qwen3.8-Flash API 何时上线、定价是否兑现。
- 社区在 vLLM / llama.cpp / Unsloth 上的真实 tok/s 与显存账。 尤其是 51B N-gram 表 offload 后的速度损失。
- 独立 Agent / 编程基准。 把官方 DeepSWE 分数放到同一 harness 里复测。
- 完整 Qwen4 家族时间表。 Flash-Next 只是架构预告,不是终局模型。
共同提醒:便宜的能力,和昂贵的叙事,同一天对账
8 月 26 日的三条热榜,其实在做同一件事:把「能力宣传」拉回到可支付的单位成本。智谱用 Flash 价位和国产卡集群,把 Ox Alpha 的预览热度收成可调用、可开源的产品;千问把 Qwen4 架构先以 Flash-Next 权重交给社区适配;宇树则在二级市场里,把人形机器人首日神话重新标成「还要看订单与利润」的交易标的。
今天能确认的是:GLM-5.3-Flash 的规格、MIT 权重与官方基准已公开;Qwen3.8-Flash-Next 的模型卡与官方定价预告可核验;宇树从 1100 元附近回落到约 591 元的价格路径有可读报道支撑。下一步价值,取决于第三方复测、真实 API/本地账单,以及宇树下一份财务与交付数据会不会把这三笔账写得更清楚。
References
- 1知乎热榜:GLM-5.3-Flash 发布
zhihu.com
- 2知乎热榜:宇树科技股价跌破 600 元
zhihu.com
- 3知乎热榜:Qwen3.8-Flash-Next
zhihu.com
- 4
- 5Hugging Face:zai-org/GLM-5.3-Flash
huggingface.co
- 6
- 7
- 8Z.ai 开发者文档:GLM-5.3-Flash
docs.z.ai
- 9知乎公开回答:小小将
zhihu.com
- 10知乎公开回答:恋猫
zhihu.com
- 11知乎公开回答:起步十档
zhihu.com
- 12Reuters:Unitree Shanghai debut
reuters.com
- 13新浪财经:宇树科技暴跌 2000 亿
finance.sina.com.cn
- 14凤凰网/快科技:宇树连续大跌
tech.ifeng.com
- 15知乎公开回答:曹多鱼
zhihu.com
- 16知乎公开回答:尔坚石打碎
zhihu.com
- 17知乎公开回答:35号庇护所
zhihu.com
- 18Hugging Face:Qwen/Qwen3.8-Flash-Next
huggingface.co
- 19X:vLLM day-0 支持
x.com
- 20X:Unsloth 本地运行帖
x.com
- 21Unsloth 文档:Qwen3.8-Flash-Next
unsloth.ai
- 22知乎公开回答:恋猫
zhihu.com
- 23知乎公开回答:quadzz
zhihu.com
- 24知乎公开回答:xuemaoii
zhihu.com
This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.
