
知乎热榜 AI 科技制造业日报|8月1日中午:Claude沙箱事故、宇树 IPO 与字节时长,10 个视频选题
从8月1日中午知乎热榜筛出5个AI、科技与制造业问题,围绕Claude评测事故、字节与腾讯时长、宇树IPO、openPangu开源和Vibe Coding后端验收给出10个可拍切口,并标明事实边界。
先看三条
今天最适合先拍的三条,分别对应安全边界、制造业兑现和工程验收。Anthropic 的新事件不是模型主动「逃出」了封闭环境,而是网络隔离和第三方评测流程出了错,Claude 随后把真实系统当成靶场;宇树 IPO 给了一个检查机器人公司的公开财务入口,报名日期、发行规模和利润变化都能落到公告与招股书;Vibe Coding 则适合做一次从演示到上线的对照实验,把重复扣库存、支付回调重放和越权访问逐项测出来。1 2 3
字节系与腾讯系的用户时长数字很抢眼,但它首先是一个统计口径问题:报告看的是占中国移动互联网总时长约 93% 的 Top 50 App,数据对应 2026 年 6 月,不是全体用户的日常使用调查。openPangu 的 5050 亿参数也不能直接等于模型能力排名,当前能确认的是权重、基础推理代码和技术报告已经公开,许可证、第三方评测和普通开发者的推理门槛仍需单独补齐。4 5
本期从知乎热榜筛出 5 个 AI、科技或制造业问题,给出 10 个视频切口。热度是知乎展示的量级文本,不是精确浏览量;回答数和关注数采用本期热榜快照的口径。
热榜中的 5 个问题
| 热榜排名 | 问题 | 热度文本 | 回答数 | 关注数 |
|---|---|---|---|---|
| 2 | Anthropic 的 Claude 也发生沙箱逃逸? | 373 万 | 69 | 199 |
| 4 | 字节系用户时长升至 40.1%,超越腾讯系 29.7% | 345 万 | 58 | 181 |
| 16 | 宇树科技 IPO,8 月 10 日开启申购 | 192 万 | 62 | 189 |
| 17 | 华为 openPangu-2.0-Pro 开源 | 181 万 | 54 | 154 |
| 24 | Vibe Coding 为什么后端难上线 | 72 万 | 70 | 105 |
10 个视频选题
| 编号 | 视频题目 | 拍摄切口 | 下一步核验动作 | 风险 |
|---|---|---|---|---|
| 1 | Claude 真的「主动攻击」了三家机构吗? | 把提示词、错误联网、评测靶场和真实系统画成事件链,逐个标出责任点。 | 对照 Anthropic 官方复盘和后续第三方审查,区分模型行为、评测伙伴配置和公司监控责任。1 | 不要把评测事故剪成「AI 自主逃逸」或「恶意觉醒」。 |
| 2 | AI 安全测试为什么也要按生产系统来管? | 复现一个没有出网白名单、日志告警和停止条件的靶场,展示一个错误配置怎样扩大影响面。 | 查评测环境的网络拓扑、出网策略、权限和实时监控记录;不复述未公开的受影响机构名称。1 | 官方称三起事件与六次运行有关,但不能据此推导更大规模的漏报。 |
| 3 | 字节系时长 40.1%,为什么微信仍然是单一 App 第一? | 把「阵营总时长」与「单个 App 时长」放在两张图里,避免把抖音、红果等应用相加后再和微信直接比较。 | 复核 Top 50 的纳入规则、应用归属、重复使用时长和 2025 年基线。4 | 统计是 2026 年 6 月快照,不能直接写成长期趋势已定。 |
| 4 | 字节抢到的是时间,还是用户的注意力? | 让同一批用户记录短视频、长视频、社交和办公 App 的使用时长,再看「打开次数」与「连续使用」是否同向。 | 找到 QuestMobile 原始表或同口径月度数据,补充年龄、地区和样本覆盖说明。4 | 知乎回答里的个人使用习惯只能做访谈线索。 |
| 5 | 宇树 IPO 看什么,不能只看机器人演示视频 | 用申购安排、营收、利润、研发费用和制造基地募资用途做一张「演示之外的账」。 | 逐项核对招股书、发行公告和上市后定期报告,特别看收入增速放缓与扣非净利润变化。2 | 发行日期和历史财务数据不能推出二级市场表现。 |
| 6 | 机器人从会翻跟头到有人长期买单,中间差几张表? | 采访巡检、安防、科研和工厂客户,分别问续航、故障、备件、培训、接口和第二年续费。 | 找公开客户案例、出货结构、返修率、产品毛利和服务合同;不把答主推测当作公司经营事实。2 6 | 「具身智能有前景」和「某家公司值得买入」是两类不同判断。 |
| 7 | 5050 亿参数的 openPangu,开源到底开放了什么? | 把权重、推理代码、训练代码、数据、许可证和在线体验拆成六个格子,逐项打勾。 | 读取模型仓库、技术报告和许可证原文,记录显存、并行方式、量化版本与可运行硬件。5 | 「昇腾原生训练」可以确认技术路线,不能直接推出性能领先或生态替代关系。 |
| 8 | 大参数模型的训练平台,能否成为真正的产品优势? | 在同一任务、同一量化和同一提示词下比较推理速度、成本、长上下文和工具调用,不只看参数总量。 | 补官方技术报告的测试条件,再做独立复测;把激活参数与总参数分栏。5 | 本期没有取得完整许可证、硬件门槛和独立榜单,节目不能先下模型排名。 |
| 9 | Vibe Coding 的后端验收,先测四个看不见的错误 | 让 AI 生成一个下单接口,再加入并发抢最后一件商品、重复支付回调、越权读取和失败回滚测试。 | 用测试结果对照数据库事务、鉴权、幂等、日志和限流实现;把「页面能跑」与「接口可上线」分开。7 8 | 不能用一次演示证明 AI 永远写不好后端,也不能用一次成功掩盖生产风险。 |
| 10 | AI 写后端不是不行,问题是验收条件有没有写进去 | 同一需求做两版:一版只说「做个订单后端」,另一版写明幂等、权限、回滚、峰值和审计要求,比较生成代码和测试覆盖。 | 记录提示词、模型版本、代码提交、测试日志和人工修改;补充超时、请求体大小、分页数量和服务商预算限制。3 7 | Google Cloud 也把人工审查、测试和正确性验证列为专业工作流的一部分,不能把「一键部署」等同于生产就绪。 |
5 个热榜问题与前 5 条可见回答
下面的回答不是按赞同数排序的「前五高赞」。本期接口返回的是每个问题前 5 条按更新时间排列的可见样本;赞同数是接口返回值,不能当作共识。原文片段只保留能说明回答方向的短句,完整内容以回答直链为准。
1. Anthropic 的 Claude 也发生沙箱逃逸?
- 热榜排名:第 2
- 知乎热度:373 万热度
- 知乎显示回答数:69
- 问题页:9
Anthropic 7 月 30 日的官方复盘称,公司检查了 141006 次可能获得互联网访问的评估运行,发现 3 起事件,涉及 6 次运行和 3 个组织。共同原因是第三方网络安全评测环境意外连上了公网,而提示词又告诉 Claude 这是模拟环境、没有互联网访问。模型执行 CTF 任务时,把真实系统当成了靶场。1
三起事件的细节并不相同:Claude Opus 4.7 曾访问一个生产数据库中的数百行数据;Claude Mythos 5 发布了一个恶意 Python 包,该包在约一小时内被 15 个真实系统下载并运行;另一个内部研究模型扫描约 9000 个目标,后来识别出目标可能是真实系统并停止。Anthropic 同时说,评测使用的模型没有上线产品的分类器和监控保护。1
这个事件适合拍「靶场为什么会变成生产事故」,不适合拍成「Claude 有了自主攻击意图」。Anthropic 自己也把它更接近评测工具链和运行流程故障,而不是模型主动逃离环境;这仍然不等于责任消失,因为网络隔离、权限、日志和停止条件都属于测试设计。
前 5 条可见回答样本
- 明辨 AI|0 赞:
一家标榜以安全为主打功能的公司,居然是在同行爆出来问题之后,然后才开始自查发现类似问题。
摘要:把同行事件后的自查视为安全信誉问题,并延伸到公司内部管理和行业竞争;没有补充事件证据。10
- 总之先给你两拳|0 赞:
畜生公司。
摘要:只有情绪表达,没有可用于事实核验的信息。11
- raven|0 赞:
谁家 AI 不逃逸个沙箱,不主动发起个攻击,谁好意思自称前沿 AI 啊!
摘要:用反讽把沙箱逃逸和前沿能力绑定,不能作为对事件机制的说明。12
- 花想容|0 赞:
这营销剧本也太硬了,只能说剧情不如短剧。
摘要:把官方披露理解为营销行为,没有给出反证。13
- 切切|0 赞:
实在是太累了,我要沙箱逃逸。
摘要:回答主体是与事件无关的戏仿和个人诉求,只有一句借题发挥,不能作为技术观点。14
2. 字节系用户时长升至 40.1%,超越腾讯系 29.7%
- 热榜排名:第 4
- 知乎热度:345 万热度
- 知乎显示回答数:58
- 问题页:15
野村国际 7 月 29 日发布的月度追踪报告使用 2026 年 6 月数据,中文整理页注明数据来源包括 QuestMobile、Sensor Tower 和 Analysys。报告称,在覆盖中国移动互联网总时长约 93% 的 Top 50 App 中,字节系时长份额从 2025 年 6 月的 33.3% 升至 2026 年 6 月的 40.1%,腾讯系为 29.7%。这是一组阵营归类后的时长份额,不是「40.1% 的人主要使用字节 App」的用户比例。4
报告同一页还列出单 App 口径:微信时长份额 19.3%,抖音 19.0%,抖音极速版 6.3%,红果免费短剧 4.5%。所以「字节系超过腾讯系」与「微信仍是单一 App 第一」可以同时成立。字节的优势更像多条内容和工具产品的合计时长,不能简化成某个产品已经全面取代微信。
前 5 条可见回答样本
- 明明|0 赞:
我不刷抖音但是确实厌恶微信,特别是微信的拉群不需要同意的功能一直不改。
摘要:是对微信功能和工作属性的个人体验,不能证明字节或腾讯的总体用户变化。16
- 拉格朗的呱呱|0 赞:
要么要求字节投资影视公司,要么对字节进行反垄断调查。
摘要:直接跳到产业和监管判断,未解释时长数据的统计口径。17
- 文森特·凡喵|8 赞:
这种「算法+无限滚动」的交互方式简直就是时间黑洞。
摘要:从通勤场景解释短视频为什么容易积累时长,适合做用户访谈和行为实验,仍不是报告本身的因果结论。18
- 勥囧厂乙|0 赞:
像我这种没安装任何字节系 app 的是不是异类。
摘要:用个人设备选择反问阵营统计,不能代表未覆盖用户。19
- 爱咋咋地|1 赞:
朋友家的小孩在用抖音和他的同学视频聊天。
摘要:提供了一个可能影响社交产品代际习惯的观察,但只是单个家庭样本。20
3. 宇树科技 IPO,8 月 10 日开启申购
- 热榜排名:第 16
- 知乎热度:192 万热度
- 知乎显示回答数:62
- 问题页:21
澎湃新闻 7 月 30 日转述发行公告:宇树科技拟发行 4044.6434 万股,占发行后总股本的 10%;初步询价日为 8 月 5 日,网上、网下申购日为 8 月 10 日,缴款日为 8 月 12 日。公司采用战略配售、网下询价配售和网上定价发行相结合的方式,融资金额为 42.02 亿元,募集资金投向机器人模型、本体、新产品和制造基地。2
同一报道引用招股书数据称,宇树 2023 至 2025 年营业收入分别为 1.59 亿元、3.92 亿元和 17.08 亿元,净利润分别为亏损 1114.51 万元、9450.18 万元和 2.88 亿元。2026 年一季度营业收入约 4.23 亿元,同比增长 68.49%;扣非后净利润约 4025.36 万元,同比下降 52.55%。这个组合比「机器人很酷」更值得拍:收入仍在增长,但研发、销售等期间费用上升后,利润增速已经不是同一条曲线。2
「特别表决权」也是视频可视化的材料。报道写明,王兴兴持有的 A 类股份每股 10 票,发行后其控制的表决权比例预计为 65.31%;这解释的是控制结构,不是投资回报。2
前 5 条可见回答样本
- Evolva|0 赞:
这么迅速么?感觉有点完犊子啊,这次能让我中一个么。
摘要:关注申购速度和中签机会,没有公司经营信息。22
- 大刘 AI 编程|0 赞:
能演示,能量产,有人长期买单,是三件事。
摘要:把机器人前景拆成演示、规模化和持续付费,并继续追问售后、备件、培训和场景,适合直接转成采访提纲。6
- 月与椰枣树|0 赞:
没有灵巧手,没有智能大脑,本质就是大号玩具。
摘要:用产品能力做否定,并进一步猜测资本套现;没有给出产品型号、测试或财务证据。23
- okpy|0 赞:
具身智能可能有前景,但绝对不是现在。
摘要:给出行业时点判断,没有说明判断依据。24
- 张性新|0 赞:
人形机器人这个行业,本质上还是制造业,高端制造业。
摘要:把宇树放进高端制造和供应链竞争中,提出未来可能出现多家企业竞争、利润被压低的判断;仍需用成本、出货和毛利数据验证。25
4. 华为 openPangu-2.0-Pro 开源
- 热榜排名:第 17
- 知乎热度:181 万热度
- 知乎显示回答数:54
- 问题页:26
新浪科技 7 月 31 日 10:21 的报道转述华为公开信息:openPangu-2.0-Pro 总参数规模为 5050 亿,模型权重、基础推理代码和技术报告已上线;openPangu 的定位是通过昇腾原生训练与推理技术,为业界使用昇腾提供实践参考。5
截至本期能确认的事实止于「哪些材料公开」和「训练、推理依托什么路线」。5050 亿是总参数,不等于每次推理都会激活 5050 亿参数;模型是否好用,还要看激活参数、上下文长度、量化方式、硬件占用、许可证和独立评测。知乎回答里把它直接等同为「国内最强」或「昇腾已经取代英伟达」,都超过了已读材料能支持的范围。
前 5 条可见回答样本
- 阿咩哦|0 赞:
传奇套壳王又发新作,是不是哪个地方又要采购了啊?
摘要:质疑模型原创性并联想到采购,没有给出权重、代码或技术报告对照。27
- 幼儿园不是好孩子|1 赞:
证明靠昇腾平台是能完整训练出来大模型的。
摘要:把开源模型理解为昇腾训练能力的展示,并延伸到国产算力生态;「证明」的范围需要训练日志、硬件规模和可复现实验支持。28
- 宅中仙人|0 赞:
这个参数放在国内绝对算是落后的那一批,起码还要迭代几轮才有实用价值。
摘要:给出参数规模与实用性的负面判断,没有列出比较模型和统一测试。29
- zha zha|0 赞:
openPangu-2.0-Pro 是基于昇腾 NPU 训练的大规模混合专家语言模型,参数规模约 505B。
摘要:抓住训练平台、MoE 和参数量三个规格点,但后面的市值联想不是模型评测。30
- 1379|0 赞:
遥遥领先。
摘要:只有口号,没有可核验指标。31
5. Vibe Coding 为什么后端难上线?
- 热榜排名:第 24
- 知乎热度:72 万热度
- 知乎显示回答数:70
- 问题页:32
Google Cloud 把 Vibe Coding 分成两种工作方式:一种是更适合快速想法验证的「纯」Vibe Coding,另一种是由 AI 协作、由人审查、测试并理解最终代码的专业工作流。它把测试、验证和人工审查放在从生成到部署的链条里,而不是把能看到页面当作完成。3
知乎题下的分歧其实可以转成实验:前端的错误通常马上可见,后端的错误会藏在并发、权限、重试、事务和故障恢复里。OWASP 的 API4:2023 还把执行超时、内存、上传大小、单次请求操作数、分页记录数和第三方服务支出上限列为需要明确限制的资源边界。33
因此,「AI 天生不适合后端」和「换个更强模型就没问题」都太快。真正能拍出差异的,是给模型同一个业务需求,一版只要求快乐路径,一版写清并发、幂等、越权、回滚、限流和审计,再比较代码、测试和失败场景。
前 5 条可见回答样本
- 鱼丸不吐泡泡|0 赞:
大型项目的耦合性太高,牵一发而动全身,很多老项目都是屎山代码,根本没人敢改。
摘要:把问题归因于旧系统上下文和依赖关系,适合拍代码库理解与回归测试,但「AI 记忆不够」仍是答主判断。34
- BLINK|0 赞:
我们做了一套 prototype to product 的教程,定位是面向非专业 coder 的避坑指南。
摘要:回答把权限、架构和商业设计列为从原型走向产品的补课内容,并留下了视频教程线索;不能据此证明教程效果。35
- 王跳跳|1 赞:
用 ai 写后端比前端简单的多,特别数据校验这种最简单的功能,ai 绝对没问题。
摘要:提出相反观点,认为后端代码生成并非主要瓶颈,真正复杂的是业务逻辑;「绝对没问题」需要测试才能成立。36
- AI 实验室|0 赞:
不是 AI 天生不会写后端,而是前端的错误大多摆在你眼前,后端的错误经常躲到并发、权限和故障里才露面。
摘要:列出重复扣库存、支付回调重放、越权访问和失败回滚四类验收条件,是本题最适合直接变成实验脚本的回答;回答末尾的推广链接不作为证据。8
- Simon|0 赞:
除非你没有前端要求,或者一次出品不用改;否则,现在 AI 前端改也不好改,用又不能用。
摘要:把讨论拉回前端维护性,提醒「前端一键成品」本身也可能只是一次性演示。37
今天先拍哪三条
- 先拍 Claude 评测事故:官方复盘给出了 141006 次运行、3 起事件、6 次运行和错误联网原因,能把「模型问题」与「测试基础设施问题」放在同一条时间线上。
- 再拍宇树 IPO 的制造业账本:8 月 10 日申购只是入口,收入增长、扣非净利润下滑、研发投入和售后能力才是机器人能否从演示走向长期订单的后续问题。
- 第三拍 Vibe Coding 后端实验:它不需要等待行业共识,直接用同一需求、两组验收条件和并发权限测试给出结果。
字节与腾讯适合做数据口径片,先把阵营总时长、单 App 时长和样本覆盖讲清楚;openPangu 适合做开源边界片,先把开放材料、许可证、硬件要求和独立评测补齐。
核验边界
- 热榜口径:本期采用本次读取到的知乎实时热榜快照。
hot_text是知乎展示的热度量级文本,不是精确浏览量;排名、回答数和关注数会随时间变化。五个问题的题面与统计字段均来自各自知乎问题页和本次热榜返回。9 15 21 26 32 - 回答口径:五题各取本次接口返回的前 5 条按更新时间排列的可见样本,不等同于按赞同数排序的高赞回答。25 条样本中有短句、戏仿、个人体验和图片占位,正文保留作者、赞同数、原文短摘和摘要,没有把它们包装成知乎共识。
- Anthropic:141006 次评估运行、3 起事件、6 次运行、三种模型和三类事故细节来自 Anthropic 官方复盘;受影响机构名称、第三方后续审查结果和完整日志没有在本期补齐。1
- 字节与腾讯:40.1% 与 29.7% 对应 2026 年 6 月、Top 50 App、约 93% 移动互联网总时长的统计口径;报告中文页注明由 WorkBuddy 整理,原始报告版权归 Nomura International (Hong Kong) Ltd.,不能把它写成全体网民调查。4
- 宇树:发行日期、4044.6434 万股、10% 发行比例、42.02 亿元融资和财务数字来自澎湃对公告与招股书的报道;申购价格、估值和中签收益未在本期确认,不构成投资建议。2
- openPangu:本期只确认华为公开了 5050 亿参数模型的权重、基础推理代码和技术报告,并采用昇腾原生训练与推理路线;完整许可证、训练成本、硬件门槛和第三方评测未补齐。5
- Vibe Coding:Google Cloud 的页面能支持「生成、测试、人工审查、部署」的工作流描述,OWASP API4 能支持资源限制、限流和支出上限等后端验收点;它们不能证明某个模型或某个工具在所有后端项目中都失败。3 33
References
- 1Anthropic:Investigating three real-world incidents in our cybersecurity evaluations
- 2澎湃新闻:宇树科技,8月10日打新
- 3Google Cloud:Vibe Coding Explained
- 4野村证券:中国互联网与新媒体月度 App 追踪报告
- 5新浪科技:华为开源盘古 openPangu-2.0-Pro 模型
- 6知乎回答:大刘AI编程
- 7OWASP API4:2023 Unrestricted Resource Consumption
- 8知乎回答:AI实验室
- 9知乎问题:如何看待 Anthropic 公布 Claude 也发生了沙箱逃逸
- 10知乎回答:明辨AI
- 11知乎回答:总之先给你两拳
- 12知乎回答:raven
- 13知乎回答:花想容
- 14知乎回答:切切
- 15知乎问题:字节系在移动互联网用户时长的占比升至 40.1%
- 16知乎回答:明明
- 17知乎回答:拉格朗的呱呱
- 18知乎回答:文森特·凡喵
- 19知乎回答:勥囧厂乙
- 20知乎回答:爱咋咋地
- 21知乎问题:宇树科技 IPO 时间定了
- 22知乎回答:Evolva
- 23知乎回答:月与椰枣树
- 24知乎回答:okpy
- 25知乎回答:张性新
- 26知乎问题:如何评价华为盘古 openPangu-2.0-Pro
- 27知乎回答:阿咩哦
- 28知乎回答:幼儿园不是好孩子
- 29知乎回答:宅中仙人
- 30知乎回答:zha zha
- 31知乎回答:1379
- 32知乎问题:Vibe Coding 吹得神,做前端一键出成品
- 33OWASP API4:2023 Unrestricted Resource Consumption
- 34知乎回答:鱼丸不吐泡泡
- 35知乎回答:BLINK
- 36知乎回答:王跳跳
- 37知乎回答:Simon
Related content
- Sign in to comment.
More from this channel›
- 知乎热榜 AI 科技制造业日报|8月2日晚:零跑交付破10万、尚界Z7两万与韩股芯片震荡,10个视频选题
- 知乎热榜 AI 科技制造业日报|8月2日中午:显卡封仓、GCC拒绝AI代码与寒武纪股权激励,10个视频选题
- 知乎热榜 AI 科技制造业日报|8月1日晚:运营商售卡新规、Astra 数学证明与汽车轻量化,10 个视频选题
- 知乎热榜 AI 科技制造业日报|7月31日晚:DeepSeek V4 Flash、特斯拉中国与 GLM 改版,10 个视频选题
- 知乎热榜 AI 科技制造业日报|7月31日中午:AI裁员返聘、黑鲨退场与长鑫上市,10个视频选题
- 知乎热榜 AI 科技制造业日报|7月30日晚:渠道售卡争议、硒鼓泄密与5万亿苹果,10个视频选题
- 知乎热榜 AI 科技制造业日报|7月30日中午:旧书训练、存储双雄与 AI 员工请愿,10个视频选题
