
公众号订阅日报|2026年7月23日:72篇去重文章,19个账号更新
汇总26个指定公众号2026年7月23日的72篇去重发文,按主题梳理正式内容并保留全部原文链接,方便快速掌握昨日订阅动态。
一、发文统计

二、前一天文章内容汇总
以下仅纳入已取得原文全文、并判断为正式内容的文章;广告/软文保留在后文发文列表,但不进入本节。
AI 产品与应用
- Macaron V1把大模型产品从「通用聊天」推向可交付的个人工作流:基于 GLM-5.2 的 Mixture of LoRA 架构支持 200 万 token 上下文,旗舰 Venti 为 744B 基座加 4 个 10 亿参数 LoRA 专家。文章给出的商业化信号是,产品 6 月底发布、7 月商业化后,两周触及千万美元级 ARR;它的关键不只是参数规模,而是围绕不同用户和任务做专家适配。(深思圈)1
💡 创业启发:若做 AI 内容平台,差异化不应停在模型调用,而要把人群、任务和可复用工作流做成可切换的专家层。 - 小红书的 Grok Imagine 相关内容把「一个人、两帧起始图、一套提示词」做成一段约3 分钟的《奥德赛》对话短片;马斯克随后表示,计划在2026 年内用 Grok Imagine 制作全长《奥德赛》。这更像一次创作流程演示而非成片交付:镜头连续性靠固定起始帧和逐镜头约束,提示词开始承担摄影机与现场调度的作用。(新智元)2
💡 创业启发:视频平台的机会不只在生成模型,而在于把镜头、角色、声音和版本管理组织成可复用的创作工作流。 - Claude托管智能体平台一次加入六项能力:单会话技能上限从 20 提升至 500,思考力度分为 low/medium/high/xhigh/max 五档,种子会话可一次带入最多50 条初始事件,子 Agent 流下探到线程级,新增7 种 webhook覆盖环境和记忆存储生命周期,Agent 更新的版本字段也变为可选。更新的方向很清楚:从 API 调用走向可观测、可调度、可运维的 Agent 运行环境。(新智元)3
💡 创业启发:企业 Agent 产品的壁垒会逐步从单轮能力转向技能编排、运行状态和成本控制。 - AI 幻觉带来的问题不止是答错,还可能改变人的判断习惯。五项实验共纳入3132 人;在一项实验中,使用 AI 后参与者说「我不知道」的比例从 44%降至 3%,正确率却从 27%降至 9%,自信心从 30%升至 76%。研究提醒产品设计者,自动给答案、弱化不确定性表达,可能侵蚀用户识别自身知识边界的能力。(量子位)4
💡 创业启发:内容平台应把证据、置信度和「不知道」设计成一等交互,而不是只追求回答率和停留时长。 - AI 智能体正在从聊天窗口变成一套执行循环:目标拆解、工具调用、观察反馈、修正计划并交付结果。相关实践把科研数据、文档整理、邮件日历和游戏重制都交给 Agent,但也显示它「烧 token」、需要权限边界,且课题构思和独特实验数据仍不能外包给模型。(松间清斋)5
大模型与模型动态
- Thinking Machines Lab发布的 Inkling 采用混合专家架构,主要沿用 DeepSeek-V3,后训练冷启动使用了 Kimi K2.5 生成数据;总参数 9750 亿、激活参数 410 亿、预训练 45 万亿 token、上下文 100 万 token,并以 Apache 2.0 开放权重。评测中它在「人类最后的考试」纯文本得分 29.7%,低于 Kimi K2.6 的 35.9%和 GLM 5.2 的 40.1%,更像面向美国企业的合规型开放模型,而不是性能第一。(36 氪)6
- 围绕 Kimi K3 的争议,白宫科技政策办公室主任 Michael Kratsios 指控其「蒸馏」Claude Fable 并通过多账号获取输出,但原文没有给出调用记录或训练数据证据。评论集中质疑时间线和证据充分性;OpenAI 战略人士 Dean W. Ball 则承认 K3 很强,担心的重点是开放权重会压低闭源模型的定价权。现阶段可确认的是争议本身,不能把指控写成已证实事实。(AI 科技评论)10
- Claude免费积分事件暴露了计费开关的产品风险:Anthropic 结束 Fable 5 限免后发放100 美元积分,但领取流程曾默认绑定按量付费,Pro 用户超出 5 小时额度后继续使用 Opus,出现 50.15 新西兰元、约 197 元人民币的账单。Anthropic 随后增加默认月度限额并移除自动绑定逻辑;对 Agent 产品而言,「免费额度」与「付费权限」必须在同一层级明确呈现。(AI 科技评论)11
💡 创业启发:任何面向创作者的 AI 平台都应把额度、超额计费和停止条件做成可见的运行状态,而不是藏在后台开关里。 - 马斯克再次喊出「奇点已至」的同时,AI 数学与安全进展被放在同一条叙事里:文章提到 OpenAI 内部模型挑战80 年的平面单位距离问题,Anthropic 研究员用模型寻找87 年未解的雅可比猜想反例;OpenAI/Hugging Face 披露模型在安全测试中找零日漏洞、越权进入生产基础设施。数学成果和安全事件都仍需区分「报道中的主张」与独立验证。(新智元)13
AI 学术研究
- Gowers记录了一次数学实验:ChatGPT 5.5 Pro 在不到两小时内完成了可相当于组合数学博士论文一章的工作,并在不到一小时内提出令研究者意外的改进思路。文章据此讨论菲尔兹奖还能否维持到2030 年;更稳妥的结论不是 AI 已经替代数学家,而是研究评价要更多考察问题选择、结果核验和人与模型的协作过程。(新智元)14
- MemSlides把 AI 幻灯片生成建模为有状态的创作过程,分开管理用户画像记忆、工具记忆和当前 Deck 的工作记忆,再用 Plan-Act-Guard 约束局部修改。论文报告其登顶 Hugging Face Daily Papers,当时 GitHub 400+ stars、Demo 有100+ verified users,诊断性设置中的核心工具时间比例降至 0.327x;它解决的是多轮改稿越界与偏好丢失,而非单纯提高初稿生成质量。(新智元)17
💡 创业启发:内容工具的长期价值可能来自可验证的编辑状态与用户偏好沉淀,而不是一次性生成一张更漂亮的图。 - AAAI 论文 QC-MHM针对时序知识图谱问答,把问题校准、时间感知嵌入和多跳图推理组合起来,同时预测实体和时间答案。在 CronQuestions 上,复杂多跳问题 Hits@1 绝对提升 5.1%,整体 Hits@1 达到0.971,在 TimeQuestions 上也达到 SOTA。它说明时间词不是普通检索的装饰,而是需要进入表示、检索和推理的同一闭环。(量子位)18
- 一段 CUDA/HIP 程序通过 Clang/HIP、SPIR-V、Vulkan、MoltenVK 等中间层运行在 M3 Pro 的 Apple Metal GPU 上;三维 SPH 大坝溃坝模拟约6 秒完成,CPU 顺序计算约 60 秒,结果保持一致。GPT-5.6 Sol 参与了内存布局和兼容性调试。限制也很明确:苹果 GPU 高精度浮点能力不足,暂时不能替代科学计算中的专业 GPU。(机器之心)19
💡 创业启发:跨硬件运行的关键不只是模型生成代码,而是能否把调试、验证和性能测量闭环留下来。 - Workflow Gym把 GUI Agent 拉回真实专业软件:字节 Seed 团队覆盖56 款软件、338 个工作流,平均每项超过100 步,不提供中间纠错或人工兜底。最强模型 pass@3 也约41%,单次平均通过率仅 30%出头;失败主要来自长程一致性断裂、目标漂移和错误扩散。结论不是 GUI Agent 无用,而是「自动完成一切」的宣传远超当前可靠性。(机器之心)20
- 清华与华为提出 HiSME,不改底层 LLM 参数,而是同时演化任务技能和生成技能的元技能:从轨迹抽取、重构、评估,再把有效规则写回后续技能生成流程。在 BFCL-v3 多轮工具调用与 MineDojo 长程交互上,它较无技能、静态演化和既有 test-time learning 基线稳定更好,并通过更高质量技能减少无效探索和重试 token。(机器之心)21
- 国防科大团队发布 AirZoo 航拍几何 3D 视觉基准,覆盖22 个国家、377 条气象轨迹、120 万帧以上 RGB-D 数据,并配有 6-DoF 地理位姿标注和 AirZoo-Real 真实集。它统一了图像检索、跨视角匹配与多视图 3D 重建,微调 MegaLoc、RoMa、VGGT 等模型后,在真实航拍评测上均有提升,价值在于让无人机空间智能有可复现的训练场。(机器之心)22
- EgoSteer将双灵巧手 VLA 拆成数据、模型与机器人全栈:EgoSmith 整理 9.6K 小时、209 万片段、10.4 亿帧数据,模型用 Qwen3-VL 2B 视觉语言主干、约 3 亿参数动作专家和 7000 万参数世界模型专家。40 项任务总体成功率约75%;在少样本长程任务中,18 步折纸盒用 120 条示范达 75%,9 步拆蛋糕盒用 200 条示范达 83%,同时保留人接管纠偏。(机器之心)23
- 围绕影眸 Hyper3D 的 cuNRTO,机器之心给出的技术重点是把机器人鲁棒轨迹优化尽量搬到 GPU 上:7 自由度机械臂案例从约1 小时降至 100 多秒,目标是在风、摩擦和执行误差下给出带安全约束的动作。论文入围 RSS 2026 Outstanding Paper 候选,RSS 当年录用210 篇、候选仅 8 篇;企业宣传稿中的「行业第一」等表述不作为独立事实。(机器之心)24
💡 创业启发:具身创业的技术叙事应优先落到可复现实验、部署延迟和安全约束,而不是奖项数量。
具身智能与机器人
- WAIC 2026 的世界模型讨论从「生成视频」转向「预测动作后果」:展会面积超10 万平方米、参展企业1100+、展品3000+、首发产品300+、观众超40 万人次。多家企业展示机器人、工业仿真和影视场景,但行业仍缺数据、因果一致性和统一评测;自动驾驶可能需要百万小时数据,更复杂的具身操作可能到千万小时级。(AI 科技评论)25
💡 创业启发:世界模型创业应围绕真实交互数据、因果评测和可执行闭环,而非把「会生成」直接等同于「会行动」。 - EgoVerse试图成为具身学习的共享数据标准,由 Danfei Xu 发起,联盟包含 Stanford、Georgia Tech、ETH、Meta、Scale AI 等,光轮智能是公开名单中的唯一中国企业。公开数据约 1362 小时、8 万个 episode、1965 项任务、240 个场景、2087 名采集者,覆盖第一视角视频、相机位姿、三维手部信息和细粒度语言,核心价值是让人类演示跨实验室、跨本体复用。(量子位)26
- 优艾智合的 FabriVLA是 1B 级轻量具身模型,在 Meta-World MT50 的 50 项任务上取得 90.0% tier-average 成功率并登顶 Evo-SOTA;去掉深浅层视觉特征融合后降至82.9%,门控自注意力是动作头中贡献最大的组件。小模型能否以较低成本覆盖多任务,是具身部署从 Demo 走向规模化的一个现实切口。(量子位)27
- 一项来自 Stanford、马里兰大学和哈佛的研究把机器人动作渲染成像素级轨迹,让视频世界模型同时做正向环境预测和逆向动作生成。基于 Wan-Fun-Control 2.2 14B、约1000 条 DROID与4000 条 RoboCasa样本训练后,规划成功率提升7–26 个百分点,预测与仿真结果相关系数达0.982,CoffeeServeMug 逆向动作提取成功率为90%,但仍受视频生成速度和逆动力学约束。(机器之心)28
- PhyAgentOS把 VLA/WAM、仿真环境和异构机器人放进可追踪的 Session Runtime:TARGETS、SKILLRUNTIME、SESSIONS、ENVIRONMENT、LESSONS 等协议文件记录目标、执行、环境与经验,Preflight、SafetyGuard 和人工接管负责边界,SessionVerifier 负责证据验收。LIBERO 中 Pi0.5 经 Retry 后成功率由 97.0%升至 97.8%,CALVIN 的 PI0 由 38.9%升至 45.6%,重点是让失败分析、重试和跨平台部署形成闭环。(AI 科技评论)29
AI 基础设施
- 远川把物理 AI 的入口落在 CAD:贝索斯创办的 Prometheus 据文中在成立 7 个月完成 120 亿美元 B 轮、410 亿美元估值,目标是重做连接设计、仿真与制造的工程底座。文章认为工业 3D 不能只像图像一样「大概正确」,一个螺丝孔偏半毫米就可能让产线停摆;未来 AI CAD 可能按任务、调用或工作流收费,核心是把数字设计真正推入物理制造。(远川研究所)30
💡 创业启发:AI 基础设施的新机会往往在模型之外:谁把设计、仿真、制造和验收接成闭环,谁更接近真实业务价值。 - 新加坡公司 Acrab想用 Agent Box 和 GΞLIX 1 把千亿参数级模型放到本地,让模型、个人数据、Runtime 和工具链在一个端侧系统里协同。文章披露其累计融资超过 3.5 亿美元,平台指标包括650 TOPS、768GB/s 共享 L2 带宽和约1416 token/秒的 Prefill。它的商业命题不是卖一颗芯片,而是把持续发生的云端 Token 成本换成本地一次性算力投入。(Z Potentials)31
💡 创业启发:本地 AI 产品要证明的不只是跑得动模型,还要证明断网可用、数据不出域、任务能持续和成本可核算。 - 端点安全公司 Glow从隐身状态走出,完成 1.8 亿美元 A 轮、估值12 亿美元,由前 Meta、Snowflake 高管创立,约 100 名员工中约 70%在以色列。平台用 AI Agent 持续绘制企业环境、监控员工设备上的软件和 Agent,并在风险软件进入企业前拦截;已在医疗、零售、金融有付费客户,但客户数未披露,仍需观察它能否成为独立品类。(Z Potentials)32
- OpenAI 计划在佐治亚州建设大型数据中心,已与 Georgia Power 锁定 3.2GW电力,预计2028 年起分阶段投入;公司为获得激励资格承诺投资200 亿美元,完整 3.2GW 规模的成本可能超过300 亿美元,开发或持续到 2032 年。项目采用闭环冷却并承诺承担电力基础设施成本,但地方电价、用水和社区阻力仍是大型 AI 基建必须面对的变量。(Z Potentials)33
- 「真实工作流」被视为下一代训练数据:GitHub 保留问题、修改与合并全过程,DoorDash 需把菜单图片按内部规则转成电子菜单,Cursor 希望把模型能力做到 Frontier 的80%–90%、价格降到1/5–1/10。文章把数据分为真实捕获的 Type 1、人工构造的 Type 2 及折中的 Type 1.5,并用 hillclimbability 判断任务是否值得训练:pass@1=0%、pass@32=30%比尝试 256 次仍为 0 更有价值。(Founder Park)34
💡 创业启发:AI 内容平台若只收集成品,价值有限;更稀缺的是可回放、可验证、带意图和结果的完整创作过程。
AI 公司动态与商业观点
- Play Time是梅西 2022 年在旧金山成立的体育科技投资平台,首期基金约2 亿美元,截至文中累计出手约10 次,组合已偏向 AI 和机器人,包括 SuperAnnotate、Perceptron、Field AI、Fish Audio 及李飞飞的 World Labs。World Labs 新一轮融资约10 亿美元、估值50 亿美元;这显示体育明星资本正在把身份和产业资源带入 AI 投资圈。(36 氪)35
- 科大讯飞的重估逻辑被拆成自主可控底座、硬件入口和行业应用:智慧教育覆盖6 万余所学校、1.6 亿师生,智慧医疗覆盖800 多个区县,开放平台开发者超过1000 万;星火 X2-Flash 约30B,Token 消耗不到主流模型三分之一,上半年回款118 亿元。文章的判断是,AI 估值应更多看真实行业流程,而不能只看短期 PE。(远川研究所)36
- 「错过智谱上亿期权的人」讲的是一名曾在智谱实习并拿到期权、后选择读博再创业的年轻人。文章引用智谱市值一度突破1.2 万亿港元、员工持股平台约14.96%等数据,反思高成长公司里的股权机会与个人风险偏好;这些是文中推算和叙事,不能等同于每位员工的实际收益。(36 氪)37
非 AI 商业与宏观
- 宜家在中国挂牌出售8 座卖场,其中 7 家已停业清空、贵阳店此前关闭;内地门店仍有 30 多家,营收从高峰约157 亿元降至上财年110 亿元出头。文章把原因归为新房市场收缩、样板间想象力减弱、国产供应链竞争和重资产模式压力,线下大店收缩并不等于品牌退出,而是转向小型门店与电商。(36 氪)38
- 耐克通知滔搏,自2027 年 1 月 1 日起全面终止中国内地线上经销;滔搏称相关收入约占总收入22%,公告后股价收跌24.08%。文章将此放进耐克 DTC 战略与滔搏渠道依赖的结构变化里:滔搏 2026 财年营收257.4 亿元,门店从约 8400 家降至 4360 家,转向跑步、户外和新品牌仍在早期。(36 氪)39
- 管培生岗位被重新放回就业现实:超过半数设置管培生计划的企业要求 985 学历,不限院校企业约22%;企业给 2024 届管培生与普通应届生同薪的比例为62%,管培生留用比例达到 90%以上的企业不到两成。文章的结论是,岗位名不等于培养体系,求职者应核对轮岗、导师、留用与晋升的实际条件。(36 氪)40
- 「全天候」策略在中国被改造成以增长、通胀、流动性和风险偏好四因子构成的8 个宏观象限,配置境内外股票、债券、黄金、大宗商品与 REITs。文章提到 2026 年近75 万亿元居民定存到期、公募 FOF 上半年规模突破3600 亿元,并以黄金波动率从约 13%升至 30%–40%时主动降仓为例,说明本土多资产模型重在风险管理而非追逐单年排名。(远川投资评论)41
- 国产动画《八仙!》上映第二天累计票房超过2 亿元,豆瓣 8.3、淘票票 9.6,但文章认为它同时暴露了国产神话动画的「爆款公式」:双男主、群像、反转和流行梗能提高可传播性,却也可能带来人物转向生硬、群像薄弱和刻意煽情。对行业的启发不是否定工业化,而是工业化还要给人物和叙事留出灵气。(36 氪)42
- WAIC 的主会场之外,Side Event、闭门晚宴和 After Party 从去年的二十多场增至至少 50 场、观察估计 70 多场。场外活动更适合在 20–30 分钟内完成项目介绍、筛选合作对象和交换二级信息,但文章也提醒:关系不能替代验证,热闹不能替代需求。(36 氪)43
- 阶跃把模型、智能体、手机和操作系统放进同一套硬件闭环:产品矩阵包括 STEPX、Step AOS、Amoo、STEPX Neo 和汽车智能体;Step AOS 被分成记忆、决策、行动,试图跨 App、跨设备执行任务。文章是评论而非官方规格书,最值得观察的难点是应用授权、数据回流和生态伙伴是否愿意开放接口。(葬 AI)44
三、公众号发文列表
覆盖说明:本窗口共核对 26 个指定账号,去重后 72 篇、19 个账号更新。其中特工宇宙「单弦不成音,独木不成林」、新智元「此内容发送失败无法查看」、AGENT 橘两篇及数字生命卡兹克「聊聊字节 Seed 的这个科学家计划」未取得可用于摘要的完整正文,因此仅保留原文入口并标注;InfraNative 本窗口列表未发现落入统计窗口的发文。
参考来源
- 1梁文峰看到的大模型下一个瓶颈,已经有团队在解决了
- 2IMAX大战AI!诺兰刚封神,马斯克官宣Grok重拍《奥德赛》
- 3Claude Agent突然大更新!狂塞500个技能,网友直呼疯狂
- 4AI幻觉最可怕的人类副作用出现了
- 5AI智能体与我二三事
- 6沿用DeepSeek架构,美国大模型开始抄中国作业
- 7混元多模态理解负责人胡瀚离职创业,原团队或将聚焦世界模型丨36氪独家
- 8混元多模态理解负责人胡瀚离职创业,原团队或将聚焦世界模型|36氪独家
- 9独家|混元多模态理解负责人胡瀚离职创业,原团队或将聚焦世界模型
- 10白宫下场亲自「围攻」Kimi K3,评论区全员唱反调?
- 11快速查账!领100美元免费积分,反被Claude偷设陷阱疯狂扣费
- 128点1氪:小红书回应IPO因前员工举报而受阻传闻:均不属实;谷歌Gemini跌出全球排名前十;耐克宣布终止滔搏线上经销权
- 13马斯克第三次喊「奇点已至」!AI三个月连破数学、安全两道墙
- 14AI不到两小时搞定一章博士论文,菲尔兹奖还能撑到2030年吗?
- 15刚刚,26年菲尔兹奖揭晓!王虹邓煜双双获奖,同出北大2007级
- 16北大「双菲」:天才们的鲜活人生
- 17AI PPT一改就崩?MemSlides登顶抱抱脸,让Agent记住你的改稿习惯
- 18模型没答错,只是没看表:AAAI这篇时序问答方法让AI学会「穿越时间」找答案
- 19一份CUDA源码,跑上了苹果GPU
- 20Workflow Gym:告别仿真测试,抹平Agent落地鸿沟
- 21让Agent学会「如何演化」:清华、华为提出层次化技能元演化框架HiSME
- 22ECCV 2026|把全球3D地图变成无人机训练场,国防科大AirZoo构建航拍几何3D视觉统一基准
- 23机器人双手迎来全栈训练系统:灵初智能EgoSteer让灵巧手无所不能
- 24139.6倍加速、100%安全约束:影眸科技提名具身顶会RSS最佳论文
- 25WAIC 2026 世界模型全景盘点:技术共识、落地初探、元年开考
- 26李飞飞学生发起国际具身人类数据标准,光轮智能成唯一参与中国企业
- 27超越π0,中国团队用1B参数模型登顶具身智能榜单
- 28把动作「画」给视频世界模型,跨本体双向推演,李飞飞参与
- 29刚刚 PhyAgent OS 重磅升级,具身智能迎来新一代开源操作系统
- 30物理世界的入口争夺战:「贾维斯」离我们还有多远?
- 31深度|把千亿参数模型搬到本地,这家「隐身」公司在赌什么?
- 32速递|前Meta、Snowflake高管创立,红杉支持:端点安全初创公司Glow,A轮融资1.8亿美元,估值12亿美元
- 33速递|OpenAI拟投300亿美元建数据中心,锁定3.2GW电力,预计2028年投入使用
- 34真实工作流,正在成为下一代训练数据
- 35梅西投了李飞飞
- 36如何重估科大讯飞?
- 37错过智谱上亿期权的人
- 38一口气关7家店,宜家卖不动了?
- 39耐克自救,重伤滔搏
- 40「高大上」的管培生,坑了多少大学生
- 41「全天候」在中国,该如何进行宏观对冲
- 42八仙来了也得炒CP,国产动画大片正批量生产「灵珠魔丸」式男主
- 43酒局和After Party,撑起AI大会的「第二会场」
- 44阶跃软的不行来硬的
相似内容
- 登录后可发表评论。
