
公众号订阅日报|2026年7月18日:47篇新文,13个账号更新
汇总26个指定微信公众号在2026年7月18日的47篇去重发文,重点梳理Kimi K3、Agent工作流、经验型AI、具身触觉、世界模型与AI基础设施,并保留全部原文入口。
一、发文统计

统计窗口为 2026 年 7 月 18 日 00:00–23:59(Asia/Shanghai)。本期从 26 个指定账号中整理出 47 篇去重发文,其中 13 个账号有更新;广告/软文保留在末尾的账号列表中,并在标题前标注,不进入下面的正式内容汇总。
二、前一天文章内容汇总
AI 产品与应用
- Agent 走过 500 天,软件入口从 GUI 向工作流迁移。 过去 500 天的路径被概括为「GUI 退场 → Headless 上位 → CLI 复兴 → Skills 封装 → Agentic Economy 萌芽」:当 Agent 能持续替人完成任务,用户关注点会从「能运行多久」转向「能替我完成什么」。这也给 AI 内容平台一个提醒:真正的产品单元不是模型或 Skill 本身,而是围绕一个明确任务交付结果。(十字路口 Crossing)1
💡 创业启发:内容平台可以把「阅读、筛选、整理、提醒」拆成可被 Agent 调用的任务接口,而不只是再做一个信息流页面。 - AI 手机的瓶颈转向信任治理。 STEPX Neo 的演示显示,用户一句「把合同送到公司」,Agent 可自行查联系人、定位、填单并生成跑腿订单,但付款仍交还给用户。文章把这套机制拆成透明决策、关键节点接管、事后审计、有限回滚四层,说明 AI 终端的竞争不只在模型聪明,还在于能否把行动权分级、把错误控制在可恢复范围内。(硅星人 Pro)2
💡 创业启发:AI 内容产品涉及发布、删除、付费和外发时,应默认把「可见、可控、可审计」做成产品能力,而不是事后补一个撤销按钮。 - ChatGPT 开始补上旧对话检索的短板。 文章围绕 ChatGPT 推出更强的历史对话搜索展开:当用户积累了接近4 年的聊天、代码、图片和资料后,找回三个月前的内容不应再依赖手动翻侧边栏。对内容平台而言,长期价值不只在生成新内容,也在于让用户能准确找回、复用和串联旧内容。(新智元)3
💡 创业启发:检索、时间线和可复用上下文,可能比再增加一个生成按钮更能提升内容产品的留存。 - Claude Code 的夜班 Agent 把「循环」变成生产方式。 文章转述 Claude Code 负责人 Boris Cherny 的工作方式:白天同时运行数百个 Agent,夜间规模可到数千个;在 Fable 5 中用
/goal定义可验收终点,用/loop执行周期任务,再用上下文文件保持长期记忆。这里的关键不是多开会话,而是把完成标准、失败出口和预算上限写清楚。(新智元)4
💡 创业启发:AI 内容平台可以将「定时抓取—判断—改写—审校—发布」封装成可观察的循环,而不是让用户每次重新下达整段提示词。
大模型与模型动态
- 模型竞争开始改用「每美元有用智能」计价。 同一组文章记录了 OpenAI 取消部分使用时限、Anthropic 把 Claude Code 周额度上调50%,并援引 DeepSWE v1.1 的口径:GPT-5.6 Sol 得分72.7%,Fable 5 为69.9%,前者估算 API 成本低36.2%。新的比较方式不再只看 Token 单价,而是把重试、人工审查和返工一起算进一次成功任务的完整成本。(新智元)6
💡 创业启发:AI 内容服务若仍按字数或调用次数收费,会越来越难解释价值;按完成的审核、研究或发布任务计价,可能更接近客户真正的预算逻辑。 - 一篇离职长文把军事 AI 红线推到台前。 前谷歌 DeepMind 研究员 Alex Turner 在 7 月 15 日发布离职长文,声称谷歌已与五角大楼签下允许「任何合法政府用途」的军事 AI 协议,并批评公司内部对25 页红线框架和约250 名员工请愿的处理方式。文章同时讨论了模型被部署到隔离军事数据中心后,外部团队能否继续监控其安全行为。以上为离职者文章中的主张,本文不将其视为已独立核验的事实。(新智元)11
AI 学术研究
- MTS 终于解释了「为什么选数据不如不选」。 2018 年提出的 Meta-learning for Training-data Selection 长期难以稳定奏效。ICML 2026 论文指出,选择网络的梯度信噪比比主网络低近一个数量级,权重还会向单样本的 one-hot 状态收敛;团队用更大 Batch Size 和局部、全局、优化动态等多维特征修正后,在四个数据集上平均准确率达到73.75%,较不筛选基线的68.26%提高 5.49 个百分点。(AI 科技评论)12
💡 创业启发:内容平台做数据闭环时,不能只追求「多采样」;要同时保留样本来源、邻域关系和历史反馈,否则自动筛选器可能把噪声误当成高价值样本。 - ARC-AGI-3 的突破被归因于 Harness 而非单纯换模型。 机器之心整理的研究认为,面对更强调物理理解与长程规划的任务,Agent 外层的工具调用、状态管理和验证环节会直接决定表现;因此评测「能不能完成」时,也要把 Harness 设计当成模型系统的一部分。(机器之心)13
💡 创业启发:内容 Agent 的评测应单列工具失败恢复、长任务状态和可验证产物,避免只看一次性回答质量。 - Self-Harness 让 Agent 修改自己的外层工作规程。 上海人工智能实验室提出的 Self-Harness 不更换底层模型,而是从运行轨迹中找出工具调用、产物恢复和退出节奏的问题,再生成候选 Harness 改动,最后用回归评测筛选。文章报告在 Terminal-Bench-2.0 上效果提升104%,并强调这不是「完全自主进化」,而是有边界、可测试的外层优化。(量子位)14
💡 创业启发:内容 Agent 的竞争不只在底模,也在任务分解、失败恢复、产物保留和发布前校验这些可积累的工程层。 - InfraNet 把 RGB 从「默认主模态」降为可控辅助。 ECCV 2026 论文针对夜间或雾天 RGB 退化的问题,固定红外为主路径,用 QualGate 同时压低不可靠的 RGB 特征、增强 IR 表示;在 LLVIP 的 YOLOv8 设置中,完整门控 mAP 为68.8,去掉 IR 增强后降至 67.2。(机器之心)15
- MoE 路由暴露出新的系统级攻击面。 ICML 2026 工作 RepetitionCurse 指出,混合专家模型依赖路由把 Token 分配给不同专家;高度重复的输入模式可能把大量请求集中到少数专家,破坏负载均衡并形成黑盒压力测试。它提醒服务商,MoE 的安全和稳定不只在权重,也在路由行为。(新智元)16
具身智能与机器人
- 触觉从灵巧手配件变成物理反馈基础设施。 ICRA 2026 后的圆桌认为,视觉在最后一厘米会遇到遮挡、状态缺失和反馈迟滞;触觉要提供位置、力、振动、温度等结构化信号,形成「大脑负责规划、小脑负责高频闭环」的分层架构。产业化的难点从单点分辨率转向高保真、低串扰、可批量制造和标准化。(AI 科技评论)17
💡 创业启发:机器人内容平台如果只展示动作而不展示失败、接触和恢复,读者看不到真正的技术差异;触觉数据也适合作为新的内容和评测维度。 - 全身触觉融资把「物理边界」推向机器人躯干。 成立于2026 年 5 月的模感科技完成数千万元天使轮,推出覆盖手部、四肢、躯干和足底的 MoSkin 柔性多模态触觉系统,可感知力、温度、滑移、振动和材质,并同步训练世界动作触觉预测模型,试图缩小 Sim-to-Real 鸿沟。(36 氪)18
- 组合式世界模型把「想错」与「判错」拆开。 RSS 2026 现场,源策未来提出将动力学预测和价值评估分离:前者推演动作后果,后者判断结果是否安全或符合目标。其 ReSim、Generation-then-Revise、World Engine 和 RISE 四项工作,把真实驾驶与机器人训练更多移到可检查的想象空间;ReSim 在 NAVSIM 上达到74.1 分。(AI 科技评论)19
- Cosmos 3 把世界模型做成全模态底座。 英伟达在 RSS 2026 拆解的 Cosmos 3 将文本、视觉、音频和动作放进统一 Transformer MoE;产品分为端侧4B Cosmos Edge、16B Nano和64B Super,并支持在 Jetson 等设备上实时推理。它的目标不只是生成视频,而是让模型理解状态、模拟未来并输出动作。(AI 科技评论)20
AI 基础设施
- Token 开始成为窄带通信中的新载体。 TeleAI 在 WAIC 展示的智传网(AI Flow)先在端侧提取视频语义和动作,再把 Token 通过卫星传输、由接收端生成式重建;语音可在0.266Kbps下传输,较传统方案低约500 倍,视频示例用 100Kbps 替代 3600Kbps。该方案已配套设备投入全国31 个省份防汛场景,后续还延伸到机器人遥操作和水下通信。(量子位)21
💡 创业启发:内容产品的传输优化不一定只靠压缩码率,也可以按任务提取「必须保留的语义」,为低带宽地区提供可用的内容服务。 - WAIC 把算力、Agent 交付和硬件闭环放在同一张图里。 36 氪的现场梳理认为,展会的三个信号是:算力从云端向端侧和机器人重组;Agent 从演示转向企业工作流交付;硬件成为承接模型能力的实际入口。大会展区首次突破10 万平方米,有1100 余家企业、3000 余项展品和 300 余款首发产品。(36 氪)22
- 端侧芯片竞争从「能跑」转向功耗、成本和本地推理效率。 WAIC 现场文章把端侧大模型概括为一个工程三角:功耗只有几瓦、成本卡在几十美元,却要承载数十亿甚至百亿级模型;当 Agent 进入 PC、手机和机器人,芯片不再只是云端算力的缩小版,而要同时解决延迟、隐私和离线可用性。(36 氪)23
- 中国宣布面向全球南方扩大 AI 能力建设。 WAIC 开幕式上公布的举措包括:未来5 年向发展中国家提供5000 个AI 专题研修培训名额,面向多个区域组织建设国际 AI 应用合作中心,并推动气象智能预警方案「妈祖」在30 个国家落地。(36 氪)5
💡 创业启发:面向内容创作者的 AI 工具若要出海,除了模型和算力,还要把培训、语言、本地场景和公共服务接口一起设计。 - 蚂蚁在 WAIC 展示三层 AI 布局。 文章整理的结构包括 AI 应用层、智能体商业生态层和技术基座层:健康 AI「阿福」用户数超过1 亿、日均处理超1000 万次咨询;AI 支付已支持3 亿笔智能体支付,并适配95%的通用 Agent 框架。(36 氪)5
- 曙光 8000 把国产算力展示从芯片推向系统。 曙光 8000(登峰)在 WAIC 首次以真机亮相,单个计算单元算力密度提升20 倍,自研互连可支撑十万卡规模稳定互连,已完成300 余项重点应用适配,覆盖 20 余个科研与产业领域。(36 氪)5
- 具身智能开始进入高危工业场景。 网易灵动在 WAIC 展示远程操控电厂、港口设备的「智能座舱」,并把人机混编、黑灯工地和一人多机作为规模化落地路径;国家超算互联网则发布为期半年的科学计算智能体生态共创与开发者招募计划。(36 氪)5
- 耳夹式 AI 耳机与端侧近存算芯片同时亮相。 千问首款 AI 智能体耳机支持同声传译、会议纪要和健康记录;光羽芯辰 TC1000 系列采用 3D 堆叠近存算架构,宣称等效带宽提升10 倍、功耗降至传统方案的1/3,可支持 3B 模型300 token/s推理及 35B 模型运行。(36 氪)5
AI 公司动态与商业观点
- 推理速度被重新解释为模型能力的一部分。 Groq 创始人 Jonathan Ross 在访谈中把 GPU 与 LPU 的关系放到 Agent 长程搜索里讨论:更低延迟不仅改善体验,也允许模型尝试更多路径、进行更深反思。对实时 Agent 来说,芯片、编译器和服务架构共同决定了「一次任务能不能做完」。(机器之心)24
💡 创业启发:实时内容审核、搜索和生成产品要同时看质量、延迟与单位任务成本,单独优化模型分数未必能改善最终体验。 - 「自驱型公司」把重复协作交给相互配合的 Agent。 Replit CEO 提出的概念是:人负责设定目标、优先级和最终责任,Agent 负责信息收集、执行、验证与常规协作。文章援引的案例称,代码产出增加3 倍而事故没有同步增加;真正的难点是把组织规则写成可检查的任务边界。(机器之心)25
💡 创业启发:小团队可以先把周报、数据汇总、素材初筛等重复流程做成可审计的 Agent 协作,再逐步扩大权限。 - ICML 现场的焦虑从模型能力转向研究者如何找到位置。 Founder Park 把今年 ICML 概括为「模型吃掉一切」与研究方向分散并存:大厂带着更大的模型和工程团队进入学术现场,研究者则需要在基础模型、工具、数据和真实科学问题之间选择自己的切口。文章重点不是一条新 SOTA,而是研究组织与个人定位正在被模型规模重新改写。(Founder Park)26
- 谷歌据悉推迟 Gemini 3.5 Pro,以继续打磨编程能力。 36 氪转述的消息称,发布时间较原计划推迟数月,原因是谷歌投入更多时间提升模型,尤其是代码能力;报道同时提到,内部对 Anthropic 和 OpenAI 的竞争压力有所担忧。该信息来自知情人士转述,尚未有谷歌公开确认。(36 氪)5
- 微软 CEO 公开批评 Fable 的内容限制。 Satya Nadella 认为 Fable 会无故拒绝部分指令,文章还提到技术支持页面显示,涉及大模型搭建等问题时,Anthropic 有时会调用旧版本模型。争议落在产品安全边界、模型可用性和用户对拒答一致性的预期之间。(36 氪)5
- 英特尔把 Gemini Enterprise 接入工程与供应链。 Intel 与 Google Cloud 宣布深化合作,计划将 Gemini 驱动的生成式 AI 用于员工日常工作、工程、供应链和企业运营,并用 Google Cloud 基础设施增强半导体开发环境,缩短芯片设计周期。(36 氪)5
- 智谱 ARR 据悉达到 10 亿美元。 36 氪援引多个独立信源称,截至 2026 年 7 月智谱年度经常性收入达到10 亿美元,2026 年 1 月至 7 月增长15 倍;今年 Q1 GLM API 价格累计上调约83%,调用量仍增长约400%。智谱截至发稿未回复,以上数字应按报道口径理解。(36 氪)5
💡 创业启发:内容平台的商业化不应只看流量规模,还要跟踪单次任务收入、复购和模型成本之间的真实关系。 - 创业者讨论从「找点子」回到真实需求。 深思圈记录旧金山一场 ITCH 活动:现场没有 Pitch Deck 或虚构用户画像,而是由本地小商家直接讲述每天卡在哪里。对 AI 创业来说,最值得复用的不是活动形式,而是把产品假设放回具体工作现场,再让模型参与解决。(深思圈)27
💡 创业启发:面向内容行业时,先访谈编辑、运营、研究员每天反复做的低价值动作,再决定做 Agent 还是做信息产品。
非 AI 商业与宏观
- 高定娃衣把潮玩消费推向线下体验。 Evalab 在上海新店发售仅88 套、定价1088 元的 38cm 齐天大圣装;设计师款曾从 398 元被炒到 2000 多元。文章认为,消费者买的不只是衣服,还包括限量、身份、展示和线下排队带来的情绪体验。(36 氪)28
- 14 套老破小把收租变成一门高杠杆生活方式。 36 氪写到,一名年轻人从 2023 年起用约20 万元买下长沙核心老城区一套 54 平方米住房,之后扩展到 14 套老破小,依靠低总价、地段和租金现金流组织资产。故事的另一面是维修、空置、流动性和房价波动风险,不能只看「收租养活自己」的结果。(36 氪)29
- ofo 公众号复更,但押金问题仍未消失。 停更近5 年的 ofo 官方账号发布皮肤病患者援助招募信息,关联运营主体仍处存续状态,但文章提到其风险信息、司法案件和被执行记录较多,评论区则重新聚焦199 元押金。(36 氪)5
- 苹果重回全球市值第一。 7 月 17 日苹果市值约4.90 万亿美元,超过下跌 3.2%后的英伟达约 4.86 万亿美元,时隔约3 个月重新回到首位。(36 氪)5
- 巴菲特再次提醒市场警惕「赌场化」。 他在 7 月 15 日接受 CNBC 采访时说,当所有人更喜欢赌博时,很难找到有价值的东西;文章把这番话放回 AI 相关股票上涨和投机交易升温的背景中,提醒读者把短期价格与长期价值分开。(36 氪)5
- 世界杯冠军戒指首次出现。 国际足联宣布,2026 年世界杯将制作2026 枚独立编号戒指,其中 30 枚给冠军队员与教练组,其余 1996 枚作为授权产品发售;这把体育荣誉进一步变成可收藏、可交易的商品。(36 氪)5
- 铁路试点提前 60 天预约购票。 7 月 20 日起,京沪高铁和京沪铁路200 多趟列车试点预约购票,过渡期可依次预约 9 月 15 日及以后的车票;8 月 30 日起,常态化开放开车前 60 日至 17 日填报需求。(36 氪)5
- 成品油价格上调,物流成本被重新计算。 7 月 17 日汽油、柴油分别上调300 元/吨和 290 元/吨;92 号汽油每升涨 0.24 元,95 号涨 0.25 元。按文章示例,50L 油箱一次多支出约 12 元,重卡月跑 1 万公里的燃油成本约增加 443 元。(36 氪)5
- NFC 果汁勾兑事件进入执法处置。 漯河市政府食安办通报,涉事 5 家企业已调查,其中 2 家公司因涉嫌虚假标签依法立案并责令下架、召回,另 3 家仍在调查。文章把重点放在标签真实性和监管处置的时间差上。(36 氪)5
- LVMH 掌门人被责令补缴约 1.74 亿元税款。 法国巴黎行政上诉法院裁决,Bernard Arnault 夫妇需补缴 2010 年额外缴款及 2012 至 2015 年财富团结税,合计约2250 万欧元;其方面表示将继续上诉。(36 氪)5
- realme 暂停中国市场产品更新。 真我中国区总裁宣布暂停中国市场产品更新,未来集中资源深耕海外性能与游戏赛道;现有机型售后由 OPPO 团队接手,下一代 ColorOS 发布后用户可转入该系统。(36 氪)5
- 房地产市场出现存量化信号。 住建部数据显示,2026 年上半年二手房交易量占新房与二手房总量的50.4%,北京、上海、江苏、广东等 18 个省区市二手住宅交易面积超过新建商品住宅,市场重点从增量开发转向存量交易。(36 氪)5
- 存储板块龙头出现连续跌停。 7 月 17 日兆易创新走出两个跌停,收报 463.15 元,市值约 3249 亿元;港股同期跌超 11%,文章把这一波动放在科技板块整体跳水与存储交易拥挤的背景下观察。(36 氪)5
- 权益 ETF 重回规模第一。 截至 7 月 16 日,沪深 300ETF 华泰柏瑞规模达935.53 亿元,超过银华日利 A;当天沪深 300 下跌 1.85%,该 ETF 仍净流入62.01 亿元,显示震荡市中资金更偏好宽基工具。(36 氪)5
- 上半年车企销量集中度仍高。 中国汽车工业协会统计显示,2026 年 1 至 6 月销量前十的企业集团共销售1264.9 万辆,占汽车总销量84.2%;吉利、奇瑞、广汽和长城同比增长,其余头部企业出现不同程度下降。(36 氪)5
- Anthropic 据悉准备 IPO 投资者会议。 报道称,Anthropic 将在未来几周安排潜在 IPO 的投资者会面,最早可能于 10 月启动上市;公司 5 月融资后估值达到9650 亿美元。这一消息仍属报道口径,上市时间和估值都可能变化。(36 氪)5
- 苹果或在秋季推出 OLED 版 iPad mini。 报道称,新款 iPad mini 最快今秋发布、10 月上市,首次采用 OLED 屏;苹果还计划更新入门版 iPad 与 11/13 英寸 iPad Air,并可能在 9 月发布折叠屏 iPhone 和新款 Apple Watch。(36 氪)5
- 蓝色薯片被解释为生产验证片。 乐事方面称,消费者发现的蓝色薯片是工厂用于确认设备与流程稳定性的着色验证薯片,着色剂符合 GB2760 标准;消费者已获得说明和退款。(36 氪)5
三、公众号发文列表
下表按账号列出本窗口内的全部去重入口;更新账号排在前面,无更新账号排在后面。标题前的「[广告/软文]」表示该入口保留但未纳入上面的正式内容汇总。
Fuentes de referencia
- 1Agent 元年 500 天:什么在消失,什么在诞生,为什么我们不该再投资 GUI 思维的软件?
- 2AI手机的真问题从来不是智能,是信任
- 3ChatGPT终于能「搜自己」!攒了近4年的对话,一键翻出
- 4Claude Code之父的夜班AI军团,Fable 5两个命令搭好
- 59点1氪:ofo停更5年突然发文,运营主体仍处存续状态;苹果市值重返全球第一;乐事回应「蓝色薯片」来源
- 6Kimi逼得两大巨头改变定价!奥特曼罕见认错,Claude额度重置
- 7刚刚,Fable 5永久可用!
- 8Fable 5 今天正式确定永久会包含在 Max 计划中
- 9萨顿 WAIC 2026 最新演讲:现在的 AI 还不算真智能,我们正迈入经验时代
- 10WAIC信息爆炸!大佬们都在说什么,笔记看这里
- 11DeepMind科学家愤然离职,万字长文揭露谷歌罪恶!
- 12专访南洋理工李搏扬:被「数学缺陷」困了八年的MTS,第一次真正 work 了| ICML 2026
- 13ARC-AGI-3近被完美攻破,这个Harness能让AI掌握物理学家思维
- 14不换模型,效果提升104%!上海AI Lab让Harness也能自进化了
- 15ECCV 2026|当RGB变成不可靠变量:InfraNet用非对称学习重构RGB-IR检测
- 16港科大新发现:MoE路由很脆弱!重复token输入阻塞负载均衡|ICML'26
- 17视觉失效之后,触觉如何补上具身智能的「最后一厘米」?| GAIR Live 032
- 18港科大博士创业做机器人全身触觉系统,红杉、瓴智、智元共同押注丨早起看早期
- 19AI到底是「想错了」还是「判错了」?源策未来陈立的组合式世界模型让策略自我纠偏 | RSS 2026
- 20英伟达 Cosmos 3 深度拆解:它想做具身智能时代的「安卓系统」| RSS 2026
- 21妙啊!无人机直连卫星传Token
- 22WAIC2026的三个关键信号:算力重组、Agent交付与AI硬件闭环
- 23端边芯片的竞争,才刚开始,端侧大模型成了刚需,芯片准备好了吗?
- 24Groq创始人深度洞察:推理越快=模型越聪明?
- 25「自驱型公司」来了!代码暴增3倍,事故不增加
- 26首尔 ICML 四天:模型吃掉一切的速度,快过所有人找身位的速度
- 27我在旧金山一场创业活动上,听到了硅谷最不性感但最真实的需求
- 28娃衣比娃还贵,年轻人排队抢潮玩圈「高定」
- 29坐拥14套老破小,买房上瘾的年轻人靠收租养活自己
Contenido relacionado
- Inicia sesión para comentar.
