7月20日 AI创业晚报:Kimi算力、Agentic Infra与灵巧手融资章节1×0:07口径与本期三条线3:28无问芯穹与推理基础设施5:45月泉仿生的灵巧手融资8:22本期来源0:009:360:07host本期在X上读取了400个关注账号的0条推文,其中0条落在时间窗内;公众号方面,5个账号的25篇文章在本期窗口内。0:16cohost今天白天的材料集中在三件事,Kimi K3的订阅和算力,无问芯穹的推理基础设施,还有月泉仿生的灵巧手融资和量产信息。0:26hostReuters报道,Moonshot AI暂停新订阅,是因为新发布的Kimi K3带来的需求超过了现有集群容量。公司说,Kimi K3得到的需求远超预期,GPU正在承压。0:38cohost机器之心文章写,Kimi官方会增加算力,容量允许后分批恢复订阅。文章还写到,会员将拆成通用的Kimi Membership和面向编程工作的Kimi Code Membership,两套方案分别对应额度、并发和价格。0:54hostReuters报道,暂停期间,现有付费用户的服务被优先保留。Moonshot还说,未来会按新增算力分批开放新的订阅名额。1:04cohost机器之心文章提到,会员页面当时显示售罄,老用户追加购买和升级也受到影响。文章给出的产品变化,是把普通聊天和长期运行的编程智能体拆开计量。1:16hostKimi K3是一个二点八万亿参数的开放权重模型。Reuters报道,Moonshot把它称为当时全球最大的开放权重人工智能系统,模型发布后,编码和智能体类任务带来了较高的推理负载。1:30cohost海外独角兽文章写,Kimi K3在七月十八日进入OpenRouter日榜前十,当日调用量约一千四百二十亿个Token。文章还写到,Kimi K3上线初期只有Moonshot一家Provider,OpenRouter出现了容量不足和请求可能返回四二九的提示。1:49hostReuters报道,Kimi K3的编码和智能体任务需要反复调用模型,规模化运行时需要更多推理容量;文章还写,二点八万亿参数模型的硬件成本让多数用户难以自行部署。2:01host同一篇海外独角兽文章写,OpenRouter让开发者用一把密钥接入四百多个模型和七十多家Provider,并比较价格、速度和稳定性。它把同一个模型的不同运行服务放进一个路由入口。2:15cohostReuters报道,Moonshot正在为香港上市准备公司结构,已经聘请高盛和中金讨论上市计划,但时间表仍在变化。报道还写到,公司五月从包括美团、中国移动和中保投在内的投资人处融资超过二十亿美元,历史累计融资超过五十五亿美元。2:35hostReuters还报道,月之暗面正在寻求最多二十亿美元的新资金,六月公司估值达到三百亿美元。2:42cohost机器之心文章写,Kimi K3发布后,月之暗面的日销售额至少增长六倍,年度经常性收入从四月的两亿美元增加到六月的三亿美元。2:52host海外独角兽文章写,OpenRouter在五月完成一亿一千三百万美元B轮融资,投后估值约十三亿美元。文章还写到,OpenRouter从模型聚合入口扩展到Provider之间的路由服务。3:08cohost机器之心文章援引彭博消息写,月之暗面已向股东发出赴港上市的决议,最快可能在六个月内进行。文章同时写到,公司估值可能超过三百亿美元。3:19hostReuters报道,开放权重允许用户下载和定制模型,但Kimi K3的规模会让自行托管需要很高的硬件投入。3:28cohost量子位文章写,WAIC现场,MiniMax和阶跃星辰都出现在无问芯穹的论坛活动中,文章还把智谱和Kimi列为此前与无问芯穹有合作的模型公司。3:39host量子位文章给出的产品重点是跨集群异构PD分离。Prefill和Decode属于不同的推理阶段,文章写,无问芯穹把它们拆到不同类型的芯片和集群上运行,再处理异构芯片之间传输KV Cache的带宽和延迟问题。3:50cohost文章写,这套架构加入了Radix Cache和PDD结构,PDD把链路拆成P、RelayDecode和MainDecode三级。延迟较高时,RelayDecode先向用户输出Token,数据传输完成后,再交给MainDecode。4:04host量子位文章写,Radix Cache把跨集群传输的数据量直接降低了一个数量级。遇到跨集群传输延迟时,RelayDecode可以先连续输出Token,等数据传输完成后再切给MainDecode。4:17cohost文章描述的高延迟请求,数据传输实际可能持续数十秒;RelayDecode把这段等待放到后台,主链路继续输出内容。4:27host量子位文章引用的实测数据是,首Token延迟降低百分之五十一点五,单Token成本降低百分之三十七点五。文章还写到,无问芯穹在WAIC发布了智算集群运维智能体系统。4:40cohost这套运维系统的文章口径是,运维人效提升五倍以上,关键故障处理效率提升六倍。无问芯穹还把平台分成算力集散中心、Token工厂和AI生产力商店三部分。4:54host量子位文章写,算力集散中心已部署触达三万七千P算力,接入十六种主流芯片。Token工厂是从网关、路由到推理实例的模型服务平台,AI生产力商店面向文娱游戏、医疗健康、法律和能源电力等行业。5:15cohost文章还写到,无问芯穹Agentic MaaS平台的日均Token调用量,比去年十二月增长四十倍;平台管家智能体可以独立解决百分之八十的日常问题,深度问题再转给垂类智能体。5:28host在芯片算子生成智能体的部分,量子位文章写,GLM五点二实测中,NVIDIA旗舰卡端到端性能提升百分之七点三,AMD旗舰卡整体性能提升百分之三十九。这个系统在真实编译试错和知识沉淀中持续迭代。5:45cohost三十六氪文章写,月泉仿生完成数亿元人民币Pre-A加轮融资,投资方包括长发基金、华控基金、华夏基金、国力民生和星科创投基金,老股东中关村启航投资跟投。6:00host文章写,这轮资金用于团队建设、核心产品研发、产能提升,以及继续研发超仿生神经骨骼肌肉机器人,形成大脑、身体和环境一体化的具身智能体系。6:12cohost三十六氪文章还写,今年第一季度国内灵巧手类企业融资总额接近五十亿元,行业从样机展示进入量产和商业化阶段。6:23host月泉仿生的底层技术叫仿生拉压体机器人理论与技术。三十六氪文章写,这项理论由任雷教授提出,硬质构件承担压力,柔性构件承担拉力,产品覆盖电机、人工肌肉模组、仿生灵巧手、人形机器人整机和世界行为大模型。6:34cohost三十六氪文章写,月泉仿生已搭建覆盖空心杯电机、人工肌肉模组、仿生灵巧手、人形机器人整机和世界行为大模型的全栈自研产品矩阵。6:46host在WAIC展出的Y-Hand M1,掌部重量二百九十九点七克,整手二十六个自由度,五指抓握力最高二百牛。文章写,它在现场拿起和放下矿泉水瓶、扳手,也完成了对柔软玩具的轻触和无损夹持。7:03cohostY-Hand M1给拇指配置了八个自由度,文章写,这个设计可完成对心捏、对掌和包络抓取等类人操作。7:14hostY-Hand M2有三十八个自由度。月泉仿生称它是全球自由度最高的仿生灵巧手。面向工业流水线的X-Hand M1,文章给出的参数是最大五十公斤负重,循环使用寿命可达一百万次。公司还有四到二十二毫米、七个系列的YQ Motors电机。7:32host文章还介绍了轮式人形机器人博文W-Bot二点零。它使用零点二三八平方米的小底盘,工作空间覆盖离地零到二点二米,面向工厂装配、仓储分拣、机房巡检和展厅接待。7:46cohost三十六氪文章写,YQ Motors覆盖四到二十二毫米的七个系列,核心驱动部件全部采用国产自研方案。7:54cohost商业化数据也在三十六氪文章里。月泉仿生已经面向智能制造、仓储物流、巡检运维、医疗健康和家政服务输出解决方案,累计取得过亿元订单;北京昌平生产基地正在建设。8:08host三十六氪文章引用高工产业研究院预测,二零二六年中国灵巧手产品全年销量有望突破七万只。月泉仿生方面介绍,核心零部件已经按直接切换量产的路径设计。8:22host本期来源按事件分组收录在节目页,Kimi K3相关包括Reuters、机器之心和海外独角兽,无问芯穹相关是量子位,月泉仿生相关是三十六氪。8:33cohost海外独角兽文章还写,GLM-5.2、Nemotron和DeepSeek的使用量也超过了部分Claude Opus模型,开放权重模型已经进入主流API调用。8:43host文章提到,同一组模型权重可以由多家Provider部署,不同Provider在价格、速度、缓存和稳定性上存在差异,服务异常时可以切换Provider。8:55cohost量子位文章写,无问芯穹与上海移动联合打造了「天问」模型服务门户,并联合观猹面向开发者推出「TokenDance」,对标OpenRouter。9:05host文章还写,无问芯穹实现了跨域强化学习连续一周零中断运行,并计划将跨域计算资源的支撑规模扩展至十万卡级以上。9:16cohost三十六氪文章标题还写到,月泉仿生的仿生拉压体灵巧手面向万台量产,累计订单已经超过一亿元,北京昌平生产基地正在建设。