7月26日 AI创业晚报:Agent开始记账,Coding开始记状态Chapters1×0:07开场口径0:22Coding Agent开始保存工程状态1:07Agent的Token账单1:510.7B文档解析模型2:32菲尔兹奖得主进入OpenAI3:19机器人开始用触觉完成操作3:55其他快讯4:25本期来源0:004:420:07男主播晚上好,这里是AI创业播客日报。先报口径:本期X关注账号未能读取;公众号方面,5个账号返回21篇窗口内文章。0:16女主播今晚我们把同一事件合并讲,先从Coding Agent的工程状态开始。0:22男主播机器之心今天报道,Valkor联合浙江大学智能计算与软件研究中心、伦敦大学学院软件工程团队,开源了loom。0:33女主播文章把loom定位成一个面向Agent软件交付的开放式交付框架,处理的是需求、任务进度、测试结果、运行时事实和修复记录这些工程状态。0:44男主播GitHub仓库的说明是,loom服务Claude Code、Codex和OpenCode这类Coding Agent,让更大的软件任务可以持续推进、验证、恢复和交接。0:56女主播仓库还写到,会话中断后,状态保存在项目的loom目录里,新的会话可以从上次停下的位置继续;仓库公开,许可证是Apache二点零。1:07男主播机器之心另一篇今天的文章把Agent成本拆成了多轮思考、工具调用、上下文重复编码,以及多个Agent之间的任务分配和状态同步。1:17女主播文章转述Anthropic团队的数据:单个Agent完成一项标准任务时,Token消耗大约是传统单轮对话的四倍;多Agent协作时,消耗达到标准对话的十五倍以上。1:29男主播文章还引用了两则账单案例:一位米哈游工程师部署数十个Agent,系统连续运行十三小时,消耗了约两百万元Token;另一个案例是三人团队指挥一百个Codex Agent,三十天消耗六千三百亿Token。1:44女主播这篇文章列出的降本方向包括模型侧的自适应推理、请求级路由、冗余上下文过滤和提示词压缩。1:51男主播量子位报道,MonkeyOCRv2把文档解析模型做成了两个版本:零点六B的S版和零点七B的B版,覆盖十七种语言。2:01女主播文章列出的开源内容包括视觉编码器、解析模型、文档理解模型、训练和推理代码、部署示例、在线Demo,以及MonkeyDoc v二数据,代码和模型权重采用Apache二点零许可证。2:15男主播在MDPBench上,零点六B版本得分八十二点五,零点七B版本得分八十三点三;文章同时列出此前三B开源模型dots.mocr的八十点五分。2:26女主播它覆盖电子原生文档和拍照文档,也包含中文、阿拉伯语等不同文字系统。2:32男主播机器之心今天还报道,刚获得菲尔兹奖的加拿大数学家Jacob Tsimerman在新闻发布会上表示,自己已经转向AI安全研究,很快加入OpenAI安全部门。2:44女主播OpenAI首席研究主管Mark Chen随后公开表示欢迎。文章还提到,今年上半年已有多位数学、物理、生物和经济学领域的科学家进入头部模型公司。2:58男主播国内方面,字节Seed团队本周发布Seed STEM科学家计划,开放一百个合作席位,面向数学、物理、化学和生物等前沿科学领域的科学家与博士生。3:10女主播机器之心文章还写到,字节Seed Edge团队此前发布过EdgeBench,用来评估真实环境中的Agent学习规律和长程能力。3:19男主播量子位今天报道李飞飞团队的一项触觉研究,研究对象是带触觉传感的灵巧手,任务包括翻书页、开锁和整理物体。3:29女主播文章列出十二项真实世界灵巧操作任务,平均成功率是百分之六十五,纯视觉基线是百分之三十五;翻书页是百分之九十六对百分之六十八,开锁是百分之七十对百分之零。3:42男主播去掉触觉输入后,成功率从百分之六十五降到百分之四十二。文章作者包括牛丹彤、刘卓洋、Trevor Darrell等,相关团队来自加州大学伯克利分校、BAIR和NVIDIA GEAR Lab。3:55女主播美国新闻与美联社的一篇报道提到,中国AI模型正在美国获得更多关注,文章把原因概括为价格更低和效率更高,并配发了上海世界人工智能大会上Moonshot的Kimi K3展台照片。4:09男主播36氪出海今晚的要闻回顾提到,蚂蚁国际完成约十二亿美元A轮融资,参与方包括蚂蚁集团、阿里巴巴等现有股东和多家国际投资机构,资金将用于全球业务和AI等前沿技术投入。4:25男主播本期来源已经按话题分组放在节目页。X关注账号本期未读取,公众号与公开网页来源列在下面。