8月25日 AI创业晚报:豆包工作、Mint-Agent与Tibo访谈

8月25日 AI创业晚报:豆包工作、Mint-Agent与Tibo访谈

本期播报豆包工作正式发布、Mint-Agent金融基模、Tibo访谈中的ChatGPT Work与Luna、Apodex本地研究Agent与面壁前进四,并补充DevDay、Qwen3.8-Flash-Next、Anthropic SDLC、Groq 3 LPX、小米AI Cube等模型、产品与算力快讯。

0:00 / 10:27
本期覆盖北京时间 2026 年 8 月 25 日 09:00 至 22:00 的 AI 与创业圈新增事实。节目先展开五条重点,再补充窗口内的模型、开发工具、产品和公司快讯;同一事件已合并呈现。

豆包工作正式发布

字节跳动正式发布面向生产力场景的 Agent 产品与品牌「豆包工作」。产品支持围绕用户目标拆解任务、调用工具并持续推进复杂工作流程,并与飞书深度打通:用户使用飞书账号登录后,可在权限范围内调用聊天记录、文档、会议纪要和日程等上下文。1
量子位与 36 氪文章写到,豆包工作可生成和编辑文档、表格、PPT、网页与应用,也可操作浏览器和电脑;长时间任务可调用云电脑,手机可远程推进未完成工作。下载豆包工作电脑版或更新豆包电脑版,可领取 30 天订阅权益,老订阅用户顺延 30 天。飞书内原豆包企业版入口已升级为豆包工作。23
关注人工智能与 AI 设计的歸藏写道,豆包工作上来先送一个月标准会员,已有会员也会免费顺延一个月。4

Mint-Agent:金融原生 Agentic 基模

机器之心文章介绍,华东师大智金院团队孵化的金融原生 Agentic Foundation Model 家族 Mint-Agent 正式发布。在 FinanceAgentBench v2 上,27B 的 Mint-Ag 得分 60.49%,超过 GPT-5.6-Sol 与 Claude Opus 4.8;单题推理成本分别约为两者的 22%10%。家族还包括 9B 的 Mint-Cu。文章写到,Mint-Agent 商业订单已超亿元。5
项目网站与技术报告分别为 mint-fin.github.io/mint-agent 与 arXiv:2608.16386。5

Tibo 访谈:Codex、ChatGPT Work 与 Luna

TechCrunch 刊发对 OpenAI 产品负责人 Thibault Sottiaux(Tibo)的访谈。Tibo 负责 API、Agent 基础设施、企业业务、ChatGPT(含 ChatGPT Work 与经典版)以及 Codex,向 Greg Brockman 汇报。访谈写到,ChatGPT Work 面向非技术白领,包含在每月 20 美元的 ChatGPT Plus 中,OpenAI 称其已达到 2000 万用户;OpenAI 还宣布 Luna 带来约 80% 的永久性价格下调。6
机器之心与量子位文章整理了同一访谈:Tibo 确认 Codex 额度重置有实体按钮,他想按就可以按;他认为当前编程 Agent 仍是过渡形态,用户还要自己维护 Skill、记忆、子 Agent 和并行任务。78
带你了解全球前沿科技与 AI 动态的小互写道,Tibo 还提到 ChatGPT 出现约一年前,DeepMind 内部已有名为 LMChat 的聊天产品。9
歸藏写道,Codex 的 5 小时限制已对 Plus 用户恢复;按 Tibo 的解释,这有助于平衡负载,并避免 Plus 用户一次用完整周额度。Pro 用户不受该限制。10

Apodex:本地数据上的深度研究 Agent

Cola / ListenHub 创始人兼 CEO Orange AI 写道,Apodex 能直接读取本地数据文件、文献和表格,再跑代码做分析,并给出可核查结论;适用场景包括临床生存分析、蛋白质对接和金融尽调,过程可回溯,中途可介入。11
喜欢摇滚乐、爱钓鱼的 PM 向阳乔木写道,Apodex 由陈天桥出资创立并亲自主导,同步发布 Apodex 1.1 mini 35B 模型,深度搜索之外还会写代码、用多 Agent 组合完成复杂任务。12

面壁智能「前进四」人才计划

机器之心文章写到,面壁智能发布「前进四」顶尖人才计划,主要面向优秀实习生:可在明星项目担任核心技术骨干,与全职员工共享研发资源;符合条件的顶尖技术实习生,可在毕业前按当期估值提前授予期权。文章给出的数据包括:MiniCPM 系列全球下载量突破 4400 万 次,GitHub 星标超 15 万;MiniCPM 搭载三星旗舰机上市;SuperMate 覆盖近 70 个可量产座舱场景。13

模型与开发工具快讯

  • 机器之心文章写到,a16z 合伙人 Martin Casado 称刚获得一款新模型访问权限,并称这将是今年最重要的模型发布;多条线索指向 Ilya Sutskever 创立的 SSI。文章同时写到,7 月英伟达与 SSI 建立长期合作,SSI 将获得 Vera Rubin 硬件,路透社报道英伟达还将向 SSI 投资约 50 亿美元。14
  • Tech Analyst Chubby 写道,Qwen3.8-27B 进入 Arena WebDev 基准前十,可在本地运行。15
  • 小互写道,ChatGPT 现支持生成透明背景图像,并可制作可分享的自定义贴纸包。16
  • Vercel CEO Guillermo Rauch 转发 fx v0.0.6 更新:更好的 Auto 模式、审批工作流更快、macOS 二进制约 6.12MB,并支持远程 HTTP MCP。17
  • 分享 AI 新产品与开源项目的 meng shao 介绍 web-quality-audit Skill,覆盖性能、可访问性、SEO、最佳实践和智能体浏览五个维度。18
  • meng shao 还写到,有人把 Grok Bot 闭源应用逆向为约 44 万行可读 TypeScript 运行时加 5.4 万行 React 渲染层,并做了功能扩展。19
  • Daily AI News 账号 Hesamation 讨论 OX Alpha 可能是持续学习模型,并引述 OpenRouter 说明该模型会保留 prompts 与 completions 但不用于训练。20
  • Orange AI 写道,ox 明显比 flash 和 August 更强,并期待本周正式版。21
  • Peter Yang 开源 /fuck-cancer Skill,帮助患者和照护者梳理癌症诊断与治疗路径。22
  • Tw93 的潮流周刊介绍 Cumora:开源的 Teams Agent。23
  • 向阳乔木写道,腾讯云刚发布面向企业的 Agent 上线、分发与管理基建。24
  • Meta AI 高级总监 Madhu Guru 继续连载 How to build great evals 第 8 篇,讨论评测的区分能力。25
  • Tibo 还写道,OpenAI DevDay 2026 将是公司历史上最好的一次 DevDay,而且差距不会小。26
  • Tech Analyst Chubby 写道,阿里即将开源发布 Qwen3.8-Flash-Next,这是开源权重的多模态混合专家模型,采用将支撑 Qwen4 家族的下一代架构。27
  • 小互写道,Anthropic 发布 AI 原生软件开发生命周期实施指南,按 Plan、Design、Build、Test、Deploy、Maintain 六个阶段讲解怎样把 Agent 接入开发流程。28

产品、融资与公司快讯

  • Founder Park 文章整理 AMI Labs 林敏与 Mind Lab Andrew Chen 关于持续学习的对话;Mind Lab 7 月底发布基于 GLM 5.2 后训练的 Macaron V1,使用混合 LoRA,原生支持持续学习。29
  • 机器之心文章介绍 16 家机构提出的 ComBodied Agents(伴身智能体)范式,围绕人的长期状态与主体性构建 Agentic AI。30
  • 机器之心文章写到,原方智能(Cirquar AI)正式启动,核心路线是世界模型,由南京大学 LAMDA 实验室博士生林浩鑫与机器人学院助理研究员唐开强创立。31
  • 量子位文章援引 Axios:Generalist 在 6 月 4 亿美元 B 轮后不到三个月又完成约 2 亿美元融资,估值超 20 亿美元;股东包括英伟达、Bezos Expeditions 与李飞飞。公司专注为机器人打造通用大脑。32
  • 量子位文章写到,英伟达被曝向 GitHub 前 CTO 创立的 Poolside 投入 60 亿美元押注开源模型。33
  • 量子位文章写到,字节跳动入股未来不远机器人最新一轮融资;公司称半年内完成 3 轮共 10 亿元融资,产品已进入约 500 个家庭。34
  • 36 氪文章写到,一名前高盛分析师在 ChatGPT 中留下对前女友的谋杀意图后,被 OpenAI 移送 FBI。35
  • 歸藏写道,Anthropic 封号很快,新号一天就没,尤其 200 美元档账号。36
  • Riley Brown 写道,多数情况下应 Build products for agents。37
  • Box 首席执行官 Aaron Levie 写道,在 Agent 会在这些平台上完成比人类多出 100 倍工作的世界里,记录系统从未如此重要;治理、可靠性、安全和业务逻辑依然关键。38

基础设施与本地算力快讯

  • 机器之心文章写到,NVIDIA 首次公布基于真实芯片的 Vera Rubin 性能测试:在 AgentX 工作负载上,Vera Rubin NVL72 相比 GB300 NVL72 最高实现每兆瓦吞吐提升 30 倍,token 成本最高降低 35 倍;测试使用 DeepSeek V4 Pro。同一时间 SpaceXAI 宣布将部署 NVIDIA Vera CPU,并计划基于 Vera Rubin 扩展 Grok 基础设施。39
  • Chubby 与小互写到,苹果发布配备 M6、M5 Pro、M5 Max 与 M5 Ultra 的新一代 Mac mini 和 Mac Studio;M5 Ultra 统一内存最高 512GB,面向本地大模型。4041
  • Chubby 写道,台湾检方起诉 9 人,指控将宣称留在台湾的 130 台 B300 服务器中的 74 台转运给中国客户,涉案者包括一名英伟达台湾员工与两名前 Super Micro 台湾员工。42
  • 量子位文章写到,原力灵机 DM0.5 登顶 RoboDojo,综合得分 24.90,平均成功率 19.34%,权重开源。43
  • 机器之心文章介绍 V-RAE:以冻结视觉基础模型为编码器,用于视频重建、生成与未来预测。44
  • 机器之心文章介绍 Anthropic 亲选的 6 个 Claude Code 用户项目。45
  • 独立 AI 评测机构 Artificial Analysis 写道,英伟达宣布 Groq 3 LPX 交互式 AI 推理机架已大规模量产,将于年内投入运行;在 Gemma 4 31B、10 万上下文上测到约 3431 tokens/s 的输出速度。46
  • 机器之心账号写道,小米展示桌面原型 AI Cube,打包自研三款芯片,150 瓦功耗下可跑 120B 大模型,约 30 tokens/s。47

References

  1. 1
  2. 2
  3. 3
  4. 4
  5. 5
  6. 6
  7. 7
  8. 8
  9. 9
  10. 10
  11. 11
  12. 12
  13. 13
  14. 14
  15. 15
  16. 16
  17. 17
  18. 18
  19. 19
  20. 20
  21. 21
  22. 22
  23. 23
  24. 24
  25. 25
  26. 26
  27. 27
  28. 28
  29. 29
  30. 30
  31. 31
  32. 32
  33. 33
  34. 34
  35. 35
  36. 36
  37. 37
  38. 38
  39. 39
  40. 40
  41. 41
  42. 42
  43. 43
  44. 44
  45. 45
  46. 46
  47. 47

This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.

Related content