AI创业播客日报|2026年9月12日早报

AI创业播客日报|2026年9月12日早报

聚合昨晚到今早 AI 应用、Agent、模型、开发者工具和 AI 行业讨论的已核验动态,男女主播对谈播报。

0:00 / 9:31
本期在 X 上读取了 404 个关注账号的 5459 条推文,其中 387 条落在时间窗内;公众号方面,3 个账号的 2 篇文章在本期窗口内。

ChatGPT Sites:多人编辑、私密分享和自定义域名

ChatGPT 官方账号发布 Sites 更新。账号简介写着“ChatGPT is for the people”。这项产品此前用于创建和托管可交互的网页应用,官方称用户已经创建超过 500 万个站点。1
更新加入多人共同编辑,用户可以邀请队友编辑、保存和发布同一个站点,也可以只邀请指定的人访问私密站点。1
官方还写到,从提示词到部署的时间缩短了一半;站点编辑者可以让 ChatGPT 检查站点数据库,站点也支持绑定自定义域名。1

Devin Fusion:多模型编码 Agent 的一组测试

Artificial Analysis 的 X 简介写着“Independent analysis of AI”。它发布了 Devin Fusion 的编码 Agent 测试结果。2
测试配置是 Devin Fusion CLI、Claude Fable 5.1 的 xhigh 模式和 SWE-2 的 medium 模式。这个配置在 Artificial Analysis Coding Agent Index 1.5 上得分 61.7,Claude Code 里的 Claude Fable 5.1 max 配置得分 62.2。2
帖子给出的单任务成本是 7.9 美元和 12.4 美元,任务用时是 35.8 分钟和 34.8 分钟。帖子还列出 DeepSWE、SWE-Atlas QnA 和 Terminal-Bench 4.0 三项评测的分数。2

GPT Image 2.5 Flare 与 Sunburst

OpenAI 开发者文档列出两个新的图像模型,模型 ID 分别是 gpt-image-2.5-flaregpt-image-2.5-sunburst。Flare 以速度为优先,Sunburst 以质量为优先。两个模型都支持图像生成、图像编辑和透明背景。3
Artificial Analysis 的账号发布榜单结果,称 Flare 位列文生图第一,Sunburst 位列图像编辑第一。4

Astra Computer Use 的浏览器实现

Browserbase 增长工程师 Kyle Jeong 的 X 简介写着,他在 Browserbase 做增长工程,也在 UCLA 学习数学和计算机。他发布消息称,团队对 Astra 的 Computer Use 做了逆向工程,并把操作速度提高到原来的两倍。5
做 AI Agent 设计和媒体产品的 shao__meng 转发了这条消息,并写到实现中使用了代码模式、无障碍树、Playwright、Stagehand 和批量动作预测,同时继续使用 Astra 模型。6

25 位菲尔兹奖得主的联合声明

机器之心的 X 简介写着,它是中国的 AI 与机器学习媒体和信息提供者。账号转发了《A Severe Misalignment of AI in Mathematics》这份声明。7
Terry Tao 的博客页面确认,声明由 25 位菲尔兹奖得主联合署名。声明写道,AI 公司把解决数学问题当作 benchmark,可能忽略理解、方法、正式写作、引用和数学知识传承。8
声明页面邀请更多人签名。页面显示的联合声明时间是 2026 年 9 月 11 日。8

其他快讯

OpenClaw 发布 v2026.9.4,加入插件和技能发现、把旧聊天转成技能、GPT Image 2.5 画布、更多云端控制和终端内直接回答。9
Ant Group 发布 Ling-3.0-flash-VL 开放权重模型,模型总参数 1240 亿、每个 Token 激活 55 亿参数,支持 256K 上下文以及图像和视频输入。10
Sakana AI 的 Fugu Max 上线 OpenRouter,支持多智能体路由、图像和 PDF 输入、网页搜索、函数调用和结构化输出,价格是输入每百万 Token 2 美元、输出每百万 Token 6 美元。11
Yutori 发布 Navigator n2 的演示,模型通过 Yutori 的 MCP 在本地驱动 Mac,并在 iMovie 里剪辑活动回顾视频。12
Box Mount 进入私有预览,可以把 Box 内容挂载进 OpenAI Agents API 的托管沙箱,让 Agent 用文件路径读写内容,并自动同步版本。13
Product Hunt 与 OpenAI Developer 合作举办 GPT-6 Astra Challenge,9 月 18 日发布的前五个项目各获得 1 万美元 OpenAI API credits,以及最多两名团队成员一年的 ChatGPT Pro。14
PyTorch 发布 2.14 更新预告,列出 Inductor、分布式、动态形状、Apple Silicon 和加速器平台支持等变化,并称自 2.13 以来有 487 位贡献者提交了 2995 个 commits。15
Raycast AI 更新后可以连接 Claude 和 ChatGPT 的订阅账号使用。16
Claude Code 桌面版增加单次会话保持电脑唤醒的开关,等待回合之间也保持唤醒。17
OpenBMB 发布一组关于模型从教材中学习的结果,帖子称 Transfer Par@8 达到 100.0,最强的自我进化方法大约把 Application Par@8 提高一倍。18
TailSFT 方法被发布用于改进强化学习前的训练覆盖,并称可以改善后续强化学习表现。19
清华大学李秀教授团队提出 EMERGE-Policy,把多智能体协作用于具身智能系统。20
一个公开项目发布了训练“flybrain”的代码,项目说明可以让这套系统在不同环境里继续训练。21
约翰斯·霍普金斯大学语言与语音处理团队发布多模态基础模型情绪敏感神经元研究,帖子称研究覆盖 Gemma、MiniCPM 和 Qwen 模型。22
UCL NLP 团队发布语音识别研究,帖子称四个数据集和四个 ASR 模型中,88% 的组合出现词错误率改善,平均相对降低 22%。23
SemiAnalysis 发布模块化数据中心的讨论,内容提到工厂化建设减少现场劳动,但会增加厂房、生产线和工厂工人的需求。24
a16z 发布风险投资行业数据,帖子称排名前 1% 的投资人占行业净利润的 57%,前 5% 占 90%。25

补充快讯

OpenAI 欢迎 Git AI 团队的 Aidan 和 Sasha 加入,团队继续维护 Git AI 开源,并开发帮助开发者了解编码 Agent 如何参与代码库的工具。26
Warp 内置支持 Grok Build CLI,加入长提示词、多光标输入、远程控制、文件浏览器和代码审查面板。27
Tailscale 的模型路由器 Aperture 基于 Vercel AI Gateway,提供数百个模型、零数据留存、无加价的 BYOK 和每次响应的成本与用量数据。28
Hugging Face 完成了六场、持续六个月的 Training Agents 系列,内容从 Agent 评测到真实环境训练,代码公开,系列观看次数超过三十万。29
EvoHarnessBench 研究工具、技能和专家 Agent 持续加入 Agent 系统时的评测,并报告现有自演化方法不能稳定适应新能力同时保留旧任务能力。30
Fabraix 创始人发文称,公司加入 YC 三个月后,年化收入从零收入增长到 104 万美元,并推出全天运行的自主 AI 红队 Agent。31
a16z 转述的数据称,美国公司的 AI 支出中位数是每位员工每月 12 美元,样本中排名前 1% 的公司是每位员工每月 7000 美元。32
Sakana AI CEO 转发介绍了 Royal Society 的《World Models in Natural and Artificial Intelligence》专题合集,内容汇集 AI、生物学和哲学领域作者对世界模型的讨论。33
Every 建议为具体工作建立个人基准测试,并称一项日常工作测试中 GPT-5.6 Luna 的表现超过 Fable 和 GPT-5.6 Sol。34
Coinbase Developer Platform 发布的上周 Agentic Trading 数据中,Perplexity 占 26.8%,Claude 占 19.3%,Grok 占 15.3%,其余渠道合计 38.6%。35
SkySynth 发布用于协同生成代码、形式化证明和测试的系统,并公布 KV 存储、模型路由器和推理引擎的对比结果。36
一个开源代码审查 Agent 使用长期经验记忆保存团队对评论的接受、拒绝和修改,并用这些反馈生成下一轮审查规则。37
Hugging Face 的一个实验用 Agent 标注样本训练文档用途分类器,处理 191724 份 FinePDFs-Edu 文档的推理成本约 0.70 美元,训练实验成本约 2.90 美元。38
MIRAGE 项目发布代码、论文、测试和 Agent Skill,用于诊断图像反复编辑后的格纹、鳞片和重复纹理,并公布修复实验。39
机器之心介绍的 Facet-0 在五项真实机器人装配任务上的平均成功率为 82%,对比的 π0.5 和 GR00T N1.7 分别为 10% 和 4%。40

Fuentes de referencia

  1. 1
  2. 2
  3. 3
  4. 4
  5. 5
  6. 6
  7. 7
  8. 8
  9. 9
  10. 10
  11. 11
  12. 12
  13. 13
  14. 14
  15. 15
  16. 16
  17. 17
  18. 18
  19. 19
  20. 20
  21. 21
  22. 22
  23. 23
  24. 24
  25. 25
  26. 26
  27. 27
  28. 28
  29. 29
  30. 30
  31. 31
  32. 32
  33. 33
  34. 34
  35. 35
  36. 36
  37. 37
  38. 38
  39. 39
  40. 40

Este contenido lo produjo un canal automáticamente. Con una sola frase, Neodrop puede seguir produciendo para ti.

Contenido relacionado