AI 工具创业者速查:9 个本周新发布(6.30–7.6)

AI 工具创业者速查:9 个本周新发布(6.30–7.6)

本期梳理 9 个近期发布的 AI 工具与功能,覆盖模型/API、Agent 开发框架、团队协作、AI 计费基础设施和实时语音架构,帮助创业团队判断哪些值得本周试用,哪些适合先观察。

7 月第一周的新发布里,最值得创业团队注意的不是「又多了一个聊天框」,而是三条更实用的变化:模型选择开始进入成本分层,Agent 开发框架开始补持久会话和确定性流程,协作工具开始把外部 Agent 纳入团队工作台。

速查表:9 个本周值得看一眼的新发布

名称核心功能定价档位适合场景
Claude Sonnet 5Anthropic 发布面向编码、工具调用和长任务执行的新 Sonnet 模型;官方称它接近 Opus 4.8 的 Agent 能力,但价格更低,API 首发价为每百万输入 token 2 美元、输出 token 10 美元,8 月 31 日后回到 3 / 15 美元。1Claude 免费/Pro/Max/Team/Enterprise 均可用;API 按 token 计费。<MarkdownCitation index="2" title="Plans & PricingClaude by Anthropic" url="https://www.anthropic.com/pricing" />
Google Genkit AgentsGoogle 在 Genkit 里推出 Agents API,把多轮会话、工具循环、流式输出、持久状态和前端协议打包成同一个 chat() 接口;TypeScript 和 Go 版本处于 preview。3Genkit 是开源框架;实际成本取决于所接模型、Firestore/云资源和部署环境。3想把客服助理、销售 Copilot、内部知识问答做进自有 Web/App,而不是只靠外部聊天产品的小团队。
Google ADK 2.0 WorkflowsADK 2.0 增加工作流运行时,把退款、工单、审批这类「必须按顺序走」的业务流程从模型自由调度改成确定性图结构;Google 文中示例显示 token 使用量和延迟都能下降。4开发框架本身未单独标价;成本主要来自模型调用和运行环境。4已经踩过 Agent 跳步骤、循环调用、错误吞掉等坑的团队,尤其适合把标准作业流程半自动化。
GitHub Copilot Kimi K2.7 CodeGitHub Copilot 首次把开源权重模型 Kimi K2.7 Code 做成可选模型,先向 Pro、Pro+、Max 计划逐步开放;Business/Enterprise 默认关闭,需要管理员启用。5在 Copilot 用量计费下按模型 token 价计费;GitHub 文档列出 Kimi K2.7 Code 每百万输入 token 0.95 美元、输出 token 4 美元。6工程团队想在 Copilot 内部用更低成本模型处理常规改代码、解释代码、轻量重构。
Notion 3.6 External AgentsNotion 3.6 允许把 Claude、Cursor 等外部 Agent 放到团队共享看板里分派任务,同时 AI Meeting Notes 增加说话人标签,Agent 可读写 PPTX/XLSX/DOCX 等文件。7Notion 定价页显示 Business 20 美元/席/月起包含 Notion Agent;Custom Agents 免费试用后按 1,000 Notion credits 10 美元计。8已经把项目、会议纪要、销售资料放在 Notion 的团队,可以测试把外部编码/研究 Agent 纳入同一个项目流。
Trigger.dev v4.5 AI AgentsTrigger.dev v4.5 把 chat.agent、Sessions 和 AI Prompts 标为稳定版,让 Vercel AI SDK 聊天补上耐久任务、断线重连、人工审批、提示词版本和成本追踪。9免费版起步;Hobby 10 美元/月,Pro 50 美元/月,另按运行和计算资源计费;也可自托管。<MarkdownCitation index="10" title="Cloud PricingTrigger.dev" url="https://trigger.dev/pricing" />
Cloudflare Monetization GatewayCloudflare 发布 Monetization Gateway 早期访问名单,计划让网站、数据集、API 或 MCP 工具通过 x402 按请求收费,并在 Cloudflare 边缘完成支付校验。11等候名单开放;正式产品定价未公开,文章示例强调可由资源所有者自定义按请求或变量计价。11做数据/API/MCP 工具的团队可以提前关注,尤其是想让 Agent 直接付费调用资源,而不是先走账号注册和人工销售。
AWS CloudFormation Express ModeAWS 推出 CloudFormation Express mode,部署在资源配置应用后即可返回,不等完整稳定检查;官方示例称部分迭代场景可快到 10 秒级,目标之一是服务 AI 辅助基础设施开发。12所有 AWS 商业区域可用,无额外费用;仍按底层 AWS 资源计费。12让 Kiro、Claude Code、Cursor 等 AI 工具频繁改 IaC 的团队,可缩短试错反馈;生产流量切换前仍要保留稳定性检查。
Hugging Face × Cerebras real-time voice AIHugging Face 和 Cerebras 展示一个开放的实时语音到语音栈:Parakeet 做语音识别,Gemma 4 VLM 在 Cerebras 上推理,Qwen3TTS 输出语音,并提供 Demo 和代码仓库。13演示和仓库开放;实际成本取决于推理提供方、部署方式和语音链路组件。13做语音客服、机器人、陪练、实时访谈助手的团队,可以拆开参考它的低延迟架构,而不是直接买一个封闭语音 Agent。

本周先试什么

如果你的产品里已经有 Agent 功能,先看 Trigger.dev v4.5 和 Google ADK 2.0。 这两个发布解决的是上线后才暴露的问题:长任务不能因为用户刷新就丢失,标准流程不能每次都交给模型临场判断。它们不一定让 demo 更炫,但会让 Agent 更像一个可维护的软件模块。
如果你的团队正在控 AI 成本,先看 Claude Sonnet 5 和 Copilot 的 Kimi K2.7 Code。 Sonnet 5 的关键点是把更强的工具调用能力放进较低价位模型;Kimi K2.7 Code 的关键点是 Copilot 开始把开源权重模型作为可选项。两者都适合做同一批任务的 A/B 测试:成功率、平均 token、人工返工时间一起看。
如果你在卖 API、数据或 MCP 工具,Cloudflare Monetization Gateway 值得排进观察清单。 它现在还不是一个可以马上大规模部署的成熟计费方案,但方向很清楚:当 Agent 变成调用方,传统「注册账号-发 API key-月底结算」会拖慢低客单价调用。早做定价实验的团队会更快知道自己的资源到底按请求、按结果还是按流量收费。

什么时候先观望

Notion 3.6 的 External Agents 很适合协作密集团队,但如果你的知识库权限、客户数据和代码仓库权限还没分清,先别急着把所有 Agent 都接进共享看板。先选一个低风险流程,比如会议纪要转任务、销售资料整理或公开文档更新。
Google Genkit Agents 仍是 preview,适合新项目和内部工具试水;核心客户流程暂时不要押在还可能有破坏性变更的接口上。ADK 2.0 则更适合流程清晰的场景,别把它误用成「让模型自己想办法」的万能 Agent 框架。
AWS CloudFormation Express Mode 能明显缩短基础设施迭代反馈,但它改变的是部署完成返回的时机,不代表资源已经可以承载生产流量。用于 AI 辅助 IaC 很合适;用于生产发布时,需要额外监控和回滚策略。

本周趋势判断

这周的共同信号是:AI 工具正在从「单点能力」转向「工作流边界」。模型发布开始强调每百万 token 的性价比,开发框架开始强调持久会话、可恢复执行和确定性编排,协作工具开始处理 Agent 的权限和审计。
对创业团队来说,下一步评估 AI 工具时不要只问「模型强不强」。更实用的问题是:它能不能接进现有流程、失败时能不能恢复、成本能不能被团队看见、权限能不能收住。能回答这四个问题的工具,才更可能从试用变成日常工作流。

相似内容

  • 登录后可发表评论。
More from this channel