
AI 代理进入协议、沙箱与供应链:7 月 28 日开发者情报
7 月 28 日的更新显示,AI 编程正在从模型选择扩展到可控沙箱、无状态协议、供应链防护,以及由人负责验收和维护的科学计算工作流。
先看结论
7 月 28 日的几条更新,把 AI 编程从模型入口推向了运行环境和工程基础设施:Grok 4.5 进入 GitHub Copilot 的多个开发入口,Google 给托管代理加入工具调用前后的 hooks,MCP 正式切换到无状态协议,OpenAI 的科学计算案例则显示,写出代码之后的验证和长期维护才是新瓶颈。GitHub 同日还为公开仓库增加了恶意 Actions 工作流审批,并扩大 Dependabot 的恶意包告警覆盖。
对工程团队来说,变化可以归结为一条更具体的判断:代理能调用什么模型,已经不再是唯一问题;它在哪个沙箱里执行、怎样被拦截、如何跨实例扩展,以及结果由谁验收,正在变成产品差异。
| 条目 | 发生了什么 | 读者应关注的边界 |
|---|---|---|
| GitHub Copilot | Grok 4.5 分阶段进入 VS Code、Visual Studio、Copilot CLI、cloud agent、Copilot App、JetBrains、Xcode 和 Eclipse;上下文窗口最高 50 万 token。1 | Business 和 Enterprise 管理员需要单独开启策略,默认关闭;可用性仍在逐步放量。 |
| Gemini API Managed Agents | Gemini 3.6 Flash 成为默认模型,新增环境 hooks、预算上限、定时触发器和免费层。2 | 代理仍在隔离云沙箱中运行;达到 token 上限会暂停,需用新的预算继续。 |
| MCP 2026-07-28 | 协议核心改为无状态请求/响应,加入多轮往返请求、基于 HTTP 头路由、可缓存列表结果和授权加固。3 | 依赖会话标识、旧 HTTP+SSE 传输或旧初始化流程的实现,需要按迁移说明调整。 |
| 科学计算 | OpenAI 汇总 8 个 agent 辅助科学计算项目,覆盖维护、优化、语言迁移和 GPU 原生重写。4 | 案例来自参与团队,报告本身是探索性回顾;科学正确性仍由人和可测验收标准判断。 |
| 软件供应链 | GitHub Actions 会在公开仓库中拦截部分疑似恶意工作流,Dependabot 也接入 OpenSSF 恶意包数据。56 | Actions 的自动审批保护目前只覆盖 github.com 上的公开仓库,不覆盖 GitHub Enterprise Server。 |
1. Grok 4.5 进入 Copilot,模型选择继续向工作流下沉
GitHub 宣布 xAI 的 Grok 4.5 开始进入 Copilot。官方给出的规格包括最高 50 万 token 上下文、文本和图像输入,以及低、中、高三档推理强度;支持入口覆盖 VS Code、Visual Studio、Copilot CLI、cloud agent、Copilot App、JetBrains、Xcode 和 Eclipse。可用对象包括 Copilot Pro、Pro+、Max、Business 和 Enterprise,但分阶段 rollout,未必立刻出现在每个账号里。1
GitHub 的内部测试称,Grok 4.5 在 VS Code 和 Copilot CLI 的终端编码任务中表现较强,尤其适合并行调工具、直接采取行动的多步骤任务。这是 GitHub 的内部测试口径,不是独立 benchmark。模型采用按使用量计费,Business 和 Enterprise 管理员还要在 Copilot 设置中开启对应策略,默认状态是关闭。1
对团队的实际影响,是模型选择和任务调度继续被放进同一套开发工作流。评估时应把四件事分开记录:模型是否可用、谁能开通、哪些入口支持,以及一次任务的实际消耗;只看模型名称,无法判断它是否适合自己的仓库和预算。
2. Google 把 hooks 放进托管代理的工具调用链
Google 的 Managed Agents in Gemini API 将
antigravity-preview-05-2026 的默认模型切换为 Gemini 3.6 Flash,同时允许开发者显式选择 Gemini 3.5 Flash 或更低成本的 3.5 Flash-Lite。托管代理会在隔离云沙箱里协调推理、代码执行、安装包、文件管理和网页检索。2变化更大的部分是 environment hooks。开发者可以在每次工具调用前后运行自己的脚本,例如在
code_execution 或 write_file 之前阻断操作,在调用结束后执行 lint 或审计。hooks 支持正则匹配工具名,也支持 HTTP 处理器。这样一来,代理的安全门不必只靠提示词,可以直接放在工具执行边界上。2Google 同时加入
max_total_tokens 预算上限、定时触发器和免费层。代理达到上限后会以 incomplete 状态暂停并保留环境,开发者可以用新的预算和上一次交互 ID 继续。对需要长时间运行的编码任务,这比单纯设置请求超时更有用,但它仍然要求团队管理沙箱生命周期、网络规则和继续执行的权限。3. MCP 正式转向无状态,代理基础设施开始按普通 HTTP 负载设计
MCP 2026-07-28 规范已正式发布。最重要的改动是去掉协议层的初始化握手和会话标识,让每个请求自带协议版本、客户端身份和能力信息。这样,请求可以落到负载均衡器后的任意实例,不必依赖共享的会话存储。3
配套变化包括:用
Mcp-Method 和 Mcp-Name HTTP 头帮助网关路由、限流和计量;用 Multi Round-Trip Requests 处理工具调用中途的确认或补充参数;给工具、提示词和资源列表增加缓存提示;把 Tasks 移到扩展中,并强化 OAuth 授权服务器签发者校验。TypeScript、Python、Go 和 C# 四个 Tier 1 SDK 已跟随新规范更新,Rust SDK 处于 beta 支持状态。3这次升级对开发者不是零成本迁移。依赖
Mcp-Session-Id、旧初始化流程或 HTTP+SSE 传输的实现,需要按照新规范调整;Roots、Sampling 和 Logging 仍能工作,但已被弃用,官方给出至少 12 个月的过渡窗口。可以从 MCP 2026-07-28 规范 和 完整变更记录 开始核对兼容性。4. 科学计算案例把瓶颈从实现推向验证和维护
OpenAI 发布了一份探索性现场报告,汇总 8 个由代理辅助的科学计算项目,其中 5 个只使用 Codex,3 个同时使用 Codex 和 Claude Code。项目主要来自生命科学,范围从日常维护、定向优化,到大规模语言迁移和 GPU 原生重写。参与团队报告说,代理降低了工程实现成本,让小团队可以处理原本需要更多工程时间或专门经验的工作。4
报告里的角色变化很清楚:研究人员把更多精力放在定义目标、设计正确性标准、组织任务和验收结果上,而不是亲自完成每一项实现。一个具体案例是,GPT-5.5 帮助把用于基因组变异文件读写的 Python 库
cyvcf2 从旧的构建与打包系统迁移到更统一的流程。4但这份报告也直接写出了限制。代理对范围明确的请求处理得更好,却不能可靠判断结果是否符合科学要求,甚至会在存在明显错误时保持自信。有效的验收方式包括与外部参考做精确输出比对、和旧工具保持结果一致、检查统计性质,或用预先知道答案的模拟数据测试。代码生成提速,并没有取消专家判断;它把专家的时间推向验证、边界条件和项目归属。
长期维护同样容易被低估。报告中的一些改动回到了原项目,也有项目因为原维护者已经放弃而转交新的社区;如果没有明确负责人和维护计划,代理生成的重写可能只是把旧的维护缺口换了一个更快的入口。
5. GitHub 同时收紧 Actions 和依赖包的供应链入口
GitHub 针对近期利用被盗凭据推送恶意 Actions 工作流的攻击,在 github.com 的公开仓库里自动拦截部分疑似恶意的 workflow run。被拦截的任务在启动前需要拥有写权限的仓库协作者通过认证后的网页会话审批,批准后才会继续执行;仓库不需要额外配置。该保护目前不适用于 GitHub Enterprise Server。5
另一项更新把 OpenSSF malicious-packages 仓库的恶意软件通告自动纳入 GitHub Advisory Database,覆盖范围从 npm 扩展到 PyPI 等更多生态。开启 Dependabot malware alerting 后,依赖命中这类通告时会收到告警;管理员可以在仓库或组织的 Code security 设置里开启,也可以用
type:malware 筛选数据库。6这两项改动都没有把人工审查从流程里删掉。前者把高风险工作流停在执行前,后者扩大已知恶意包的识别面;它们解决的是「已知或疑似风险如何先挡住」,不等于每个第三方 Action、依赖包或代理生成的脚本都已经安全。
给工程团队的三个检查点
- 重新画模型和入口的对应表。 为每个模型记录支持的客户端、账号层级、管理员策略、计费方式和实际 rollout 状态,不要把「已宣布」当成「已可用」。
- 把工具调用前后的拦截点纳入代理设计。 能在执行前拒绝什么、执行后记录什么、预算用尽后怎样恢复,都应该和 prompt、模型选择一起进入测试。
- 为代理产物指定验收人与维护人。 代码能否通过测试只是第一道门;科学计算、生产依赖和长周期业务还需要领域正确性、回归基线、责任归属和后续维护计划。
7 月 28 日的更新共同指向一个工程事实:AI 代理的竞争已经延伸到模型之外。协议是否易于扩展,执行环境是否可控,供应链是否能在动作发生前拦截,决定了它能不能从一次演示变成团队愿意长期依赖的工具。
참고 출처
- 1Grok 4.5 is now available in GitHub Copilot
github.blog
- 2What’s new in Managed Agents in Gemini API
blog.google
- 3The 2026-07-28 Specification
blog.modelcontextprotocol.io
- 4
- 5
- 6

AI 编程与应用进展情报
持续跟踪 AI 应用与 AI 编程方向的新闻、产品进展、公司动态和落地案例,整理成便于快速阅读的情报简报。
이 콘텐츠는 채널이 자동으로 생성했습니다. 한 문장이면 Neodrop이 당신을 위해 계속 만들어 냅니다.
관련 콘텐츠
- 로그인하면 댓글을 작성할 수 있습니다.