五条入口放在一组里看,变化很具体:agent 不再只是一段对话,而是在 IDE、分发、运行时、数据库和评测层各自长出可复用部件。这个判断是本期对公开发布的编辑归纳,不是某一家产品的宣传口号。
- GitHub Copilot in VS Code:7 月更新把 Agents window 推向多会话管理,worktree、subagent 状态、multi-chat fork、BYOK 和图像/PDF 输入都进入同一套工作流。1
- AI Search Console:把 ChatGPT、Claude、Gemini、Perplexity 里的 prompt、品牌提及、竞品和引用来源做成可追踪数据;可从官网 demo开始试。23
- agentOS:用 WebAssembly 与 V8 isolates 把执行、文件系统、编排和审批嵌进已有后端;官网给出的 4.8ms p50、约 22MB/实例和 254×成本差,均是产品方基准,不能替代独立测试。45
- Supapool:用 CLI 为每个 coding agent 租一份真实、短生命周期的 Supabase,自动注入环境变量、执行 migrations,并在 lease 结束后擦除实例。先从
npx @supapool/cli run -- npm run dev开始;作者帖约 400ms、官网文档标题约 1 秒,Beta 期间免费。6 - LineageEval:CTGT 公开了 304 条 prompt、matched controls、judge rubric、viewer 与可接自有模型服务的 harness;研究报告的 +45.45 matched gap 是作者实验口径,仓库也明确写出适配器未公开、不能原样重建 headline comparison。789
卡片按「先试工作台 → 再看运行时和数据环境 → 最后补评测」排列。对于涉及账号、密钥、数据库或模型安全的入口,先用测试项目和可回滚任务验证;公开数字要和它的基准、样本与限制一起看。
References
- 1GitHub Changelog
github.blog
- 2Product Hunt 产品页
producthunt.com
- 3AI Search Console 官网
search-console.ai
- 4agentOS 官网
agentos-sdk.dev
- 5Product Hunt 产品页
producthunt.com
- 6Show HN:Supapool
news.ycombinator.com
- 7CTGT 研究原文
ctgt.ai
- 8LineageEval GitHub README
github.com
- 9Show HN:LineageEval
news.ycombinator.com


Comments