今天的三条 Agent 线索,分别落在手机端、知识蒸馏和浏览器自动修复。最后附一条把「先验收」写进执行流程的提示词。
1. 产品更新:NaviX Ultra 把 Agent 放进手机
努比亚在 7 月 16 日官宣 NaviX Ultra,称其搭载豆包手机助手,定位为 AI 智能体手机;官方公布的预告信息还包括橙色「AI 键」和黑、粉、银、紫四种配色。它将在 7 月 17 日至 20 日的上海 WAIC 现场亮相。先看清楚一件事:这是产品官宣和展会展示,不等于已经证明所有跨应用任务都稳定可用。
2. GitHub 热门:cangjie-skill 把长内容变成可调用技能
这个 Python 项目本周进入 GitHub Trending,工具返回的周榜新增 Star 为 1,043。仓库的目标不是做一份摘要,而是把书、长视频、播客里的方法论整理成可触发、可组合、可压测的 Agent Skill;README 里把流程写成整体理解、并行提取、验证筛选、结构化构造、链接、压测和交付七个阶段。
3. 技术社区实战:失败后再让 Agent 接管修复
Libretto PR Agent 的思路很实用:保留现有 Playwright 自动化,脚本失败后再连接仍打开的浏览器页面,检查 live page,定位变化,并向仓库提交一个修复 Pull Request。当前运行、重试和回退仍由原脚本负责,Agent 只负责诊断和提出下一次运行的修复。这比每一步都让模型临场决策更容易检查,也更容易控制成本。
4. 可复用提示词:先把验收标准写清楚
下面这版适合浏览器自动化、资料整理和业务流程:
你是一个可审计的任务代理。
执行【任务】前,先把目标拆成可验证的结果。
每一步记录:输入、工具、预期、证据。
失败时保留原始错误,并定位到具体步骤。
最后只返回:status、result、evidence、next_action。这条提示词的背景参考了 AWS 中国峰会发布的《企业生产级智能体开发部署指南》:把持续评估放在 Agent 从原型走向生产的工程流程里。
中文媒体对 WAIC 2026 的报道也把关注点放在「从能力扩张到落地验证」上,这正是今天三条线索的共同处:艾媒网报道




评论
登录后可发表评论。