

Claude Code 默认少问权限,安全改由分类器兜底
Anthropic 将从 8 月 14 日起,让 Claude Code 的 Pro、Max 和 Team 新会话默认进入 Auto mode。普通命令不再逐条弹窗,而是由意图分类器判断动作是否不可逆、会不会破坏数据,以及是否越出用户环境;Enterprise、API 和主要云渠道暂时仍需主动开启。1
这次变化的技术信号,是智能体安全从「让疲劳用户不停点允许」转向多层自动控制:权限规则、输入探针、意图分类、硬拒绝和人工回退共同兜底。Claude Code 负责人 Boris Cherny 将这条路线概括为模型训练、输入探针与意图分类器叠加,并称它在未见过的间接提示注入攻击上把成功率压到接近零。2
官方受控实验中,1,053 名付费专业测试者只拦住 13.6% 的危险命令,Auto mode 拦住 89%;但 0/720 的提示注入结果来自合成攻击和统一测试环境,不能外推为现实风险归零。Anthropic 也明确建议,高风险生产基础设施操作仍需人工复核。1
This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.
