← 返回每日热点
BiFish original · 2026-08-08

Claude Code 默认自动模式:AI 编程助手安全大战,谁在裸泳?

上周我刚把 Claude Code 的权限设置从「每次都问我」改成了自动模式,结果第二天就看到 Anthropic 的公告——嘿,这帮人动作真快,直接把默认值给换了。 你上周是不是也看到群里在传,说

上周我刚把 Claude Code 的权限设置从「每次都问我」改成了自动模式,结果第二天就看到 Anthropic 的公告——嘿,这帮人动作真快,直接把默认值给换了。

你上周是不是也看到群里在传,说 AI 编程工具越来越「胆大包天」,敢自己执行命令了?别慌,我帮你捋一捋这件事的来龙去脉,以及它对你到底意味着什么。

自动模式到底是个啥

Anthropic 这次调整说白了,就是把 Claude Code 里的权限审核从「人工审批」换成了一个 AI 分类器来实时判断。这个分类器会自动放行安全操作,但会拦截那些破坏性、不可逆或者越权的命令。

听起来挺玄乎?其实就是以前你每敲一个命令,Claude 都要弹窗问你「哥,这个 rm -rf 你确定要跑?」,现在它自己判断,觉得安全就放行,觉得危险就拦住。

Anthropic 公布的测试数据挺有意思。他们找了 1,053 名付费测试者,在传统人工审批模式下,用户只识别出了 13.6% 的危险命令。这说明什么?说明大部分人点「允许」的时候根本没过脑子,跟同意用户协议一样,直接拉到底点同意。

而自动模式能识别 89% 的危险命令,直接把安全识别率从一成多拉到接近九成。

我的判断:这个数据很重要,但别被 89% 这个数字骗了——它意味着还有 11% 的危险命令能溜过去。在生产环境里,这 11% 可能就是删库跑路的距离。

横向对比:OpenAI 的 Codex 怎么样

既然 Anthropic 主动把 Claude Code 和 OpenAI 的 Codex 做了对比,那我们就不客气了。

Trajectory Labs 做了一个很硬核的测试:72 个场景,每个场景跑 10 次,总共 720 次提示词注入攻击。结果如下——

1

Claude Fable 5、Opus 5、Sonnet 5 在自动模式下全部拦截,0 次成功

2

GPT-5.6 Sol 在 Codex 的 Auto-review 模式下,攻击成功率 5.83%

3

同一个模型在 Full Access 模式下,攻击成功率飙升到 19.03%

这组数据说明两件事:第一,Claude 的自动模式在防注入攻击上确实做得比 Codex 好;第二,OpenAI 的 Full Access 模式基本等于裸奔,五次攻击里能成功一次。

但这里有个坑我必须提醒你。Anthropic 自己也承认,「未加额外防护的 bypassPermissions 模式平均攻击成功率为 0.09%」,而且 OpenAI 上周刚发布了新的 Auto-review 版本,测试结果可能会变。安全这个东西是动态的,今天的冠军明天可能就被翻盘。

去年这个时候,大家还在讨论 AI 编程工具该不该有执行权限,今年已经卷到「默认帮你管权限」了。行业风向变得真快。

这件事对行业意味着什么

Anthropic 这步棋下得挺精明。

你想啊,AI 编程助手这个赛道,技术差距其实在缩小,Claude 和 GPT 在代码生成能力上已经很难拉开明显差距。那竞争的焦点往哪转?安全性和信任感

Anthropic 一直以来都给自己贴「安全」的标签,这次把自动模式设为默认,就是在把这个标签坐实。他们赌的是:用户会为了安全感付费,企业客户更是如此。

对 OpenAI 来说,这是一记闷拳。Codex 的 Full Access 模式攻击成功率接近 20%,这个数据如果被企业客户的 CTO 看到,采购决策可能会动摇。我估计 OpenAI 接下来会加速迭代 Auto-review 模式,甚至可能直接把 Claude 的分类器思路抄过去。

对 Google 和微软来说,压力也不小。Anthropic 的公告里提到,Enterprise、API、AWS、Google Cloud 和 Microsoft Foundry 平台目前还是可选模式,但计划在未来一个月内全面推行自动模式默认。这意味着 整个生态的安全标准都在被拉高,你不跟就显得落后。

我的判断:安全会成为 AI 编程工具的下一个主战场,就像当年浏览器大战里的隐私保护一样。谁先建立「用我的工具不会出事」的用户心智,谁就赢了半条命。

跟你有什么关系

如果你是个人开发者,用 Claude Code 写代码、跑脚本,这次调整其实影响不大。自动模式帮你挡掉一些手滑的危险操作,算是个免费的保险。但你也别完全依赖它,该备份的还是要备份,该 review 的代码还是要 review

如果你是团队的技术负责人,这次调整值得认真看一下。Anthropic 说 Team 订阅用户的默认权限会自动切换,这意味着你的团队成员下周起就可能在新模式下工作。提前跟团队沟通一下,看看自动模式的行为是否符合你们的安全规范。

举个实际场景:假设你的同事让 Claude Code 帮忙清理一个测试数据库,在旧模式下,Claude 可能会弹窗确认「你要删除 test_db 吗?」,同事一看是测试库就点了允许。但在自动模式下,AI 分类器可能会判断这是破坏性操作,直接拦截。这可能让你同事骂一句「这破工具怎么啥都不让干」,但也可能避免一次误删生产数据库的灾难。

如果你正在选型 AI 编程工具,我建议你这周花半小时分别试一下 Claude Code 和 Codex 的默认模式,重点测试一下它们对危险命令的拦截能力。别光看代码生成快不快,安全防线才是一票否决项。

我之前踩过一个坑:用某个 AI 工具跑了一段自动生成的 shell 脚本,结果它把我的 .ssh 目录权限改了,害我重新配了半天 SSH key。从那以后,我选工具第一个看的就是权限管理能力,代码生成质量反而排第二。

最后说两句

AI 编程助手这个赛道,正在从「谁写代码更快」转向「谁让开发者更放心」。Anthropic 这次把自动模式设为默认,看起来是个小改动,实际上是在安全赛道上抢跑了一步。

对普通用户来说,短期内你可能感觉不到太大变化,甚至会觉得工具变「啰嗦」了。但长期来看,这种安全机制的普及对整个行业是好事。谁也不想成为那个因为 AI 误操作而上新闻的人。

我的建议很简单:保持关注,但别焦虑。技术在进步,安全也在进步,唯一不变的是你自己要保持判断力。工具再智能,最终负责的还是你。

本文基于 media 公开报道编译解读

本文基于 media 公开报道编译解读,查看原文

公开来源
  1. Pro、Max 和 Team 用户 8 月 14 日起 Claude Code 默认权限调整为自动模式