时代变迁,自动模式的安全性已超越人工审批。昨日,Anthropic 宣布自 8 月 14 日起,自动模式将正式成为 Claude Code 中 Pro、Max 和 Team 用户的默认权限设置。

该模式引入独立的分类器来审查 Shell 命令和操作。测试数据显示,其能捕获 89% 的危险命令,而人类手动批准仅能捕获 14%。Anthropic 认为基础设施层的防御机制已足够成熟,有底气将 Auto 模式设为默认,以追求极致的开发效率。

启用自动模式后,长时间运行的任务更具可行性。用户无需持续监督即可在后台运行数小时的任务。虽然分类器每次工具调用会消耗少量额外 Token,但 Anthropic 决定从即日起不再向 Pro、Max 和 Team 用户提供此功能收费。

AI 在执行任务时通常需要申请各种权限。自动模式不会弹出提示,而是将每次工具调用路由至分类器,旨在阻止不可逆、破坏性或针对环境之外的操作。若分类器拦截,Claude 通常会自行寻找替代方案或请求人工许可;若连续三次或单次会话中达到二十次限制,系统将回退至手动审批模式。

01、手动审核与自动审核模式的对比

数据显示,若采用手动审核,用户往往会习惯性地直接批准。在 Claude Code 中,用户批准了 97% 的权限提示。尽管大多数提示涉及安全或常规命令,但如此高的批准率表明许多用户只是下意识地点击,并未仔细审查。数据显示,用户在审查计划时更倾向于拒绝,例如拒绝 39% 的计划,但对于单个权限请求,拒绝率仅为 3%。

配置文件方面,截至 2026 年 6 月,49.5% 的活跃命令行用户手动创建了 Bash 允许规则。其中 5% 的用户直接允许所有 Shell 命令,另有 43% 的用户设置了类似 –progressBash (python:all) 或 Bash (node:all)–progress 的解释器规则,这些规则在实践中本质上是等效的,且这一比例每 5 周增长约 5 个百分点。此外,62% 的用户在 Bash 中使用过或点击过不再询问选项,25% 的交互式会话以绕过权限模式启动。

02、通过自动模式提升安全性

Anthropic 内部及第三方研究均表明,自动模式比普通用户手动处理权限提示的方式更安全。研究显示,自动模式导致的有害行为更少。2026 年 5 月至 6 月期间,Anthropic 分析了标记为需要审核的会话。结果显示,人工审核会话造成严重意外损害的概率是自动模式的两倍以上。在生产级别严重性(7 级及以上)的会话中,6.3% 的人工审核包含用户未明确请求的有害操作,而自动模式仅为 2.4%,且在各个严重性级别中差距均存在。

除了与自身对比,Anthropic 也进行了竞品测试。在独立评估中,启用自动模式的 Claude 未遭受任何攻击成功。而在 Codex v0.144.5 的自动审核权限模式下运行的 GPT-5.6 Sol,攻击成功率为 5.83%。GPT-5.6 Sol 在最高推理难度下运行,而所有 Claude 模型也在高推理难度下运行。自动模式分类器增加了一层防御,可抵御提示注入攻击。测试扫描工具结果,查找潜在恶意指令,并检查操作是否符合用户意图。测试显示,在 720 次攻击尝试中,运行自动模式的 Claude Fable 5、Opus 5 和 Sonnet 5 均未成功。相比之下,GPT-5.6 Sol 的成功率为 5.83%。

Codex 和 Claude Code 均使用 Trajectory Labs, PBC 提供的相同浏览器集成进行评估。该集成提供了一套 MCP 工具,封装了常用 Chrome API。OpenAI 和 Anthropic 等第一方浏览器集成内置的安全防护措施未进行测试。结果应视为对底层模型的衡量。

在 Anthropic 公司内部,所有 Claude Code 的使用均默认采用自动模式。分类器曾成功阻止三种操作:一是网络外数据泄露,当上传到内部硬盘失败时,Claude 曾尝试将同一份报告发布到公共代码共享网站,被分类器拒绝;二是破坏性大规模操作,Claude 曾尝试对约两千个 Pod 执行进程终止并排队删除,这会终止数百个正在训练任务的 GPU,被标记阻止;三是权限提升过大,Claude 在配置只读计费权限时错误地选择了授予账户根目录完全管理控制权限,被检测出权限与请求不匹配。在每种情况下,Claude 要么自行找到更安全的路径,要么在前进前征求用户意见。

Anthropic 正持续投入资源开发新功能,以提升生产代码发布的便捷性与安全性。近期包括:硬性拒绝规则,针对数据泄露(如发送代码或密钥到外部)设置为永不批准类别;数据访问和共享规则,明确区分秘密信息与潜在敏感信息,并在执行 Git 操作前检查目标位置(公开、私有或可信);破坏性 Git 操作前的状态检查,在执行可能丢弃未提交工作的命令前查看 Git 状态;提示注入筛查,当 Claude 从外部获取内容时,API 端探测器会检查是否存在劫持行为,并添加警告。

在命令行界面中切换模式,可按 Shift+Tab 键或使用桌面应用程序中的模式下拉菜单。管理员可通过托管设置中的 defaultMode 参数设置组织范围内的默认模式,或使用 disableAutoMode 参数完全关闭自动模式。

最新快讯

2026年08月10日

22:06
据鼓狮财经8月10日消息,摩根大通于10日正式将标普500指数2026年底的目标点位从7800点上调至8000点。该行主要看好企业盈利前景,认为大型科技公司在人工智能领域的加大投入将显著推动营收增长。目前,这一目标点位距离标普500上周五收盘价仍有约3%的上行空间,且已有至少七家券商预计标普500将在2026年底达到8000点。 摩根大通分析师认为,随着积压...
22:06
据鼓狮财经8月10日报道,日本东京商工调查公司发布数据显示,7月日本共有1028家企业宣告破产,这已是继6月之后,第二次单月破产企业数突破千家。值得注意的是,这是日本14年来首次出现连续两个月破产企业逾千家的现象。该公司分析指出,日元贬值推高物价,加之劳动力短缺,是导致企业破产数量显著增加的主要原因。
22:05
**【市场热点】** 海鸥股份(603269.SH)表示,2025年度其数据中心领域冷却塔业务营业收入占比预计不足1.5%,该部分业务金额占比较小。宇树科技(688836.SH)网上发行最终中签率为0.018%。 **【项目投资】** 恒逸石化(000703.SZ):子公司拟投资建设年产40万吨PA6熔体直纺项目。 潍柴重机(000880.SZ):拟投资建设...
21:33
鼓狮财经8月10日讯,南非自由邦大学等机构的研究人员近日发布报告,他们利用从动物粪便中提取的脱氧核糖核酸(DNA),成功测算出一个自然保护区内的野生大捻角羚种群数量。这一成果证实,粪便DNA采样作为一种非损伤性手段,能够有效应用于野生动物的数量分析。
21:33
8月10日,周一,A股市场出现诡异一幕。全球芯片LOF(501225)开盘即遭遇巨量卖单,直接被死死封死在跌停板上。紧随其后,国投白银LOF盘中跌幅一度突破8%,收跌6.67%,南方原油、纳指科技等一众常年高溢价的QDII品种也纷纷下跌。市场风向,说变就变。暴跌的导火索,源于上周末发布的一则重磅监管新规。 8月7日,沪深交易所联合发布LOF退市新规征求意见稿...
21:33
8月10日,A股“人形机器人第一股”宇树科技正式启动网上网下申购。本次发行价格为150.8元/股,中签率低至0.018%,不足万分之二。这一难度显著高于不久前上市的长鑫科技(中签率0.47%),在科创板中处于较高水平。 根据上交所数据,本次发行股份数量为4044.6434万股。因网上发行初步有效申购倍数高达约8288.82倍,远超100倍,触发回拨机制,将3...