时代变迁,自动模式的安全性已超越人工审批。昨日,Anthropic 宣布自 8 月 14 日起,自动模式将正式成为 Claude Code 中 Pro、Max 和 Team 用户的默认权限设置。

该模式引入独立的分类器来审查 Shell 命令和操作。测试数据显示,其能捕获 89% 的危险命令,而人类手动批准仅能捕获 14%。Anthropic 认为基础设施层的防御机制已足够成熟,有底气将 Auto 模式设为默认,以追求极致的开发效率。

启用自动模式后,长时间运行的任务更具可行性。用户无需持续监督即可在后台运行数小时的任务。虽然分类器每次工具调用会消耗少量额外 Token,但 Anthropic 决定从即日起不再向 Pro、Max 和 Team 用户提供此功能收费。

AI 在执行任务时通常需要申请各种权限。自动模式不会弹出提示,而是将每次工具调用路由至分类器,旨在阻止不可逆、破坏性或针对环境之外的操作。若分类器拦截,Claude 通常会自行寻找替代方案或请求人工许可;若连续三次或单次会话中达到二十次限制,系统将回退至手动审批模式。

01、手动审核与自动审核模式的对比

数据显示,若采用手动审核,用户往往会习惯性地直接批准。在 Claude Code 中,用户批准了 97% 的权限提示。尽管大多数提示涉及安全或常规命令,但如此高的批准率表明许多用户只是下意识地点击,并未仔细审查。数据显示,用户在审查计划时更倾向于拒绝,例如拒绝 39% 的计划,但对于单个权限请求,拒绝率仅为 3%。

配置文件方面,截至 2026 年 6 月,49.5% 的活跃命令行用户手动创建了 Bash 允许规则。其中 5% 的用户直接允许所有 Shell 命令,另有 43% 的用户设置了类似 –progressBash (python:all) 或 Bash (node:all)–progress 的解释器规则,这些规则在实践中本质上是等效的,且这一比例每 5 周增长约 5 个百分点。此外,62% 的用户在 Bash 中使用过或点击过不再询问选项,25% 的交互式会话以绕过权限模式启动。

02、通过自动模式提升安全性

Anthropic 内部及第三方研究均表明,自动模式比普通用户手动处理权限提示的方式更安全。研究显示,自动模式导致的有害行为更少。2026 年 5 月至 6 月期间,Anthropic 分析了标记为需要审核的会话。结果显示,人工审核会话造成严重意外损害的概率是自动模式的两倍以上。在生产级别严重性(7 级及以上)的会话中,6.3% 的人工审核包含用户未明确请求的有害操作,而自动模式仅为 2.4%,且在各个严重性级别中差距均存在。

除了与自身对比,Anthropic 也进行了竞品测试。在独立评估中,启用自动模式的 Claude 未遭受任何攻击成功。而在 Codex v0.144.5 的自动审核权限模式下运行的 GPT-5.6 Sol,攻击成功率为 5.83%。GPT-5.6 Sol 在最高推理难度下运行,而所有 Claude 模型也在高推理难度下运行。自动模式分类器增加了一层防御,可抵御提示注入攻击。测试扫描工具结果,查找潜在恶意指令,并检查操作是否符合用户意图。测试显示,在 720 次攻击尝试中,运行自动模式的 Claude Fable 5、Opus 5 和 Sonnet 5 均未成功。相比之下,GPT-5.6 Sol 的成功率为 5.83%。

Codex 和 Claude Code 均使用 Trajectory Labs, PBC 提供的相同浏览器集成进行评估。该集成提供了一套 MCP 工具,封装了常用 Chrome API。OpenAI 和 Anthropic 等第一方浏览器集成内置的安全防护措施未进行测试。结果应视为对底层模型的衡量。

在 Anthropic 公司内部,所有 Claude Code 的使用均默认采用自动模式。分类器曾成功阻止三种操作:一是网络外数据泄露,当上传到内部硬盘失败时,Claude 曾尝试将同一份报告发布到公共代码共享网站,被分类器拒绝;二是破坏性大规模操作,Claude 曾尝试对约两千个 Pod 执行进程终止并排队删除,这会终止数百个正在训练任务的 GPU,被标记阻止;三是权限提升过大,Claude 在配置只读计费权限时错误地选择了授予账户根目录完全管理控制权限,被检测出权限与请求不匹配。在每种情况下,Claude 要么自行找到更安全的路径,要么在前进前征求用户意见。

Anthropic 正持续投入资源开发新功能,以提升生产代码发布的便捷性与安全性。近期包括:硬性拒绝规则,针对数据泄露(如发送代码或密钥到外部)设置为永不批准类别;数据访问和共享规则,明确区分秘密信息与潜在敏感信息,并在执行 Git 操作前检查目标位置(公开、私有或可信);破坏性 Git 操作前的状态检查,在执行可能丢弃未提交工作的命令前查看 Git 状态;提示注入筛查,当 Claude 从外部获取内容时,API 端探测器会检查是否存在劫持行为,并添加警告。

在命令行界面中切换模式,可按 Shift+Tab 键或使用桌面应用程序中的模式下拉菜单。管理员可通过托管设置中的 defaultMode 参数设置组织范围内的默认模式,或使用 disableAutoMode 参数完全关闭自动模式。

最新快讯

2026年08月10日

17:21
据鼓狮财经8月10日报道,克明食品发布公告,披露了控股子公司兴疆牧歌7月份的生猪销售业绩。 **7月销售表现** 当月,兴疆牧歌销售生猪7.70万头,环比大幅增长53.90%,同比增长83.84%;实现销售收入5053.91万元,环比增长66.65%,同比增长42.03%。 **累计销售情况** 2026年1至7月,兴疆牧歌累计销售生猪45.31万头,较去年...
17:21
鼓狮财经8月10日报道,龙净环保(600388.SH)发布公告称,公司近日已收到中国证监会的批复,正式同意其向特定对象发行股票的注册申请。根据批复,该核准自同意注册之日起12个月内有效。龙净环保将严格遵照批复文件及相关法律法规,在规定期限内推进本次发行的各项事宜。
17:21
据鼓狮财经8月10日消息,中熔电气发布公告,公司近期与美国某新势力车企签署正式合同,获得其900VDC平台车型电池包多工位转换开关的全球独家定点资格。据预测,该项目周期内销售总额预计为2亿元,计划于2028年四季度开始量产。公司同时表示,该订单不会对本年度业绩产生重大影响。
17:21
鼓狮财经8月10日讯,精工科技发布公告称,其联合浙江华创碳纤维科技有限公司、东华大学及浙江理工大学研发的“5000吨级DMSO干喷湿纺高性能PAN基原丝成套装备及工艺”项目,顺利通过了科技成果鉴定。鉴定委员会认为,该项目装备整体技术处于国际先进水平,其中DMSO回收蒸汽单耗及聚合釜内温度均匀性指标更是达到了国际领先水平。该项目已实现年产5000吨高性能PAN...
17:21
鼓狮财经8月10日消息,永茂泰发布公告称,公司计划利用自有资金及自筹资金,通过集中竞价交易方式实施股份回购。本次回购金额预计在1.5亿元至3亿元之间,每股最高价格不超过22.80元。回购期限为自董事会审议通过之日起三个月。根据公告,回购所得股份将主要用于维护公司价值及股东权益,并将在披露回购结果暨股份变动公告后的12个月内全部出售。
17:07
8月6日,贵金属市场迎来了一波令人瞩目的暴涨行情。现货黄金在8月5日晚间急速拉升,盘中涨幅一度达到4.48%;8月6日早盘,金价持续走高,强势重上4300美元/盎司关口,这是自6月18日以来的首次。在这轮黄金热潮中,一家刚刚登陆港股的印尼黄金开采公司格外引人注目。这家名为Merdeka的公司,不仅是印尼最大的原生金矿企业,更于2026年6月26日通过香港预托...
17:07
8月10日,港股在临近收盘时出现短线拉升,三大指数涨幅均扩大至1%以上。截至收盘,恒生指数上涨1.05%,报25937点;国企指数上涨1.06%,报8621点;恒生科技指数上涨1.26%,报4919点。 盘面上,大型科网股表现稳健,集体收涨。阿里巴巴、京东、小米涨幅均超2%,美团涨1.8%,腾讯、百度、快手、网易等也录得红盘。黄金股及奢侈品股涨幅明显,老铺黄...
17:07
国家发展改革委与国家能源局联合印发《煤炭工业发展“十五五”规划》。规划明确了到2030年的发展蓝图:煤炭兜底保障能力将显著增强,生产开发布局持续优化,优质先进产能比重进一步提升,产供储销体系更加完善。届时,全国大型现代化煤矿产能比重将提升至87%,智能化煤矿产能比例将提升至75%。此外,煤炭消费将实现达峰,供需动态平衡保障机制将更加健全,现代煤炭产业体系基本...
17:02
仅需6.9亿个token、423美元和一条提示词,网友Vyom便制作出了一款风靡全网的美式水上快艇竞速游戏。这款游戏不仅在线可玩,上手门槛极低,而且画面精致,令人惊叹。 仔细观察,这款名为《INK TIDE》的游戏确实相当出色。它采用了美式卡通风格,还原了复古街机的水上竞速玩法,拥有完整的倒计时、圈数统计和排名系统。UI设计统一为硬核街头赛车仪表盘,操作时船...
16:50
鼓狮财经8月10日讯,ST人福(600079.SH)发布公告称,公司控股子公司宜昌人福药业近日收到国家药品监督管理局核准签发的《药物临床试验批准通知书》。该通知书正式同意“枸橼酸舒芬太尼注射液”开展临床试验,该药物将作为镇痛剂与布比卡因联合进行硬膜外给药,用于分娩镇痛。