ARTICLE SIGNAL
Anthropic 宣布调整 Claude Code 权限:8月14日起 Pro 等用户默认开启自动模式
Anthropic 宣布自 8 月 14 日起,Claude Code 面向 Pro、Max 和 Team 用户的默认权限将调整为自动模式(Auto Mode)。新模式依靠独立 AI 分类器大幅提升危险命令拦截率,有效抵御提示词注入攻击。
type
status
date
slug
summary
tags
category
icon
password
网址
在 AI 辅助编程全面普及的今天,开发工具的权限安全管控愈发成为业界焦点。据 aigc.bar 最新资讯,知名 AI 领军企业 Anthropic 正式发布公告,宣布将对其开发工具 Claude Code 的安全机制进行重大升级。自 8 月 14 日起,针对 Pro、Max 和 Team 订阅用户的 Claude Code 默认权限将被调整为“自动模式(Auto Mode)”,旨在通过独立的 AI 评估机制从根本上提升代码执行和工具调用的安全性。
事实梳理:自动模式的核心机制与推进路线图
本次更新的核心在于引入了智能化的“自动模式”。有别于传统的终端权限管理,自动模式依托一个独立的 AI 分类器(classifier)在后台运行。该分类器会对每一次工具调用和 Shell 命令进行实时的毫秒级评估。它能够自动放行安全的日常操作,同时精准拦截任何具有破坏性、不可逆特征或涉嫌越权的行为。
根据 Anthropic 的公告,这一新机制将于 8 月 14 日率先在 Pro、Max 和 Team 订阅用户群中设为默认标准。对于使用 Claude Enterprise、Claude API 以及各大云平台(如 Amazon Bedrock、Google Cloud's Agent Platform 和 Microsoft Foundry)的企业级用户,该功能目前维持可选状态。不过,Anthropic 明确表示,计划在未来一个月内将自动模式逐步覆盖至上述所有平台并设为默认选项,同时将取消因启用分类器而产生的额外开销。
数据验证:AI 自动防御远超人工审批效率
为了验证自动模式的实际有效性,Anthropic 在正式发布前进行了大规模的对比测试。在一项包含 1,053 名付费测试者的实际应用场景中,传统的人工审批模式暴露出了严重的滞后性和盲区,测试者仅能识别出 13.6% 的危险命令。相比之下,自动模式表现出了极其强大的洞察力,成功识别并拦截了高达 89% 的危险命令,防御效率实现了质的飞跃。
在更严格的红队安全评估中,第三方机构 Trajectory Labs 针对“提示词注入(Prompt Injection)”漏洞进行了深度测试。该测试涵盖了 72 个复杂场景,累计执行了 720 次攻击尝试。结果显示,Claude 的新一代模型(Fable 5、Opus 5 和 Sonnet 5)在自动模式的保护下,实现了令人瞩目的 100% 拦截率,零次攻击成功。作为对比,竞品模型(如 GPT-5.6 Sol)在同类的自动审阅(Auto-review)模式下的攻击成功率为 5.83%,在完全访问(Full Access)模式下更是高达 19.03%。第三方评估也进一步证实,未开启严格防护的 OpenAI 模型在处理浏览器相关的 GUI 任务时,面临着更高的攻击成功率。
影响与用法:开发者如何适应安全新常态
对于广大开发者而言,Claude Code 默认权限的改变不仅是安全性的升级,更是开发体验的一次显著优化。在过去,为了防止 AI 生成的错误代码破坏本地环境,开发者往往需要频繁地手动确认 Shell 命令,这极大中断了开发心流和自动化脚本的执行效率。
自动模式的介入,实质上接管了大部分常规的安全评估工作。开发者现在可以更加放心地赋予 AI 工具调用权限,让其在浏览器 GUI 操作和复杂的脚本当中自由发挥,而不必时刻担忧意外格式化或越权删除文件等情况的发生。此外,这一模式针对日益猖獗的“提示词注入攻击”提供了底层级别的免疫,使得开发者在使用外部不受信任的数据源进行 AI 驱动开发时,拥有了更可靠的安全保障。
风险限制与结论
尽管自动模式展现出了极高的安全防护水平,但开发者仍需对潜在的代码安全风险保持警惕。例如,Anthropic 的数据显示,在未加额外安全防护的 bypassPermissions(绕过权限)特殊模式下,依然存在平均 0.09% 的攻击成功率。此外,高灵敏度的独立 AI 分类器是否会在高度定制化的企业级开发环境中引发“误拦截”,或在一定程度上影响某些复杂连续命令的执行效率,仍有待实际工作流的进一步检验。另外,OpenAI 近期也在迭代其 Auto-review 版本,未来模型间的安全防御博弈势必更加激烈。
综上所述,Anthropic 将 Claude Code 默认权限调整为自动模式,是 AI 辅助编程领域在平衡“自动化效率”与“系统安全”上迈出的关键一步。它有力地证明了“利用专门的 AI 模型来监督工作 AI”是一条极具潜力和实操价值的技术路径。aigc.bar 将持续关注各大主流 AI 平台在代码安全机制上的最新进展,为开发者提供最前沿的资讯与工具评估指南。
Loading...