Hacker News 中文摘要

RSS订阅

Claude Code 现在默认使用自动模式 -- Auto mode is now the default in Claude Code

文章摘要

自2026年8月14日起,Claude Code在Pro、Max和Team计划中默认启用自动模式,该模式通过分类器平衡用户不被打断的需求与避免有害操作,且不再对分类器额外收费。企业版等平台仍为可选,后续将逐步推广。

文章总结

好的,这是根据您的要求,对原文进行中文重述和精简后的版本:

标题:Claude Code 的自动模式现已成为 Pro、Max 和 Team 套餐的默认设置

核心变更: 自2026年8月14日起,Claude Code 的 Pro、Max 和 Team 套餐将默认启用“自动模式”。该模式旨在平衡用户减少中断的需求与系统防范有害操作的能力。对于已自行设置其他默认模式的用户,可能会收到一次性的切换询问。企业版、API 及云平台用户目前仍可选择加入,未来一个月内也将逐步成为默认设置。此外,从即日起,这些套餐用户将不再需要为自动模式的分类器开销付费。

自动模式如何工作: 自动模式不再频繁弹出权限确认提示,而是通过一个分类器来评估每个工具调用。该分类器专门用于拦截那些不可逆、具有破坏性或针对外部环境的操作。当分类器拦截某项操作时,Claude 通常会自行寻找更安全的执行路径,或直接向用户请求许可。如果连续三次或单次会话中累计二十次操作被拦截,Claude Code 将回退到手动审批模式。

安全性对比与数据支持: 经过数月的内部及第三方测试,包括红队演练、提示注入评估、对1053名付费测试者的对照研究以及真实生产会话分析,结果表明:自动模式在各项安全指标上均达到或优于用户手动审查。

  • 用户审查的局限性:数据显示,用户对权限提示的批准率高达97%,表明许多用户是习惯性点击通过,而非仔细审查。相比之下,用户对Claude提出的计划有39%的拒绝率,但对单个权限请求的拒绝率仅为3%。
  • 自动模式更胜一筹:在对照实验中,人类审查员仅能发现13.6%的危险命令,而自动模式能拦截89%。在真实生产环境中,手动审批模式下出现用户未明确要求的严重意外危害(7级以上)的概率是自动模式的2.6倍(6.3% vs 2.4%)。
  • 对抗性测试:与安全公司Apollo Research的合作测试表明,自动模式能有效抵御合成攻击,并将分类器的漏报率从12%降至7%。
  • 提示注入防御:第三方评估显示,在720次针对Claude最新模型的攻击尝试中,自动模式实现了零成功率。相比之下,竞品模型在类似模式下仍有5.83%的攻击成功率。

内部案例: 在Anthropic公司内部,自动模式已成功阻止了多起潜在事故,例如:将内部报告错误地发布到公共代码托管网站、在长时间运行的会话中尝试大规模销毁训练任务、以及试图授予超出请求范围的过高权限。

持续改进: 团队正持续为自动模式增加安全功能,包括:对数据外泄等行为的“硬拒绝”规则、区分敏感信息的访问与共享规则、在执行破坏性Git操作前检查状态,以及对外部内容进行提示注入筛查。

生产环境应用案例: Adobe、Nuro、Gusto和Garner Health等公司团队已采用自动模式作为生产默认设置。数据显示,采用自动模式的团队,其PR(拉取请求)提交量增加了约25%。

如何开始: 对于Pro、Max和Team用户,若未设置过默认模式,新会话将自动启用自动模式。用户可通过CLI中的Shift+Tab或桌面应用的下拉菜单切换模式。管理员可通过托管设置锁定组织范围的默认模式。文章最后强调,自动模式虽能降低风险,但并不能完全消除风险,对于生产基础设施的高风险变更,仍建议用户自行审查Claude的操作。

评论总结

以下是对评论内容的总结,涵盖主要观点、论据及不同立场,并保留关键引用:


1. 支持自动模式(Auto Mode)的合理性

  • 论据:自动模式能有效拦截危险命令,且人类审查易疲劳(如97%的提示被批准)。Anthropic测试显示,自动模式拦截89%危险命令,而人类仅13.6%。
  • 关键引用
    • "auto mode blocked 89% of the same commands... humans blocked only 6 that auto mode allowed"(作者ta-run)
    • "users approve 97% of permission prompts in Claude Code"(作者nomilk)

2. 反对自动模式,强调人工控制

  • 论据:自动模式可能过度拦截安全命令(如findgrep),且用户需保持对代码变更的掌控。部分用户认为“用Claude判断Claude命令的安全性”并非良策。
  • 关键引用
    • "I like to stay in control, learn about the new code and change direction if it goes off track"(作者lukan)
    • "Using more Claude to categorize the safety of Claude commands is not the answer"(作者awkii)

3. 沙箱与隔离方案

  • 论据:用户通过Docker、bubblewrap等工具实现安全隔离,允许YOLO模式运行。部分用户认为沙箱比依赖自动模式更可靠。
  • 关键引用
    • "I've been running Claude Code with --dangerously-skip-permissions in a Docker container... I definitely wouldn't want to run it unsandboxed"(作者steve_taylor)
    • "I made a tool to bubblewrap any agent... it protects the rest of the system against prompt injections"(作者SwellJoe)

4. 对Anthropic的信任与批评

  • 论据:部分用户质疑Anthropic的动机(如“权限疲劳”设计),或批评其模型更新导致自动模式分类器误判。也有用户认为自动模式是“解决本不存在的问题”。
  • 关键引用
    • "The conspiracy theorist inside of me says it's precisely designed to... give me 'permission fatigue'"(作者frogulis)
    • "Auto mode feels like a solution to a problem that shouldn't exist"(作者nomilk)

5. 技术细节与成本问题

  • 论据:自动模式会额外消耗15-28%的token(现免费),且分类器可能误判。用户建议使用白名单(如Cursor的allow once/allowlist)或自定义脚本。
  • 关键引用
    • "Auto mode... increases your token usage by ~15-28%, and Anthropic used to charge you for these tokens"(作者tristanj)
    • "Cursor lets you choose between 'allow once' and 'add command to allowlist'"(作者nomilk)

6. 对测试数据的质疑

  • 论据:Anthropic测试中人类审查者表现极差(仅13.6%拦截率),但未说明测试者技能水平,数据可能不具代表性。
  • 关键引用
    • "Any note on the proficiency, experience, and skill levels of the testers? 'cos the diff in numbers is absurdly high"(作者ta-run)

总结:评论呈现两极分化——支持者认为自动模式能有效减少人为失误,反对者强调人工控制与沙箱隔离的必要性。技术细节(如token成本、分类器误判)和Anthropic的透明度问题也被广泛讨论。