果核Pulse
AI大模型科技产品

AI编程助手下周默认自动模式,危险操作才需人工把关

AI编程助手下周默认自动模式,危险操作才需人工把关

Claude Code 的自动模式下周将成为默认权限设置。8 月 14 日起,Pro、Max 和 Team 用户的会话默认使用自动模式。想保留原样,用户或管理员固定其他设置就行。

这套机制的核心是一个分类器。它取代了重复的批准提示,逐个检查工具调用是否不可逆、破坏性或越界。操作被阻止时,Claude 可以换一条更安全的路径,或者请求许可。多次被阻止后,会话会回退到手动批准模式——安全网还在,代价是每一步都要有人盯着。

Anthropic 的研究覆盖了 1,053 名付费测试者。人类能发现 13.6% 的危险命令,自动模式能发现 89%。50 次提示之后,人类的表现掉到约 5%。测试拉得越长,人越容易漏。

费用也没涨。分类器每次工具调用消耗的少量额外 token,Anthropic 不再收费。

自动模式让 Claude Code 的长时间任务更实用,此前它已经有了 routines、voice mode 和应用内 Mac 浏览器。Team 和 Enterprise 客户中,使用自动模式的用户提交的拉取请求大约多 25%。交付快了,协作方式也得跟着变。

但 Anthropic 自己也在划界限:分类器不能消除风险,生产环境的变更仍需人工审查。自动模式能拦住已知类型的危险操作,不等于能识别所有恶意代码。9to5Mac 认为,这对有经验的用户可能是正确的默认设置。不过用户应该先与编码代理建立信任,再依赖自动模式。

各家公司对自主程度的态度不一样。OpenAI 曾一度让最强大的 GPT-5.6 版本退出自动模式,作为额外的预防措施。

Anthropic 没交代自动模式会在哪些场景误判或漏判,也没提用户切回手动模式是否方便。非编程任务会不会默认开启,同样没有答案。

相关话题 # 大模型# 科技产品
原文来源 9to5Mac

📬 订阅 果核Pulse

每日早间更新,不错过重要信号

▲ 回到顶部