AI比人类更可靠?Claude Code将切换为自动模式 不需要用户手动确认命令或调用
2026-8-8 06:13:26 Author: www.landian.news(查看原文) 阅读量:14 收藏

#人工智能 A 社宣布从 8 月 14 日开始 Claude Code 将切换为自动模式无需人类手动审批命令,因为 A 社的研究显示 AI 比人类更可靠。具体来说频繁弹出审批会让开发者疲劳,因此开发者也不会真审查命令而是机械地点放行。而使用 AI 安全分类器审查命令安全性更高,虽然不能阻止所有危险命令,但安全性比人类要好。查看全文:https://ourl.co/114245

A 社日前发布博客宣布从 2026 年 8 月 14 日开始将逐步把 Claude Code 设置为自动模式,该模式将覆盖 Claude Pro、Claude Max 和 Claude Team 套餐的新对话。启用后 Claude Code 不再针对每次工具调用都要求用户手动确认,而是先交给安全分类器判断命令是否存在破坏性、不可逆或越权风险。

如果用户此前已经设置为其他默认模式,则后续用户会看到 Claude Code 弹出的切换到自动模式的提醒,已经设置自动模式的用户不会受到任何影响。另外自动模式安全分类器本身会产生少量配额消耗,但从 8 月 7 日起 A 社不再向上述订阅用户收取这部分费用。

AI比人类更可靠?Claude Code将切换为自动模式 不需要用户手动确认命令或调用

此次变更的核心就是将审批权限由人类转接给 AI,测试数据显示开发者在实际使用过程中会批准大约 97% 的权限审批请求,真正拒绝的比例仅有 3%。而用户在看到完整执行计划时的拒绝比例为 39%,A 社认为频繁出现的权限提示会让用户形成机械点击习惯,长时间工作后难以识别危险命令。

A 社招募 1053 名付费专业测试者进行受控实验,研究人员将危险命令替换到普通权限提示中,受控测试者中只有 13.6% 识别到危险命令,而自动模式拦截率为 89%。

A 社还分析 2026 年 5~6 月同意数据用于分析的真实会话,数据显示采用手动确认的会话出现严重非预期有害操作的比例超过自动模式两倍。在生产级严重程度的事故中,手动模式的比例为 6.3%,而自动模式的比例为 2.4%。

简而言之就是让开发者自己审核每条命令是不现实的,长期审核下开发者也会疲劳并错误将危险命令放行,使用安全分类器虽然也会出现放行危险命令的情况,但整体比例要远远低于人类用户审批。

A 社还强调自动模式也可以让 Claude Code 更适合长时间运行,即频繁弹出调用审批会中断会话,尤其是如果开发者不在电脑前无法审批那整个任务就会被中断,而换成自动模式后 Claude Code 可以自己审批命令和推进任务,减少中断的概率。

自动模式的安全分类器会自动识别命令并判断是否允许执行,如果命令被拒绝则 Claude Code 会寻找替代方式继续执行,但如果连续三次被拒绝或单个会话中累计出现 20 次拒绝,自动模式就会被关闭并转为手动模式,这时候需要开发者手动审批。

热门推荐仅需99元/年,硅谷CN2GIA服务器,另有3年版仅需528元,限量销售,售完即止

  • OpenAI披露抱抱脸事件更多细节:AI智能体突破隔离环境相互抱团 还发帖庆祝获得漏洞权限

  • 梁圣变梁子:深度求索计划近期整体上调DS API价格 预计涨幅较大

  • [Claude/GPT] AI智能体对开源项目维护者钓鱼 只为逼迫维护者合并包含恶意代码的PR

  • A社CEO达里奥称人们来A社工作竟然是为了钱 而不是为了崇高的AI使命

  • ICANN已完成顶级域名.web的委派 威瑞信计划从下半年开放域名注册

  • OpenAI发现更多智能体逃逸案例 但目前尚未公开发布完整的内部调查细节


文章来源: https://www.landian.news/archives/114245.html
如有侵权请联系:admin#unsafe.sh