Anthropic为Claude Code推出“自动模式”,AI编程安全防线升级

🤖 由 文心大模型 生成的文章摘要

Anthropic宣布,将于8月14日起,为Pro、Max和Team订阅用户的编程智能体Claude Code,将默认权限模式调整为“自动模式”。 此举旨在通过独立AI分类器,在保障效率的同时,大幅提升对危险操作和恶意攻击的防御能力。

自动模式的核心是独立的AI分类器,它会实时评估每次工具调用和Shell命令,自动放行安全操作,拦截破坏性、不可逆或越权行为,无需用户逐一审批。目前,该模式对Claude Enterprise、API及各大云平台用户仍为可选,但Anthropic计划在未来一个月内将其推进为默认选项。

测试结果成效显著:危险命令识别率从传统人工模式的13.6%跃升至89%。在第三方进行的720次提示注入攻击测试中,Claude Code的自动模式实现了100%拦截率,0次成功。而竞争对手OpenAI的Codex工具在类似测试中,攻击成功率在5.83%至19.03%之间。

此次更新直接回应了AI编程工具的安全顾虑。随着工具获得执行命令、修改文件等更高权限,恶意攻击风险增加。Claude Code通过专用安全分类器构建“隔离带”,与OpenAI思路相似但实效更优。这预示着AI编程工具的竞争,正从代码生成能力转向高权限任务中的可靠性与安全性。

Claude Code自动模式的推出,是Anthropic在AI智能体安全领域的重要尝试,旨在证明AI不仅能编写代码,更能安全、自主地执行完整开发任务。这一模式若经得起企业级场景考验,将有力推动AI编程智能体从“辅助工具”向“可信赖的自主开发者”演进。

「93913原创内容,转载请注明出处」