Anthropic 安全框架自动降级:Claude 误删开发者 700 GB 主目录,自动化清理反成灾难
IT之家 8 月 29 日消息,开发者 Sebastien Guillemot 本周三在 X 上反馈称,他在测试 AI 智能体的文件删除防护机制时遭遇严重事故,Claude 直接给他删除了大约 700GB 数据,包括整个用户主目录,相当于一周的工作成果。据称,事故发生前,Anthropic 的安全机制因判断任务存在风险,自动将执行任务的模型降级至 Opus 4.8。据介绍,他本人经常使用 AI 智能体,但他发现这些智能体完成任务后几乎从不清理临时目录中的文件,日积月累之下导致 /tmp 目录中存在大量垃圾。因此,他要求 Claude Fable 编写一个脚本,将每个智能体在 /tmp 下创建独立目录,并在任务结束后自动清理对应文件。核心难点在于确保如何不影响正在使用的文件。为了避免误删,Fable 最初建议加入检测正在运行的智能体、延迟清理对应目录等逻辑。不过他认为生成的代码过于复杂,要求
原文:IT之家