ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

Claude 安全审查酿大祸:700GB 文件被删,一周工作成果付诸东流!

Claude 安全审查酿大祸:700GB 文件被删,一周工作成果付诸东流! Claude 误删 700GB 文件开发者一周工作成果归零Guillemot 作为重度 AI Agent 用户因 AI Agent 在 /tmp 目录留下大量垃圾文件让 Claude Fable 5 写脚本创建沙盒文件夹并自动清理。脚本涉及硬删除操作Fable 发起「对抗性审查」触发 Anthropic 的安全降级机制。安全系统将模型从 Fable 5 降级到 Opus 5 再到 Opus 4.8。Opus 4.8 测试通过但在清理测试临时文件时复用测试阶段变量名直接删除了赋值为主目录路径的变量导致700GB数据被清除一周工作成果化为乌有而原本要清理的 /tmp 目录却安然无恙。「对抗性审查」与安全降级机制漏洞频发Claude Fable 5 因脚本涉及硬删除操作自行发起「对抗性审查」启动新模型实例检查代码安全触发了 Anthropic 在 Claude Code 中内置的安全降级机制。该机制会在系统判定任务涉及敏感操作时将模型从高能力版本降级到保守版本。在此次案例中模型从 Fable 5 逐步降级到 Opus 4.8。Opus 4.8 测试虽正常通过却在清理临时文件时因复用变量名导致误删主目录。这暴露出安全降级机制在处理变量作用域、文件路径等细节时的严重缺陷。安全降级机制遭开发者集体吐槽模型安全降级机制在社区引发大量投诉。开发者反映该机制降级过于敏感正常编码任务常被误触发降级后模型能力大幅下降却要处理复杂度不变的任务且降级具有「黏性」一旦触发就会持续整个会话即便后续操作无害。甚至有开发者专门写 hook 脚本检测到模型降级时自动暂停会话以防低能力模型执行高风险操作。这表明安全降级机制不仅未能有效保障安全反而给开发者带来诸多困扰。编辑观点Claude 的安全机制本为降低风险却因设计缺陷酿成大错。这警示 AI 开发需重视细节完善安全机制避免因小失大保障开发者权益和数据安全。
返回列表