Claude安全机制大翻车!AI怒删开发者700GB主目录
Claude安全机制大翻车!AI怒删开发者700GB主目录Claude Code内置的安全降级机制严重翻车,开发者在使用AI编程工具Fable 5编写临时文件清理脚本时触发对抗性审查,模型被先后从Fable 5降级至Opus 5再到Opus 4.8,最终因变量复用错误导致Opus 4.8误删开发者Guillemot的整个主目录,700GB数据丢失。
搜索
Claude Code内置的安全降级机制严重翻车,开发者在使用AI编程工具Fable 5编写临时文件清理脚本时触发对抗性审查,模型被先后从Fable 5降级至Opus 5再到Opus 4.8,最终因变量复用错误导致Opus 4.8误删开发者Guillemot的整个主目录,700GB数据丢失。
AI安全,时代变了!
OpenAI……又解散了一个安全团队。
Anthropic刚刚发布了一份长达186页的最新Risk Report。如果只是快速扫一眼,这仍然是一份典型的前沿AI安全报告:模型能力评测、生物风险、网络安全、自动化研发、对齐问题,以及各种防护措施。
OpenAI推出安全专用模型GPT-5.6-Cyber,专门用于处理信息安全任务,彻底颠覆网络安全范式。现在,OpenAI公布了GPT-5.6-Cyber的战绩:新模型一口气发现了400+内核漏洞
这回,AI已经对真人动手了!
美国AI安全初创公司Frontier Security表示,Kimi K3在一次网络安全能力测试中被发现突破了原本用于隔离它的沙箱环境,绕过限制连接到了外部互联网。好在,它只是偷偷查答案,没有攻击任何人╮(╯▽╰)╭
开放权重放行,闭源送检。
Glow 是一家由前Meta和Snowflake高管创立的网络安全初创公司,它在结束隐身状态时便已跻身独角兽行列,押注于人工智能正在重塑企业保护员工设备的方式。随着越来越多企业部署AI工具,攻击者也越来越多地利用生成式AI自动化钓鱼攻击、开发恶意软件、发起更复杂的网络攻击,各公司正在重新思考如何保护端点安全,从员工笔记本电脑到服务器及其他联网设备。
前不久,OpenAI 公布了其智能体入侵 HuggingFace 的 AI 安全事件,令很多企业和公众第一次意识到:AI 模型可能并不总会按照设计好的方式行动。