美国时间6月12日,美国商务部以“国家安全风险”为由发布出口管制措施,要求全球范围内暂停所有非美国籍用户对Anthropic两款旗舰模型——Claude Fable 5与Mythos 5的访问权限。
受该禁令影响,Anthropic被迫在全球范围内下线上述两款模型服务,相关API与应用调用在多地区短时间内无法使用。
此次事件的直接导火索,据称来自亚马逊内部研究人员发现的一项模型越狱技术,该技术可能绕过部分安全分类与内容限制机制,引发监管部门对模型潜在风险的关注。
在随后数周内,Anthropic对模型安全系统进行了紧急修复与重训,重点强化安全分类器与对抗性输入识别能力,以降低类似越狱攻击的可利用空间。
6月30日,美国商务部宣布解除相关出口管制措施,允许恢复对上述模型的访问权限。自7月1日起,Claude Fable 5与Mythos 5重新在全球范围内恢复可用。
此次短暂“全球下线—恢复上线”的事件,也再次将AI大模型的安全对齐、越狱攻击以及监管介入问题推向行业关注焦点。
