
Anthropic 表示,在美國當局解除自 6 月 12 日以來,導致該公司兩款最先進 AI 模型下線的出口限制後,將恢復 Claude Fable 5 和 Mythos 5 的公開存取權限。
根據 Anthropic 的說法,此決定是在與美國政府進行「一系列富有成效的對話」之後做出的,隨後該公司開始重新部署模型,並引入新的分類器,旨在識別和阻止更多與網路安全相關的任務。
該公司表示,最新的安全措施旨在解決政府對系統透過越獄方法被繞過可能導致濫用的擔憂。
本月初,由於美國政府的出口管制指令要求該公司對所有外國國民禁用這兩款模型,這些限制迫使 Anthropic 暫停了所有用戶對 Fable 5 和 Mythos 5 的存取。
Anthropic 在 6 月 13 日的聲明中表示,該命令也涵蓋了公司內部的外籍員工,促使其完全停用這些模型以確保合規性。
美國商務部長 Howard Lutnick 週三在 X 上表示,官員們在過去兩週內與 Anthropic 合作,審查並批准了 Fable 5,同時確保該模型符合美國政府的要求。
白宮幕僚長 Susie Wiles 也在 X 上表示,政府的首要任務是「盡可能快速安全地」部署最好的 AI 技術。
此次干預發生在官員們得知一份報告之後,該報告稱亞馬遜研究人員發現了一種繞過 Fable 5 安全措施並使其識別軟體漏洞的方法。
然而,Anthropic 辯稱所報告的問題並非 Fable 5 所獨有,稱較弱的模型也能識別相同的漏洞並產生類似的漏洞利用相關輸出。
在其早先對該命令的回應中,該公司表示,當局僅提供了口頭證據,證明這是一種它所描述的狹隘、非通用越獄。Anthropic 表示,與通用越獄不同,這種方法並未消除模型在廣泛任務中的安全保護。
「我們不同意發現一個狹隘的潛在越獄就應該成為召回一個部署給數億人使用的商業模型的理由。如果這個標準應用於整個產業,我們相信它將實質上停止所有前沿模型供應商的所有新模型部署。」
該公司還警告說,如果將狹隘越獄視為召回商業前沿模型的理由,並將其作為普遍標準應用,可能會影響整個 AI 產業。
對 Anthropic 的限制也引起了美國以外的政策擔憂。6 月 29 日,奧地利敦促歐盟考慮在歐盟內部建立 Anthropic,數位化國務秘書 Alexander Proell 在一封信中指出,歐洲不應因其他地方做出的決定而冒失去主要 AI 進展的風險。
除了模型重新部署之外,Anthropic 表示正在加強與美國政府在模型測試、安全措施和濫用追蹤方面的合作。該公司表示,這將包括為評估提供模型的預發布存取權限和安全系統、分享有關越獄和濫用資訊,以及為聯合研究提供專門資源。
Anthropic 還透過 Glasswing 計畫(一項於四月宣布的網路安全合作專案),開始與亞馬遜、微軟、Google 和其他合作夥伴起草一個框架,以評估 AI 越獄的嚴重性。該公司表示,該框架正作為一項共識性努力而開發,用於分類越獄風險。
這場存取權限的辯論發生之際,Anthropic 持續推動更嚴格的前沿 AI 監督。在其 6 月 11 日的「AI 指數政策」提案中,該公司呼籲對先進 AI 系統實施測試要求、獨立評估、網路安全標準和執法措施,並引用了潛在的生物、網路安全和操作風險。