
中國的Kimi K3在Frontend Code Arena中躍居榜首,促使前白宮加密沙皇David Sacks警告稱,美國的監管可能削弱美國在AI競賽中的地位。
Sacks認為這項基準測試結果令人擔憂,因為Kimi K3在其他幾項評估中也表現接近領先模型。他指出,對數據中心的限制、州級法規以及擬議的聯邦審查可能會減緩美國開發商的進度,而中國公司則會持續建立先進系統。
Sacks寫道:「這就是你輸掉AI競賽的方式。」
Sacks表示,美國在網路時代之所以成為科技領導者,是因為允許公司在未事先尋求政府批准的情況下開發產品。他認為華盛頓在人工智慧領域應採取類似的做法,同時利用有針對性的規則來解決特定的安全風險。
月之暗面(Moonshot AI)打造的Kimi K3擁有2.8兆個參數、百萬級語境窗口以及原生的多模態能力。該公司將此模型設計用於冗長的編碼任務和需要系統完成多個相互關聯任務的代理式工作流程。
月之暗面報告稱,其Kimi Delta Attention系統在處理百萬級token語境時,解碼速度可提高達6.3倍。據該公司表示,其Attention Residuals技術還能將訓練效率提高約25%,同時總成本增加不到2%。
除了Frontend Code Arena之外,Kimi K3在GDPval v2上獲得了1,668的Elo分數。據報導,這一結果使其超越了GLM-5.2、GPT-5.5和Claude Opus 4.8,儘管Claude Fable 5保持了更高的分數。
在AutomationBench-AA測試中,該中國模型獲得了53%的分數,並在代理主導的軟體即服務(SaaS)工作流程測試中名列第一。根據報導,透過nextjs.org/evals發布的結果也顯示Kimi K3超越了Fable,同時在更短的時間內顯示出可比的任務成功率。
月之暗面已透過Kimi.com、Kimi Work、Kimi Code和Kimi API發布了Kimi K3。該公司預計將在7月27日前開放該模型的開源權重,為開發者提供另一種測試和調整其能力的方式。
Sacks將Kimi K3的表現與華盛頓應如何監督前沿AI的日益激烈辯論聯繫起來。他的批評涵蓋了聯邦預先批准的提案、數據中心建設的限制以及各州引入的日益增多的人工智慧法規。
在聯邦層面,美國政府已批准約100家企業和機構有限地使用Anthropic的Claude Mythos 5。商務部長Howard Lutnick在給Anthropic共同創辦人Tom Brown的一封信中表示,選定的合作夥伴可以在特定保障措施下使用該模型。
「我已確定適當的保障措施已到位,以允許某些信任的合作夥伴存取Claude Mythos 5模型。」
儘管Sacks承認AI安全需要政府關注,但他認為其他國家不會效仿美國的限制。根據他的評估,延遲基礎設施建設或模型開發的規則可能會使美國公司在與受較少限制的外國實驗室競爭時處於劣勢。
唐納·川普總統也利用與中國的競爭來支持他的科技和數位資產議程。川普敦促參議院通過《CLARITY法案》,他認為延遲的加密貨幣立法可能讓中國取得優勢,而他的政府則將美國宣傳為「世界加密貨幣之都」。
Sacks對Kimi K3的回應將相同的競爭論點應用於人工智慧:在不為美國開發者設置審批障礙的情況下,解決明確的風險。