文章上線

Anthropic 執行長 Dario Amodei 闡明立場:並非反對公開權重模型,但警告威權主義 AI 的風險

Anthropic 執行長 Dario Amodei 闡明立場:並非反對公開權重模型,但警告威權主義 AI 的風險

目錄

你可能想知道的事項

1. Anthropic 是否支持禁止公開權重的 AI 模型,特別是來自中國的那些?

2. Anthropic 的領導層認為哪些具體風險比開源模型本身更值得關注?

主要議題

週一下午,Anthropic 創辦人兼執行長 Dario Amodei 發布了一則澄清,回應業界關於他的公司主張禁止公開權重模型的揣測。他明確表示: Anthropic 從未支持禁止公開權重模型。Amodei 指出,熟悉他先前著作的人應已理解他的立場,但他刻意重申,以消除任何殘留的疑慮。

這項澄清接續了一封由 NVIDIA 執行長 Jensen Huang 發起的公開聯署信,該信敦促政策制定者不要匆忙對公開權重 AI 模型實施限制。這封由多家大型 AI 公司簽署的信並未針對任何特定國家,但業界討論很快轉向對中國的關切。關切的焦點並非僅在於中國實驗室公開模型,而在於有指控稱某些中國組織可能透過挪用美國公司的智慧財產來加速其能力。

在這些指控中被提及的技術之一是模型蒸餾(model distillation),此過程透過大量探測一個模型來學習另一個模型的行為與內部模式。批評者認為,此類做法可以在不直接取得原始訓練資料或權重的情況下複製能力。Amodei 將開放性問題與地緣政治風險區分開來:他認為許多公開權重模型在不具危險能力時是無害或有益的。用他自己的話說,不具危險能力的公開權重模型可視為公共財。它們除了執行時的運算成本外,幾乎不花費,卻能為企業、開發者與研究人員帶來相當的價值。

同時,Amodei 描述了另一類讓他夜不能寐的恐懼。他的主要擔憂不是企業運行開源模型,而是威權政府可能開發出超越美國能力的 AI 系統,並利用該優勢追求持續的軍事主導地位或加強國內鎮壓。他以中國共產黨為威權國家中最具能力的例子,但也澄清其他威權國家在濫用方面並非沒有可能性。

除了地緣政治與軍事的關切外,Amodei 也提出了 AI 促成的生物性威脅。他主張,在涉及生物攻擊向量的情境中,公開權重模型會帶來特殊問題,因為一旦發布後很難監控且難以對其施加強而有力的安全防護。引用英國 AI 安全研究所(U.K. AI Security Institute)的一份分析,他強調公開權重的發布往往是不可逆的;一旦公開,模型就無法完全收回。在模型可能被改作惡用的情境中,這種永久性會放大風險。

開源支持者對此說法提出異議,認為更廣泛地讓有能力的模型可獲取能使防禦能力民主化:如果強大模型不集中於少數實體,防禦者與獨立研究者能夠發現漏洞、測試緩解措施並建立保護工具。Amodei 的觀點承認開放對創新與防禦的好處,但對於缺乏全球協調與可強制執行的安全措施的情境仍持謹慎態度。

為了處理對中國可能濫用先進 AI 的特定擔憂,Amodei 提出數項他認為可行的政策做法。他重申支持現有限制中國取得尖端晶片的措施——這一要素已存在於美國政策中——並呼籲在涉及非法智慧財產轉移時,對蒸餾行為實施正式打擊。美國政府先前已警告,若有證據顯示與 AI 模型相關的智慧財產竊取,將可能採取制裁;Amodei 的建議與此立場一致。

重要的是,Amodei 表示支持一個國際性的模型安全測試制度。他歡迎由部分美國政府主導或業界提出的努力,旨在為最具能力的 AI 系統建立獨立的安全測試。他強調測試必須在全球範圍內適用,並且應涵蓋公開或封閉的模型,同時對來自新創公司與學術研究的低能力模型予以豁免。要求測試具有全球性為政治上帶來難題:這需要所有主要 AI 開發國家(包括中國共產黨)合作。儘管有此障礙,Amodei 認為在防止 AI 促成的生物性威脅方面,有限的合作可能是可行的,因為此類合作也可能符合中國的利益。

總而言之,Amodei 的澄清平衡了兩條主線:原則性地為不具危險能力的公開權重模型辯護,以及對威權國家開發或部署的先進 AI 系統所構成的戰略與生物風險提出冷靜的警告。他的立場反對對開放性的簡單禁令,同時主張以針對性的政策——出口管制、打擊非法智慧財產轉移與全球安全測試——來應對他所識別的較急迫威脅。

這一立場處在技術、倫理與地緣政治辯論的交叉點上,關於如何管理強大 AI 技術。它凸顯一個反覆出現的主題:開放與創新帶來重要利益,但必須配合治理機制以減輕超越國界與商業利益的風險。

重點洞見表

面向描述
Anthropic 的立場Anthropic 不支持禁止公開權重模型,且從未主張此類禁令。
公開權重作為公共財不具危險能力的公開模型可為開發者、研究人員與企業提供低成本的價值。
主要關切威權國家開發出用於軍事或鎮壓目的的優越 AI——中國被引用為最具能力的例子。
生物風險AI 可能促成生物攻擊;公開權重的發布尤其具風險,因為一旦公開就難以控制。
政策建議限制先進晶片取得、對非法蒸餾/智慧財產竊取執法,並為高能力模型建立全球安全測試。
全球測試要具備效力需全球參與,包括威權政府的合作,才能具公信力。

後續…

展望未來,Amodei 所突顯的辯論反映出一項更廣泛的需求:在開放研究的益處與地緣政治競爭及非對稱風險的現實之間取得和解。實際的下一步可能包括就測試與出口管制達成多邊協議、建立更清晰的蒸餾與智慧財產保護規範,以及強化監測危險雙用途應用的國際機制。要達成此類協調將複雜且緩慢,但有針對性、透明且以證據為本的政策能在保留公開權重模型所促進的技術創新同時,降低最嚴重的風險。

最終,Amodei 的言論邀請一場細緻的討論:在安全且有價值的情境下保留開放性,但在關鍵生死存亡的風險處建立可強制執行的全球防護。這種平衡將在未來數年內界定 AI 治理議程的很大一部分。

最後編輯時間:2026/7/28
#輝達

Claude AI

AI 智能編輯