科技

AI模型蒸餾成美中科技戰新焦點 美國科技業面臨兩難

AI模型生成的文本也經常包含與原作相同的角色名稱、情節元素和主題設定。這種現象更接近改作而非單純的思想借用,在著作權法上可能同樣面臨侵權質疑。(圖/AI生成)
蒸餾是讓較小型模型具備更強能力的關鍵技術之一,而要進行蒸餾,必須先有前沿模型,再將其能力蒸餾到較小型模型中。(圖/AI生成)

今年稍早,Google AI主管Jeff Dean在一檔Podcast中談到一項當時還鮮少受到科技圈以外關注的技術概念「蒸餾」,Dean在談到Google AI模型的開發時表示,Google當時希望在不依賴單一大型影像辨識模型的情況下提升系統效能,因此發現了人工智慧蒸餾技術。記者許若茵/編譯

今年稍早,Google AI主管Jeff Dean在一檔Podcast中談到一項當時還鮮少受到科技圈以外關注的技術概念「蒸餾」,Dean在談到Google AI模型的開發時表示,Google當時希望在不依賴單一大型影像辨識模型的情況下提升系統效能,因此發現了人工智慧蒸餾技術。

Dean說明,蒸餾是讓較小型模型具備更強能力的關鍵技術之一,而要進行蒸餾,必須先有前沿模型,再將其能力蒸餾到較小型模型中,僅僅5個月後,蒸餾突然從矽谷一路成為華盛頓特區的熱門議題,科技業人士與美國國會議員開始爭論,這項技術是否正在成為國家安全威脅,以及是否讓中國得以在高風險的AI競賽中追趕美國。

上週末,中國AI實驗室Moonshot AI發布Kimi K3後,相關討論進一步升溫。使用者很快發現,Kimi K3的能力已能與Anthropic及OpenAI目前最頂尖的商用AI競爭,與販售專有模型使用權的美國主要AI公司不同,Moonshot及其他中國AI實驗室提供所謂開放權重模型,使用者可以下載技術、進行調整,並在自己選擇的環境中運行。

部分美國政府官員將Moonshot快速追趕的原因歸咎於蒸餾,並形容這是竊取美國智慧財產,尤其指控其將Anthropic的前沿模型Fable納入開發。

白宮顧問Michael Kratsios週三在X發文表示,美方掌握的資訊顯示,MoonshotAI曾蒸餾Anthropic的Fable,用於開發K3。他指出,Moonshot為此建立了複雜的內部平台,大規模對美國模型進行蒸餾,並能快速切換不同存取方式以避免被偵測。

「AI履歷健檢」看見自己優勢:https://campaign.1111.com.tw/resume-review/
更多科技工作請上科技專區:https://techplus.1111.com.tw/

從廣義來看,蒸餾是利用聊天機器人的回答或先進AI模型產出的成果,訓練另一個模型。這項做法之所以具有爭議,是因為在特定使用方式下,模型開發商可能直接利用已投入數百萬甚至數十億美元研發先進訓練技術的企業所產生的成果,打造具有競爭力的產品。

AI安全公司SecurityPal創辦人Pukar Hamal形容,這就像有人去聽課、讀教科書並完成所有艱難的作業,另一名學生卻沒有做這些事,只問能不能直接抄走對方的成果。

無論是Kratsios的發文或其他因素,全球科技業巨頭週五罕見地集體表態。Nvidia、Microsoft、Meta、Palantir等科技公司與20多家企業共同發布公開信,敦促政策制定者避免對開放權重AI模型「過早限制」,以免「扼殺競爭或將創新推向海外」。

這些企業在信中表示,蒸餾,也就是利用一個模型的輸出協助訓練或改進另一個模型,是模型改進、演進與驗證過程中廣泛使用的技術。

不過,蒸餾的興起也讓美國政策制定者面臨兩難。美國政府長期關注中國科技涉及的智慧財產竊取及國家安全問題,如今則必須重新思考如何處理模型輸出被其他國家利用的情況。

Georgetown大學安全與新興科技中心研究員ColinShea-Blymyer表示,美國政府目前仍在尋找適當立場。

他指出,美國政府可能主張,中國及俄羅斯企業利用美國模型辛苦產出的成果提升自身模型效能,因此取得了不公平優勢。

雲端軟體公司Box執行長Aaron Levie也是週五公開信的連署者之一。他接受採訪時表示,若要維持競爭力,美國企業必須能夠取得最好的技術,無論這項技術是在美國、中國或其他地方開發。

Levie表示,整體而言,創新越多,不論來自美國、中國或其他地方,都應該帶來更多AI進展,並使AI成本持續下降、效率逐漸提升。

雖然目前討論多集中在Kimi K3等中國開放權重AI模型,但Info-Tech Research Group研究主管Shashi Bellamkonda表示,許多企業在開發自己的模型時也使用蒸餾技術。

例如Nvidia就曾在Llama Nemotron系列模型的訓練過程中使用蒸餾,相關做法也記載於配套研究論文中。

Bellamkonda表示,利用大型模型的輸出訓練更小、更便宜的模型,是一項合理且非常有價值的技術,而且一直被廣泛使用。

然而,Anthropic的立場有所不同,因為公司能看到自家模型如何被使用,同時也需要保護快速成長的商業利益。

Anthropic今年2月表示,中國的DeepSeek、Moonshot及MiniMax正以「工業規模」蒸餾其Claude模型,使用約2.4萬個假帳號,產生1600萬次交流。

Anthropic目前估值接近1兆美元,並計畫在不久的將來上市。公司表示,阻止非法蒸餾涉及國家安全。

Anthropic指出,公司與其他美國企業打造的AI系統,可以阻止國家及非國家行為者利用AI開發生物武器或進行惡意網路活動,因此需要產業、政策制定者及全球AI社群迅速採取協調行動。

OpenAI與Anthropic都已在服務條款中禁止蒸餾。Bellamkonda表示,兩家公司基本上是在主張,未經授權使用其大型模型,可能構成智慧財產竊取。

但隨著AI開發成本持續攀升,企業也會想盡辦法提升效率。Hamal表示,若在SecurityPal使用Kimi K3等中國開放權重模型,他不會有太大疑慮。Security Pal利用AI自動化安全評估,而採用這類模型可能為公司節省大量成本。

Hamal表示,公司會確認程式碼中沒有惡意後門,但完成評估後,若將模型部署在自己的基礎設施上,並沒有理由不能使用。

然而,Anthropic與OpenAI在主張蒸餾涉及智慧財產竊取時,也面臨一項棘手問題。兩家公司本身都曾利用其他來源的內容建立模型,並因此遭到相關訴訟。

代表作家對AI公司提起著作權訴訟的Boies Schiller Flexner律師Max Pritt表示,美國政府同樣面臨這項問題。

Pritt指出,美國政府目前公開強調保護科技公司的智慧財產,但對於創作者及個人智慧財產在未經授權情況下被使用的問題,則大多保持沉默。

資料來源:CNBC

這篇文章 AI模型蒸餾成美中科技戰新焦點 美國科技業面臨兩難 最早出現於 科技島-掌握科技新聞、科技職場最新資訊

Author