記者黃仁杰/編譯
TikTok母公司字節跳動(ByteDance)據報已禁止員工利用美國人工智慧模型進行模型蒸餾,以避免引發華府進一步反制;另一方面,Claude開發商Anthropic也證實,正籌組內部晶片設計團隊,投入客製化AI晶片開發。

據原文引述《The Information》報導,字節跳動近期明確要求員工,不得透過美國AI模型的輸出訓練自家模型。報導稱,公司擔心相關行為可能引發美國政府報復,進而波及其重要海外資產TikTok。不過,目前尚未見字節跳動公開說明,也未有其他主要媒體獨立證實相關內部命令。
模型蒸餾是指利用能力較強的「教師模型」產生資料或評估答案,再將這些能力轉移至規模較小的「學生模型」。這項技術本身廣泛用於AI開發,但爭議主要集中在企業是否未經授權,大量擷取封閉模型的輸出,用於訓練競爭產品。
「AI履歷健檢」看見自己優勢:https://campaign.1111.com.tw/resume-review/
更多科技工作請上科技專區:https://techplus.1111.com.tw/
美國AI業者近期持續指控部分中國企業利用大量帳號,繞過地區及服務限制存取美國模型。Anthropic先前表示,DeepSeek、月之暗面(Moonshot AI)與MiniMax曾利用約2.4萬個虛假帳號,與Claude進行超過1,600萬次互動,以取得推理、程式設計及工具使用等能力。相關中國企業當時未回應置評要求。
爭議在月之暗面推出Kimi K3後進一步升高。美國白宮官員指控,月之暗面利用Anthropic的Fable模型蒸餾Kimi K3,並透過泰國存取受出口管制的輝達GB300伺服器。不過,相關官員並未公開提出證據,也有AI專家認為,模型蒸餾不足以單獨解釋Kimi K3的能力提升。
原文另稱,阿里巴巴也曾禁止員工使用Claude,以降低旗下Qwen模型遭質疑進行蒸餾的風險。不過,阿里巴巴對內提出的主要理由是資訊安全疑慮,並將Claude Code列為高風險軟體,要求員工改用自家工具Qoder,而非公開承認此舉是為避免蒸餾爭議。
與此同時,Anthropic已證實正在建立內部晶片設計團隊,希望透過硬體與模型共同設計,提升Claude的效能、能源效率及運算規模。公司目前正招募具備晶片設計、驗證及軟硬體整合經驗的工程師,但尚未公布產品時程或晶片用途。
Anthropic表示,即使投入客製化晶片研發,仍會維持「多晶片策略」,繼續採用亞馬遜AWS、Google、輝達與AMD提供的運算硬體,並非全面轉向自研晶片。
先前報導指出,Anthropic曾與三星洽談,由三星擔任潛在晶片製造夥伴,但雙方仍處於早期討論階段,Anthropic也尚未決定晶片用途、伺服器配置或運算規格。
至於原文所稱Anthropic將與博通合作,目前沒有可靠消息證實。博通實際合作的對象是OpenAI,雙方共同開發名為Jalapeño的AI推論晶片;因此不能將博通直接列為Anthropic自研晶片計畫的合作夥伴。
來源:wccftech
—
本篇文章授權來源:科技島