近期,中國人工智慧公司深度求索(DeepSeek)開發的AI模型DeepSeek-V3,因其宣稱的低成本、高效能優勢,在美國科技投資界引發震動。然而,多方證據顯示,DeepSeek可能以不正當手段「借用」美國OpenAI的技術,其真實成本也可能遠高於先前聲稱的數字。
DeepSeek被指控「蒸餾」OpenAI模型
OpenAI和美國白宮官員表示,DeepSeek可能透過「蒸餾」技術,利用OpenAI的專有技術開發其AI產品。OpenAI發言人指出,中國組織正積極嘗試複製美國先進AI模型,他們正在評估DeepSeek可能不當「蒸餾」其模型的跡象。「蒸餾」是一種透過訓練小型模型模仿大型模型行為的技術,目的是將複雜模型的知識提煉到簡單模型,以提高AI效率並降低成本。
OpenAI發言人強調,開發人員可以合法使用蒸餾技術來提升應用水平,但根據OpenAI的官方使用條款,禁止使用OpenAI模型的產出來開發與其競爭的AI模型。白宮人工智慧與加密貨幣事務主管塞克斯(David Sacks)也表示,DeepSeek「很可能」竊取了美國的智慧財產權。
社群媒體流傳的截圖顯示,DeepSeek V3模型有時會「坦言」自己基於ChatGPT-4的設計架構,甚至自稱自己是ChatGPT,這似乎佐證了DeepSeek直接移植OpenAI技術的指控。喬治城大學安全與新興科技中心分析師費爾德蓋斯(Jacob Feldgoise)指出,DeepSeek是否使用OpenAI的o1模型來訓練其R1模型,是目前的一大爭議點。
DeepSeek的低成本說法遭質疑
DeepSeek團隊最初聲稱,其開發DeepSeek-V3模型僅花費不到600萬美元,但這一說法受到質疑。半導體研究和顧問公司SemiAnalysis的報告指出,DeepSeek的主要投資方早在2021年就囤積了一萬塊輝達A100 GPU,僅GPU方面的投資就超過5億美元,伺服器總資本支出約16億美元。矽谷科技投資公司Altimeter Capital創辦人格斯特納(Brad Gerstner) 也認為,DeepSeek以600萬美元研發出媲美OpenAI等公司AI工具的說法是「假新聞」。
晶片來源和出口管制問題
有報告指出,DeepSeek可能透過第三方繞過美國對高階晶片的出口管制,取得大量輝達晶片來支援其AI模型的開發。美國商務部正在調查DeepSeek是否使用了被禁止運往中國的美國晶片。DeepSeek表示使用了輝達的H800晶片,這款晶片在2023年可以合法購買。美國政府也正在調查DeepSeek是否透過新加坡的第三方實體取得高效能的輝達晶片。
輝達發言人表示,DeepSeek的成功是「測試時擴展」技術的典範,並未直接回應是否使用了受制裁的高階晶片。同時,白宮國家安全委員會也已開始調查DeepSeek是否對美國國家安全構成影響。國會議員也要求白宮考慮將目前允許向中國出口的輝達H20晶片列入出口管制對象,並嚴格管制可用於AI推理的晶片設計技術。
DeepSeek的隱私權和安全隱憂
DeepSeek的隱私權政策明確指出,其收集的資訊將儲存在中國的伺服器上,引發了美國國會議員對國家安全的擔憂。他們要求禁止聯邦政府設備和關鍵基礎設施安裝中國的AI工具。美國國會議員也呼籲調查新加坡是否成為中國實體取得被禁晶片的中轉國,並表示若有國家不願打擊相關活動,應受到更嚴格的許可要求。
義大利政府已因用戶資料隱私考量封鎖DeepSeek在該國的使用,並對其所有者進行調查。台灣和美國德州也已禁止公務機關和關鍵基礎設施使用DeepSeek等中國應用。
用Podcast訂閱本節目