DeepSeek大模型的出色表現引發美國AI行業上下震動,不僅性能與OpenAI O1旗鼓相當,更關鍵的是訓練成本低得多,也引發了美國政府的猜疑和調查,新加坡都被牽扯進來。

DeepSeek官方沒有詳細披露大模型訓練的硬件規模,只說用了數量有限的2048顆H800 GPU,在兩個月內訓練了6710億個參數的V3大模型,相當于280萬個GPU小時。
相比之下,Meta花了16381顆H100 GPU、54天實現,訓練了4050億個參數的Llama 3大模型,相當于3080萬個GPU小時,硬件成本相差多達11倍。
半導體研究機構SemiAccurate提出,DeepSeek應該囤積了大約6萬顆NVIDIA GPU,包括1萬顆A100、1萬顆H100、1萬顆H800、3萬顆H20,總成本超過140億元。
其中,A100、H100始終都在美國限制對華出口只列,H800作為特供版一度合規,之后也被限制,目前只有H20是完全合規的。
歐美普遍認為,DeepSeek通過美國出口監管漏洞,獲得了NVIDIA高端的H100 GPU,而且數量不少,最多可能有5萬顆。


根據NVIDIA的財報,2022年底,美國剛剛限制AI芯片對華出口的時候,新加坡貢獻的收入占比只有9%,但是到了現在,這個比例已經高達22%,顯得很不正常。
因此,美國白宮、FBI等機構正在調查,DeepSeek是否通過位于新加坡的第三方公司,獲得了管制出口的NVIDIA AI GPU。
同時,美國有關人士呼吁對新加坡進出口采取更嚴格的監督、管控措施,避免受限產品轉而進入中國。
不過,截至目前,美國政府尚未發現任何確鑿證據。
NVIDIA則回應稱,已知嚴格遵守法律要求,與新加坡的大多數交易都是運往其他地方的貨物,而不是中國。
NVIDIA強調,與新加坡相關的收入并不意味著轉移到中國,其公開文件顯示的是客戶賬單地址而非發貨地址。

根據在線分析平臺Semrush的數據,盡管ChatGPT仍然是全球最受歡迎的AI應用之一,但其流量正在下降,而新興的DeepSeek正在迅速崛起。
數據顯示,目前DeepSeek在消費者活動方面仍落后于ChatGPT,ChatGPT的平均每日訪問量保持在數千萬。
不過ChatGPT最近的流量有所下降,在2024年10月1日它有2210萬訪客,但到1月19日,這一數字已降至1490萬。
與此同時,DeepSeek的訪問量正在快速增長,到2025年1月19日,其訪問量已增長到712萬次,幾乎增長了三倍。
不僅如此,DeepSeek還迅速攀升至140個國家的蘋果App Store下載排行榜首位,并在美國的安卓Play Store中同樣占據榜首位置。
尤為值得一提的是,印度成為了這款應用新用戶增長的最大“引擎”,其下載量占據了所有平臺下載總量的15.6%。

近一周以來,DeepSeek不僅引發了美國硅谷的恐慌,也讓很多原本不關心AI的人感受到了中國AI大模型的震撼。
不過,國外老牌硬件網站Tomshardware發文稱,DeepSeek可能沒有宣傳的那么具有顛覆性,在AI領域不存在奇跡。
以下為文章節選(僅供參考,不代表本站觀點):
中國初創公司DeepSeek最近因其先進的AI模型R1的計算資源使用量驚人地低,而成為科技界的焦點。
該公司聲稱DeepSeek的訓練成本僅為600萬美元以及2048個GPU,其最新的R1模型可以與Open AI的o1相媲美。
然而,行業分析公司SemiAnalysis報告稱,DeepSeek背后的公司花費了16 億美元的服務器成本,并擁有50,000 個NVIDIA Hopper GPU。?
報告稱,DeepSeek運營著一個擁有約50,000個Hopper GPU的龐大計算基礎設施。根據 SemiAnalysis 的數據,其中包括10,000個H800和10,000個H100,另外還購買了H20芯片。
這些資源分布在多個位置,用于AI訓練、研究和財務建模等。SemiAnalysis的數據顯示,該公司在服務器上的總資本投資約為16億美元,估計運營成本為9.44億美元。
DeepSeek 起源于High-Flyer(幻方),這是一家中國對沖基金,很早就采用了人工智能,并在GPU上投入了大量資金。
2023 年,High-Flyer成立了 DeepSeek,作為一家專注于人工智能的獨立企業。與許多競爭對手不同,DeepSeek 仍是自籌資金,這使其在決策方面具有速度和靈活性。
DeepSeek的一個主要優勢在于它能夠運行自己的數據中心,而大多數其他AI初創公司則依賴外部云提供商。這種獨立性允許其完全控制測試和AI模型優化。
此外,它能夠快速迭代而不受外部瓶頸的影響,這使得DeepSeek與業內傳統參與者相比效率極高。
根據SemiAnalysis的數據,DeepSeek只在中國境內招聘,注重員工的技能和解決問題的能力,而非資歷。
DeepSeek面向北京大學、浙江大學等知名高校招聘人才,并提供極具競爭力的薪水。根據研究,DeepSeek的一些人工智能研究人員的薪酬超過130萬美元(約合942.7萬元人民幣),超過了 Moonshot(月之暗面)等其他領先的中國人工智能公司的薪酬。
SemiAnalysis報告稱,由于人才的涌入,DeepSeek率先推出了MLA等創新技術。DeepSeek 強調效率和算法改進,而不是蠻力擴展,重塑了人們對AI模型開發的期望。
出于多種原因,這也讓大家相信,技術的快速進步可能會減少對高端GPU的需求,從而對NVIDIA等公司產生利空應影響。
最近有消息稱,DeepSeek 僅花費600萬美元訓練其最新模型,但這個數字僅指總訓練成本的一部分——不包括研究、模型改進、數據處理或整體基礎設施費用。
事實上,自成立以來,DeepSeek在人工智能開發上花費了超過5億美元。SemiAnalysis認為,與受官僚主義困擾的大型公司不同,DeepSeek 的精益結構使其能夠積極推動人工智能創新。
DeepSeek的崛起凸顯了一家資金雄厚的獨立AI公司如何挑戰行業領導者。但現實情況要復雜得多:SemiAnalysis 認為DeepSeek的成功建立在數十億美元的戰略投資、技術突破和有競爭力的員工隊伍之上。
這意味著沒有什么奇跡。正如埃隆·馬斯克一年前指出的那樣,如果你想在AI領域具有競爭力,你就必須每年投入數十億美元。

在DeepSeek的強大壓迫感下,OpenAI CEO(Sam Altman)奧特曼即將開啟全球巡演,積極啟程拜會投資人、產業領袖。
據報道,奧特曼在30日一場閉門會議向政策制定人士提出他的擔憂,認為DeepSeek凸顯“Stargate計劃”的必要性。?
本周起,奧特曼將前往日本、韓國、印度、德國、法國、迪拜,與投資者、開發商及業界領袖會面。
據悉,奧特曼周一于東京將拜訪軟銀集團創辦人暨社長孫正義,日本總理石破茂也與OpenAI總裁布洛克曼(Greg Brockman)會面。?
然后奧特曼將前往首爾,去新德里與投資人洽談合作,然后周五參加柏林工業大學的AI專題演講。
接著下一周,奧特曼將參加巴黎AI高峰會,包括Google DeepMind執行長哈薩比斯(Demis Hassabis)、Anthropic共同創辦人暨執行長阿莫迪(Dario Amodei)也會出席。
隨后奧特曼前往迪拜參加世界政府高峰會,同場還有 Google 執行長皮蔡(Sundar Pichai)、甲骨文董事長艾利森(Larry Ellison)及阿里巴巴集團主席蔡崇信。
“人們對OpenAI的技術非常感興趣,包括我們下一代 AI Agent如何實現經濟價值。”OpenAI 31 日聲明表示,“我們將在未來幾周與多個國家的商業領袖、開發者及合作伙伴會面。”
2025年1月22日,特朗普宣布軟銀、OpenAI、甲骨文聯合成立一家新AI公司Stargate,計劃在未來四年投資5000億美元,并將立即投資1000億美元,為OpenAI建設新的AI基礎設施。
Stargate的初始股權投資者包括軟銀、OpenAI、Oracle和MGX,其中軟銀負責財務,OpenAI負責運營,Arm、微軟、NVIDIA、Oracle和OpenAI是該項目的關鍵初始技術合作伙伴。
