
在日前發布的最新一期《開放模型現況:2026年夏季觀察》報告中,全球知名人工智慧(AI)開源社群「抱抱臉」(Hugging Face)發現,中國AI企業在開放模型領域快速崛起,部分模型正成為美國千億級參數大模型的重要底座。
Hugging Face對1月至8月初在其平台上發布的開放模型進行了分析。分析顯示,在此期間,該平台上的公共模型倉庫數量從243萬個增加到296萬個,其中最引人注目的變化是中國AI企業在開放模型領域的快速崛起。
「在2026年的幾乎每個月,中國實驗室發布的最大、性能最高的開源模型都超過了美國實驗室發布的模型。」報告稱,中國團隊開源模型的月度最大參數規模介於7540億至2.78萬億之間,相比之下,美國團隊在過去7個月中有5個月公開的模型最大規模都低於1300億參數。

Hugging Face
報告特別提到,月之暗面、MiniMax、小米和智譜幾乎不再發布參數規模低於700億的模型,小米和美團今年均發布了參數規模超過1萬億的模型,而就在一年前,它們在開放權重模型領域還沒有廣為人知。
Hugging Face認為,這一變化一方面是因為單純打造大模型本身已經不再構成明顯差異化優勢,另一方面則得益於社區量化技術的發展,使得大型模型在發布後僅需數天便能夠在本地運行,從而為這種“大模型優先”的策略創造了條件。
同時,騰訊、阿里巴巴的通義千問大模型則採取了另一種模式,從參數規模不足10億的小模型一直涵蓋到超大規模模型。
Hugging Face將這兩類路線分別概括為不同的商業策略:前者,即專注於大型模型的企業,主要瞄準模型排行榜和API需求;後者則希望打造開發者預設使用的「模型家族」。
從總下載量來看,兩種策略的差異十分明顯。月之暗面模型下載量為3,700萬次,而涵蓋不同參數規模的Qwen模型下載量達到20.45億次,約為前者的55倍。
美國企業方面,美國超威半導體公司(AMD)和英偉達是今年發布新開放模型數量最多的公司,兩家公司發布的模型都超過200家。
儘管美國企業也推出了參數規模超過1000億的大模型,例如英偉達新一代開源大模型Nemotron 3 Ultra,但Hugging Face注意到,一些美國開發的模型實際上是以中國模型為底座,或者利用了中國實驗室公開的研究成果,例如思維機器實驗室的Inkling(952B)。
在模型許可證方面,中國團隊同樣表現出相對較高的開放程度。
報告統計,今年發布的、參數規模超過200億的178個中國模型中,59%採用Apache 2.0許可證,22%採用MIT許可證(兩者核心區別在於Apache 2.0增加了明確的專利授權以及對修改文件的聲明要求,而MIT則極其短小精悍、幾乎沒有限制)。 DeepSeek和智譜甚至以MIT許可證公開了參數規模在7000億至1.65兆之間的大模型。
相較之下,美國同等模式的授權方式更加分散,僅29%採用Apache或MIT許可證,41%採用自訂條款,另有30%未註明許可證。
Hugging Face認為,開放模式帶來的商業效益並非主要來自於授權收費,而是來自API、雲端服務、硬體以及平台等業務。智譜和kimi的估值表明,有效的開源策略也能在社群中獲得廣泛的認可和成長機會。
報告也單列一節特別指出,Qwen正逐漸成為開源社群「事實上的基礎模型」。目前,Hugging Face Hub上基於Qwen開發的衍生模型超過15.14萬個,是Meta全部模型衍生品數量的2.6倍,若僅比較Llama相關模型,Qwen的衍生模型數量甚至達到其4.7倍。

Hugging Face
2026年前7個月,Qwen衍生模型每天增加約180至210個。這顯示其普及並非僅由單一模型的發布所驅動,而已事實上成為開發者在微調和部署時的預設工作流程的一部分。
Hugging Face認為,這項結果得益於Qwen團隊定期發布新模式、涵蓋廣泛的參數規模,以及Apache 2.0授權帶來的較低使用門檻。
而擁有廣泛的模型家族和應用普及程度非常重要,這有助於在開發者、模型發布方和未來用戶之間形成良性反饋循環,能嵌入基礎設施並成為生態系統一部分的模型,最終可能找到一條具有商業可行性的成功路徑。
