國產大模型改寫全球AI調用版圖
222
訂閱已訂閱已收藏
收藏點擊播報本文,約
近日,全球模型聚合平台OpenRouter最新周度Token(詞元)調用榜單出現歷史性變化:前五名全部為國產大模型,DeepSeek V4 Flash位居榜首,小米MiMo V2.5、騰訊Hy3、DeepSeek V4 Pro、智譜GLM5.2依次位列第二至第五名。DeepSeek V4 Flash正式版上線后,單日使用量和合作平台新訂閱用戶均實現約30%的增長,憑借突出的性價比優勢,扭轉全球AI開發者的使用格局。
DeepSeek為何登頂全球調用榜?這體現了我國大模型產業怎樣的競爭優勢?科技日報記者就此採訪了有關專家。
第一問:DeepSeek為何登頂全球調用榜?
對於“登頂”原因,中國電子信息產業發展研究院未來產業研究中心人工智能研究室主任鐘新龍表示,直接原因是DeepSeek V4 Flash正式版的上線。
他介紹,該正式版將此前發布的預覽版的能力驗証轉化為穩定的商用服務,上線過程中,DeepSeek與合作平台同步推進舊有版本用戶的遷移以及舊接口停用,使用戶調用在短期內集中到該正式版。
同時,極致性價比疊加智能體需求放大了該正式版的用戶需求。數據顯示,該版本官方價格為每百萬Token輸入1元、輸出2元,且智能體應用場景Token消耗量大,市場需求水漲船高。據報道,該版本上線后,單日使用量和合作平台新訂閱用戶均增長30%,說明它的發布既提高了存量用戶的使用頻次,也帶來了新增客戶的入場。“可以理解為,正式版上線觸發了需求,成本性能比和智能體生態又將需求持續放大。”鐘新龍說。
第二問:國產模型在技術層面有哪些優勢?
在國產模型包攬榜單前五的背景下,我國大模型在技術層面的優勢值得關注。“國產大模型的突出優勢,已經擴展到全鏈路工程能力。”鐘新龍表示。
以DeepSeek V4 Flash為例,通過混合專家、稀疏注意力和長上下文壓縮等技術路徑,在百萬級上下文、推理能力、工具調用和低價格之間形成平衡﹔小米MiMo V2.5、騰訊Hy3、DeepSeek V4 Pro及智譜GLM 5.2,則分別在多模態、代碼生成、長程規劃和復雜推理等方向上形成互補。
“更為關鍵的是,國內企業能夠快速完成灰度測試、正式發布、接口遷移和多平台分發,從而將技術進步迅速轉化為全球開發者的實際調用。”鐘新龍說。
第三問:將給國內AI企業帶來哪些機遇與挑戰?
從更長周期看,國產模型在海外推理成本上的優勢,正在為產業發展打開新空間。
我國大模型普遍採用MoE(混合專家)架構,這一架構可以通過降低參數激活比來壓縮推理成本。通俗來講,一個公司有幾十個專家,處理一個任務時,MoE架構下隻需要“激活”幾個最擅長的專家來完成,而不需要動用所有專家,從而實現有效“降本”。
在鐘新龍看來,國內AI企業可以利用該正式版發布的窗口吸引全球開發者,並由低價API(應用程序接口)服務逐步延伸至推理工具鏈、行業解決方案等高附加值環節,擴大發展空間。同時,調用量增長還將拉動國產推理芯片、服務器、存儲等基礎設施需求,為軟硬件協同優化提供真實場景。
不過,挑戰同樣不容忽視。鐘新龍表示,高調用未必帶來高利潤,正式版發布形成的流量峰值會考驗企業的算力供給、服務穩定性、故障恢復能力等,持續低價還可能壓縮利潤空間。此外,海外市場對版權合規、網絡安全及審計等方面的要求日益嚴格,持續抬高合規門檻。“對國內企業而言,要進一步把價格優勢轉化為穩定服務能力、合規交付能力、開發者生態以及高價值應用。”鐘新龍建議。
關注公眾號:人民網財經
分享讓更多人看到
- 評論
- 關注































微信掃一掃


第一時間為您推送權威資訊
報道全球 傳播中國
關注人民網,傳播正能量