根據OpenRouter最新數據測算,上周(8月3日至8月9日)全球AI大模型總調用量為69萬億Token,環比增長21.48%。
其中,上榜的AI大模型中,中國AI大模型周調用量達34.25萬億Token,環比增長21.76%;同期美國AI大模型周調用量為9.17萬億Token,環比增長109.36%。中國大模型周調用量連續十五周超過美國,穩居全球首位。


記者注意到,上周,全球調用量排名前四均為中國AI大模型。其中,DeepSeek-V4-Flash-0731(即DeepSeek-V4-Flash正式版)位居第一,周調用量達8.83萬億Token,環比增長570%;騰訊Hy3位居第二,周調用量達8.05萬億Token,環比增長67%;DeepSeek-V4-Flash-0423(即DeepSeek-V4-Flash預覽版)排名第三,周調用量達5.88萬億Token,環比下滑19%;小米MiMo-V2.5掉到第四,周調用量達5.39萬億Token,環比下滑14%。
7月31日,DeepSeek宣佈,DeepSeek-V4-Flash正式版API上線公測。據瞭解,DeepSeek-V4-Flash正式版的模型結構、尺寸和DeepSeek-V4-Flash預覽版保持一致,僅重新進行後訓練。據官方更新日誌顯示,V4-Flash正式版在Agent能力上大幅增強,基準測試遠超預覽版本。
據Artificial Analysis測算,V4-Flash正式版完成單項測試任務的平均成本約為0.03美元,只有Anthropic旗艦模型Claude Fable 5的1/100,成為目前全球主流模型中成本最低的模型。

OpenAI旗下GPT-5.6 Luna進入前五,周調用量達4.43萬億Token,環比增長128%。
7月10日,OpenAI正式公開發佈GPT-5.6系列模型,而GPT-5.6 Luna是該系列中速度最快、成本最低的模型,適用於大規模、高頻率任務處理,可支持工具調用和多步驟工作流程。該系列模型上線不到三周之際,OpenAI宣佈優化GPT-5.6系列模型定價和性能,以提升企業用戶AI應用的性價比。其中,GPT-5.6 Luna模型價格下調80%。
穀歌Gemini 3.6 Flash首次進入榜單,排名第九,周調用量達2.33萬億Token,環比增長446%。
Gemini 3.6 Flash於7月22日發佈。第三方測評機構Artificial Analysis Index的數據顯示,Gemini 3.6 Flash在輸出時消耗的token數量比上一代Gemini 3.5 Flash平均減少了17%。
其每百萬輸入Token價格保持在1.50美元,輸出價格則由上一代的9美元降至7.50美元,降幅約16.7%。
值得注意的是,此前一周排名第七的MiniMax M3和排名第九的階躍星辰Step 3.7 Flash跌出榜單。
來源:中國每日經濟新聞