中国AI大模型在全球开发者社区和产业应用中的影响力仍在快速攀升。根据全球最大模型聚合平台OpenRouter的最新数据测算,在8月3日至8月9日的一周内,中国AI大模型的周调用量已达34.25万亿Token,连续第十五周超越美国,稳居全球首位。
同期美国AI大模型周调用量为9.17万亿Token,环比增长109.36%。中国与美国的调用量差距从上一周的约3倍扩大至近4倍。全球AI大模型总调用量达69万亿Token,环比增长21.48%。
DeepSeek-V4-Flash正式版首次登顶
上周调用量榜单中,全球排名前四的AI大模型全部来自中国。其中,DeepSeek-V4-Flash正式版以8.83万亿Token的周调用量位居全球第一,环比增长570%。
7月31日,DeepSeek正式发布V4-Flash正式版API公测,新版本延续2840亿参数、130亿激活参数和100万Token上下文能力,通过新一轮后训练显著增强了代码生成、工具调用、复杂任务处理和Agent能力。评测数据显示,该模型在终端操作测试Terminal Bench 2.1得分82.7,网络安全攻防模拟Cybergym得分76.7,工具调用综合测试Toolathlon Verified得分70.3,多项能力逼近行业顶级水平。
DeepSeek Harness能力也在新版本中首次亮相。据DeepSeek披露,本次公开基准测试中的CodeAgent任务使用了DeepSeek Harness极简模式作为框架进行测试。
腾讯Hy3以8.05万亿Token位居第二,环比增长67%;DeepSeek-V4-Flash预览版排名第三(5.88万亿Token,环比下滑19%);此前一周位列第二的小米MiMo-V2.5回落至第四(5.39万亿Token,下滑14%)。
快速落地的产业应用
新版本的商用落地速度同样引人注目。中国联通北京市分公司依托京元Token服务平台,在国产算力服务器上快速完成DeepSeek-V4-Flash正式版的部署上线。通过引入DSpark新一代推测解码加速框架,平台将模型推理性能提升到原MTP方案的2倍,每秒输出Token数达到60以上。
中国联通已在APP“臻选生活”专区上线了49元、79元和99元三档Token包月产品,用户可直接通过统一API接口调用最新模型能力。
从7月31日API公测到登顶全球调用量榜首,DeepSeek-V4-Flash正式版仅用了不到一周时间。模型能力的快速提升与产业应用的加速落地正在相互促进,推动中国AI大模型在全球竞争中保持领跑态势。