“便宜、快速、跑得动”——这三个看似朴素的标签,正让一家中国AI公司在大模型赛道上跑出令全球瞩目的加速度。
全球最大的AI模型聚合平台OpenRouter最新发布的周度榜单显示,在7月27日至8月2日这一周里,来自中国深度求索(DeepSeek)的V4 Flash模型,以7.22万亿Token的调用量拿下全球第一。如果把这个数字翻译成更直观的语言:全球开发者在这七天里,让这台AI“大脑”处理了相当于上千万册《红楼梦》的文字量。
![]()
更惊人的是单日峰值。海外开发者社区平台OpenCode的数据显示,仅8月1日一天,DeepSeek V4 Flash的处理量就冲到了8万亿Token——其中5万亿来自免费试用,另外3万亿是真金白银的付费调用。
这把“价格屠刀”是怎么挥出来的?
DeepSeek V4 Flash到底有什么魔力?要回答这个问题,得先看看它的“身板”。
今年4月24日,DeepSeek正式发布V4系列,其中Flash版本的总参数规模为2840亿,但每次推理时只激活130亿参数。打个比方:别人开一辆大卡车送货,每趟都要烧满整箱油;DeepSeek V4 Flash则像一辆智能配送车,只装当下需要的货物,自然省油又跑得快。
![]()
7月31日,DeepSeek V4 Flash正式版API上线公测,新增了“思考模式”和“非思考模式”切换功能,让开发者可以根据任务复杂程度灵活选择。这款模型支持长达100万Token的上下文窗口,什么概念?相当于一次能“看完”《三体》三部曲外加几十篇论文,然后直接回答你的问题。
全球AI“总盘子”56.8万亿,中国连续14周领跑
把视角拉高,整个AI行业的增长势头同样令人瞠目。
OpenRouter数据显示,上周全球AI大模型总调用量达到56.8万亿Token。其中,仅中国AI大模型就贡献了28.13万亿Token,虽然比前一周略有回落,但这已经是连续第十四周超过美国,稳坐全球头把交椅。
![]()
相比之下,美国AI大模型上周调用量为4.38万亿Token,虽然环比猛增87.18%,但与中国仍有明显差距。
说明什么?不是美国AI变弱了,而是中国大模型太“卷”了。 当美国巨头还在拼参数规模、拼模型能力上限的时候,中国团队用极致性价比和开源策略,把AI能力送到了全球中小开发者的手边。
截至8月5日,DeepSeek V4 Flash的调用量仍以6.92万亿Token位居OpenRouter榜首,热度未见消退。
一个值得玩味的细节是:去年底高盛曾发布报告指出,中美AI模型的差距已缩短到3到6个月。从今天这份成绩单来看,在一些维度上——尤其是“有多少人真正在用”——差距,或许已经不存在了。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.