近几周,美国国内对中国开源权重AI模型所谓“泛滥”的担忧之声不绝于耳。然而,DeepSeek新近实施的尖峰时段定价机制,恰恰印证了这些担忧实属多余,并表明其大多数用户仍主要位于亚洲地区。
诚然,这种格局对于中国其他一些备受瞩目的AI模型——如阿里巴巴的通义千问(Qwen)系列大语言模型——可能同样适用。但即将到来的需求规模之庞大,着实令人叹为观止。仅通义千问系列模型,在Hugging Face平台上的下载量占比,就已达Meta开源权重模型的2.6倍之多!

尖峰定价机制揭示用户地域分布
七月底,DeepSeek发布了其最新的Flash级模型迭代版本,命名为V4-Flash-0731。尽管该模型参数量仅为2840亿,但其性能却可与据信参数规模达数万亿的Anthropic旗下Opus 4.8模型相媲美。更令人瞩目的是,DeepSeek将V4-Flash-0731的定价设为:输入每百万词元仅0.14美元,输出每百万词元仅0.28美元。
紧接着,就在上周,DeepSeek开始在自家API和Chat平台上推出V4-Pro模型,定价为:输入每百万词元0.435美元,输出每百万词元0.87美元。根据微信上的初步基准测试显示,V4-Pro模型在Terminal Bench 2.1、Cybergym、DeepSWE和AutomationBench等多项基准测试中,表现均优于Opus 4.8。
需要指出的是,DeepSeek有限的算力可能已被其V4级模型的汹涌需求所淹没。毕竟,该AI实验室在七月的词元消耗量上已仅次于Anthropic,甚至可能在未来数月内登顶。
因此,DeepSeek现已实行尖峰时段定价机制:
V4-Flash输入价格:从每百万词元0.14美元上调至0.22/0.44美元(非尖峰/尖峰时段)
V4-Flash输出价格:从每百万词元0.28美元上调至0.66/1.32美元(非尖峰/尖峰时段)
V4-Pro输入价格:从每百万词元0.435美元上调至0.66/1.32美元(非尖峰/尖峰时段)
V4-Pro输出价格:从每百万词元0.87美元上调至1.98/3.96美元(非尖峰/尖峰时段)
关键在于,DeepSeek的尖峰时段为北京时间09:00至12:00和14:00至16:00,这表明其大多数用户仍位于亚洲,从而安抚了外界对于美国企业大规模转向采用这些模型的担忧。
阿里巴巴通义千问3.8模型下载量远超Meta开源权重模型
阿里巴巴近期发布了两个主要的通义千问3.8级模型。首先,Qwen 3.8-Max(2.8万亿参数)在性能上仅次于月之暗面的Kimi K3。然而,更引人注目的是Qwen 3.8(270亿参数)模型,其编程能力与Opus 4.5相当,却能在一台MacBook上流畅运行!
鉴于中国许多开源权重模型如今的能力已大致等同于OpenAI和Anthropic提供的专有模型,它们人气飙升也就不足为奇了。
事实上,全球最大的开源权重AI模型库之一——Hugging Face——上周刚指出,阿里巴巴的通义千问模型目前衍生态已达151,448个(总下载量),大约是Meta开源权重模型下载量的2.6倍!



