DeepSeek史上最为轰动的全面提价行动,仅仅维持了23天。
8月17日,DeepSeek正式对V4系列API价格作出调整。无论是主打性价比的Flash,还是性能更强的Pro,输入与输出价格均出现明显上调。部分媒体经过细致计算后,甚至得出高达1100%的涨幅数据。
当时,不少观察者认为,那个曾以低价震撼全球的DeepSeek,终于要开始认真追求盈利了。
然而,新价格尚未满月,DeepSeek便突然宣布降价。此次价格松动的,是负责走量、主打性价比的Flash模型。
自9月10日12点起,Flash系列的缓存命中输入最高降价60%,缓存未命中输入降价约33%,输出价格也进行了小幅下调。
不过,更有趣的是,DeepSeek V4 Flash的这次降价,降得并不彻底。在一些关键指标上,几乎未作变动。
再加上就在9月9日宣布降价的当天下午,DeepSeek又爆出一则重大消息。
据路透社报道,DeepSeek已聘请中信证券筹备科创板IPO,计划于今年启动上市程序。不过,具体的上市时间、募资规模和目标估值,目前尚未确定。
此次降价,恐怕并不像“最高降价60%”表面上看起来那么简单。
DeepSeek,究竟降了多少
或许在一切开始之前,我们还是先来审视一下DeepSeek此次的具体降幅。
今年4月,V4 Flash刚发布时,DeepSeek采用全天统一价格。每百万Token的缓存命中输入为0.02元,缓存未命中输入为1元,输出为2元。
所谓缓存命中,即模型发现同一段内容此前已处理过,可直接调用的数据,通常收费最低;
而缓存未命中代表模型首次处理这些内容,所有计算需从头开始;输出则更为直观,即AI最终生成的文字、代码和答案,也就是AI最终返回的结果。
到了8月17日,DeepSeek宣布为整个V4系列更新价格,分为高峰价和低谷价。
工作日上午9点到12点、下午2点到6点属于高峰时段,其他时间则按低谷价收费。
调整之后,Flash在空闲时段的缓存命中输入涨至0.05元,缓存未命中输入涨至1.5元,输出涨至4.5元。高峰时段的价格则再翻一倍。
也就是说,在工作日下午调用Flash,每百万Token的输出价格从2元直接涨至9元。
顺带一提,上述媒体计算的1100%涨幅,出现在V4 Pro身上。其缓存命中输入,从此前每百万Token 0.025元的长期优惠价,涨至高峰时段的0.3元,整整变为原来的12倍。
而此次DeepSeek的价格调整,仅涉及Flash模型。
最显眼的是“最高降价60%”,指的是空闲时段的缓存命中输入,从0.05元降回0.02元,与今年4月V4 Flash刚发布时完全一致。
缓存未命中输入也从1.5元降至1元,同样回到4月的价格。
但是,在此次降价中没有同步调整的,是输出价格。
Flash在空闲时段的输出价格从4.5元降至4元,降幅仅约11%。与4月最初的2元相比,现在仍贵一倍。
到了高峰时段,缓存命中输入、缓存未命中输入和输出分别为0.04元、2元和8元。相比4月的统一价格,两项输入仍贵一倍,输出更是原来的4倍。
至于一个月前也同步涨价的V4 Pro,此次价格完全未动。
因此,DeepSeek此次主要收回了Flash的输入涨幅,输出价格仅象征性地小幅下调。
虽说输出Token不一定是一次调用中账单的大头,但由于价格往往最贵,也是用户最烧钱的部分。
如果按现在降价后的价格计算,其单价已是普通输入的4倍、缓存输入的200倍。
由此可见,尽管降价了,但按照DeepSeek的降价规划,它依然认为V4 Flash应卖得比以前更贵。
既然始终认为V4 Flash应更值钱,那为什么DeepSeek仍不得不降价呢?
V4 Flash “卖爆了”,但还得降价
DeepSeek未公开此次降价的具体原因,我们也无法看到其自家API的调用账本。
不过,从其他平台公开的调用数据中,仍能发现一些线索。
全球最大的AI模型调用平台之一OpenRouter,每天公布不同模型处理的Token数量。用户可在此平台充值,再通过同一接口调用DeepSeek、GPT、Claude等不同模型。
截至9月8日,V4 Flash 0731过去30天共处理约50.7万亿Token,位居OpenRouter所有模型第一。最近一周,它又处理了约12.4万亿Token,排名第三。
如果将DeepSeek旗下的不同模型相加,它们占据了OpenRouter最近一周约23.8%的文本请求,甚至压过了OpenAI和Google。
因此,V4 Flash显然不缺用户。
但当我们点开V4 Flash在OpenRouter上的页面,情况开始变得有趣。
提供这款模型的供应商,多达28家。DeepSeek官方仅是其中之一。
因为V4 Flash开放了模型权重,任何有服务器和技术能力的公司,都可将其部署到自己的机器上,再将API卖给开发者。
卖的都是V4 Flash,价格却可能相差很大。
在OpenRouter目前列出的供应商中,OpenInference每百万Token的输入价格为0.05美元,输出价格为0.16美元。DeepSeek官方在高峰时段的价格,则分别为0.44美元和1.32美元。即便按空闲时段减半计算,也要0.22美元和0.66美元。
便宜的供应商可能在速度、模型精度和稳定性上有所差异。但对一部分只想降低成本的开发者来说,价格差异足够大,就值得换过去试试。
更重要的是,他们根本无需放弃DeepSeek。
代码无需大改,任务也无需重新适配。很多时候只需更换一个API地址,背后运行的依然是V4 Flash,钱却交给了另一家公司。
当然,这里需声明,这组数据绝不意味着DeepSeek是因第三方平台竞争才选择降价,一切仍以官方口径为准。
但这组数据仍有价值。它至少说明了V4 Flash当前面临的来自自身“分身”的竞争非常激烈。
这也是开源模型必须面对的“宿命”。毕竟其他闭源模型涨价后,用户要么咬牙付钱,要么改用其他。但DeepSeek涨价后,用户还能继续使用DeepSeek,甚至无需向DeepSeek付费。
偏偏就在降价前一天,DeepSeek又开放了V4.1 Flash中间版本的测试。
按DeepSeek的说法,新版本采用新的模型架构,能力更强、速度更快、运行成本也更低;甚至因其能力已全面超越V4 Pro,他们还计划在模型正式上线后,在V4.1 Pro上线前,将所有V4 Pro的模型请求转接至V4.1 Flash上。
如此强的能力,本应成为DeepSeek守住涨价的底气。可V4.1 Flash刚进入测试,DeepSeek先做的却是将Flash系列价格降下来。
答案或许就藏在DeepSeek最成功之处。
它实在太便宜了。
成也性价比,败也性价比
便宜,一直是DeepSeek最锋利的武器。
当其他大模型还在按美元计算成本时,DeepSeek直接将API价格以人民币计算,并压至地板价。久而久之,大家也形成了一个根深蒂固的印象。
DeepSeek就应该便宜。
这种印象有多难改变?商业史上已上演过多次。
2002年,大众推出旗舰轿车辉腾。为将其送入豪华车市场,大众投入超10亿欧元研发,产品直接瞄准奔驰S级和宝马7系,售价一度达到7.6万欧元。
但它从未完成每年销售2万辆的目标。直到2013年,大众仅生产了5812辆辉腾。
毕竟同样的价格摆在面前,大家肯定想买奔驰、宝马和奥迪,很难说服自己花豪华车的钱,买一辆挂着大众车标的汽车。
DeepSeek现在遇到的,也是类似的问题。
V4 Flash当然很便宜,问题在于,外面还有一大群比DeepSeek官方更便宜的“DeepSeek”。大家用着同一套模型权重,得到的答案也差不多,官方接口想涨价,开发者们不可能乖乖买账。
而且,之前最令人担忧的情况还是出现了。
8月全面涨价时,V4 Flash仍是原来的V4 Flash。用户付出了更高的价格,却没有同时获得一个能力更强的新模型。
这对一直以性能、性价比为标签的DeepSeek来说,确实是禁忌。否则梁文锋的“滑动变祖器”,也不会“长时间停在‘牢梁’这边了”。
甚至此次价格调整,也显示了DeepSeek当前最难受之处。输出价格舍不得全部降回去,说明它仍想提高收入;输入价格又率先大幅回落,说明它也不能完全放弃自身最重要的性价比优势。
一边要赚钱,一边还要守住“便宜”的招牌。众所周知,“既要又要”向来是最难受的。
当然,或许这也只是DeepSeek同样落入了每个商业公司都需审视的困境罢了: 想让用户接受涨价,至少得让他们看到,自己多花的钱究竟换来了什么。
DeepSeek的定价想走向高端,最大的对手可能不只是GPT和Claude,还有那个曾惊艳全世界的自己。如需获取更多关于DeepSeek的深度资讯,欢迎访问亚博体育(中国)官网 - 亚博系列全平台入口。
本文来自微信公众号“蓝字计划”,作者:Hayward,36氪经授权发布。