摘要
“买一批设备回来,10个月收回成本就够了,希望能以合理价格买到芯片,这样就不用自己做芯片了”,近日在投资会上,DeepSeek 创始人梁文峰道出了自己的苦恼,现在的芯片价格太贵了,无法满足DeepSeek对于大模型低成本的需求。 值得注意的是,在本次投资会之前,就有媒体爆料称:DeepSeek开始自研定制的推理芯片,已经秘密启动一年时间,并与芯片设计公司、晶圆代工厂及存储厂商展开多轮接洽。 从中我们不难看出,主打低价格的DeepSeek正在遭遇芯片的成本危机,随着AI大模型的商业落地和Token的大规模调用,曾经被边缘化的推理芯片正在取代训练芯片,成为AI大模型厂商的主要成本支出。 那么对于以DeepSeek为代表的主打低价格的大模型厂商来说,如何进一步降低推理芯片的价格,将成为大模型企业的核心竞争力。 【1】DeepSeek带动行业降价 2026年,对于国内大模型产业来说,是集体降价冲刺的一年: 5月23日,DeepSeek宣布将V4-Pro模型的“折扣优惠”正式变成了永久性的“降价通知”,原先2.5折的专业版模型API调用价格,变成了“永久2.5折”;此后更是推出类似电价的峰谷定价机制,根据不同时间段动态调整API价格; 5月28日,小米旗下MiMo-V2.5全系列API接口永久下调资费,部分细分调用场景降价比例逼近99%,并宣布不再区分上下文窗口长度,统一按低价计费,解决开发者长文本处理的成本焦虑。 6月底,腾讯云平台内上线的DeepSeek-V4全系列模型同步下调调用价格,最高降幅达到97.5%、第三方入驻模型MiniMax-M3推理输入、推理输出、缓存命中三项费用,各项降幅均为50%。 这波降价幅度有多大?以DeepSeek为例,经过调价后,其专业版百万Tokens的价格直接降到0.025元,价格只有Minimax M2.7价格的5.8%。 价格成为杀手锏,企业和用户开始用脚投票,对于大多数需求来说,使用成本往往比性能参数更重要,OpenRouter数据显示:在调低价后,DeepSeek-V4-Flash模型登顶全球调用榜,而在此之前,DeepSeek旗下 V3.2/R1等大模型排名最多达到第三名。 (来源: DeepSeek官网 )