8月6日,DeepSeek发布公告称,计划近期整体上调API服务定价,预计涨幅较大,并提醒用户合理安排使用,具体方案以正式通知为准。
与此前针对高峰时段调整价格不同,本次指向API服务整体定价。DeepSeek尚未披露涨价幅度、生效时间及不同模型的具体价格,但“整体上调”和“预计涨幅较大”的表述,意味着其以低价著称的API商业策略可能迎来重要变化。
这一调整发生在DeepSeek-V4-Flash正式版上线、模型调用量快速增长之际。伴随智能体应用增加,单项任务消耗的Token(词元)数量明显高于传统聊天场景,如何在维持价格竞争力的同时覆盖推理资源投入,正在成为大模型厂商共同面对的商业化问题。
模型调用量快速增长
8月6日,在DeepSeek开发者平台,官方发布公告称,后续将对全线产品的API调用上调价格,且涨幅较大。目前DeepSeek-V4-Flash每百万Token缓存命中输入、缓存未命中输入和输出的平时价格分别为0.02元、1元和2元;V4-Pro对应价格分别为0.025元、3元和6元。
今年6月底,DeepSeek引入峰谷计费机制,北京时间每日9时至12时、14时至18时的API价格为平时价格的2倍,其余时段执行平时价格。本次公告则提出“整体上调”API服务定价,未来是否继续保留上述峰谷价格结构,以及平时、高峰价格将分别调整至何种水平,仍需等待正式方案。
今年4月,DeepSeek发布V4预览版,并推出V4-Pro和V4-Flash两个版本。7月底,DeepSeek-V4-Flash正式版发布,取代此前的预览版。DeepSeek称,新版本重点增强了智能体能力,并加入推测解码模块。公司公布的测试数据显示,其在多项智能体和代码任务中的表现较预览版有所提高。
随着新版模型的发布,DeepSeek的调用量迎来暴增。据海外开发者平台OpenCode披露,8月1日,V4-Flash在该平台单日处理Token总量达到8万亿,其中5万亿来自免费试用,3万亿来自付费调用。
近年来,伴随Coding需求的提升,Token用量正呈现指数级增长的态势。今年3月,国家数据局对外披露,我国日均Token调用量已突破140万亿,较2024年初(1000亿)增长超过千倍。
平价策略搅动行业格局
Token需求量的暴增构成了此轮AI热潮的底层逻辑,也成为不少AI厂商需要直面的成本压力。
有意思的是,在OpenAI及Anthropic等海外巨头不断通过压缩限时用量等办法,变相提高用户Token价格之时,以DeepSeek为代表的国产大模型却反其道而行之,走上了平价策略。
今年5月,公司宣布将V4-Pro原定的限时折扣转为永久价格,API价格维持在原定价的四分之一。按照定价,模型输入(缓存未命中)定价为3元/百万Token,输出为6元/百万Token,折合美元每百万Token分别约为0.44美元和0.87美元。而同期,OpenAI GPT-5.5的每百万Token输入和输出价格分别为5美元和30美元,Anthropic Claude Opus4.7则为5美元和25美元。
巨大的价格优势加上几乎能够比肩头部模型的性能,让DeepSeek迅速成为全球开发者眼中的性价比首选,也令全球大模型厂商备感压力。
近日,OpenAI官方宣布将GPT-5.6Luna价格下调80%,将GPT-5.6Terra价格下调20%。谷歌也在强化以效率见长的Gemini Flash产品线,Anthropic则继续对部分高端Claude模型维持较高定价,希望以能力、安全性和稳定性支撑溢价。
