梁文锋不想当“价格屠夫”了
财经
财经 > 财经资讯 > 正文

梁文锋不想当“价格屠夫”了

曾被业界戏称为大模型“价格屠夫”的DeepSeek,正在收起屠刀。

8月17日0时,DeepSeek API新价格正式生效。

此次调整不仅覆盖V4 Pro和V4 Flash的价格,还将峰谷定价引入V4系列,将北京时间9:00—12:00、14:00—18:00划定为高峰时段,其余17个小时为空闲时段;空闲价格为高峰价格的一半。

调整后,旗舰模型DeepSeek V4 Pro高峰时段缓存命中输入、缓存未命中输入和输出价格分别达到每百万Token 0.3元、9元和27元,较此前分别上涨1100%、200%和350%;V4 Flash对应的高峰期价格,也分别上涨了400%、200%和350%。

当Token不再完全“白菜价”,谁的钱包会最受伤?

涨价幅度不小

这是一场事先张扬的涨价。

早在6月底,DeepSeek便通知用户,计划在V4正式版上线后引入峰谷定价,以“更合理地配置资源、提升服务稳定性”。

按照当时的方案,V4 Pro每百万Tokens缓存命中输入、缓存未命中输入和输出的平时价格分别为0.025元、3元和6元,高峰价格分别为0.05元、6元和12元;V4 Flash高峰时段三项价格则分别为0.04元、2元和4元。

该方案原计划随7月中旬上线的V4正式版实施。但此后模型发布延期,峰谷价格也未按原定时间落地。

8月6日,DeepSeek再次在开放平台发布通知,并向部分API用户发送邮件,明确表示近期将整体上调API服务价格,且“预计涨幅较大”,提醒用户提前规划用量,但未同步公布具体价格和生效日期。

约一周后,DeepSeek V4 Pro正式版和最终调价方案陆续上线。作为V4系列的旗舰模型,V4 Pro面向复杂推理、编程和Agent任务,支持100万Token上下文、最长38.4万Token输出,以及思考模式、工具调用和OpenAI Responses API等功能。

又过了4天,新价格正式生效。

值得一提的是,DeepSeek最终落地的新定价明显高于6月底披露的早期峰谷方案。

以V4 Pro输出为例,6月底方案中的平时和高峰价格分别为6元和12元,最终的空闲和高峰价格则达到13.5元和27元,空闲时段价格已经超过此前拟定的高峰价格。

可以看到,这次调整并不只是利用峰谷价差引导用户错峰调用,而是在保留分时计费框架的同时,整体抬高了V4系列API的价格。

涨价之后,DeepSeek与其他国产旗舰模型之间的价差也在缩小。

以高峰时段为例,V4 Pro缓存未命中输入和输出价格分别为每百万Token 9元和27元。作为参照,智谱此前的期间模型GLM-5.2对应价格约为8元和28元,两者已经进入相近区间;月之暗面的旗舰模型Kimi K3缓存未命中输入和输出价格则分别为20元和100元,仍明显高于V4 Pro。

GLM-5.2及Kimi K3定价。图/截自智谱、月之暗面官网

GLM-5.2及Kimi K3定价。图/截自智谱、月之暗面官网

不过,不同模型的能力、推理强度和适用场景并不相同,单纯比较Token价格并不能直接判断性价比。DeepSeek的价格优势也没有完全消失:V4 Pro空闲时段缓存未命中输入和输出价格分别为4.5元和13.5元,仍低于上述两款模型;其缓存命中输入价格最高为0.3元,也明显低于GLM-5.2和Kimi K3约2元的水平。

这意味着,涨价后的DeepSeek已不再像此前那样与部分国产旗舰模型拉开数量级价差。对于开发者而言,模型选择也将从单纯比较价目表,转向比较完成同一项任务所需的调用次数、Token消耗和最终效果。

谁受伤?

从应用场景看,受此次DeepSeek涨价影响较大的首先是需要长期运行Agent的个人开发者和技术团队。这类用户不仅Token消耗量大,任务又通常需要连续保留上下文,难以通过缩短对话或频繁开启新会话降低成本。

AI博主、个人开发者“人工大黑”主要使用DeepSeek V4 Flash处理浏览器检索、程序纠错和服务器环境部署等执行任务。

他向中国新闻周刊展示的8月8日调用记录显示,当天,他共发起267次请求,消耗约7673万Token。其中,缓存命中输入约7547万Token,占总量的98.35%,缓存未命中输入约105万Token,输出约21万Token。

按照调整前的价格计算,人工大黑的这些调用约花费2.99元;根据实际调用时段套用新的峰谷价格后,费用将上升至7.27元,是原来的2.43倍。而这个用量,据人工大黑介绍,还只是轻度到中度之间的一个用量。

对人工大黑而言,此次涨价中最难承受的是缓存命中输入价格上涨。“对于我们这种使用Agent的用户,典型模式是高复用的长上下文会话。”他说,编程Agent会反复读取代码、历史对话和工具调用结果,缓存单价虽然不高,却会被数千万甚至上亿Token的用量放大。

而缓存命中输入恰恰是本轮DeepSeek涨幅最大的计费项目,高峰时段,V4 Pro和Flash的涨幅分别达1100%、400%。

不过,哪项涨价对账单影响最大,仍取决于具体业务的Token结构。

对高缓存命中、长上下文复用的Agent用户,缓存价格上涨可能构成主要成本增量;而批量撰写营销文案、商品介绍、小说剧本和长篇报告等业务,通常输入要求较短、模型生成内容较长,属于输出密集型业务,更容易受到输出价格上涨影响。

对后者而言,DeepSeek V4 Pro高峰时段每百万Token输出价格从6元涨到27元,这一涨幅可能成为主要成本压力。

受新定价影响较大的另一类用户,是那些必须在国内工作时间内实时响应的企业应用,譬如在线客服、实时编程助手。这些应用无法简单地将用户请求延后到DeepSeek定义的空闲时间,因而难以充分利用优惠的空闲价格。

此外,依赖第三方低价Coding Plan的高强度开发者,也将受到较大冲击。

过去,一些开发者并不直接按照DeepSeek官网API价格付费,而是通过OpenCode等第三方编程套餐获得更低成本的调用额度。人工大黑介绍,对调用量很大的用户而言,这类套餐曾是重要的低价渠道。

事实上,DeepSeek涨价后,OpenCode已调整其Go套餐的使用上限。OpenCode公布的额度对比显示,V4 Flash的限额由此前每5小时约63300次降至3800次,降幅约94%;V4 Pro则由3450次降至1050次。其表示,此次调整是为了反映DeepSeek涨价带来的成本变化,同时正在研究如何以接近此前的价格继续提供相关模型。

不过,成本上涨,并不意味着重度用户会立刻离开DeepSeek。

人工大黑表示,执行类任务仍会继续使用V4 Flash。在他的实际体验中,虽然V4 Pro正式版的提升较为有限,但V4 Flash的输出速度可达到约150 Token/s,能力也处于其认为的及格线之上,“如果按API价格计算,涨价后的性价比依然较高”。

但开发者的选择正在变得更加精细。人工大黑早就不是让一个模型包办所有任务,而是使用GLM处理部分编程工作,借助Kimi完成规划和逻辑推理,再把大量执行任务交给V4 Flash。

当越来越多开发者开始根据能力、速度和价格拆分任务,大模型厂商也将迎来一场比价格战更严格的考试。

价格战比的是谁能把Token卖得更便宜,价值战考验的则是,模型能否用更少的调用、更短的时间和更稳定的结果完成任务。低价可以吸引开发者尝试,真正的能力才能让他们长期留下。

过去,DeepSeek凭借低价重新定义了大模型API的价格下限;如今,它需要回答一个新的问题:当价格优势收窄之后,模型本身是否仍有足够的价值,让开发者继续留下?