
路透社8月3日报道,中国AI初创公司DeepSeek再次以“极致性价比”搅动全球大模型市场。
据研究公司Artificial Analysis最新数据,DeepSeek于上周五(7月31日)正式发布的V4-Flash模型,将AI推理成本压至全球已知最低水平:每百万输入token定价0.14美元,输出token仅0.28美元。若以实际任务测试成本衡量,该模型完成单次基准测试的平均花费仅为3美分(约0.2元人民币)。
这一价格意味着什么?横向对比来看,同项测试中,Moonshot AI的Kimi K3成本为86美分,OpenAI的GPT-5.6 Sol为1.86美元,而Anthropic的Claude Fable 5高达3.15美元——DeepSeek的测试成本不足后者的1%。
值得注意的是,Artificial Analysis采用的并非简单“标价对比”,而是综合了模型实际处理与生成数据量的“真实成本测算”。即便某些模型表面单价低廉,若其推理步骤冗长、token消耗大,最终使用成本仍会水涨船高。在这一维度下,V4-Flash的性价比优势更为凸显。
性能与价格的“剪刀差”
低价是否以牺牲性能为代价?Artificial Analysis的智能指数显示,V4-Flash在涵盖编程、推理及办公场景等九项基准测试中综合得分50分(满分100),与谷歌Gemini 3.6 Flash持平,略低于Meta同类产品(51分),但较Moonshot Kimi K3(57分)及Anthropic Claude Opus 5、OpenAI GPT-5.6等头部旗舰稍显落后。
换言之,V4-Flash的定位清晰:以接近主流水平的智能表现,换取极致的成本优势,主攻企业大规模部署的“经济性”需求。
中国AI赛道已迅速进入“群狼环伺”的红海竞争
DeepSeek此前凭借R1模型在2025年初引发全球关注,随着Moonshot、MiniMax、Z.AI(智谱)等初创公司,以及字节跳动、阿里巴巴等互联网巨头加速布局,中国AI赛道已迅速进入“群狼环伺”的红海竞争。
就在DeepSeek发布新模型的同一时段,阿里巴巴于今天(8月3日)推出其迄今规模最大、能力最强的开源模型Qwen3.8-Max,参数规模与Moonshot(月之暗面)上月发布的产品处于同一量级。
全球AI“性价比之战”正从单点突破演变为系统性竞赛。(AI研究院)