英国路透社最近搞了个大新闻——对全球多款主流AI模型进行基准测试,结果挺有意思:中国深度求索(DeepSeek)最新发布的DeepSeek-V4-Flash模型,运行成本直接干到了最低。这事儿得细说说。

就在7月31日,DeepSeek正式发布了V4-Flash模型,再次把“超低成本”这张牌打得出彩。回想年初,DeepSeek-R1刚亮相时,全球市场一片哗然,不少人开始质疑美国AI企业那动辄几十亿、上百亿美元的投资是否真有必要。现在V4-Flash来了,这话题又被点燃了。
美国研究机构“人工智能分析网”的评估方法很实在——不只是看定价,还看实际完成任务时处理的数据量。按他们算的,DeepSeek-V4-Flash每百万输入词元只收0.14美元,每百万输出词元收0.28美元,平均每项测试成本约0.03美元。对比一下:OpenAI的GPT-5.6 Sol模型,测试成本1.86美元;Anthropic的“克劳德-寓言5”模型,更是高达3.15美元——这差距,直接差了上百倍。难怪业内都在讨论:成本优势是不是正在改写AI竞赛的规则?
更值得关注的是,在综合编程、推理、模拟职场任务等9项测试的“智能指数”中,DeepSeek-V4-Flash的得分跟谷歌的“双子座3.6闪电”模型不相上下。虽然略低于北京月之暗面科技的Kimi K3,以及OpenAI和Anthropic的部分顶级模型,但考虑到它那令人咋舌的低成本,这个成绩已经相当亮眼了。