DeepSeek单日吞下8万亿Token OpenAI被迫降价追赶

倚天百科 百科资讯 2

8月3日,海外开发者开源项目团队OpenCode发文称,其平台上DeepSeek V4 Flash的调用量大幅飙升,单日处理达8万亿Token。

其中5万亿为免费试用额度消耗,3万亿为开发者通过OpenCode平台付费使用。

与此同时,模型API分发平台OpenRouter的最新数据显示,上周(7月27日至8月2日)DeepSeek V4 Flash以7.22万亿Token的周调用量位居所有模型第一。

在全球调用量排名中,前五名均为中国AI大模型,DeepSeek-V4-Flash登顶榜首,环比增长13%。

DeepSeek

据CNMO科技了解,8万亿Token相当于约5600万本《三体》三部曲的文字量,或约4万部完整电影剧本的体量。

以普通用户日常使用场景计算,这一调用量相当于数百万开发者同时高频调用同一模型。

OpenCode是一个面向程序员的终端AI编程工具,其附带的Zen、OpenCode Go网关聚焦代码开发场景,基于使用需求精选适配模型。DeepSeek V4 Flash在代码开发这一垂直场景中单日消耗8万亿Token,意味着其已经成为大量开发者的默认编程助手。

面对DeepSeek的强势表现,OpenAI迅速做出反应。7月31日,OpenAI宣布GPT-5.6 Luna降价80%,输出价格从每百万Token 6美元直接砍到1.2美元,输入价格从1美元降至0.2美元。另一款模型Terra也下调了20%。这一价格调整距离两款模型正式推出仅约三周。

然而,开发者的反应并不如OpenAI所愿。在OpenCode的评论区,OpenAI核心产品与平台负责人Tibo打起了GPT-5.6 Luna的广告,但开发者并未买账。有开发者直言:“我们希望得到DeepSeek的价格。”这一幕恰恰折射出当前开闭源模型竞争的激烈程度。

OpenAI

即便OpenAI将Luna价格下调80%,DeepSeek V4 Flash在其自有API上的单任务成本仍比前者低约60%。关键原因是DeepSeek提供了约98%的缓存命中折扣,远超业内普遍的90%。DeepSeek V4 Flash的正式版于7月31日上线公测,正式版在Agent能力上大幅增强,定价为同水平模型最低。

中国AI大模型已连续十四周在全球调用量排名中领跑。当OpenAI以更低价格仍无法在成本与用户心智方面取胜时,国产开源模型正在将传统性价比概念带入全新的竞争阶段。