DeepSeek模型单日吞下8万亿Token,OpenAI打折追赶
创始人
2026-08-03 21:11:13

北京时间8月3日,海外开发者开源项目团队OpenCode发文称,其平台上DeepSeek V4 Flash的调用量大幅飙升,单日处理达8T(万亿)Token。其中5T为免费试用额度消耗,3T为开发者通过OpenCode平台付费使用。

与此同时,模型API分发平台OpenRouter最新数据显示,上周(7月27日至8月2日)DeepSeek V4 Flash以7.22万亿Token的周调用量位居第一。

OpenRouter与OpenCode同为模型调用平台,但定位不同。前者是全场景通用API聚合网关,模型库较全,面向各类AI应用开发;后者本体是面向程序员的终端AI编程工具,附带的Zen、OpenCode Go网关仅聚焦代码开发场景,基于使用需求精选适配模型,模型池高度精简集中。

有趣的是,在评论区,OpenAI核心产品与平台负责人Tibo(蒂博·索蒂奥)打起了OpenAI GPT-5.6产品家族里轻量经济型模型Luna的广告。但开发者并未买账,评论区有开发者直言:“我们希望得到DeepSeek的价格。”

这一幕恰恰折射出近期开闭源模型竞争的激烈程度。7月31日,OpenAI宣布GPT-5.6 Luna降价80%,输出价格从每百万Token 6美元直接砍到1.2美元,输入价格从1美元降至0.2美元。紧接着当日晚些时候,DeepSeek V4 Flash正式版API上线公测。

DeepSeek-V4-Flash正式版采用MoE架构,总参数规模达到284B(激活13B),支持最长100万Token上下文,支持非思考与思考模式切换。其模型结构、尺寸均与预览版保持一致,仅重新进行了后训练。在Artificial Analysis智能指数中,DeepSeek V4 Flash获得50分,仅比GPT-5.6 Luna的51分低1分。

在成本端,即使OpenAI已将GPT-5.6 Luna价格下调80%,DeepSeek V4 Flash在其自有API上的单任务成本仍比前者低约60%。关键原因是DeepSeek提供了约98%的缓存命中(输入内容与服务器上已有的计算记录匹配上,提升计算效率)折扣——即命中缓存的Token仅按标价2%计费,远超业内普遍的90%折扣水平。定价方面,DeepSeek-V4-Flash输入命中缓存仅0.2元/百万Token,未命中输入1元/百万Token,输出2元/百万Token。

相近定位却更具性价比的优势,正是近期海外对开闭源模型争议的核心。分析认为,OpenAI面临多重竞争压力——中国开源模型快速迭代,模型差距不断缩小,这使得美国头部模型也不得不重新思考性价比。

DeepSeek-V4-Flash正式版上线不到一周,便在两大平台交出单日8T、周调用7.22T的成绩单。当OpenAI以更低价格仍无法在成本与用户心智方面取胜时,国产开源模型将传统性价比概念带入新的竞争阶段。

相关内容

热门资讯

河北推动算力资源转化成产业优势 夯实智算基础 发展词元经济 河北推动算力资源转化成产业优势 日前,广州市海珠区,一名街道网格员手持智...
原创 一... 余承东可能怎么也没想到。自己研究了这么多年的汽车、手机、芯片,最后让全国网友讨论他的,竟然是一只几块...
网友开发云甩竹知了,13万人听... DoNews8月3日消息,据三言科技报道,近日有网友开发出一款网页版“云甩竹知了”,让你足不出户就能...
原创 第... 距离我们只有49光年的一颗岩质行星上,天文学家首次探测到了大气层存在的确凿信号。 这比在宜居带里发现...
DeepSeek模型单日吞下8... 北京时间8月3日,海外开发者开源项目团队OpenCode发文称,其平台上DeepSeek V4 Fl...