DeepSeek模型单日吞下8万亿Token,OpenAI打折追赶
创始人
2026-08-03 16:06:00
0

2026.08.03

本文字数:1074,阅读时长大约2分钟

作者 |第一财经吕倩

北京时间8月3日,海外开发者开源项目团队OpenCode发文称,其平台上DeepSeek V4 Flash的调用量大幅飙升,单日处理达8T(万亿)Token。其中5T为免费试用额度消耗,3T为开发者通过OpenCode平台付费使用。

与此同时,模型API分发平台OpenRouter最新数据显示,上周(7月27日至8月2日)DeepSeek V4 Flash以7.22万亿Token的周调用量位居第一。

OpenRouter与OpenCode同为模型调用平台,但定位不同。前者是全场景通用API聚合网关,模型库较全,面向各类AI应用开发;后者本体是面向程序员的终端AI编程工具,附带的Zen、OpenCode Go网关仅聚焦代码开发场景,基于使用需求精选适配模型,模型池高度精简集中。

两个平台的数据共同说明:DeepSeek V4 Flash正式版上线后,为平台带来了显著的调用量与用户规模提升。OpenCode CEO Jay(贾亚库马尔)8月1日发文称,DeepSeek V4 Flash上线后使用量单日增长了30%,OpenCode Go的新订阅用户也增长了30%。

有趣的是,在评论区,OpenAI核心产品与平台负责人Tibo(蒂博·索蒂奥)打起了OpenAI GPT-5.6产品家族里轻量经济型模型Luna的广告。但开发者并未买账,评论区有开发者直言:“我们希望得到DeepSeek的价格。”

这一幕恰恰折射出近期开闭源模型竞争的激烈程度。7月31日,OpenAI宣布GPT-5.6 Luna降价80%,输出价格从每百万Token 6美元直接砍到1.2美元,输入价格从1美元降至0.2美元。紧接着当日晚些时候,DeepSeek V4 Flash正式版API上线公测。

DeepSeek-V4-Flash正式版采用MoE架构,总参数规模达到284B(激活13B),支持最长100万Token上下文,支持非思考与思考模式切换。其模型结构、尺寸均与预览版保持一致,仅重新进行了后训练。在Artificial Analysis智能指数中,DeepSeek V4 Flash获得50分,仅比GPT-5.6 Luna的51分低1分。

在成本端,即使OpenAI已将GPT-5.6 Luna价格下调80%,DeepSeek V4 Flash在其自有API上的单任务成本仍比前者低约60%。关键原因是DeepSeek提供了约98%的缓存命中(输入内容与服务器上已有的计算记录匹配上,提升计算效率)折扣——即命中缓存的Token仅按标价2%计费,远超业内普遍的90%折扣水平。定价方面,DeepSeek-V4-Flash输入命中缓存仅0.2元/百万Token,未命中输入1元/百万Token,输出2元/百万Token。

相近定位却更具性价比的优势,正是近期海外对开闭源模型争议的核心。分析认为,OpenAI面临多重竞争压力——中国开源模型快速迭代,模型差距不断缩小,这使得美国头部模型也不得不重新思考性价比。

DeepSeek-V4-Flash正式版上线不到一周,便在两大平台交出单日8T、周调用7.22T的成绩单。当OpenAI以更低价格仍无法在成本与用户心智方面取胜时,国产开源模型将传统性价比概念带入新的竞争阶段。

微信编辑| 小羊

·联系我们

:bianjibu@yicai.com

:business@yicai.com

(来源:第一财经)

相关内容

热门资讯

长征五号B遥一运载火箭顺利通过... 2020年1月19日,长征五号B遥一运载火箭顺利通过了航天科技集团有限公司在北京组织的出厂评审。目前...
9所本科高校获教育部批准 6所... 1月19日,教育部官方网站发布了关于批准设置本科高等学校的函件,9所由省级人民政府申报设置的本科高等...
9所本科高校获教育部批准 6所... 1月19日,教育部官方网站发布了关于批准设置本科高等学校的函件,9所由省级人民政府申报设置的本科高等...
湖北省黄冈市人大常委会原党组成... 据湖北省纪委监委消息:经湖北省纪委监委审查调查,黄冈市人大常委会原党组成员、副主任吴美景丧失理想信念...
《大江大河2》剧组暂停拍摄工作... 搜狐娱乐讯 今天下午,《大江大河2》剧组发布公告,称当前防控疫情是重中之重的任务,为了避免剧组工作人...