推广 热搜: ???  ????  content=  时期  校长  日方  创新  裂缝  药厂  小品 

DeepSeek模型单日吞下8万亿Token,OpenAI打折追赶

   日期:2026-08-04 01:59:37     来源:第一财经    浏览:0    评论:0    

北京时间8月3日,海外开发者开源项目团队OpenCode发文称,其平台上DeepSeek V4 Flash的调用量大幅飙升,单日处理达8T(万亿)Token。其中5T为免费试用额度消耗,3T为开发者通过OpenCode平台付费使用。

与此同时,模型API分发平台OpenRouter最新数据显示,上周(7月27日至8月2日)DeepSeek V4 Flash以7.22万亿Token的周调用量位居第一。

OpenRouter与OpenCode同为模型调用平台,但定位不同。前者是全场景通用API聚合网关,模型库较全,面向各类AI应用开发;后者本体是面向程序员的终端AI编程工具,附带的Zen、OpenCode Go网关仅聚焦代码开发场景,基于使用需求精选适配模型,模型池高度精简集中。

有趣的是,在评论区,OpenAI核心产品与平台负责人Tibo(蒂博·索蒂奥)打起了OpenAI GPT-5.6产品家族里轻量经济型模型Luna的广告。但开发者并未买账,评论区有开发者直言:“我们希望得到DeepSeek的价格。”

这一幕恰恰折射出近期开闭源模型竞争的激烈程度。7月31日,OpenAI宣布GPT-5.6 Luna降价80%,输出价格从每百万Token 6美元直接砍到1.2美元,输入价格从1美元降至0.2美元。紧接着当日晚些时候,DeepSeek V4 Flash正式版API上线公测。

DeepSeek-V4-Flash正式版采用MoE架构,总参数规模达到284B(激活13B),支持最长100万Token上下文,支持非思考与思考模式切换。其模型结构、尺寸均与预览版保持一致,仅重新进行了后训练。在Artificial Analysis智能指数中,DeepSeek V4 Flash获得50分,仅比GPT-5.6 Luna的51分低1分。

在成本端,即使OpenAI已将GPT-5.6 Luna价格下调80%,DeepSeek V4 Flash在其自有API上的单任务成本仍比前者低约60%。关键原因是DeepSeek提供了约98%的缓存命中(输入内容与服务器上已有的计算记录匹配上,提升计算效率)折扣——即命中缓存的Token仅按标价2%计费,远超业内普遍的90%折扣水平。定价方面,DeepSeek-V4-Flash输入命中缓存仅0.2元/百万Token,未命中输入1元/百万Token,输出2元/百万Token。

相近定位却更具性价比的优势,正是近期海外对开闭源模型争议的核心。分析认为,OpenAI面临多重竞争压力——中国开源模型快速迭代,模型差距不断缩小,这使得美国头部模型也不得不重新思考性价比。

DeepSeek-V4-Flash正式版上线不到一周,便在两大平台交出单日8T、周调用7.22T的成绩单。当OpenAI以更低价格仍无法在成本与用户心智方面取胜时,国产开源模型将传统性价比概念带入新的竞争阶段。

内容由网友发布或转自其他网站,如有侵权及其他问题,请发送邮件至jiyuwang@qq.com,我们将第一时间处理。
 
打赏
0相关评论

推荐图文
推荐资讯
点击排行
网站首页  |  关于我们  |  联系方式  |  使用协议  |  版权隐私  |  网站地图  |  排名推广  |  广告服务  |  积分换礼  |  网站留言  |  RSS订阅  |  违规举报
Powered By DESTOON