DeepSeek模型单日吞下8万亿Token OpenAI打折追赶

2026-08-03 13:45:3021

 北京时间8月3日,海外开发者开源项目团队OpenCode发文称,其平台上DeepSeek V4 Flash的调用量大幅飙升,单日处理达8T(万亿)Token。其中5T为免费试用额度消耗,3T为开发者通过OpenCode平台付费使用。

  与此同时,模型API分发平台OpenRouter最新数据显示,上周(7月27日至8月2日)DeepSeek V4 Flash以7.22万亿Token的周调用量位居第一。

  OpenRouter与OpenCode同为模型调用平台,但定位不同。前者是全场景通用API聚合网关,模型库较全,面向各类AI应用开发;后者本体是面向程序员的终端AI编程工具,附带的Zen、OpenCode Go网关仅聚焦代码开发场景,基于使用需求精选适配模型,模型池高度精简集中。

  两个平台的数据共同说明:DeepSeek V4 Flash正式版上线后,为平台带来了显著的调用量与用户规模提升。OpenCode CEO Jay(贾亚库马尔)8月1日发文称,DeepSeek V4 Flash上线后使用量单日增长了30%,OpenCode Go的新订阅用户也增长了30%。

  有趣的是,在评论区,OpenAI核心产品与平台负责人Tibo(蒂博·索蒂奥)打起了OpenAI GPT-5.6产品家族里轻量经济型模型Luna的广告。但开发者并未买账,评论区有开发者直言:“我们希望得到DeepSeek的价格。”

  这一幕恰恰折射出近期开闭源模型竞争的激烈程度。7月31日,OpenAI宣布GPT-5.6 Luna降价80%,输出价格从每百万Token 6美元直接砍到1.2美元,输入价格从1美元降至0.2美元。紧接着当日晚些时候,DeepSeek V4 Flash正式版API上线公测。

  DeepSeek-V4-Flash正式版采用MoE架构,总参数规模达到284B(激活13B),支持最长100万Token上下文,支持非思考与思考模式切换。其模型结构、尺寸均与预览版保持一致,仅重新进行了后训练。在Artificial Analysis智能指数中,DeepSeek V4 Flash获得50分,仅比GPT-5.6 Luna的51分低1分。

  在成本端,即使OpenAI已将GPT-5.6 Luna价格下调80%,DeepSeek V4 Flash在其自有API上的单任务成本仍比前者低约60%。关键原因是DeepSeek提供了约98%的缓存命中(输入内容与服务器上已有的计算记录匹配上,提升计算效率)折扣——即命中缓存的Token仅按标价2%计费,远超业内普遍的90%折扣水平。定价方面,DeepSeek-V4-Flash输入命中缓存仅0.2元/百万Token,未命中输入1元/百万Token,输出2元/百万Token。

  相近定位却更具性价比的优势,正是近期海外对开闭源模型争议的核心。分析认为,OpenAI面临多重竞争压力——中国开源模型快速迭代,模型差距不断缩小,这使得美国头部模型也不得不重新思考性价比。

  DeepSeek-V4-Flash正式版上线不到一周,便在两大平台交出单日8T、周调用7.22T的成绩单。当OpenAI以更低价格仍无法在成本与用户心智方面取胜时,国产开源模型将传统性价比概念带入新的竞争阶段。

文章来源:第一财经DeepSeek V4 Flash 海外爆量事件 全维度受益 A 股标的分析一、事件核心驱动逻辑(先定底层逻辑)
需求端:V4 Flash 单周 7.22 万亿 Token、单日 8 万亿 Token 调用量爆炸式增长,MoE 架构 + 100 万超长上下文、超高缓存命中率带来极低推理成本,倒逼 OpenAI 大幅降价,国产大模型全球商业化、API 调用量、私有化部署全面爆发;
产业链传导路径:调用量暴涨→算力集群扩容→服务器 / 光模块 / 芯片 / 存储需求大增;低价模型降低 AI 应用门槛→To B 行业落地加速;
两大受益主线:①直接参股深度求索(股权增值);②算力硬件基础设施(业绩兑现最强);③AI 应用落地(模型商用放量)。
二、第一梯队:直接参股 DeepSeek(事件弹性最大,题材催化最强)(1)大额深度产业绑定(正宗度最高)
蓝色光标(300058)
早期第三大股东,子公司持股约 10%;联合开发营销垂直大模型,海外 OpenCode、OpenRouter 平台大量开发者用 V4 Flash 做 AI 营销、短剧投放,直接享受低价模型商用红利,股权 + 业务双重受益。
中贝通信(603220)
直接持股约 5.74%,DeepSeek 官方独家算力服务商,承接 V4 全系列训推一体智算集群、定制化一体机搭建,海外调用暴量直接拉动算力租赁与 IDC 机柜上架率。
彩讯股份(300634)
A 轮出资 2 亿持股约 3%,基于 V4 Flash 做企业客服、金融知识库、政企私有化部署,超长 100 万上下文非常适配文档解析、合同审阅场景。
(2)基金间接参投(公告实锤,情绪标的)
九安医疗(002432):子公司 7.5 亿元大额参投深度求索首轮融资,资金关注度极高;
浙江东方(600120):天使轮基金入股,最早一批财务投资方;
开润股份汤臣倍健中原高速华金资本:基金穿透小额持股,仅短期情绪博弈,股权占比极低,基本面无实质联动。
(3)母公司关联绑定每日互动(300766):幻方量化(DeepSeek 母公司)二股东,为模型训练提供海量用户行为数据,数据要素长期受益。三、第二梯队:算力硬件 & 国产芯片(业绩确定性最强,卖铲人逻辑)1、AI 服务器 & 整机集群(MoE 大模型、百万 Token 上下文刚需)
浪潮信息(000977):亦庄智算中心核心服务器供应商,推出 DeepSeek 专属推理一体机,V4 海量并发推理直接拉动整机出货;
中科曙光(603019):杭州训练中心承建方,液冷智算集群总包,超大参数 MoE 模型高功耗散热刚需;
拓维信息(002261):华为昇腾核心伙伴,湘江鲲鹏服务器完成 V4 全适配,国产替代私有化部署主力底座;
神州数码高新发展:昇腾架构 DeepSeek 定制一体机,政企本地化交付放量。
2、高速光模块(万卡集群互联核心,调用量暴涨直接增量)
中际旭创(300308):全球 800G/1.6T 光模块龙头,海外 AI 算力集群扩容核心供货,海外开发者大规模部署 V4 直接拉动高速光互联需求;
新易盛天孚通信东山精密:海外云厂商算力资本开支上行,间接受益全球 DeepSeek 生态部署潮。
3、国产 AI 芯片(V4 官方完成寒武纪、昇腾双适配)
寒武纪 - U(688256):Day0 完成 V4 Flash(284B MoE)全量适配,开源推理框架同步放出代码,国产芯片生态标杆;
海光信息景嘉微:推理端国产 GPU 替代,私有化部署刚需;
紫光股份(000938):新华三交换机、智算网络设备,算力集群组网必备。
4、配套温控 / IDC / 存储
液冷散热:英维克高澜股份(超大算力集群功耗管控);
算力租赁 IDC:润泽科技数据港宝信软件
存储:兆易创新(长鑫存储配套,KV Cache 超长上下文缓存存储需求)。
四、第三梯队:AI 应用层(V4 低价打开商业化空间,落地放量)1、代码开发赛道(本次爆发源头:OpenCode 为程序员编程平台)
拓尔思:NLP 大模型、代码检索、知识库,长文本代码解析受益 100 万上下文窗口;
软通动力润和软件:基于 DeepSeek 做代码生成、企业软件定制开发,海外开发者需求外溢至国内 IT 服务商。
2、行业通用 AI 落地
智能营销:浙文互联省广集团(对标蓝色光标,API 低成本调用做 AIGC 广告);
政务数字化:南威软件久远银海(私有化部署 DeepSeek 做政务大模型);
云平台分发:优刻得 - W(云市场上架 V4 模型,收取 API 分销佣金)。
五、优先级精简版(实操直接参考)1、基本面最正宗(优先看)蓝色光标中贝通信浪潮信息中际旭创寒武纪2、国产算力替代主线拓维信息中科曙光紫光股份英维克3、短线情绪博弈标的九安医疗浙江东方彩讯股份六、核心风险提示


参股类个股多数为财务小额投资,短期无法兑现利润,纯题材炒作波动极大;
算力硬件受益逻辑是中长期算力资本开支兑现,短期受大盘、AI 板块情绪影响;
DeepSeek 海外高调用量为行业竞争催化,不代表相关公司业绩立刻增厚,以上仅为产业链逻辑梳理,不构成任何个股买卖、持仓投资建议。

作者声明: 本文转载自第三方,旨在提供资讯参考,并非证券推荐或投资建议。作者对内容的真实性、准确性不承担保证责任。本文不构成任何投资建议或证券推荐。截至发文日,作者与文中提及的标的不存在持仓关系。

合规声明:本站发布的所有文章及观点均系个人研究共享,投资心得交流,不代表本站立场,且不构成任何形式的投资建议。投资者据此操作,风险自担,请务必保持独立审慎的决策态度。