DeepSeek-V4-Flash免费活动5天吞吐超1万亿Token
分析者梳理了相关服务的Token数据,该服务的免费活动上线5天,累计Token吞吐量突破1万亿。
仅从数据标题看,容易将其归为AI平台的常规营销数据。拆分每日数据后可以得到清晰的增长趋势:活动前48小时累计吞吐量超过2200亿Token,平均每天约1100亿。
后三天累计新增吞吐量约7800亿Token,平均每天约2600亿。Token消耗速度不仅没有因第一波尝鲜结束下降,反而提升至活动初期的2.36倍。
1万亿Token的规模验证了一件事,AI推理需求的价格弹性可能远大于行业预期。过去讨论AI基础设施,习惯关注模型参数、基准测试、GPU数量。
进入智能体(Agent)时代后,Token吞吐量会成为非常重要的新指标。智能体和聊天机器人的成本结构完全不同,一次普通对话可能只调用一次模型,一个智能体完成任务需要多次规划、调用工具、重复推理,单个任务就能产生几十上百次模型请求。
智能体大规模落地后,Token消耗会呈现明显的放大效应。这次免费活动相当于一次大规模需求侧压力测试,当用户的边际推理成本接近0,5天内消耗量就超过1万亿,且需求仍在加速增长。
能打出这样的需求规模,不止是因为免费。DeepSeek-V4-Flash本身就是针对高频调用优化的模型,官方披露它总参数2840亿,激活参数130亿,支持100万上下文窗口。
DeepSeek官方定位该模型,在简单智能体任务上表现接近DeepSeek-V4-Pro,同时参数更小、速度更快、API成本更低。高效率推理模型、免费API、智能体高频调用,三个因素叠加后迅速放大了Token消耗。
这次1万亿Token的更重要意义,是一次AI算力需求发现。原来API收费时,开发者会主动控制Token消耗,压缩上下文、减少测试次数,很多应用理论可行但经济上不划算。
当前该平台所有交互、API调用、输入输出、缓存读写都不收费,成本约束被暂时移除,批量编码、长文本处理、多智能体协同、自动化工作流等此前受限的场景都得到释放。
数据的核心价值不在于证明用户喜欢免费产品,而是验证了当推理价格足够低时,市场会诞生原本不存在的AI使用场景,这是AI基础设施接下来最大的变量之一。
从投资研究角度,接下来需要持续跟踪四个核心指标。第一个是免费活动结束后的Token留存率,付费留存才能证明沉淀的是真实需求,而非仅薅羊毛的流量。
第二个是API Token与聊天Token的比例,聊天流量对应C端用户,API流量对应开发者和应用,长期来看开发者侧的价值远高于普通用户。
第三个是单开发者Token产出,该指标能反映开发者是否从测试体验转向实际部署应用。该平台此前披露,8月18日单日新增注册4547人,其中新增API用户3677人,单日Token吞吐量达到1440.6亿。
第四个是从免费到付费 credits或订阅的转化率,免费负责获客,生态负责留存,付费订阅最终实现商业化。如果这个转化漏斗可以跑通,这次1万亿Token就不只是营销事件,更会是平台获取开发者的基础设施补贴。
分析者不关注1万亿这个数字还会上涨多少,更关注AI行业是否正在经历类似云计算早期的变化:算力价格降低后,不仅压低原有需求的成本,还会直接创造大量新需求。
如果这个结论成立,未来真正有价值的AI基础设施,不会单纯比拼拥有多少模型,而是要看谁能跑通从模型供给、低成本推理到API、智能体、工作流再到开发者生态的完整链条。
这次5天1万亿Token的活动,已经完成了一次相当大规模的实验,实验真正有价值的部分才刚刚开始。目前该平台还免费开放DeepSeek-V4-Flash-Vision-Exp、Tencent Hy3等模型,具体免费时间和规则以官方页面为准。