DeepSeek V4 Flash 涨价后日 Token 消耗为何腰斩?OpenCode CEO 解释 GPU 成本与 AI 模型不可能三角
OpenCode CEO Jay V 披露 DeepSeek V4 Flash 涨价细节:8 月 16 日调价后日 Token 消耗从峰值下降超 50%,GPU 成本上升是主因。原文梳理价格变化、消耗数据及 AI 模型不可能三角。
- DeepSeek V4 Flash
- OpenCode
- Token 消耗
- AI 模型定价
- GPU 成本
OpenCode CEO Jay V 表示,DeepSeek V4 Flash 于 8 月 1 日上线后,OpenCode 平台的日 Token 消耗量从约 3 万亿迅速飙升至 18 万亿,两周内增长六倍,已接近 OpenRouter 全平台的日处理规模。该模型定价约为 Fable 的 1/350、GPT-5.6 Sol 的 1/175、Claude Sonnet 的 1/70,被用户形容为“便宜到无需计量的 AI”。
8 月 16 日,OpenCode 对该模型实施价格调整,高峰时段价格上调 5 倍,非高峰时段上调 2.5 倍。调价后,DeepSeek Flash 的日 Token 消耗量从峰值下降超过 50%。Jay V 认为,此次涨价是对 GPU 成本上升的被动回应。目前 OpenCode 正在寻找能够按原价处理流量的供应商,若要支撑当前需求,大约需要 1000 台 B300。
DeepSeek Flash 的运行状况暴露出 AI 模型市场的一个“不可能三角”:便宜、强大与大规模稳定供应难以同时满足。价格调整后,OpenCode Go 的配额先从 60 美元降至 15 美元,随后恢复至 30 美元,并引入了高峰与非高峰时段的差异化费率机制。
事件要点回顾
• 8 月 1 日:DeepSeek V4 Flash 上线,OpenCode 日 Token 消耗从约 3 万亿增至 18 万亿。 • 8 月 16 日:高峰时段价格上调 5 倍,非高峰时段上调 2.5 倍。 • 调价后:日 Token 消耗从峰值回落超 50%。 • 同期:OpenCode Go 配额经历了 60 美元→15 美元→30 美元的调整,并新增峰谷费率。
价格与消耗数据对比
从消耗端看,DeepSeek V4 Flash 上线两周内拉动 OpenCode 日 Token 增长约六倍,一度逼近 OpenRouter 全平台日处理量;调价后则快速回落五成以上。从定价端看,其原价约为 Fable 的 1/350、GPT-5.6 Sol 的 1/175、Claude Sonnet 的 1/70,即便在涨价后,其相对低价仍是吸引流量的关键因素。
后续观察:供应瓶颈与定价机制
Jay V 提到,当前要按原价承接现有流量规模,需要约 1000 台 B300 的算力支持,OpenCode 正在寻找能满足这一条件的供应商。与此同时,平台通过 OpenCode Go 配额调整(60 美元→15 美元→30 美元)以及峰谷定价机制,试图在成本压力与用户需求之间寻找平衡。未来需持续关注 GPU 供应成本变化、供应商谈判进展,以及峰谷定价对 Token 消耗的进一步影响。