DeepSeek API 价格上涨,最便宜模型策略已被改写
- Olivia Johnson

- 8月14日
- 讀畢需時 12 分鐘
DeepSeek 于 8 月 13 日确认大幅上调 DeepSeek API 价格,结束了持续数日的不确定性,并改变了其 V4 模型背后的成本逻辑。新费率将于 2026 年 8 月 16 日 16:00 UTC 生效。无论常规时段还是优惠时段,价格都将高于此前水平。
这一区别很关键。DeepSeek 并非只是在繁忙时段加收附加费,而是在引入高峰与非高峰时段计费的同时,上调了 V4-Flash 和 V4-Pro 的基础成本。
此次调整紧随 DeepSeek-V4-Pro-0813 正式发布之后,也扭转了 DeepSeek 在今年早些时候制造的价格压力——当时,大幅折扣促使 ByteDance、Tencent 及其他中国供应商作出回应。
开发者如今面临更复杂的选择。他们必须权衡 V4 的能力、更高的使用成本、按时段变化的计费方式,以及围绕单个异常低价端点构建业务的风险。
DeepSeek API 公告究竟改变了什么
DeepSeek 将原本简单的统一费率,改为随时段变化的更高价格体系。
该公司于 8 月 13 日通过官方文档披露了最终调整方案。DeepSeek 表示,新计费安排将在三天后的 8 月 16 日 16:00 UTC 开始实施。
高峰时段为 01:00 至 04:00 UTC,以及 06:00 至 10:00 UTC。其余时段均按非高峰标准计费。高峰费率是非高峰费率的两倍。
这一安排对应北京时间上午 9 点至中午 12 点,以及下午 2 点至 6 点。这些时段覆盖了中国及周边亚洲市场工作日中的相当大一部分。
DeepSeek 此前已提醒客户,重大调整即将到来。多位 API 用户在 8 月初分享的一封邮件建议他们规划使用量,并等待正式通知。
在当时,生效日期和最终方案均未获确认。8 月 13 日发布的官方更新日志解答了这两个问题。
DeepSeek 将此次调整与 V4 系列的正式发布联系起来。该公司表示,高峰与非高峰计费将帮助其更合理地分配资源,同时鼓励客户安排可灵活调度的工作负载。
这一解释指向的是需求管理,而不只是收入增长。按时段计费让客户有理由将批处理任务避开拥挤时段。
但此次调整的影响不止于高峰倍率。即使在非高峰时段,所有主要计费类别也都变得更贵。
对于 V4-Flash,非高峰缓存命中费率上涨了 150%。缓存未命中的输入价格上涨约 57%,生成输出价格则上涨约 136%。
高峰时段的调整幅度更大。Flash 的缓存命中成本升至此前的四倍,输出成本则约为此前的 4.7 倍。
V4-Pro 的变动最为显著。其非高峰缓存命中费率上涨超过六倍,而高峰缓存命中费率则升至此前的十二倍以上。
Pro 的输入与输出价格也有所上调。新的非高峰输出费率约为旧水平的 2.3 倍,高峰费率则约高出 4.6 倍。
这些百分比基于调整前展示的 V4 费率计算。DeepSeek 的定价文档仍是生效日期后计费标准的权威参考。
面向消费者的聊天机器人是另一项产品。本次公告针对的是通过公司 API 访问 DeepSeek 模型的开发者和组织。
这一区分也解释了为何许多普通用户不会立即察觉变化。运行数百万次自动化模型调用的创业公司,面临的结果将截然不同。
因此,关键并不只是 DeepSeek 增设了昂贵时段,而是该公司重设了直接访问 V4 的基础经济模型。
DeepSeek 为何在发布 V4-Pro-0813 的同时涨价
这一时间点将价格变化与更强的生产级模型,以及服务不断增长的智能体工作负载所面临的问题联系在一起。
DeepSeek-V4-Pro-0813 于 8 月 13 日在 app、Web 服务和 API 上全面可用。现有集成可通过同一 deepseek-v4-pro 模型名称访问此次更新。
这种方式避免了立即迁移。应用无需更换端点或模型标识符,即可获得最新版本。
这种操作上的简便掩盖了商业层面的变化。使用相同标识符的客户将在 8 月 16 日后按新计费安排付费。
DeepSeek 表示,0813 更新提升了模型在智能体任务、编程、工具使用、指令遵循和长上下文处理方面的表现。这些仍属于公司自行开展的评测,并非独立保证。
该模型还引入了低、高和最高三档推理强度设置。推理强度决定系统在返回答案前为解决请求投入多少计算资源。
这一功能让开发者拥有更大的控制权,但也可能改变 token 消耗量和延迟。以最高强度运行的复杂编程智能体,与简短聊天回复带来的服务负担并不相同。
DeepSeek 的V4 发布记录称,该模型系列支持一百万 token 的上下文窗口。上下文窗口是模型能够在一次请求中处理的输入和对话历史量。
长上下文对于代码仓库分析、文档审阅和自主编程至关重要,也让缓存成为成本结构的核心。
提示词缓存让供应商能够复用此前已处理的输入,而无需重复计算相同内容。编程智能体通常会反复发送系统指令、工具说明、代码仓库上下文和对话历史。
这种模式曾让 DeepSeek 早期的缓存命中折扣格外具有吸引力。团队可以保持冗长的智能体会话活跃,而不必每次都支付完整的输入费率。
新的涨价削弱了这一优势。它并未取消缓存,因为缓存输入仍比未缓存输入便宜。但节省幅度已不再处于此前那种异常低的水平。
DeepSeek 尚未公布详细的利用率数据,以说明 V4 需求在多大程度上超出可用容量。该公司也未披露与调整后费率相关的、按模型划分的成本明细。
该公司的资源分配解释是合理的,但不应被视为容量短缺的独立证据。价格表本身才是已经确认的行动。
早期报道提供了有用背景。一篇 6 月的高峰定价报道称,DeepSeek 计划通过按时段收费来分散需求并提高服务稳定性。
最终的 8 月方案在更广泛涨价的基础上落实了这一机制。DeepSeek 正在释放一个信号:对 V4 的生产级访问不应再被视作近乎无成本的商品。
这一信号出现之际,AI 产品正通过智能体消耗更多 token。聊天机器人或许只回答一次请求,而智能体可以制定计划、调用工具、检查结果、修正方法,并持续执行多个步骤。
每一步都可能重新发送上下文并产生额外输出。因此,请求层面的温和价格调整,可能在整个工作流程中放大为更显著的变化。
新计费安排为 DeepSeek 提供了两项杠杆:它既能从必须立即运行的工作负载中获得更多收入,也能将可灵活调度的工作引导至更安静的时段。
这在云计算中很常见。供应商长期以来一直使用折扣闲置容量、预留使用量和区域定价来影响需求。
DeepSeek 的版本更为直接:由时钟决定适用费率,而最昂贵的时段与其本土市场的正常工作时间重叠。
最便宜模型的承诺如今面对生产现实
核心矛盾在于 DeepSeek 的低成本形象,与运营一项被广泛采用的生产级服务所需的经济成本之间。
DeepSeek 获得国际关注,部分原因在于它挑战了人们对高能力 AI 成本的既有认知。其开放权重发布也让开发者能够在官方服务之外运行模型。
这两项特质相互强化。较低的直接 API 费率让试验更容易,而可下载的权重则降低了对单一托管端点的依赖。
DeepSeek API 的涨价使这两种优势发生分离。即使 DeepSeek 对托管推理收费更高,开放权重仍可能继续可用。
托管推理意味着供应商负责硬件、扩缩容、网络和模型服务软件。客户无需自行维护这些基础设施,只需发送请求。
自托管提供了更强的控制力,但并不一定更便宜。团队必须获取算力、维护部署软件、监控故障,并为需求高峰保留足够硬件。
因此,规模较小的开发者会在 DeepSeek 官方端点、第三方托管服务和订阅制编程服务之间进行比较。大型组织也可以评估专属部署或多供应商方案。
这种可移植性给 DeepSeek 带来压力。当客户无法从其他地方获得同一模型时,涨价会容易得多。
V4-Flash 已拥有可下载权重。这让托管公司有机会在吞吐量、可用性、区域部署和成本方面展开竞争。
不过,确切的生产版本仍然很重要。第三方供应商必须明确其服务的是哪个检查点,以及其推理配置是否与 DeepSeek 官方端点一致。
V4-Pro-0813 最初通过 DeepSeek 的托管服务提供。开发者不应假设较旧的开放检查点能够复现当前 API 模型的所有行为。
这构成了本文的核心张力。DeepSeek 可以为最新的托管体验收取更高费用,但大幅涨价也会促使客户测试替代方案。
竞争对手无需在每项基准测试中击败 V4。他们只需提供输出质量、延迟、可靠性和可预测计费之间可接受的组合。
ByteDance、Tencent、Alibaba、Moonshot AI 及其他中国供应商仍是这一考量的一部分。西方开发者还可以比较 OpenAI、Anthropic、Google、开放权重托管商和编程智能体订阅服务。
当供应商采用不同的 tokenizer、缓存规则、上下文限制和推理控制机制时,直接比较价格可能会产生误导。输出费率较低的模型,可能为完成同一任务生成更多 token。
可靠性同样重要。如果限流或延迟导致应用无法达到服务目标,低价端点的价值就会下降。
这正是 DeepSeek 可以为涨价辩护的地方。如果 V4-Pro-0813 能以更少的重试完成困难任务,即使 token 费率提高,其实际成本仍可能具有竞争力。
DeepSeek 已公布该更新表现良好的基准测试结果。这些测试提供了方向性信号,但团队应在接受这一说法前复现自己的工作负载。
面向代码仓库规模的编程基准并不能代表所有生产任务。客户支持分类、文档提取和交互式聊天会带来不同的失效模式。
早期 V4 折扣也设定了一个难以摆脱的参照点。一旦开发者围绕极低成本设计系统,任何价格常态化都会显得格外严厉。
DeepSeek 当前的策略类似于先获取客户、再实现变现,尽管公司并未如此表述。折扣加速了采用,而官方 V4 发布则引入了更明确的商业结构。
这种模式在科技市场中很常见。不同寻常的是,这一转变围绕着一个以卓越成本效益为卖点的模型系列展开,其速度之快、规模之大都颇为突出。
这一反转并不意味着 DeepSeek 已放弃低成本竞争。即使在调整之后,相对性价比仍取决于所选模型、时间窗口、缓存表现和任务性能。
但这确实意味着,“DeepSeek 更便宜”已不再是充分的采购规则。买方需要针对具体工作负载进行测算。
DeepSeek 涨价对开发者意味着什么
眼下最重要的任务,是在决定继续使用、调整时间、分散供应商还是迁移之前,先衡量实际工作负载的行为。
风险敞口最大的,是缓存命中率高且输出生成量大的应用。长时间运行的编程代理往往同时具备这两种特征。
编程代理可能会反复发送代码仓库指令和此前的工具结果。这会形成可缓存的输入;与此同时,补丁、说明和命令输出则会产生生成 token。
在旧有结构下,较高的缓存复用率可以让这些会话的成本极低。调整后的费率缩小了这一优势,尤其是对 V4-Pro 而言。
交互式产品还面临第二项挑战:由于用户期待即时响应,它们并不总能将工作移至非高峰时段。
批处理工作负载则拥有更大的灵活性。文档索引、夜间评估、合成数据生成和非紧急分析,都可以安排在非高峰窗口执行。
团队应将 UTC 时间表换算为各自运营地区的时间。一个在本地看似处于非高峰的工作负载,可能恰好与 DeepSeek 的高费率时段重叠。
仅靠排程无法解决所有问题。两个时段的成本都比此前更高,因此调整任务时间只是改变涨幅大小,并不能避免涨价。
开发者应从使用遥测数据入手。他们需要分别衡量缓存命中、缓存未命中、生成输出、请求时间、模型选择、推理强度和重试情况。
汇总 token 总量会掩盖真正的机制。两款月度消耗相同的应用,可能因流量和缓存特征不同而面临不同的变化。
一次有价值的审查可以从几个问题开始:
哪些请求确实需要 V4-Pro,而不是 V4-Flash?
哪些任务可以在高峰时段之外运行?
有多少输入实际获得了缓存命中处理?
较高的推理设置带来的完成质量提升,是否足以证明其用量合理?
失败会多频繁地触发重试或备用调用?
应用能否将部分任务路由到另一款模型?
模型路由尤为相关。它根据复杂度、延迟要求或成本约束,将请求分配给不同模型。
简单的提取或分类工作可能不需要能力最强的模型。复杂的代码仓库变更则可能仍值得使用 V4-Pro。
团队应使用任务级成功指标测试路由策略。如果错误率导致需要人工修正,较低的 token 支出意义并不大。
多供应商支持也值得关注。DeepSeek 对 OpenAI 风格和 Anthropic 风格请求格式的兼容性,可以减少一部分迁移工作。
API 兼容性并不保证行为完全一致。工具 schema、流式事件、推理控制、安全策略和错误响应仍可能不同。
开发者应将供应商特定逻辑隔离在一个小型适配器之后。这样便于比较输出、切换流量,而无需重写整个产品。
影子评估可以将部分请求发送至第二家供应商,同时不向用户展示这些响应。团队可以在迁移生产流量前比较质量、延迟和 token 用量。
合同和余额政策同样重要。DeepSeek 先前向客户发送的消息称,拒绝新条款的用户可以停止使用服务并申请退款。
组织应直接核实当前政策,而不应依赖截图。也不应仅因历史费率看似稳定,就大量预充值余额。
社区反馈表明,切换供应商已经成为讨论的一部分。在一场活跃度很高的开发者讨论中,用户讨论了非高峰排程、第三方托管、本地部署和竞争性编程订阅服务。
这些评论属于反应,而非经过验证的市场份额数据。一名开发者表示计划离开,并不能证明大规模迁移已经发生。
不过,这场讨论仍揭示了一种重要的采购行为:许多 AI 开发者对模型的忠诚度取决于其当前价值。
这使得大幅价格变动对任何供应商都存在风险。因本次涨价而加入备用方案的开发者,可能会永久保留该备用方案。
因此,最有力的应对方式并非立即退出,而是利用具有代表性的工作负载和新的计费窗口进行可控基准测试。
三个信号将显示 DeepSeek 的押注是否奏效
接下来的考验是:更好的 V4 性能和更稳定的容量,能否弥补这次定价逆转。
第一个信号是 8 月 16 日之后的服务质量。DeepSeek 将分时定价与资源分配联系起来,因此用户应在高峰时段关注延迟、错误率和限流情况。
如果性能变得更稳定,公司的运营解释就会获得支持。如果服务依然拥堵,客户将会质疑额外支出究竟带来了什么。
公开的状态信息会有所帮助,但生产遥测数据更有价值。每个团队都应比较生效日前后的请求延迟和失败率。
第二个信号是当前 V4 版本的第三方可用性。只有当外部供应商能够提供足够相似的模型时,开放权重才会形成竞争压力。
开发者应跟踪检查点发布、托管公告、上下文支持、吞吐量和工具使用行为。使用较旧检查点的供应商,并不能直接替代 V4-Pro-0813。
如果多家托管方都能提供相当的结果,DeepSeek 的直连 API 将面临更激烈的价格竞争。如果最新版本仍为独占,公司就能保留更多控制权。
这一区别也会影响自托管。可下载的权重提供了技术自由,但部署超大模型需要严肃的基础设施和工程能力。
第三个信号是客户行为。观察主要代理平台是否继续将 DeepSeek 作为默认选项、将其置于高级限制之后,或引入替代路线。
可见的迁移将削弱这一策略。稳定的使用量,尤其是高峰时段的稳定使用,将表明客户接受了新的价值主张。
开发者情绪的变化会快于可靠的采用数据。即使总体使用量仍然很高,抱怨也可能主导社交平台。
DeepSeek 下一次自行调整定价,也将提供另一项线索。稳定的价格表将表明其对新结构有信心;而迅速推出折扣则可能暴露阻力。
更广泛的中国模型市场同样重要,因为 DeepSeek 此前曾迫使竞争对手做出回应。ByteDance、Tencent、Alibaba 和 Moonshot AI 现在可以选择压低新费率,或维持自身利润率。
新一轮价格战将压缩 DeepSeek 通过 V4 变现的空间。如果各方协调转向更高的商业费率,则可能表明早先的折扣周期难以持续。
因此,DeepSeek 的 API 决策不止影响一张账单。它检验的是:开放权重模型供应商能否在采用规模达到生产级之后,继续维持低成本访问。
对开发者而言,实际应对方式很明确:收集一周具有代表性的流量,将其在现实可行的替代方案上重放,并比较完成的任务,而非宣传费率。结果中应纳入高峰时段、缓存行为、重试、延迟和人工修正。
然后再决定灵活性价值几何。你的工作负载能否转移到非高峰时段,还是应在下一次调整之前增加第二家供应商?DeepSeek 的涨价使这一问题成为架构问题,而不再只是采购问题。


