知识卡片:DeepSeek上调API定价,主力模型首次采用峰谷计价
一句话结论
DeepSeek自2026年8月17日零时起执行新版API价格,V4-Flash与V4-Pro两款主力模型首次采用峰谷计价,高峰时段为每日9—12时、14—18时共7小时,闲时统一为高峰时段的五折;综合模型、Token类型与时段,本轮涨幅介于50%至1100%,其中V4-Pro缓存命中输入高峰价上涨1100%。
事件概述
据腾讯研究院AI速递20260818报道,DeepSeek于8月17日零时起执行新版API定价。V4-Flash与V4-Pro两款主力模型首次引入峰谷计价机制。高峰时段为每日9—12时、14—18时,共7小时;闲时价格统一为高峰时段价格的50%。综合模型、Token类型与时段,本轮涨幅介于50%至1100%。此外,官方同时抬高了基础价格(具体基础价格上调幅度待核实)。
方法/产品要点
- 峰谷时段:高峰为每日9—12时、14—18时,共7小时;闲时统一为高峰时段的五折。
- 主力模型:V4-Flash与V4-Pro两款模型首次采用峰谷定价。
- V4-Pro-0813新版特性:支持100万Tokens上下文,最高384K输出;原生支持工具调用,并兼容Anthropic API。
- 定价目的:通过价格杠杆引导错峰调用,提高算力集群利用率(原文表述,量化效果待核实)。
主要结果或产业意义
本轮涨幅介于50%至1100%,其中V4-Pro缓存命中输入在高峰时段的价格上涨1100%,同时基础价格被抬高。推测价格上涨可能反映推理算力成本与供给端压力。峰谷计价意味着大模型API正在从“按量一口价”走向分时计费,类似电力与云计算领域的错峰调度策略。新版V4-Pro-0813的1M上下文、384K输出以及Anthropic API兼容特性,也使其在开发者生态中具备更强的可迁移性。
为什么重要
这是国产大模型厂商首次在主力模型上实行峰谷计价,标志着大模型API商业化进入更精细的运营阶段。对开发者和企业用户而言,成本结构将出现时段敏感性变化;对行业而言,大模型API定价可能越来越与算力集群调度深度绑定。峰谷定价作为一种需求侧管理工具,未来或成为提升推理算力利用率的常见手段。
与既有脉络的关系
已有相关卡片“OpenRouter博客文章归档”曾指出AI基础设施中间层正在快速产品化与平台化。本期速递中的另一条新闻——Stripe以超70亿美元收购OpenRouter——是该趋势的重大并购验证。DeepSeek此次峰谷计价则从模型厂商侧表明:大模型调用正被当作可精细计量、可调度的基础设施资源来运营。二者共同构成AI基础设施商业化的最新增量信息。
局限与不确定性
- 原始材料为媒体速递摘要,未提供完整价格表;各模型、Token类型与时段的具体单价均待核实。
- “抬高基础价格”的具体上调幅度待核实。
- 材料未说明V4-Flash是否同步更新版本。
- 峰谷定价对实际错峰效果与算力集群利用率的影响,尚无量化数据,视为待核实。
可用于图书/PPT/简报的角度
- 一张图讲清“大模型API的峰谷电价”:高峰7小时与闲时五折的定价结构。
- 类比分析:云计算分时定价与抢占式实例如何被迁移到大模型API市场。
- 产业信号:推理成本开始主导API定价,模型厂商从拼参数转向拼算力调度与商业化运营。
- 开发者启示:成本敏感型应用可错峰处理非实时任务;Anthropic API兼容性降低了迁移成本。
原始材料
URL: https://m.sohu.com/a/1064115732_455313?scm=10001.325_13-325_13.0.0-0-0-0-0.5_1334&digest_item=3
来源标题:腾讯研究院AI速递 20260818
英文标题(存档用):DeepSeek Adjusts API Pricing with Peak-Valley Pricing for Flagship Models
英文关键词:DeepSeek API pricing; peak-valley pricing; V4-Flash; V4-Pro; AI infrastructure; inference cost