AI消息速览

DeepSeek上调API定价,主力模型首次采用峰谷计价

事件日期 2026-08-17 · 产业观察 · 已接受

事件日期2026-08-17
信息日期2026-08-18
入库日期2026-08-18
通道产业观察
状态已接受
来源腾讯研究院(搜狐同步)

知识卡片:DeepSeek上调API定价,主力模型首次采用峰谷计价

一句话结论

DeepSeek自2026年8月17日零时起执行新版API价格,V4-Flash与V4-Pro两款主力模型首次采用峰谷计价,高峰时段为每日9—12时、14—18时共7小时,闲时统一为高峰时段的五折;综合模型、Token类型与时段,本轮涨幅介于50%至1100%,其中V4-Pro缓存命中输入高峰价上涨1100%。

事件概述

据腾讯研究院AI速递20260818报道,DeepSeek于8月17日零时起执行新版API定价。V4-Flash与V4-Pro两款主力模型首次引入峰谷计价机制。高峰时段为每日9—12时、14—18时,共7小时;闲时价格统一为高峰时段价格的50%。综合模型、Token类型与时段,本轮涨幅介于50%至1100%。此外,官方同时抬高了基础价格(具体基础价格上调幅度待核实)。

方法/产品要点

  • 峰谷时段:高峰为每日9—12时、14—18时,共7小时;闲时统一为高峰时段的五折。
  • 主力模型:V4-Flash与V4-Pro两款模型首次采用峰谷定价。
  • V4-Pro-0813新版特性:支持100万Tokens上下文,最高384K输出;原生支持工具调用,并兼容Anthropic API。
  • 定价目的:通过价格杠杆引导错峰调用,提高算力集群利用率(原文表述,量化效果待核实)。

主要结果或产业意义

本轮涨幅介于50%至1100%,其中V4-Pro缓存命中输入在高峰时段的价格上涨1100%,同时基础价格被抬高。推测价格上涨可能反映推理算力成本与供给端压力。峰谷计价意味着大模型API正在从“按量一口价”走向分时计费,类似电力与云计算领域的错峰调度策略。新版V4-Pro-0813的1M上下文、384K输出以及Anthropic API兼容特性,也使其在开发者生态中具备更强的可迁移性。

为什么重要

这是国产大模型厂商首次在主力模型上实行峰谷计价,标志着大模型API商业化进入更精细的运营阶段。对开发者和企业用户而言,成本结构将出现时段敏感性变化;对行业而言,大模型API定价可能越来越与算力集群调度深度绑定。峰谷定价作为一种需求侧管理工具,未来或成为提升推理算力利用率的常见手段。

与既有脉络的关系

已有相关卡片“OpenRouter博客文章归档”曾指出AI基础设施中间层正在快速产品化与平台化。本期速递中的另一条新闻——Stripe以超70亿美元收购OpenRouter——是该趋势的重大并购验证。DeepSeek此次峰谷计价则从模型厂商侧表明:大模型调用正被当作可精细计量、可调度的基础设施资源来运营。二者共同构成AI基础设施商业化的最新增量信息。

局限与不确定性

  • 原始材料为媒体速递摘要,未提供完整价格表;各模型、Token类型与时段的具体单价均待核实。
  • “抬高基础价格”的具体上调幅度待核实。
  • 材料未说明V4-Flash是否同步更新版本。
  • 峰谷定价对实际错峰效果与算力集群利用率的影响,尚无量化数据,视为待核实。

可用于图书/PPT/简报的角度

  • 一张图讲清“大模型API的峰谷电价”:高峰7小时与闲时五折的定价结构。
  • 类比分析:云计算分时定价与抢占式实例如何被迁移到大模型API市场。
  • 产业信号:推理成本开始主导API定价,模型厂商从拼参数转向拼算力调度与商业化运营。
  • 开发者启示:成本敏感型应用可错峰处理非实时任务;Anthropic API兼容性降低了迁移成本。

原始材料

URL: https://m.sohu.com/a/1064115732_455313?scm=10001.325_13-325_13.0.0-0-0-0-0.5_1334&digest_item=3

来源标题:腾讯研究院AI速递 20260818

英文标题(存档用):DeepSeek Adjusts API Pricing with Peak-Valley Pricing for Flagship Models

英文关键词:DeepSeek API pricing; peak-valley pricing; V4-Flash; V4-Pro; AI infrastructure; inference cost