AI消息速览

GPT-5.6 Luna 一夜降价80%,AI 自我优化开启价格战

事件日期 2026-08-01 · 产业观察 · 已接受

事件日期2026-08-01
信息日期2026-08-01
入库日期2026-08-01
通道产业观察
状态已接受
来源新智元

知识卡片:GPT-5.6 Luna 一夜降价80%,AI 自我优化开启价格战

英文标题(对应 OpenAI 官方页面):Advancing the price-performance frontier with GPT-5.6
英文关键词:GPT-5.6; price-performance frontier; Luna; Sol; Terra; speculative decoding; GPU kernel optimization; Agents' Last Exam; Claude Fable 5; Codex; ChatGPT Work
原始来源:新智元《GPT-5.6一夜爆砍80%,1元屠杀最贵Claude!》,AIERA 转载,2026-08-01;URL: https://aiera.com.cn/2026/08/01/other/admin/106767/gpt-5-6%e4%b8%80%e5%a4%9c%e7%88%86%e7%a0%8d80%ef%bc%8c1%e5%85%83%e5%b1%a0%e6%9d%80%e6%9c%80%e8%b4%b5claude%ef%bc%81

一句话结论

据这篇报道,OpenAI 在 GPT-5.6 发布约三周后大幅下调 Luna 和 Terra 价格,其中 Luna 降幅达 80%,输入/输出每百万 token 降至 $0.20/$1.20。降价底气来自 GPT-5.6 Sol 自我重写生产内核等优化;评测中 Luna 在 Agents' Last Exam 上反超 Anthropic 最贵的 Fable 5,单任务成本约为后者的 1%。

事件概述

  • 2026-08-01 报道称,OpenAI 对 GPT-5.6 系列实施价格调整:
    • Luna:输入从 $1 降至 $0.20,输出从 $6 降至 $1.20,降幅 80%;
    • Terra:输入从 $2.50 降至 $2,输出从 $15 降至 $12,降幅 20%;
    • Sol:维持 $5 输入、$30 输出不变。
  • 文章称,降价压力来自开源/中国模型的低价竞争,以及 Anthropic 在企业市场的进攻;同时 OpenAI 自身收入在加速,Codex 与 ChatGPT Work 活跃用户已超过 1000 万。

方法/产品要点

  • 降本机制被概括为“AI 自己给自己打工”:GPT-5.6 Sol 通过 Codex 接入 OpenAI 生产推理栈,自己动手优化运行自己的系统。
  • 具体优化方向:
    1. 负载均衡:分析生产流量,发现负载不均,测试新的路由策略;
    2. GPU 内核:用 OpenAI 维护的 Triton 和 Gluon 重写生产内核,结合更广泛内核优化,端到端服务成本降低 20%;
    3. 推测解码:改进草稿(draft)模型,设计并跟踪数百次实验,token 生成效率提升超过 15%;
    4. KV 缓存与配置调优:分析生产负载,生成并评估候选配置。
  • Sol 写出的内核不能直接上线,需用开源工具 FpSan(浮点数消毒器)检查结构、数据流后才放行。
  • 产品变化:Sol 新增 Fast mode,最高 2.5 倍速度、价格翻倍,智能水平不变;Codex 中对应 /fast 指令。
  • 订阅方面:Codex 和 ChatGPT Work 的月费与额度不变,但使用 Luna/Terra 时消耗积分更少。

主要结果或产业意义

  • 在跨 55 个领域的 Agents' Last Exam 评测中,Luna 得分反超 Anthropic 最贵的 Fable 5,单任务成本约 1%,速度约 9 倍。
  • 第三方机构 The Agent Report 的拆解显示,GPT-5.6 三档在 Agents' Last Exam 上均高于 Fable 5。
  • 在 DeepSWE 上,Luna 每美元约获得 24 个基准分,Fable 5 约 3.2 个,文章称效率差距达 5 到 7.5 倍。
  • 内部数据显示:GPT-5.6 内测阶段,每位活跃研究员的日均 token 输出是 GPT-5.5 时代峰值的两倍以上;过去半年,内部代码推理研究算力占比涨了 100 倍,内部智能体 token 用量涨了约 22 倍。
  • 分析师观点:价格战能拉高使用量但会压利润率;企业开始要求清晰的投资回报率。OpenAI 敢降价,是因为效率提升来自它自己的模型。

为什么重要 / 与既有脉络的关系

  • 已有卡片已记录 GPT-5.6 发布及 Sol/Terra/Luna 三档产品线。本条增量信息是发布三周后的价格调整,以及“模型自我优化基础设施”的证据:Sol 重写生产内核、端到端成本降 20%,Luna 在专业评测中以极低成本反超 Anthropic 最贵模型。
  • 如果这些信息得到官方验证,意味着竞争焦点正在从“模型能力”转向“单位成本智能”,大模型公司可以用自家模型优化自身服务,形成成本-能力飞轮。

局限与不确定性

  • 文中的价格、评测数据、内部数据均来自媒体转述,未经独立核实;具体以 OpenAI 官方公告为准。
  • 标题中的“1元”是夸张说法,正文未给出人民币计价;人民币定价待核实。
  • “中国模型 token 成本整体比美国同行便宜最高9倍”是文章转述,未给出具体模型和统计口径。
  • “Fable 5”的定位、Anthropic 的年化收入数据、CFO Sarah Friar 会议细节、7月单月年化经常性收入超过整个第二季度的统计口径等,均有待核实。
  • 降价是否长期有效、Sol 的自我优化是否可复现,材料未提供持续性数据。

可用于图书/PPT/简报的角度

  • 案例:AI 自己优化自己——从 GPT-5.6 Sol 重写生产内核看“自我对弈式降本”。
  • 图表:Luna/Terra/Sol 新旧价格对比与降幅。
  • 评测比较:Agents' Last Exam / DeepSWE 下的单位成本智能,展示“性价比”如何成为新战场。
  • 产业信号:OpenAI 与 Anthropic 的竞争从模型能力扩展到企业市场、智能体调用成本与收入增速。

原始材料

  • 新智元:《GPT-5.6一夜爆砍80%,1元屠杀最贵Claude!》,AIERA 转载,2026-08-01
  • URL: https://aiera.com.cn/2026/08/01/other/admin/106767/gpt-5-6%e4%b8%80%e5%a4%9c%e7%88%86%e7%a0%8d80%ef%bc%8c1%e5%85%83%e5%b1%a0%e6%9d%80%e6%9c%80%e8%b4%b5claude%ef%bc%81
  • 文章引用的 OpenAI 官方页面:https://openai.com/index/advancing-the-price-performance-frontier-with-gpt-5-6