AI消息速览

GPT-5.6 发布与 Claude 额度重置

事件日期 2026-07-10 · 产业观察 · 已接受

事件日期2026-07-10
信息日期2026-07-10
入库日期2026-07-10
通道产业观察
状态已接受
来源量子位

知识卡片:GPT-5.6 发布与 Claude 额度重置

一句话结论

GPT-5.6 是 OpenAI 迄今最强模型,分 Sol、Terra、Luna 三档,引入 ultra 多 agent 并行模式和 ChatGPT Work 智能体功能;Anthropic 在发布后连夜重置了 Claude 的 Fable 5 额度。

事件概述

2026 年 7 月 10 日,OpenAI 正式发布 GPT-5.6,同步推出 ChatGPT Work(由 Codex 和 GPT-5.6 驱动),并完成产品架构合并(Chat / Work / Codex 三种模式)。Anthropic 在发布会后宣布重置 Claude Fable 5 额度。

方法/产品要点

  • 模型家族:Sol(旗舰,最高能力)、Terra(平衡款)、Luna(最快最便宜)。
  • 关键新模式:ultra 模式——由多个 agent 并行处理,默认协调 4 个 agent,可扩展至 16 个。
  • 工程新能力:Programmatic Tool Calling(程序化工具调用),模型可自写轻量程序协调多工具调用。
  • ChatGPT Work:跨应用/文件行动,持续数小时完成目标,具备跨应用取材、产出成品、长任务持续监督、Auto-Review 安全审查等能力。
  • 定价(每百万 token):Sol 输入$5/输出$30;Terra 输入$2.5/输出$15;Luna 输入$1/输出$6。

主要结果或产业意义

  • 性能对比:在 Agents’ Last Exam 上,Sol 以 53.6 分刷新纪录,比 Fable 5 高出 13.1 分;中等推理强度下以约四分之一成本领先 11.4 分。Terra 和 Luna 以约十六分之一成本反超 Fable 5。
  • 代码能力:Sol(最高推理强度)与 Fable 5 分差在 1 分以内,但时间少 61%,成本约一半。
  • 设计能力:仅需高层级指示即可生成美观、功能完整的界面,且能自行检查渲染效果。
  • 安全:在 ExploitBench 上 GPT-5.6 得分 73.5%(GPT-5.5 为 47.9%);网络安全和生物两个维度均未越过“关键”风险阈值。高级网络安全能力仅向通过身份验证的机构和人员开放。
  • Anthropic 反应:连夜重置用户 Fable 5 额度(待核实具体重置规则)。

为什么重要

GPT-5.6 通过 ultra 模式和多 agent 并行大幅提升了长周期复杂任务的完成能力,同时大幅降低 token 消耗和成本。ChatGPT Work 的推出标志着智能体从对话工具向跨应用自动化工作流的进化。安全测试的严格管控(尤其网络安全领域)也体现了前沿模型治理的新思路。

局限与不确定性

  • “ultra 模式 15 分钟烧完 Pro 会员 5 小时限额”的用户反馈表明 token 消耗依然可观。
  • 高级网络安全能力仅限可信访问计划,普通用户能使用的具体功能范围待核实。
  • Anthropic 重置额度的具体时间、范围及原因未在材料中详细说明。
  • 官方声称的“成本优势”依赖于中等推理强度下的对比,极端推理场景下的实际使用成本待核实。

可用于图书/PPT/简报的角度

  • 从“ultra 模式”看 AI 从单模型到多 agent 并行架构的范式转变。
  • OpenAI vs Anthropic 的竞争态势:GPT-5.6 发布如何倒逼对手调整产品策略。
  • 智能体应用落地:ChatGPT Work 如何将“目标变成完成品”,对办公自动化的启示。
  • 安全红线:前沿 AI 能力分级开放(防御 vs 攻击)的治理框架。

原始材料

  • 来源:量子位(QbitAI),2026-07-10,标题“GPT-5.6一发布,Claude终于舍得重置Fable 5额度了”,作者听雨。
  • URL: https://www.qbitai.com/2026/07/447691.html
  • 英文标题(根据文章):GPT-5.6 Launch: Claude Finally Resets Fable 5 Quota
  • 英文关键词:GPT-5.6, Claude Fable 5, OpenAI, Anthropic, multi-agent, AI safety, ChatGPT Work