知识卡片:GPT-5.6 发布与 Claude 额度重置
一句话结论
GPT-5.6 是 OpenAI 迄今最强模型,分 Sol、Terra、Luna 三档,引入 ultra 多 agent 并行模式和 ChatGPT Work 智能体功能;Anthropic 在发布后连夜重置了 Claude 的 Fable 5 额度。
事件概述
2026 年 7 月 10 日,OpenAI 正式发布 GPT-5.6,同步推出 ChatGPT Work(由 Codex 和 GPT-5.6 驱动),并完成产品架构合并(Chat / Work / Codex 三种模式)。Anthropic 在发布会后宣布重置 Claude Fable 5 额度。
方法/产品要点
- 模型家族:Sol(旗舰,最高能力)、Terra(平衡款)、Luna(最快最便宜)。
- 关键新模式:ultra 模式——由多个 agent 并行处理,默认协调 4 个 agent,可扩展至 16 个。
- 工程新能力:Programmatic Tool Calling(程序化工具调用),模型可自写轻量程序协调多工具调用。
- ChatGPT Work:跨应用/文件行动,持续数小时完成目标,具备跨应用取材、产出成品、长任务持续监督、Auto-Review 安全审查等能力。
- 定价(每百万 token):Sol 输入$5/输出$30;Terra 输入$2.5/输出$15;Luna 输入$1/输出$6。
主要结果或产业意义
- 性能对比:在 Agents’ Last Exam 上,Sol 以 53.6 分刷新纪录,比 Fable 5 高出 13.1 分;中等推理强度下以约四分之一成本领先 11.4 分。Terra 和 Luna 以约十六分之一成本反超 Fable 5。
- 代码能力:Sol(最高推理强度)与 Fable 5 分差在 1 分以内,但时间少 61%,成本约一半。
- 设计能力:仅需高层级指示即可生成美观、功能完整的界面,且能自行检查渲染效果。
- 安全:在 ExploitBench 上 GPT-5.6 得分 73.5%(GPT-5.5 为 47.9%);网络安全和生物两个维度均未越过“关键”风险阈值。高级网络安全能力仅向通过身份验证的机构和人员开放。
- Anthropic 反应:连夜重置用户 Fable 5 额度(待核实具体重置规则)。
为什么重要
GPT-5.6 通过 ultra 模式和多 agent 并行大幅提升了长周期复杂任务的完成能力,同时大幅降低 token 消耗和成本。ChatGPT Work 的推出标志着智能体从对话工具向跨应用自动化工作流的进化。安全测试的严格管控(尤其网络安全领域)也体现了前沿模型治理的新思路。
局限与不确定性
- “ultra 模式 15 分钟烧完 Pro 会员 5 小时限额”的用户反馈表明 token 消耗依然可观。
- 高级网络安全能力仅限可信访问计划,普通用户能使用的具体功能范围待核实。
- Anthropic 重置额度的具体时间、范围及原因未在材料中详细说明。
- 官方声称的“成本优势”依赖于中等推理强度下的对比,极端推理场景下的实际使用成本待核实。
可用于图书/PPT/简报的角度
- 从“ultra 模式”看 AI 从单模型到多 agent 并行架构的范式转变。
- OpenAI vs Anthropic 的竞争态势:GPT-5.6 发布如何倒逼对手调整产品策略。
- 智能体应用落地:ChatGPT Work 如何将“目标变成完成品”,对办公自动化的启示。
- 安全红线:前沿 AI 能力分级开放(防御 vs 攻击)的治理框架。
原始材料
- 来源:量子位(QbitAI),2026-07-10,标题“GPT-5.6一发布,Claude终于舍得重置Fable 5额度了”,作者听雨。
- URL: https://www.qbitai.com/2026/07/447691.html
- 英文标题(根据文章):GPT-5.6 Launch: Claude Finally Resets Fable 5 Quota
- 英文关键词:GPT-5.6, Claude Fable 5, OpenAI, Anthropic, multi-agent, AI safety, ChatGPT Work