知识卡片:Anthropic发布Claude 5.1,缓存读取成本降低75%
一句话结论
Anthropic推出Claude 5.1(速递材料中具体产品名为Fable 5.1与Mythos 5.1),在多个Agent基准上显著提升,同时通过缓存读取价格下调75%,使典型任务整体成本降低约25%。
事件概述
腾讯研究院AI速递(2026-09-03)报道,Anthropic推出Claude 5.1的两个版本:Fable 5.1面向用户与企业开放,Mythos 5.1仅向经审核的高风险领域伙伴提供;两者共享同一底层模型。
方法/产品要点
- 同一底层模型分为两个版本:Fable 5.1开放;Mythos 5.1限定高风险领域伙伴(具体审核标准待核实)。
- Terminal-Bench-Science成绩从24.7%提升至52.6%,AutomationBench从17.1%提升至31.4%。
- 可连续运行数十小时复杂任务。
- 输入输出价格不变,缓存读取价格下调75%。
主要结果或产业意义
- 典型任务整体成本降低约25%,高度Agent化任务最高降低45%。
- 基准成绩的大幅提升,意味着模型在面向终端操作、自动化工作流等Agent场景中的能力有可见进步。
为什么重要
已有相关卡片中的Agent多聚焦于虚拟世界、IDE或推理引擎等具体场景;本条增量信息在于:Anthropic通过缓存读取降价75%降低长时程Agent任务的成本,并以“开放版+受限版”双轨方式应对风险场景,同时支持连续运行数十小时的复杂任务,是Agent规模化落地的一次产品化推进。
局限与不确定性
- 报道未给出具体计费数值,也未说明“典型任务整体成本降低约25%”和“高度Agent化任务最高降低45%”的计算口径。
- “Fable 5.1”“Mythos 5.1”与“Claude 5.1”之间的品牌与版本关系待核实。
- 基准提升的对比基线、任务集细节及第三方复现结果待核实。
可用于图书/PPT/简报的角度
- Agent基准跃升:Terminal-Bench-Science从24.7%升至52.6%,AutomationBench从17.1%升至31.4%。
- 成本杠杆:缓存读取价格下调75%,使长时程Agent任务更具经济可行性。
- 双轨产品策略:面向用户与企业 vs. 经审核的高风险领域伙伴。
原始材料
- 英文标题:待核实(原始页面未给出英文标题)
- 英文关键词:Anthropic; Claude 5.1; Fable 5.1; Mythos 5.1; AI agent; cache read cost reduction; Terminal-Bench-Science; AutomationBench
- 中文标题:Anthropic发Claude 5.1,缓存读取成本降75%
- 来自:腾讯研究院AI速递 20260903
- URL:https://m.sohu.com/a/1071171604_455313?scm=10001.325_13-325_13.0.0-0-0-0-0.5_1334&digest_item=1