Claude Fable 5.1发布:缓存降价75%、安全升级、数据可控,补全大模型“可部署性”短板
2026/9/18 22:56:08 网站建设 项目流程

缓存降价:长任务成本大降

每百万token的缓存读取价格,从1美元降到0.25美元,降幅75%。这一数字虽不起眼,却决定了agent跑长任务时真正的成本。标准输入、输出价格没动,Anthropic只动了缓存读取这一项。由于agent的成本结构和一次性聊天不同,缓存让系统保存已处理的上下文,后续只需付便宜的读取费。因此,缓存读取价格砍掉75%后,典型负载省约25%,重度agent任务省到45%。

模型部署:两种方式各有侧重

Fable 5.1和Mythos 5.1是同一个模型的两种部署方式,区别在于安全保护级别。Fable 5.1面向所有人开放,带网络安全和生物安全防护;Mythos 5.1保留更多原始能力,只提供给经过审核的网络安全和生命科学机构。这意味着Anthropic尝试将“模型能力”和“模型开放程度”拆开管理。

跑分提升:多项基准测试领先

跑分方面也有提升,8项公开基准全部第一。在智能体科学研究的Terminal - Bench - Science上,Fable 5.1拿到52.6%,是Fable 5(24.7%)的两倍多,也甩开GPT - 5.6 Sol的22.4%。

反蒸馏机制:堵住数据篡改漏洞

新注册的API账户无法再在多轮对话里手动篡改Claude的上下文并保留思维链记录。反蒸馏机制采用签名机制,验证模型权限和对话内容一致性。若校验失败,处理方式取决于开发者设置的参数。某些操作会触发失败,而部分操作则是安全的。使用Claude官方产品无需担心,直接调Messages API的开发者需注意。该机制旨在阻止“拿到别人的推理过程再重新灌进去”。

编程表现:有亮点也有局限

Anthropic称Fable 5.1会减少走捷径行为,更愿追根因。投资机构Millennium给出案例,但代码评审平台CodeRabbit的独立测试显示,Fable 5.1在代码评审中的召回率几乎没变,精确率有所提升,但速度变慢。这表明它并非所有编程任务的默认选择,只适用于复杂任务。

科研能力:输出接受真实验证

Anthropic此次着重展示了科学研究能力。Mythos 5.1在蛋白质设计和折叠方面表现出色,设计的结合剂亲和力高、命中率高;Fable 5.1重绘金星地形图并开源;Mythos 5.1优化GPU kernel,推理速度加快、成本降低且即将开源。这些输出开始接受真实世界验证。

数据留存:满足监管行业需求

Fable 5默认要求保留30天使用数据,这限制了受监管行业。Fable 5.1配套推出Enterprise Frontier Safeguards,让日志存于客户自己的云环境,用客户管理的密钥和审计系统,满足了金融、医疗等行业的需求。

总结:补全“可部署性”短板

综合来看,缓存降价适合长任务、安全系统减少误伤、敏感数据留在客户手里,Fable 5.1补全了“可部署性”这三块基础设施,竞争重心正从“每百万token多少钱”挪到“完成一个合格任务多少钱”。

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询