Anthropic面向长期自主任务的顶级公开模型
AI模型竞争正逐渐从“简短回答”转向“长时间自主工作的代理”。在此趋势下,Anthropic发布了Claude Fable 5模型。Anthropic将Fable 5描述为“向公众发布的Claude模型中最强大的一个”,并宣布它在软件工程、知识工作、视觉、科学研究和执行长期任务的能力方面超越了现有的Claude模型。 (Anthropic)

一言概之
Claude Fable 5是一款将Mythos级性能开放给普通用户使用的模型,但在网络安全、生命科学、模型蒸馏等高风险领域附加了强大的安全防护措施。
Fable 5的核心特点
Fable 5最重要的特点是其长期任务能力。Anthropic解释说,Fable 5和Mythos 5能够比之前的Claude模型更长时间地自主工作。它是一个专注于需要多个步骤的任务的模型,例如代码库分析、迁移、研究、文档分析和复杂视觉信息解释,而不是简单的问答。 (Anthropic)
从开发者的角度来看,重要的规格如下:
Fable 5与Mythos 5的关系
要理解Fable 5,必须了解它与Mythos 5的关系。根据Anthropic的说法,Fable 5和Mythos 5使用相同的底层模型。区别在于安全防护措施。Fable 5面向公众发布,因此对网络安全、生命科学、化学和模型蒸馏等相关的高风险请求采取保守的安全防护措施。而Mythos 5则提供给有限信任访问计划的合作伙伴,例如Project Glasswing。 (Anthropic)
简而言之如下:
类别Claude Fable 5Claude Mythos 5
| 目标用户 | 普通用户/企业/开发者 | 以授权合作伙伴为中心 |
| 基础模型 | 与Mythos 5相同 | 与Fable 5相同 |
| 安全防护 | 严格应用 | 在某些领域有所放宽 |
| 可用性 | 公开可用 | 有限公开 |
| 核心目的 | 高性能模型的普及 | 高风险专业领域的应用 |
安全防护:为什么有些请求会回退到Opus 4.8?
Fable 5中最具争议的部分是其安全防护措施。Anthropic解释说,Mythos级模型可能被滥用于网络攻击、生物风险、模型蒸馏等。因此,如果检测到特定请求,Fable 5将不会直接响应,而是自动切换到Claude Opus 4.8进行响应。用户将知晓此切换。 (Anthropic)
Anthropic表示,根据初步数据,超过95%的Fable会话在没有回退的情况下运行。然而,他们承认由于安全防护措施经过保守调整,正常的请求也可能被错误检测。 (Anthropic)
从教育、研究和安全咨询的角度来看,这一点至关重要。例如,在漏洞分析、逆向工程、漏洞利用分析、生命科学研究等“善意研究”与“可滥用知识”重叠的领域,可能难以充分利用Fable 5的性能。
价格
API基准价格为普通使用时输入每百万Token 10美元,输出每百万Token 50美元。使用Batch API时,输入每百万Token降至5美元,输出每百万Token降至25美元。 (Claude API Docs)
模型输入输出
| Claude Fable 5 | $10 / MTok | $50 / MTok |
| Claude Fable 5 Batch | $5 / MTok | $25 / MTok |
| Claude Opus 4.8 | $5 / MTok | $25 / MTok |
| Claude Sonnet 4.6 | $3 / MTok | $15 / MTok |
| Claude Haiku 4.5 | $1 / MTok | $5 / MTok |
仅从价格来看,Fable 5比Opus 4.8贵一倍。因此,与其用于所有任务,不如有选择地用于失败成本较高的任务,例如高难度编码、大规模重构、长篇文档分析和复杂代理任务,这更为实际。
数据保留政策
Fable 5和Mythos级模型适用30天数据保留政策。Anthropic解释说,Mythos级模型的输入和输出将为信任和安全目的保留30天,并且这些数据不会用于训练新的Claude模型。 (Claude Help Center)
特别是使用零数据保留(ZDR)的企业需要注意。根据Anthropic的说明,此政策会影响通过Claude Console的ZDR工作区、Claude Enterprise的ZDR设置、AWS Bedrock、Google Cloud Agent Platform和Microsoft Foundry以ZDR方式访问的组织。 (Claude Help Center)
企业引入时需要检查的要点如下:
| 检查项目 | 确认要点 |
| 个人信息 | 是否包含客户数据、日志、源代码 |
| 安全政策 | 是否允许30天保留 |
| 云路径 | 将在API、Bedrock、Vertex AI还是Foundry中使用 |
| 审计 | 检查访问日志、加密、数据删除政策 |
| 任务分离 | 一般任务使用Sonnet/Opus,高难度任务仅使用Fable |
适合哪些任务?
Fable 5适用于“一次性长期委托的任务”。例如:
| 领域 | 适用场景 |
| 软件开发 | 大规模代码库分析、迁移、重构、测试生成 |
| 云/DevOps | IaC代码审查、Terraform结构改进、故障原因分析 |
| 安全 | 防御性代码审计、安全设计审查、检测规则改进 |
| 文档分析 | 长篇政策文档、合同、技术文档比较 |
| 教育内容 | 课程大纲设计、实践场景生成、评估题目构成 |
| 视觉任务 | 基于截图的UI分析、图表解析、基于图像的代码重构 |
然而,在网络安全和生命科学领域,由于安全防护措施,部分请求可能会被路由到Opus 4.8。在安全教育或漏洞分析任务中使用Fable 5时,最好将提示设计为侧重于“防御性分析、代码审查、风险解释和补丁方向”,而不是“攻击重现”,这样会更稳定。
总结
Claude Fable 5与其说是一个“更智能的聊天机器人”,不如说是一个旨在执行长期任务的高性能代理型模型。其1M Token上下文、128k输出以及强大的编码、文档和视觉能力都极具吸引力。然而,由于其高昂的价格、30天数据保留政策以及高风险领域的回退政策,在企业环境中首先需要进行安全和合规性审查。
总而言之,Fable 5不应被视为“总是使用的模型”,而应被视为一个高级模型,适用于那些明确需要使用昂贵模型的任务,例如重要的代码库更改、复杂分析或长期代理操作。
发表回复