1. Claude Fable 5.1 适合谁
它面向长程 Agent、复杂代码库、高难度推理和需要持续工具调用的工作流。若任务只是短文本改写、分类或批量抽取,先用成本更低的 Claude 型号建立基线;旗舰模型是否更省钱,应按一次任务的总 Token、重试次数和完成率判断。
2. Claude Fable 5.1 官方规格
| 项目 | 官方资料 | 接入时要核对 |
|---|---|---|
| 模型 ID | claude-fable-5-1 | 渠道是否暴露同名 ID |
| 上下文 | 1,000,000 tokens | 系统提示、工具定义也占窗口 |
| 最大输出 | 128,000 tokens | 账号与请求上限可能更低 |
| 官方标准价格 | 输入 $10、输出 $50/MTok | 本站账单以控制台为准 |
| 缓存 | 支持 prompt caching | 写入和读取采用不同计费口径 |
这些数字用于建立公开规格基线,不代表本站承诺的价格、SLA 或实际最大输入。长上下文请求还要预留工具结果、推理块和输出空间。
3. 从 Fable 5 到 5.1 有哪些变化
5.1 不只是名称升级。官方文档将每条消息的 effort 控制、Agent 运行进度、缓存读取成本和长任务稳定性列为重点,同时提醒迁移者重新验证强制工具调用与 thinking block 的兼容行为。
- effort 控制:按消息调节思考强度,适合把规划与执行阶段分开。
- 进度可见性:长 Agent 任务可提供更清晰的运行反馈。
- 缓存成本:重复系统提示和大段固定上下文更值得使用缓存。
- 严格校验:旧代码若拼接或回放 thinking/tool block,升级前必须跑回归测试。
完整升级检查见 Claude Fable 5 升级 5.1 迁移指南。
4. Claude Fable 5.1 API 怎么接入
接入分两层:Anthropic 原生协议使用 Messages API;OpenAI 兼容渠道则需要确认字段映射、工具调用、thinking 内容和错误响应是否被完整保留。不要只测试一句普通对话就认定迁移完成。
curl https://www.codex789.com/v1/chat/completions -H "Authorization: Bearer sk-codex789-your-api-key" -H "Content-Type: application/json" -d '{"model":"claude-fable-5-1","messages":[{"role":"user","content":"审查这段迁移方案的风险"}]}'如果模型列表中尚未出现该 ID,请保留 Fable 5 或 Opus 5 的回退配置,不要在生产环境硬切。
5. Fable 5.1、Opus 5 和 Sonnet 5 怎么选
Fable 5.1 适合最高复杂度和长程 Agent;Opus 5 适合需要高质量但更关注单位任务成本的工作;Sonnet 5 适合日常编码、批量执行和交互速度。选择时固定同一组任务,记录是否一次完成、工具调用是否闭环、总输出量和失败回退,而不是只比较宣传榜单。
进一步比较见 Claude Fable 5.1 vs Opus 5,跨厂商选型见 GPT-6 Astra vs Claude Fable 5.1。
6. 常见问题
Claude Fable 5.1 的模型 ID 是什么?
官方模型 ID 为 claude-fable-5-1,实际请求前仍需确认渠道是否已经提供。
Fable 5.1 一定比 Fable 5 兼容吗?
不一定。普通文本请求通常容易迁移,但工具调用、thinking block 回放和严格结构化流程需要回归测试。
本站已经可以直接调用吗?
以控制台模型列表和接口响应为准;未显示时请联系客服单独确认。
7. 缓存、Batch 与三种成本口径
Fable 5.1 的官方标准价是输入 $10、输出 $50/MTok;5 分钟缓存写入为 $12.50,1 小时缓存写入为 $20,缓存读取为 $0.25/MTok。缓存读取只有基础输入价的 2.5%,但第一次写入仍会产生费用。Batch API 的输入和输出按官方标准价五折,适合不要求即时返回的离线评测、批量分类和报告生成。
| 示例任务 | 计算方法 | 官方标准价估算 |
|---|---|---|
| 100K 输入 + 10K 输出 | 0.1×$10 + 0.01×$50 | $1.50 |
| 80K 已缓存 + 20K 新输入 + 10K 输出 | 0.08×$0.25 + 0.02×$10 + 0.01×$50 | $0.72,不含首次缓存写入 |
| 同任务使用 Batch | 标准输入输出费用 × 50% | $0.75 |
以上只是用官方 Token 单价演示计算,不包含工具费用、失败重试、数据驻留或本站渠道倍率。本站实际扣费必须以控制台流水为准。
8. 原生 Messages API 与兼容接口不要混为一谈
需要完整使用 adaptive thinking、effort、prompt caching 和原生 tool use 时,优先按 Anthropic Messages API 的字段验证。下面示例使用消息级 effort;生产环境应把密钥放入环境变量,不要写在源码中。
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-fable-5-1",
"max_tokens": 4096,
"output_config": {"effort": "high"},
"messages": [
{"role": "user", "content": "审查迁移方案并列出阻断上线的问题"}
]
}'OpenAI 兼容渠道可降低 SDK 迁移成本,但字段映射不一定覆盖全部原生能力。至少要分别验证普通文本、tool use、thinking block、缓存 usage 字段和错误响应;只得到一次 200 不能证明功能等价。
9. 上线前的可用性与版本核验
- 请求模型列表,确认返回的 ID 是
claude-fable-5-1,而不是旧模型别名。 - 保存响应中的实际模型 ID、request ID、usage 和日期。
- 对 1M 长上下文逐步加压,不要直接用最大窗口做第一次请求。
- 验证账号、区域和上游平台是否支持相同功能;Bedrock、Google Cloud、Microsoft Foundry 的模型 ID 格式可能不同。
- 确认回退模型能否读取当前对话中的 thinking block,不能读取时只传递可见消息和业务状态。
官方状态为 Active,并承诺不早于 2027-09-01 退役;这不等于本站所有分组已经同步开放。
官方来源:Anthropic Claude Fable 5.1 overview、Claude pricing、Fable 5.1 migration guide。核对日期:2026-09-19。