Skip to main content

Anthropic Claude Opus 5

使用本指南,在生产环境中安全采用 anthropic/claude-opus-5。 Claude Opus 5 是面向复杂推理、长周期代理编程和高自主性工作流的当前 Opus 模型。它与 Opus 4.8 价格相同,支持 100 万 token 的上下文窗口,最多可输出 128K token。

迁移快速入门

  1. 将模型 ID 改为 anthropic/claude-opus-5,其余请求保持不变。
  2. 重新运行生产环境中的提示词、工具和结构化输出评估。
  3. 针对长上下文和高强度工作负载,重新测量延迟、token 用量和任务成本。
  4. 在更改默认路由前,先逐步试用,并保留 Claude Opus 4.8 作为回退模型。

新功能

  • Phaseo 模型 ID 为 anthropic/claude-opus-5。
  • 上下文窗口为 100 万 token。
  • 最大输出为 128K token。
  • 适用于长周期推理、编程和自主工具工作流。
  • 价格仍与 Claude Opus 4.8 保持一致。

测试内容

提示词和输出

  • 检查模型对最长系统提示词的遵循情况。
  • 检查结构化输出和 Schema 的通过率。
  • 检查回复长度和停止行为。
  • 检查专为 Claude Opus 4.8 调整的提示词是否出现回归。

工具和代理

  • 检查工具选择和参数质量。
  • 检查工具错误或部分结果后的恢复情况。
  • 检查长周期任务完成率。
  • 检查高自主性工作流中的权限和审批边界。

运维

  • 检查各推理强度下的延迟和 token 用量。
  • 检查长文档和代理轨迹的上下文窗口用量。
  • 计算每个成功任务的成本。
  • 检查主路由超时或失败时的回退行为。

安全发布

  1. 评估期间保留 Claude Opus 4.8 作为回退选项。
  2. 在处理用户请求前,先对有代表性的生产流量进行影子测试。
  3. 按工作负载逐步试运行,不要一次性切换所有 Opus 路由。
  4. 只有质量、延迟、成本和工具安全检查均达到目标后再扩大流量。

来源

最后修改于 2026年10月2日