Anthropic Claude Opus 4.7
anthropic/claude-opus-4.7 を本番環境に安全に導入するには、このガイドを使います。
Claude Opus 4.7 ではリクエスト形式が変わりました。4.6 用の設定をそのまま残すと、リクエストが失敗することがあります。
新機能
- 新しい effort レベル
xhigh(Messages API)。 - Opus 4.7 では拡張 thinking budget が削除され、
thinking: { type: "enabled", budget_tokens: ... }は失敗します。 - サンプリングパラメーター
temperature、top_p、top_kはデフォルト以外の値を指定できません。 - 明示的に有効にしない限り、thinking の内容は省略されます。
- tokenizer の更新により、Opus 4.6 よりトークン使用量が増えることがあります。
Phaseo Gateway の互換動作
移行時の破損を抑えるため、Phaseo は Opus 4.7 でも古い Opus 4.6 フィールドを受け付け、上流への送信前に正規化します。temperature、top_p、top_kは受け付けますが、削除します。- 古い thinking budget は転送されません。
- Opus 4.7 の thinking は常に
thinking: { "type": "adaptive", "display": "summarized" }として送信されます。 reasoning.effortは引き続き有効でoutput_config.effortに対応します。xhighも使えます。
移行クイックスタート
1. モデル ID を更新する
モデル ID をanthropic/claude-opus-4.7 にします。
2. 要約表示の適応型 thinking に移行する
Opus 4.7 では次を使います。thinking: { "type": "adaptive", "display": "summarized" }
3. サンプリング制御を削除する
次の値は送信しません。temperaturetop_ptop_k
4. effort 制御を再設定する
推論制御を使う場合は、次の値で再テストします。- 基準値として
output_config.effort = "high"。 - 最も難しいコーディングやエージェント処理には
output_config.effort = "xhigh"。
reasoning.effort は Opus 4.7 の output_config.effort と同じ値に変換されます。
5. トークン上限を確認する
tokenizer が変わったため、次を見直します。max_tokens/max_output_tokens- タイムアウト予算
- コスト制御とアラート
テスト項目
- 本番プロンプトでの厳密なスキーマ出力成功率。
- 長時間のツール処理(呼び出し回数、完了率、レイテンシ)。
highとxhighの出力品質の差。- 利用量の多いプロンプトでのトークンコストの変化。
安全なロールアウト
- トラフィックを切り替える前にリクエスト形式を更新します。
- 本番評価セットで Opus 4.7 をシャドー実行します。
- Opus 4.6 へ戻せる状態で段階的に試します。
- 品質、レイテンシ、コストの差が目標範囲内になってから拡大します。