Google Gemini 3.1
Gemini 3.1 ファミリーを本番環境に安全に導入するには、このガイドを使います。google/gemini-3-pro-previewgoogle/gemini-3-flash-previewgoogle/gemini-3.1-pro-previewgoogle/gemini-3.1-flash-lite-preview
新機能
- Gemini 3 では推論の深さを制御する主な項目として
thinking_levelが導入されました。 - マルチモーダルの画像処理向けに
media_resolutionが追加されました。 - Thought Signature により、呼び出し間で推論コンテキストが保持されます。
- 厳密なワークフローでは Thought Signature が欠けると品質低下や
400エラーが発生することがあります。 - Gemini 3.1 Pro は複雑なタスクやエージェントワークフロー向けの、より強力な推論モデルです。
移行クイックスタート
1. 推論制御の対応付けを見直す
汎用の推論設定をアプリで公開している場合は、Gemini 3 の経路に慎重に割り当てます。OpenAI 互換フローではreasoning_effort は概念上 thinking_level に対応しますが、動作は一対一ではないため再テストが必要です。
2. Thought Signature を正しく扱う
公式 Gemini SDK と標準のチャット履歴では、通常シグネチャーは自動的に処理されます。低レベルのリクエストを構築する場合、特に関数呼び出しや画像の生成・編集では、返された署名を保持し、指定どおりそのまま返送します。3. プロンプトの書き方を見直す
Gemini 3 では長いプロンプトの枠組みより、直接的なプロンプトとパラメーターによる制御が推奨されています。古いモデルの挙動を補うため複雑になっている場合は、簡素化して再評価します。4. マルチモーダル設定を調整する
画像、文書、複合メディアを含む経路では、以前のデフォルトが適切とは限らないためmedia_resolution を再テストします。
テスト項目
プロンプトと推論の動作
- 簡潔なプロンプトと詳細なプロンプトの比較
- 段階的な推論タスク
- 長いコンテキストの統合
- 推論の連続性を保つ必要があるエージェント処理
応答の処理
- ターン間での署名の保持
- 関数呼び出しの成功率
- スキーマ成功率
- thinking 制御変更後の空、部分的、形式不正な出力
本番メトリクス
thinking_levelごとのレイテンシ- トークン使用量とコスト
media_resolution設定ごとのマルチモーダル経路の性能- Gemini 3 と Gemini 3.1 Pro のタスク成功率の比較
ロールアウトの推奨事項
Gemini 3 と Gemini 3.1 は別々の移行として扱います。- まずリクエスト形式と署名の処理を移行します。
- 次に Gemini 3 でプロンプトとスキーマの評価を再実行します。
- より深い推論が必要な経路では Gemini 3.1 Pro を個別に導入します。
- トラフィックの多い処理には、より簡単または低コストのフォールバックを用意します。