ベストプラクティス

Cova Nexus を効率的に利用するための推奨事項

モデル選定の方針

用途に最適なモデルを選ぶことで、品質を確保しながらコストを最適化できます。

用途推奨モデル理由
日常会話・カスタマーサポートclaude-haiku-4-5 / gemini-3-flash低コストで応答が速い
コード生成・レビューgpt-5.3-codex-spark / codex-auto-reviewコード関連タスクに最適化されている
複雑な推論・分析claude-opus-4-6 / gpt-5.5 / grok-4.5非常に高い推論性能を備える
マルチエージェント・検索grok-4.20-multi-agent-0309 / gemini-pro-agentエージェントとマルチエージェントのオーケストレーションに適している
長文ドキュメント処理gemini-3.1-flash-lite / claude-sonnet-4-6非常に長いコンテキストに対応する
画像・動画生成gpt-image-2 / gemini-3.1-flash-image / grok-imagine-image / grok-imagine-video専門的な画像・動画生成機能を備える

コスト最適化

ℹ️ コスト最適化のヒント
  • 重要度の低いリクエストには grok-3-mini(入力 $0.3/1M)や gemini-3.1-flash-lite(入力 $0.25/1M)など低価格のモデルを利用します
  • キャッシュを活用し、同じ処理を繰り返す際のトークン消費を減らします
  • max_tokens を適切に設定し、不要な出力によるコストを抑えます
  • ストリーミング出力を利用し、最初のトークンから処理することで体感待ち時間を短縮します

信頼性を高めるための推奨事項

本番環境を安定して運用するため、次の対策を推奨します。

🔄
リトライ戦略
5xx エラーやタイムアウトには指数バックオフを使用し、初回待機時間を 1 秒、最大 3 回を目安にリトライします。
🎯
フォールバック方針
代替モデルを用意します。gpt-5.5 が利用できない場合は、gpt-5.4 または claude-opus-4-6 に切り替えられます。