ベストプラクティス
Cova Nexus を効率的に利用するための推奨事項
モデル選定の方針
用途に最適なモデルを選ぶことで、品質を確保しながらコストを最適化できます。
| 用途 | 推奨モデル | 理由 |
|---|---|---|
| 日常会話・カスタマーサポート | claude-haiku-4-5 / gemini-3-flash | 低コストで応答が速い |
| コード生成・レビュー | gpt-5.3-codex-spark / codex-auto-review | コード関連タスクに最適化されている |
| 複雑な推論・分析 | claude-opus-4-6 / gpt-5.5 / grok-4.5 | 非常に高い推論性能を備える |
| マルチエージェント・検索 | grok-4.20-multi-agent-0309 / gemini-pro-agent | エージェントとマルチエージェントのオーケストレーションに適している |
| 長文ドキュメント処理 | gemini-3.1-flash-lite / claude-sonnet-4-6 | 非常に長いコンテキストに対応する |
| 画像・動画生成 | gpt-image-2 / gemini-3.1-flash-image / grok-imagine-image / grok-imagine-video | 専門的な画像・動画生成機能を備える |
コスト最適化
ℹ️ コスト最適化のヒント
- 重要度の低いリクエストには grok-3-mini(入力 $0.3/1M)や gemini-3.1-flash-lite(入力 $0.25/1M)など低価格のモデルを利用します
- キャッシュを活用し、同じ処理を繰り返す際のトークン消費を減らします
- max_tokens を適切に設定し、不要な出力によるコストを抑えます
- ストリーミング出力を利用し、最初のトークンから処理することで体感待ち時間を短縮します
信頼性を高めるための推奨事項
本番環境を安定して運用するため、次の対策を推奨します。
リトライ戦略
5xx エラーやタイムアウトには指数バックオフを使用し、初回待機時間を 1 秒、最大 3 回を目安にリトライします。
フォールバック方針
代替モデルを用意します。gpt-5.5 が利用できない場合は、gpt-5.4 または claude-opus-4-6 に切り替えられます。