5テスト・検証・トラブルシューティング
- 5.1GenAI の評価システム
FM 出力の品質を体系的に評価する方法を学びます。Bedrock Model Evaluations、RAG 評価、LLM-as-a-Judge、Bedrock Agent evaluations、A/B・カナリア、関連性/事実性/一貫性/流暢性メトリクス、回帰テストを扱います。
- 5.2GenAI アプリケーションのトラブルシューティング
GenAI 固有の不具合の切り分けを学びます。コンテキストウィンドウ超過、FM API 統合の問題、プロンプトの不具合、検索(埋め込み品質/ドリフト)の問題、スキーマ検証・CloudWatch Logs/X-Ray でのプロンプト保守を扱います。

