Instiq

Microsoft Azure AI Engineer Associate のナレッジマップ

Microsoft Azure AI Engineer Associate の主要概念 126 件と、そのつながり。上のマップでノードをクリックすると関連用語や前提をたどれます。下は全概念の索引で、定義と「前提・関連する概念」への内部リンクを掲載しています。

概念一覧(126)

  • 生成 AI

    学習データをもとに文章・画像・コードなど新しいコンテンツを生成するAI。分類/回帰とは別用途。

  • プロンプトと補完

    プロンプト=モデルへの入力(指示/質問)、補完=モデルが返す生成結果。

  • Azure Machine Learning

    MLのワークフロー(準備→学習→評価→デプロイ→予測)を支援。Automated ML(自動最良選択)とDesigner(ノーコード)がある。

    前提: 機械学習(ML)

  • Azure ML のデプロイ(オンライン/バッチエンドポイント・トラフィック分割)

    推論はエンドポイントで提供。マネージドオンラインエンドポイント=リアルタイム低遅延(Azure がインフラ管理・オートスケール)/Kubernetes オンライン=既存 AKS/バッチエンドポイント=大量データをコンピューティングクラスター上で非同期スコアリング。1 エンドポイントに複数デプロイを置き、トラフィック分割でブルー/グリーン(段階的ロールアウト・即ロールバック)。デプロイにはスコアリングスクリプト(init/run)と環境、適切なインスタンス種別/数が必要(MLflow モデルは推論コード不要なことも)。アクセスはマネージド ID+キー/トークン認証、必要ならプライベートエンドポイント。

    前提: Azure Machine Learningバッチエンドポイントコンピューティングクラスターマネージドオンラインエンドポイント

  • Azure ML のジョブと AutoML/スイープ(MLflow・ハイパーパラメーター調整)

    学習はジョブとして実行:コマンドジョブ(単一スクリプト)・スイープジョブ(ハイパーパラメーター探索)・パイプラインジョブ(コンポーネントの DAG)。定義は YAML(CLI v2)/SDK v2。トラッキングは MLflow がネイティブ統合(log_metric/log_param/log_artifact・autolog)で実験を比較。AutoML はタスク指定でアルゴリズム/前処理を自動探索しリーダーボードで選択。スイープは探索空間+サンプリング(グリッド/ランダム/ベイズ)+早期終了(Bandit/中央値停止)でハイパーパラメーターを調整、max_concurrent_trials で並列度とコストを制御。

    前提: Azure Machine Learningコマンドジョブコンポーネント(再利用可能なステップ)早期終了ポリシー(Bandit/中央値停止)

  • ML データ準備(エンコード/スケーリング/不均衡)

    生データをモデルが学べる形に整える工程。エンコード=カテゴリを数値化(ワンホット/順序/ターゲット)、スケーリング=標準化(z-score)/正規化(Min-Max)、不均衡=SMOTE等のオーバーサンプリング/クラス重み付け(評価はF1/PR-AUC)。変換のfitは分割後のトレーニングデータのみ(データリーク防止)。

    前提: モデル評価指標(適合率/再現率/F1/AUC/RMSE)

  • トークン

    モデルが扱うテキストの単位(おおむね単語の一部)。料金やコンテキスト長の基準になる。

  • Azure AI Language

    感情分析・エンティティ認識・キーフレーズ抽出・言語検出・要約・会話言語理解(CLU)など、テキスト理解を担う。

    前提: 会話言語理解(CLU)キーフレーズ抽出と言語検出エンティティ認識(NER)と PII 検出感情分析とオピニオンマイニング

  • Azure OpenAI Service

    GPT等の基盤モデルにAzure経由で安全にアクセスし、自分のアプリに生成AIを組み込む(企業向け統制)。

    前提: 基盤モデル生成 AI

  • Azure ML のコンピューティングとデータ(ワークスペース/クラスター/データアセット)

    Azure ML ワークスペースが ML の成果物(データ・モデル・実験・エンドポイント)を一元管理し、関連リソース(ストレージ/Key Vault/Application Insights/Container Registry)が紐づく。コンピューティングは開発用のコンピューティングインスタンス(個人・停止でコスト節約)と学習をスケールさせるコンピューティングクラスター(オートスケール・アイドル時 0 ノード・低優先度/Spot VM 可)。データは Blob/ADLS への接続情報=データストアと、再利用可能・バージョン管理された参照=データアセット(uri_file/uri_folder/mltable)。学習済みモデルはモデルレジストリでバージョン管理。環境(conda/Docker)で依存を固定し再現性を担保。操作は Studio/Python SDK v2/CLI v2。

    前提: Azure Machine Learningコンピューティングクラスターコンピューティングインスタンスデータアセット(uri_file/uri_folder/mltable)

  • 埋め込み(embeddings)

    テキスト等を数値ベクトルに変換し、意味の近さを比較できるようにする表現。検索やRAGに使う。

  • 基盤モデル

    幅広い用途に使える大規模な事前学習モデル(例:GPT)。マルチモーダルは複数種類を扱う。

  • RAG の最適化

    RAG の品質は検索(retrieval)の質に依存する。類似度しきい値・チャンクサイズ・検索戦略(上位 k/再ランク付け)を調整し、ドメイン固有なら埋め込みモデルの選択・ファインチューニングで関連性を高める。セマンティック(ベクトル)検索とキーワード検索を組み合わせたハイブリッド検索で補完し、関連性メトリクスと A/B テストで定量的に評価・改善する。

    前提: セマンティックランカーとベクトル検索生成 AI の品質メトリクスと評価埋め込み(embeddings)ファインチューニング

  • Azure AI Vision

    画像のタグ・キャプション・物体検出・OCR(Read)など汎用的なコンピュータービジョンを事前構築モデルで提供。

    前提: コンピュータービジョン

    関連: OCR(Read)

  • ファインチューニング

    自社のラベル付きデータで基盤モデルを追加学習し、振る舞い・文体・専門知識を重みに内在化させる方法。RAGより手間大。

    前提: 基盤モデル

  • Document Intelligence カスタム/構成モデル

    独自フォームを学習するカスタムモデル(テンプレート型/ニューラル型)と、複数のカスタムモデルを束ねて自動で振り分ける構成モデル。

    前提: Azure AI Document Intelligence

  • セマンティックランカーとベクトル検索

    検索結果を意味的関連性で並べ替えるセマンティックランカーと、埋め込みベクトルで類似検索するベクトル検索。両者とキーワードを組み合わせるハイブリッド検索が RAG の品質を高める。

    前提: 埋め込み(embeddings)

  • 音声認識(STT)とカスタム音声

    話し言葉をテキストに変換する音声認識。専門用語や訛りに合わせて「カスタム音声認識(Custom Speech)」で認識精度を高められる(音声合成側のカスタムニューラル音声とは別物)。

    前提: Document Intelligence カスタム/構成モデル音声合成(TTS)と SSML

  • 音声合成(TTS)と SSML

    テキストを自然な音声に変換する音声合成。SSML(音声合成マークアップ言語)で発音・抑揚・間を制御し、カスタムニューラル音声で独自の声を作れる。

    前提: Document Intelligence カスタム/構成モデル

  • Foundry Agent Service(基礎)

    Microsoft Foundry でエージェントを構築・実行するマネージドサービス。モデル・指示(システムプロンプト)・ツール(ナレッジ・関数)・スレッドを組み合わせて目的志向の AI を作る。

    前提: プロンプトと補完

    関連: Function Calling(関数呼び出し)

  • スイープジョブ(ハイパーパラメーター調整)

    探索空間・サンプリング・主要メトリック・早期終了を指定して多数の試行を走らせ、最良のハイパーパラメーター構成を見つけるジョブ。

    前提: 探索空間(search space)

    関連: プライマリメトリック

  • ハルシネーション

    生成AIが「もっともらしいが誤った内容」を自信ありげに生成する現象。人の確認やRAGで緩和。

    前提: 生成 AI

  • Azure Key Vault

    鍵・シークレット・証明書を安全に保管・管理するサービス。アプリに直接埋め込まずに済む。

  • マネージド ID

    シークレットの管理なしにアプリが Azure リソースへ安全にアクセスできる ID。Azure が自動管理するサービスプリンシパル。

  • DALL-E(画像生成)

    Azure OpenAI のテキストから画像を生成するモデル。プロンプトに基づき画像を作成・編集する。

    前提: Azure OpenAI Serviceプロンプトと補完

  • プロンプトシールドと有害性検出

    ジェイルブレイクや間接的プロンプトインジェクションを検出するプロンプトシールドと、保護された素材(著作物)の検出で生成 AI の悪用や漏えいを防ぐ。

    前提: 生成 AIプロンプトと補完

  • インデックスとインデクサー

    Azure AI Search の検索対象を定義するインデックスと、データソースから内容を取り込んで索引化するインデクサー。クエリは構文・並べ替え・フィルター・ワイルドカードに対応する。

    前提: Azure AI Search(ナレッジマイニング)

  • 要約(抽出/抽象)

    長文や会話の要点をまとめる機能。抽出的要約は重要文を選び、抽象的要約は新しい文で言い換えて要約する。

  • イベント駆動 AI パイプライン

    Event Grid/Service Bus/Event Hubs でイベントやメッセージをトリガーに、非同期で AI 処理(取り込み→埋め込み→インデックス化→推論)をオーケストレーションする設計。

    前提: 埋め込み(embeddings)Azure Event GridAzure Event HubsAzure Service Bus

  • AI 向けベクトルデータ管理

    埋め込みベクトルを保存し類似検索する基盤。Azure では Cosmos DB(NoSQL のベクトル検索)、PostgreSQL の pgvector、Azure AI Search のベクトルインデックスを用途で選ぶ。

    前提: セマンティックランカーとベクトル検索Azure AI Search(ナレッジマイニング)Azure Cosmos DB埋め込み(embeddings)

  • Azure AI Content Safety

    有害・不適切なコンテンツを検出・抑制するコンテンツフィルター。生成AIの安全運用に使う。

    前提: 生成 AI

  • Azure AI Document Intelligence

    請求書・レシート・フォームから項目(金額・日付等)を構造化抽出する(ドキュメントインテリジェンス)。

  • Face(顔)

    画像内の顔の検出・属性分析に特化(責任あるAIの観点で一部機能は制限)。

    前提: 責任ある AI

  • コンポーネント(再利用可能なステップ)

    入力・出力・コード・環境をまとめた再利用可能な処理単位。パイプラインのステップとして組み合わせ、バージョン管理・共有できる。

  • プロンプトフロー(prompt flow)

    LLM・プロンプト・Python・ツールをノードとして連結し、生成 AI アプリのフローを構築・評価・デプロイする開発ツール。SDK で連鎖ロジックを定義する。

    前提: 生成 AIプロンプトと補完

  • GenAIOps

    MLOps の考え方を生成 AI(Azure AI Foundry・基盤モデル・プロンプト)へ拡張した運用プラクティス。プロンプトやエージェントのフロー、評価指標(グラウンディング・有害性等)をコードやコンフィグとして Git 管理し、CI/CD で評価→デプロイ→監視→改善のサイクルを自動化する。

    前提: 基盤モデル生成 AIMLOps(SageMaker Pipelines / Model Registry)プロンプトと補完

  • RAG(検索拡張生成)

    社内文書などを検索してプロンプトに添え、根拠ある回答を生成する手法。ハルシネーション低減に有効。

    前提: ハルシネーションプロンプトと補完

  • 責任ある AI

    AIを安全・公正・透明に使う指針。Microsoftの6原則=公平性/信頼性と安全性/プライバシーとセキュリティ/包括性/透明性/説明責任。

  • Azure OpenAI モデルデプロイと PTU

    Azure OpenAI でモデルを選んでデプロイし、エンドポイントとして公開する。スループットは従量課金か、確保されたプロビジョニング済みスループット(PTU)で安定させる。

    前提: Azure OpenAI Service

  • 会話言語理解(CLU)

    ユーザー発話から意図(インテント)とエンティティを抽出するカスタム言語モデル。発話を追加して学習・評価・デプロイし、クライアントから利用する(旧 LUIS の後継)。

  • ドキュメント翻訳とカスタム翻訳

    Translator のドキュメント翻訳は書式を保ったままファイルを翻訳し、カスタム翻訳(Custom Translator)は対訳データで業界固有の用語に適応したモデルを学習・公開する。

    前提: Azure AI Translator

  • 画像分析(タグ・キャプション・物体検出)

    Azure AI Vision の画像分析。視覚的特徴を選んで画像にタグ付け・キャプション生成・物体検出を行い、スマートクロップで重要領域を切り出す。

    前提: Azure AI Vision

  • キーフレーズ抽出と言語検出

    テキストから要点となるキーフレーズを抽出し、言語検出でどの言語かと信頼スコアを判定する。

  • エンティティ認識(NER)と PII 検出

    固有表現認識(NER)で人名・地名・組織などを抽出し、PII 検出で個人を特定できる情報を見つけてマスキングする。

  • OCR(Read)

    Azure AI Vision の Read 機能で、印刷・手書きのテキストを画像やドキュメントから抽出する光学文字認識。

    関連: Azure AI Vision

  • プロンプトフロー(Foundry)

    LLM・プロンプト・Python・ツールをノードでつないで生成 AI のフローを構築・評価・デプロイする開発機能。RAG やエージェントの実装に使う。

    前提: プロンプトフロー(prompt flow)生成 AIプロンプトと補完

  • 音声翻訳と話者認識

    音声をその場で別言語の音声/テキストへ変換する音声翻訳と、声で個人を識別/検証する話者認識。

  • Azure AI Video Indexer

    動画やライブ配信から話者・文字起こし・顔・ラベル・感情などの insight を抽出するサービス。

    前提: インデックスとインデクサー

  • ファインチューニングと合成データの運用

    プロンプト→RAG→ファインチューニングの順(コスト/効果)で最適化する。ファインチューニングは高品質な学習データが要で、不足時は合成データを作成(品質・多様性・偏りの管理が必要)。ファインチューニング済みモデルも過剰適合や劣化を監視し、評価→登録→デプロイ→監視の MLOps ライフサイクルで開発から本番まで管理する。

    前提: ファインチューニングMLOps(SageMaker Pipelines / Model Registry)プロンプトと補完

  • 生成 AI の品質メトリクスと評価

    生成 AI は出力が一意でないため評価が運用の要。AI 品質メトリクス=根拠性(提供根拠に基づくか=ハルシネーションの逆)/関連性(質問に答えるか)/一貫性(論理性)/流暢性(自然さ)。加えてリスク・安全性の評価(有害コンテンツ/脱獄耐性)を、組み込み+カスタムメトリクスの自動評価ワークフローとして品質ゲート化する。

    前提: 生成 AIハルシネーション

  • プロンプトフローの CI/CD

    プロンプトフローをコードとして扱い、評価をゲートにした自動テスト・承認・デプロイのパイプラインを構成して、生成 AI アプリを安全に反復リリースする。

    前提: プロンプトフロー(prompt flow)生成 AIプロンプトと補完

  • Azure API Management(APIM)

    複数のバックエンド API を統一された入口で公開する API ゲートウェイ。ポリシー(XML・インバウンド/バックエンド/アウトバウンド/エラー)で認証(validate-jwt)・レート制限・変換・キャッシュ・CORS を適用。製品とサブスクリプション(キー)で利用者へ提供、開発者ポータルでドキュメント提供、バックエンド認証はマネージド ID、シークレットは名前付き値(Key Vault)。

    前提: Azure Key Vaultマネージド ID

  • Custom Vision

    自分の画像で学習させ、独自の画像分類器・物体検出を作るサービス。

  • Azure AI Speech

    音声⇔テキスト(音声認識・読み上げTTS)と音声翻訳を担う。

    前提: 音声翻訳と話者認識音声認識(STT)とカスタム音声音声合成(TTS)と SSML

  • Azure AI Translator

    テキストの言語間翻訳を担うサービス。

  • コンピュータービジョン

    画像/動画を解析し、物体・文字・顔などを認識・理解するAI分野(分類・物体検出・OCR・顔検出等)。

    前提: Face(顔)

  • Azure Container Apps

    Kubernetes を意識せずコンテナ/マイクロサービスを動かすサーバーレス基盤。KEDA でイベント駆動スケール(ゼロスケール可)、Dapr 連携に対応。

    前提: ML データ準備(エンコード/スケーリング/不均衡)

    関連: ACR(Azure Container Registry)

  • AutoML のタスク(表形式/画像/NLP)

    自動機械学習は表形式データだけでなく、コンピュータービジョン(画像分類・物体検出)や自然言語処理にも適用でき、アルゴリズムと前処理を自動探索する。

    前提: コンピュータービジョン機械学習(ML)自然言語処理(NLP)

  • コンピューティングクラスター

    学習やバッチ推論をスケールさせるオートスケール計算。アイドル時 0 ノードに縮小でき、低優先度/Spot VM でコストを抑えられる。

  • モデルカタログ

    Azure AI Foundry / Azure ML で多数の基盤モデル(OpenAI・Hugging Face・Meta 等)を探索・比較・デプロイできるカタログ。

    前提: Azure Machine Learning基盤モデル

  • 探索空間(search space)

    調整するハイパーパラメーターとその候補範囲(離散 choice・連続 uniform/loguniform 等)の定義。

  • Azure ML ワークスペース

    ML の成果物(データ・モデル・実験・エンドポイント)を一元管理する最上位リソース。ストレージ・Key Vault・Application Insights・Container Registry が紐づく。

    前提: Azure Machine LearningAzure Key Vault

  • 推論パラメータ(温度・top-p・コンテキストウィンドウ)

    温度/top-pは出力の多様性(低い=一貫的/高い=創造的)、コンテキストウィンドウは一度に扱える入力+出力トークンの上限。

    前提: トークン

  • 大規模言語モデル(LLM)

    膨大なテキストで学習し、次のトークンを確率的に予測して文章を生成するモデル(Transformer基盤)。

    前提: トークン

  • Function Calling(関数呼び出し)

    LLMに外部ツールやAPIを使わせる基本的な仕組み。呼び出し可能な関数のスキーマ(名前・引数・説明)をモデルに渡すと、モデルは実行はせず「この関数をこの引数で呼びたい」という構造化された提案(JSON等)だけを返し、実際の実行と結果の返送はアプリ側が担う。

    関連: Foundry Agent Service(基礎)

  • モデル評価指標(適合率/再現率/F1/AUC/RMSE)

    分類は混同行列(TP/FP/TN/FN)を基礎に適合率/再現率/F1/AUC・PR-AUC。不均衡では精度(accuracy)が誤解を招くためF1/PR-AUCを使う。見逃しを減らす=再現率、誤検知を減らす=適合率。回帰はRMSE(大誤差を強く罰)/MAE(外れ値に頑健)/決定係数R²。しきい値でprecision/recallを調整。

  • MLOps(SageMaker Pipelines / Model Registry)

    MLライフサイクルを再現可能・自動・統制された形で回す。Pipelinesは処理→学習→評価→登録/デプロイをDAGで自動化、評価ステップ+条件で品質ゲート。Model Registryはモデルをバージョン管理し承認ステータスで本番デプロイを統制。CodePipeline等のCI/CDやEventBridgeで再学習を自動化。

  • ACR(Azure Container Registry)

    コンテナイメージを保存・管理するプライベートレジストリ。ACR Tasks でクラウド側ビルドができ、認証はマネージド ID を使う。

    前提: マネージド ID

    関連: Azure Container Apps

  • エージェントループ(推論→行動→観察)

    エージェントが目標達成まで「推論(次に何をするか)→行動(ツール/関数呼び出し)→観察(結果を取り込む)」を反復する制御構造(ReAct 等)。無限ループや暴走を防ぐため最大反復回数・タイムアウト・停止条件・人手承認を設ける。

    前提: Function Calling(関数呼び出し)

  • コンテンツフィルターとブロックリスト

    Azure OpenAI / Content Safety のセーフティ機能。カテゴリ別の重大度しきい値でフィルターし、独自のブロックリストで禁止語を加える。

    前提: Azure AI Content SafetyAzure OpenAI Service

  • Custom Vision の学習(分類/検出・mAP)

    画像分類と物体検出から課題に合うモデルを選び、画像にラベル付け→転移学習で訓練→精度・再現率・mAP で評価→公開して利用する。

    前提: Custom Visionモデル評価指標(適合率/再現率/F1/AUC/RMSE)

  • Document Intelligence プレビルト/レイアウトモデル

    請求書・領収書・身分証など一般的な文書を学習なしで抽出するプレビルトモデルと、表・選択マーク・構造を抽出するレイアウトモデル。

    前提: Azure AI Document Intelligence

  • 感情分析とオピニオンマイニング

    テキストの肯定/否定/中立をスコア付けする感情分析と、対象(側面)ごとの意見を抽出するオピニオンマイニング。

  • AI 向けコンテナ/サーバーレスコンピュート

    推論や AI パイプラインの実行基盤。Azure Container Apps(スケール対応・KEDA)や Azure Functions(イベント駆動)でモデル呼び出しや前後処理をサーバーレスに動かす。

    前提: Azure FunctionsAzure Container Apps

  • 生成 AI の本番監視(ドリフト/品質/安全性)

    本番のモデル出力を継続監視し、品質低下・グラウンド性の劣化・有害出力・データ/プロンプトの変化を検知してアラートと再評価につなげる。

    前提: 生成 AIプロンプトと補完

  • Azure Functions

    サーバーレス(FaaS)の代表。イベント駆動で関数を実行し、実行分だけ課金。

  • Azure Cosmos DB

    グローバル分散・低遅延・自動スケールのマネージド NoSQL。複数 API(NoSQL/MongoDB/Cassandra/Gremlin/Table)対応。

    前提: ML データ準備(エンコード/スケーリング/不均衡)

  • バッチエンドポイント

    大量データをコンピューティングクラスター上で非同期にスコアリングするエンドポイント。呼び出すとバッチスコアリングジョブが起動する。

    前提: コンピューティングクラスター

  • 早期終了ポリシー(Bandit/中央値停止)

    見込みの薄い試行を打ち切ってコストを抑えるスイープの設定。Bandit(スラックファクター)・中央値停止・切り捨て選択などがある。

    前提: スイープジョブ(ハイパーパラメーター調整)

  • ファインチューニングジョブ

    基盤モデルを独自データで追加学習し特定タスクに適応させるジョブ。データ準備・適切なベースモデル選択・学習・評価の手順で進める。

    前提: ファインチューニング基盤モデル

  • MLflow トラッキング

    Azure ML にネイティブ統合された実験管理。log_metric/log_param/log_artifact や autolog で学習を記録し、実行を比較する。

    前提: Azure Machine Learning

  • パイプラインジョブ

    複数のコンポーネントを DAG として接続し、ステップ間でデータを受け渡して実行する一連の処理。スケジュール実行や監視ができる。

    前提: コンポーネント(再利用可能なステップ)

  • Responsible AI ダッシュボード

    モデルを責任ある AI の観点で評価する Azure ML のツール群。誤差分析・解釈可能性・公平性・反事実分析などを 1 つのダッシュボードで提供する。

    前提: Azure Machine Learning責任ある AI

  • サンプリング方法(グリッド/ランダム/ベイズ)

    スイープで探索空間から構成を選ぶ方式。グリッド(全数)・ランダム(無作為・広く速い)・ベイズ(過去結果から有望領域を学習)。

    前提: 探索空間(search space)スイープジョブ(ハイパーパラメーター調整)

  • Azure Event Grid

    離散イベント(「Blob 作成」等)をリアクティブに配信する pub/sub。イベントサブスクリプションで購読し、ほぼリアルタイムに反応する。

    前提: エージェントループ(推論→行動→観察)

  • 機械学習(ML)

    データから規則(パターン)を学び、新しいデータに対して予測を行う技術。AIの土台。

  • ワンホットエンコーディング

    カテゴリ変数を、各カテゴリに対応する 0/1 のフラグ列へ変換する手法。順序のないカテゴリ(色・地域)に使い、ラベルエンコーディング(整数化=誤った順序を与える)の代わりに用いる。次元が増えるため高カーディナリティでは別手法(埋め込み等)を検討。

    前提: 埋め込み(embeddings)ML データ準備(エンコード/スケーリング/不均衡)

  • 自然言語処理(NLP)

    言葉(テキスト/音声)を解析して意味・感情・意図を理解し、翻訳/要約する分野。

    前提: 要約(抽出/抽象)

  • AI Gateway(API Management)

    Azure API Management に配置し、Microsoft Foundry のモデルへのアクセスを集中的に認証・レート制限・監視・トークン課金管理する。バックエンドのモデルキーを隠蔽し利用を統制する。モデル/エージェント側の安全フィルタ(Foundry のガードレール)とは役割が異なる。

    前提: Azure API Management(APIM)トークン

  • 生成 AI の監視とトレース

    モデルの性能・リソース消費を診断設定で監視し、トレースで各実行を記録、フィードバックを収集して継続改善する。

    前提: 生成 AI

  • Microsoft Foundry のハブとプロジェクト

    生成 AI 開発の土台。ハブベース構成ではハブが共有リソース・接続・セキュリティ・コスト管理を束ね、その下のプロジェクトが個別の作業領域とモデル/フローを管理する。2025年以降はハブ不要の Foundry プロジェクト(軽量・単体)構成も選べる。

    前提: 生成 AI

  • モデルとフローの評価

    生成 AI の出力品質を、グラウンド性・関連性・流暢さ・類似度などの指標や手動評価で測り、フローやモデル選定を改善する。

    前提: 生成 AI

  • Spatial Analysis

    Azure AI Vision の機能で、動画内の人の存在や移動を検出し、人数カウントや距離・入退室などの空間的なイベントを把握する。

    前提: Azure AI Vision

  • AI の可観測性(トレース/トークン監視)

    Application Insights や Foundry のトレースで、各リクエストのレイテンシ・トークン消費・コスト・エラーを記録し、品質と性能を継続監視する。

    前提: トークン

  • 自動評価パイプライン

    テストデータに対してグラウンド性・関連性・流暢さ・安全性などの指標を自動算出し、回帰を検知してモデル/プロンプトの変更可否を判断する仕組み。

    前提: プロンプトと補完

  • Foundry の評価と安全性

    生成 AI の品質を、グラウンド性・関連性・流暢さなどの指標と手動評価で測り、コンテンツフィルターやリスク評価で安全性を担保してからデプロイする。

    前提: 生成 AI

  • モデルのデプロイオプション(Foundry)

    Foundry のモデルを使う方法。サーバーレス API(従量・即利用)と、マネージドコンピューティング(専用エンドポイントにデプロイ)を要件で選ぶ。モデルカタログから選択する。

    前提: モデルカタログ

  • Azure Kubernetes Service(AKS)

    マネージドな Kubernetes。多数のコンテナの本番オーケストレーション(自動配置・自己修復・スケール)。

    前提: ML データ準備(エンコード/スケーリング/不均衡)

  • 誤差逆伝播

    ニューラルネットワークの学習で、出力の誤差を出力層から入力層へ逆向きに伝えながら各重みの勾配を計算する手法。勾配降下法と組み合わせて重みを更新するために使われ、深層学習の学習アルゴリズムの中核をなす。

    前提: 勾配降下法

  • 決定木

    特徴量に対するしきい値で分岐を繰り返し、葉ノードで予測値を出す解釈しやすいモデル。単体では訓練データに過剰適合しやすく、深さの制限や剪定で抑える必要がある。回帰・分類の両方に使える。

  • コマンドジョブ

    単一のスクリプトを指定の環境・計算・入力で実行する基本のジョブ。パラメーターやデータ入力を渡し、ログで障害を診断する。

  • コンピューティングインスタンス

    個人の開発・ノートブック実行用のマネージド VM。停止してコストを節約でき、ターミナルや Jupyter を備える。

  • データアセット(uri_file/uri_folder/mltable)

    再利用可能でバージョン管理されたデータへの参照。種類は uri_file(単一ファイル)・uri_folder(フォルダー)・mltable(スキーマ付き表形式)。

  • トレースによるフロー評価

    フローの各ステップの入出力・遅延・トークン消費を記録(トレース)し、品質や性能のボトルネックを評価・改善する。

    前提: トークン

  • モデルレジストリ

    学習済みモデルをバージョン管理し、ステージや系統(リネージ)とともに登録・参照する場所。デプロイ対象の選択に使う。

  • マネージドオンラインエンドポイント

    リアルタイム低遅延の推論を提供し、Azure がインフラとオートスケールを管理するエンドポイント。Kubernetes オンラインは既存 AKS を使う。

  • プレイグラウンド

    デプロイした言語モデルをコードなしで対話的に試し、プロンプトやパラメーターの挙動を確認する場所。

    前提: プロンプトと補完

  • プライマリメトリック

    スイープや AutoML が最適化の良し悪しを判断する指標(例:accuracy・AUC)。最大化/最小化の方向も指定する。

    関連: スイープジョブ(ハイパーパラメーター調整)

  • プロンプトテンプレート

    変数を差し込める雛形としてプロンプトを定義し、入力に応じて動的に組み立てる仕組み。再利用と一貫性を高める。

    前提: プロンプトと補完

  • プロンプトバリアント

    同じ目的に対する複数のプロンプト版を定義・追跡し、手動評価や指標で比較して最良の表現を選ぶ手法。

    前提: プロンプトと補完

  • レジストリ(ワークスペース横断共有)

    モデル・コンポーネント・環境・データを複数のワークスペース間で共有する組織レベルのカタログ。開発から本番へ昇格させる際に使う。

    前提: コンポーネント(再利用可能なステップ)

  • スコアリングスクリプト(init/run)

    デプロイで推論を実装するスクリプト。init() でモデルを読み込み、run() で各リクエストを処理する。MLflow モデルでは不要なことがある。

  • Synapse Spark / サーバーレス Spark

    ノートブックから大規模データを対話的に加工するための Spark コンピューティング。アタッチした Synapse Spark プールや AML のサーバーレス Spark を使う。

    前提: Azure Machine Learning

  • トラフィック分割とブルー/グリーン

    1 つのエンドポイントに複数デプロイを置き、トラフィックを割合配分する。新版へ段階的にロールアウトし、問題時に即ロールバックできる。

  • Azure Event Hubs

    大量のストリーミング/テレメトリを取り込む高スループットのイベント取り込み。パーティションとコンシューマーグループで並列に処理する。

  • 勾配ブースティング

    弱い決定木を1本ずつ逐次的に追加し、直前までの予測誤差を縮めるように学習していくアンサンブル手法(代表実装は XGBoost・LightGBM)。表形式データに対する強力な既定手法として、多くのマネージド ML サービスに組み込みアルゴリズムとして用意されている。

    前提: 決定木

  • 勾配降下法

    損失関数の勾配(傾き)の反対方向へ、学習率で決まる歩幅ずつパラメータを更新して損失を最小化する最適化アルゴリズム。全データを使うバッチ型のほか、1件ずつ更新する確率的勾配降下法(SGD)や少量ずつ処理するミニバッチ型などの変種がある。

  • 線形回帰

    連続値のターゲットを、特徴量の重み付き線形結合として予測する基本的な教師あり学習モデル。解釈しやすく、回帰問題のベースラインとしてまず試されることが多い。

  • ロジスティック回帰

    線形結合の出力をシグモイド関数に通して 0〜1 の確率を得ることで、二値分類を行うモデル。名前に「回帰」とあるが実際には分類器であり、線形回帰同様に解釈しやすく分類問題のベースラインとしてよく使われる。

    前提: 線形回帰

  • Microsoft Agent Framework

    単一エージェントの応答だけでは対応しきれない複雑なワークフローを実装するためのオープンソースのオーケストレーションフレームワークで、Semantic Kernel と AutoGen を統合した後継にあたる。マルチエージェント連携(役割分担・引き継ぎ)、複数ユーザーとの並行セッション、human-in-the-loop(人の承認)を挟むワークフローと自律実行の両方を含む柔軟なタスク制御をコードで組み立てる。Foundry Agent Service で個々のエージェントを作り、本フレームワークでそれらを束ねて動かす関係。

    前提: Foundry Agent Service(基礎)

  • k-means クラスタリング

    教師なしで、データを k 個のクラスタに分ける代表的手法。各点を最寄りの重心へ割り当て→重心更新を反復する。k はエルボー法/シルエットで選ぶ。スケールに敏感なので標準化が前提。顧客セグメンテーション等に使う。

    前提: ML データ準備(エンコード/スケーリング/不均衡)

  • 主成分分析(PCA・次元削減)

    相関する多数の特徴量を、分散を最大化する少数の合成軸(主成分)へ圧縮する次元削減法。可視化・ノイズ低減・計算コスト削減に使う。教師なしで、解釈性は下がる。t-SNE/UMAP は可視化向けの非線形代替。

    前提: コンポーネント(再利用可能なステップ)

  • Microsoft Copilot

    Microsoft 365・Windows・GitHub などに組み込まれた、すぐ使える生成AIアシスタント。

    前提: 生成 AI

  • プロンプトエンジニアリング

    指示・例・役割(システムプロンプト)の与え方を工夫して出力を改善する最も手軽な方法。ゼロショット/少数ショット/思考の連鎖がある。

    前提: プロンプトと補完

  • Azure Service Bus

    エンタープライズ向けのメッセージブローカー。順序・トランザクション・重複排除・デッドレターに対応し、確実な指示(コマンド)の配送に使う。