ナレッジ ソースとは

メモ

Azure AI 検索は、Azure ポータル、REST API、およびAzure SDKから使用できます。 また、Foundry IQ は、エンタープライズ コンテンツを、Microsoft Foundry ポータルのエージェントの再利用可能なアクセス許可に対応したナレッジ ベースに変換するマネージド ナレッジ レイヤーです。

Important

機能、またはマークされたプロパティ (プレビュー) は、サービス レベル アグリーメントの対象ではなく、運用環境のワークロードには推奨されず、一般公開される前に変更または制約される可能性があります。 Azure AI 検索 プレビューの用語は、スタンドアロンでも一般公開されている機能の一部でも、すべてのプレビュー機能に適用されます。

ナレッジ ソースは、エージェント検索パイプラインで使用されるコンテンツを定義する、Azure AI 検索 サービスの最上位リソースです。 各ナレッジ ソースはインデックス型またはリモート型のいずれかであり、それによってコンテンツの取り込み、処理、検索の方法が決まります。 ナレッジ ソースは、ナレッジ ベースの必須コンポーネントです。

1 つのナレッジ ベースで複数のナレッジ ソースを参照できます。 エージェント検索エンジンは、すべてのクエリを 1 つの要求で実行します。 各ナレッジ ソースに対してサブクエリが生成され、上位の結果が取得応答で返されます。

サポートされているナレッジ ソース

Azure AI 検索では、エージェント取得ワークロードに関する次のナレッジ ソースがサポートされています。

サブタイプ Description インデックス付きまたはリモート
検索インデックス 既存のインデックスを内包します。 インデックス 付き
Azure BLOB BLOB コンテナーからインデクサー パイプラインを生成します。 インデックス 付き
Azure SQL (プレビュー) Azure SQLテーブルまたはビューからインデクサー パイプラインを生成します。 インデックス 付き
ファイル (プレビュー) ファイルをAzure AI 検索に直接アップロードします。 インデックス 付き
OneLake レイクハウスからインデクサー パイプラインを生成します。 インデックス 付き
インデックス付きSharePoint (プレビュー) SharePoint サイトからインデクサー パイプラインを生成します。 インデックス 付き
リモート SharePoint (プレビュー) SharePointからコンテンツを取得します。 リモート
Fabric データ エージェント (プレビュー) Microsoft Fabric データ エージェントから回答と埋め込みリソースを取得します。 リモート
Fabric オントロジー (プレビュー) Microsoft Fabricオントロジからエンティティベースとリレーションシップベースの回答を取得します。 リモート
MCP サーバー (プレビュー) 外部 MCP サーバーから、ツールを使用したライブの結果を取得します。 リモート
Work IQ (プレビュー) Work IQ から組織インテリジェンスを取得します。 リモート
ウェブ Microsoft Bingからリアルタイムの接地データを取得します。 リモート

インデックス付きナレッジ ソース

インデックス付きナレッジ ソースは、エージェント検索の 条件を満たす検索インデックスを指します。 コンテンツは、次の 3 つのパスのいずれかを使用してクエリ時間の前にインデックスに取り込まれます。

  • 独自のインデックスを持ち込む: 検索インデックスナレッジ ソースを使用して、検索サービスの既存のインデックスをラップします。

  • ファイルの直接アップロード:ファイルナレッジソースを使用して、ファイルをAzure AI 検索に直接アップロードします。 このサービスはファイルを処理し、抽出されたコンテンツを生成された検索インデックスに格納します。外部ストレージやインデクサー パイプラインは必要ありません。

  • 自動生成されたインデクサー パイプライン:他のすべてのインデックス付きナレッジ ソースに対して、Azure AI 検索は外部データ ソースから完全なインデクサー パイプラインを自動的に作成します。 これには、 データ ソース、 スキルセット、 インデクサー、および チャンクされたインデックス が含まれます。

クエリは、フルテキスト (キーワード)、ベクター、またはハイブリッド クエリを使用して、検索サービスでローカルに実行されます。

インデックス付きナレッジ ソースには基になる検索インデックスがあるため、応答内の参照には、インデックス内のドキュメントにリンクされる、サービスによって生成された引用 URL (プレビュー)を含めることができます。 リモート ナレッジ ソースにはバッキング インデックスがないため、引用 URL は返されません。

リモート知識ソース

リモート ナレッジ ソースは、外部プラットフォームに直接接続します。 コンテンツがAzure AI 検索に取り込まれることはありません。 代わりに、各プラットフォームのネイティブ API を介してクエリ時に取得されます。 エージェント検索エンジンは API 呼び出しを行い、同じ応答内のインデックス付きナレッジ ソースと共に結果を表示します。

プラットフォームに応じて、リモート接続はパブリック インターネット (Bing など) またはMicrosoft テナント内 (SharePointやFabricなど) を介してコンテンツに到達します。

統合ランク付け

インデックス付きナレッジ ソースとリモート ナレッジ ソースの両方について、取得されたすべてのコンテンツが同じランク付けパイプラインを通過します。 結果は関連性についてスコア付けされ、クエリ間でマージされ、取得応答で返される前に再ランク付けされます。

サポート情報ソースの使用

ナレッジ ソースは、ナレッジ ベースとは別に作成および管理する独立したオブジェクトです。 次の点に注意してください。

  • ナレッジ ベースを作成する前にナレッジ ソースを作成します。 ナレッジ ベースは ID によってナレッジ ソースを参照するため、ナレッジ ソースが最初に存在する必要があります。

  • ナレッジ ソースを削除するには、最初にナレッジ ソースを参照するすべてのナレッジ ベースを更新または削除します。 その後、ナレッジ ソースを削除できます。

  • ナレッジ ソースとそのナレッジ ベースは、同じ検索サービス上に存在する必要があります。

ナレッジ ソースの作成

Azure ポータル、Microsoft Foundry ポータル、REST API、およびAzure SDKでの作成のサポートは、ナレッジ ソースの種類によって異なります。 種類ごとの手順については、 サポートされているナレッジ ソースのリンクを参照してください。

秘密度ラベルの取り込み (プレビュー)

blob、インデックス付き OneLake、およびインデックス付き SharePoint の知識ソースでは、 を ingestionPermissionOptions を含むように設定することで、sensitivityLabelを取り込むことができます。 この値を設定する前に、すべての前提条件に従ってください。 インデックスに同期されると、ラベルは取得応答で表示され、クエリ時にドキュメント レベルのアクセスを適用するために使用されます。 詳細については、「 クエリ時にアクセス許可を適用する (プレビュー)」を参照してください。

インデックス付きナレッジ ソースで、統合ベクター化やカスタムテキスト分割スキルなど、チャンクインデックスを使用する場合は、 スキルセット内のインデックス プロジェクションを使用して各チャンク行に秘密度ラベルをマップする必要もあります。 それ以外の場合、ソース ドキュメントにラベルがある場合、取得応答のチャンク レベルの参照は返されません。

ドキュメントに埋め込まれた画像を表示する (プレビュー)

BLOB、インデックス付き OneLake、インデックス付きSharePointナレッジ ソースの場合は、ナレッジ ソースのassetStoreでingestionParametersを構成して、ソース ドキュメントに埋め込まれたイメージを保持できます。 ナレッジ ベースで画像の提供も有効にすると、 取得アクション によってそれらの画像が応答合成プロンプトに挿入されるため、LLM は図、グラフ、抽出された画像コンテンツを推論できます。 詳細については、「エージェント型検索でドキュメントに埋め込まれた画像を表示する (プレビュー)」を参照してください。

同じナレッジ ソースで assetStore と ingestionPermissionOptions を構成しないでください。 ingestionPermissionOptionsが構成されている場合、イメージ サービスはサポートされません。

インジェストをプライベート ネットワークに制限する (プレビュー)

BLOB、インデックス付きSharePoint、インデックス付きAzure SQLナレッジ ソースでは、プライベート インデクサーの実行がサポートされます。 BLOB とAzure SQLの場合、承認済みの共有プライベート リンクは、ソース接続とAzureの依存関係を保護できます。 SharePoint Online は共有プライベート リンク ターゲットではないので、プライベート モードは保護されたAzure依存関係にのみ適用されます。

現在、 インデックス付きの OneLake ナレッジ ソースでは、プライベート同期はサポートされていません。

言語ごとの自動アナライザーを使用する (プレビュー)

BLOB、インデックス付き OneLake、およびインデックス付きSharePointナレッジ ソースでは、多言語コンテンツの言語ごとの自動アナライザーがサポートされます。 有効にすると、Azure AI 検索は各ソース ドキュメントの言語を検出し、一致するMicrosoft言語アナライザーを自動的に適用します。 ナレッジ ソース定義またはクエリではアナライザーを指定しません。

知識ソースの使用

ナレッジ ソースを作成したら、 ナレッジ ベースで参照します。 ナレッジ ベースによって、クエリを実行するナレッジ ソースが決まります。 次のセクションでは、どのソースを含めるかを制御するためのオプションと、エンジンがそれらの中でどのように選択するかを制御する方法について説明します。

ナレッジ ソースに対して常にクエリを実行する

alwaysQueryをナレッジ ソース定義にtrueに設定して、取得の理由に関係なく、すべてのクエリに含めます。

検索時の推論負荷を使って LLM の使用量を制御する (プレビュー)

取得推論作業は、各クエリに適用される LLM 処理の量を制御します。 すべてのソリューションが LLM クエリ計画の恩恵を受けるわけではありません。 シンプルさと速度が優先される場合は、minimal effort を使用して LLM 処理をバイパスします。 low および medium のレベルでは、LLM はどのナレッジ ソースにクエリを実行するかを計画して選択し、medium では、より深い結果を得るための反復パスが追加されます。 各レベルの詳細については、「 取得理由の設定 (プレビュー)」を参照してください。

low と medium の取り組みにおける選定は、以下の要因に基づいて行われます:

  • ナレッジ ソースの name。

  • インデックスの description (インデックス付きナレッジ ソースの場合)。

  • ナレッジベース定義またはretrievalInstructionsで指定された。 取得手順は、LLM が選択またはスキップするナレッジ ソースをガイドします。 プロンプトのように機能します。簡潔さ、トーン、書式設定を指定できます。