注
Azure AI 検索は、Azure ポータル、REST API、およびAzure SDKから使用できます。 また、Foundry IQ は、エンタープライズ コンテンツを、Microsoft Foundry ポータルのエージェントの再利用可能なアクセス許可に対応したナレッジ ベースに変換するマネージド ナレッジ レイヤーです。
検索サービスを作成するときは、価格モデルとサービス レベルを選択する必要があります。 Azure AI 検索には、それぞれ異なるワークロード パターンに適した 2 つの価格モデルと、容量と機能を決定する関連するサービス レベルが用意されています。
| 価格モデル | 最適な用途 | 課金方法 |
|---|---|---|
| Dedicated | 安定した予測可能で高使用率のワークロード | 検索ユニット (SU) を使用した固定容量。サービス レベルの選択に基づく時間単位のレート |
| サーバーレス (プレビュー) | 頻度の低い、バースト性の高い、または高度に変動するワークロード | 使用量ベース: コンピューティング ユニット (CU) とインデックス付きストレージ (GB/月) で測定 |
注
専用モデルの検索ユニット (SU) とサーバーレス モデルコンピューティング ユニット (CU) は同じではなく、同じように使用することはできません。 SU ベースの料金計算ツールや、サーバーレス ワークロードの見積もりは使用しないでください。
どちらのモデルも同じコア検索機能を提供します (以下に示すサーバーレス プレビューの軽微な例外がいくつかあります)。 主な違いは、機能面ではなく、価格設定とスケーリングの挙動です。
専用価格モデルを選択するには、ワークロードのニーズを見積もり、適切な事前プロビジョニング容量を持つ サービス レベルを選択 する必要があります。
サーバーレス価格モデルを選択する場合、事前プロビジョニングされたサービス レベルを選択する必要はありませんが、従量課金ベースの価格が使用されるため、 パフォーマンスの最適化 はコストに直接影響します。
サーバーレス価格モデル (プレビュー)
Important
サーバーレス開発者レベルは現在プレビュー段階です。 このプレビュー版はサービス レベル アグリーメントなしで提供されています。運用環境のワークロードに使用することはお勧めできません。 特定の機能がサポートされていないか、機能が制限されている可能性があります。 詳細については、「 Microsoft Azure プレビューの追加使用条件」を参照してください。
サーバーレス開発者レベルの課金は、2026 年 9 月 13 日に開始されました。 その日以降の使用量の料金は、Azure請求書に表示されます。 2026 年 9 月 13 日より前の使用には課金されません。
サーバーレス開発者レベルでは、他の価格レベルとの間の移行はサポートされていません。また、他のレベルで使用できる一部の機能は、パブリック プレビュー中はサポートされていません。 サービスの制限、サポートされている機能、および価格の詳細は、一般公開前に変更される可能性があります。
プレビュー期間中、サーバーレス価格モデルは 特定のリージョンでのみサポートされます。
サーバーレス価格モデルは、ワークロードに基づいてコンピューティングとストレージを自動的にスケーリングする使用量ベースのオファリングです。 これにより、容量を事前にプロビジョニングする必要がなくなり、使用するリソースに対してのみ支払うことができます。
サーバーレス モデルを使用する場合、レプリカ、パーティション、検索単位は構成しません。 代わりに、サービスは、クエリボリューム、インデックス作成アクティビティ、およびワークロードの複雑さに応じて容量を動的に管理します。
課金は、次の 2 つの主要ディメンションに基づいています。
- コンピューティング使用量: 1 時間あたりのコンピューティング ユニット数 (CU/h) で測定され、実行された作業 (クエリ、インデックス作成、その他の操作) に基づいて課金されます。
- インデックス付きストレージ: インデックスのサイズに基づいて、1 か月あたり GB ごとに課金されます。
このモデルは、バースト トラフィックやマルチテナント アプリケーションなど、需要が変動するワークロード向けに設計されています。 専用サービスと同じコア検索機能と API がサポートされているため、コードを書き直さずに検索アプリケーションをビルドして実行できます。
サーバーレス開発者レベルはパブリック プレビュー段階であり、現在、次の機能はサポートされていません。
- インデックスエイリアス: サポートされていません
- デバッグ セッション: サポートされていません
- インデクサーのプライベート ネットワーク: サポートされていません
- 共有Private Link リソース: サーバーレス モデルの計画されたサポートなし
- サービス レベル アグリーメント (SLA): パブリック プレビュー中は使用できません
詳細については、
その他の大規模なサーバーレス展開オプションについては、Azure AI 検索 サーバーレス プライベート プレビューサインアップ フォームを使用してMicrosoftにお問い合わせください。
専用の価格モデル
専用価格モデルは、固定インフラストラクチャをワークロードに割り当てることで、予測可能なパフォーマンスとコストを提供するプロビジョニング容量オファリングです。 容量を事前に構成して、保証されたリソースで一貫したインデックス作成とクエリの要求をサービスが処理できるようにします。
専用レベルでは、レプリカ、パーティション、検索ユニット (SU) を明示的に構成します。 レプリカはクエリスループットと高可用性を提供し、パーティションではストレージとインデックス作成の容量を定義します。 これらによって、検索サービスの合計容量とパフォーマンス特性が決まります。
課金は次の内容に基づいています。
- サービス レベル: 事前に選択されたプロビジョニング済み容量。
- 検索ユニット (SU): レプリカ×パーティションとして計算される専用サービスの課金単位。 検索ユニットの数と選択したサービス レベルに基づいて、固定の時間単位料金を支払います。
このモデルは、安定した予測可能な需要を持つワークロード向けに設計されており、一貫したパフォーマンス、低待機時間、制御されたスケーリングが重要です。
専用価格モデルでは、選択したサービス レベルによって以下が決定されます。
- サービスで許可されるインデックスとその他のオブジェクトの最大数。
- パーティションのサイズと速度 (物理ストレージ)。
- 固定月次コストとしての課金対象料金、容量を追加した場合の増分コスト。
- ワークロードの特性。 一部のレベルは、特定のワークロード用に最適化されています。
場合によっては、レベルによって Premium 機能の可用性も決定されます。
階層の説明
最も一般的に使用される課金対象レベルは次のとおりです。
Basic は運用環境のワークロードをサポートし、最大 3 つのレプリカで SLA 要件を満たすことができます。
Standard (S1、S2、S3) は既定のレベルです。 パーティションとレプリカのスケーリングをサポートし、より大きなワークロードとパフォーマンスの向上を実現します。
一部のレベルは、特定の種類の作業向けに設計されています。
Standard 3 High Density (S3 HD) は、マルチテナント向けに最適化された S3 の ホスティング モード です。 S3 HD は S3 と同じユニットごとの料金ですが、多数の小さなインデックスをサポートし、高速なファイル読み取りと高密度ストレージシナリオに最適化されたハードウェアを使用します。
ストレージ最適化 (L1、L2) レベルは、TB あたりの低コストのストレージを提供し、更新頻度の低い大規模なインデックス用に設計されています。 通常、これらのレベルではクエリの待機時間が長くなります。
無料の制限付き検索サービス レベルもあります。
- Free では、チュートリアルや開発など、小規模なプロジェクトに限定 された検索サービス が作成されます。 リソースはテナント間で共有され、スケーリングはサポートされていません。 一部の Premium 機能は使用できず、サービスが非アクティブな期間が経過すると削除される場合があります。 Azure サブスクリプションごとに 1 つの無料検索サービスのみを使用できます。
[価格レベルの選択] ページで新しいAzure AI 検索 サービスを作成すると、Azure ポータルに課金料金が表示されます。
地域料金の 価格ページ を確認できます。
コストの計画と管理 を参照して、Dedicated 料金モデルと、それが Serverless モデルとどう比較されるかの詳細を確認してください。
レベルを選択する方法
Azure ポータルでは、サービスの作成時に Select Pricing Tier ページでサービス レベルが指定されます。
PowerShell または Azure CLI では、レベルは -Sku パラメーターを使用して指定されます。
レベル別の利用可能なリージョン
リージョンの一覧には、Azure AI 検索 が提供される場所が表示されます。 一部のリージョンでは、特定のレベルの容量の制約があるため、これらのレベルで新しい検索サービスが作成できなくなる場合があります。 この一覧では、脚注を使用して、制約付きリージョンと階層を示します。
Azure portal で検索サービスを作成すると、利用できないリージョンと層の組み合わせが自動的に除外されます。
階層による機能の使用の可否
ほとんどの機能は、すべてのレベルで利用できます。 場合によっては、選択したレベルによって機能の可用性が異なります。
| 機能 | レベルに関する考慮事項 |
|---|---|
| インデクサー | インデクサーは S3 HD で使用でき、 インデクサー全体の毎日の実行クォータと、その他の考慮事項 (プレビュー) があります。 インデクサーには、Free レベルに対するより多くの制限があります。 |
インデクサー executionEnvironment 構成パラメーター |
すべてのインデクサー処理を検索サービスに割り当てられている検索クラスターのみにピン留めするには、S2 以上が必要となります。 |
| AI エンリッチメント | Free レベルで実行されますが、大規模なワークロードでは推奨されません。 |
| 送信アクセス (インデクサー) 用のマネージド ID または信頼できる ID | Free レベルでは使用できません。 |
| カスタマー マネージド暗号化キー | Free レベルでは使用できません。 |
| IP ファイアウォール アクセス | Free レベルでは使用できません。 |
| プライベート エンドポイント (Azure Private Link との統合) | 検索サービスへの受信接続の場合、Free レベルでは利用できません。 インデクサーによる他の Azure リソースへの送信接続の場合は、Free または S3 HD では使用できません。 スキルセットを使用するインデクサーの場合、Free、Basic、S1、S3 HD では使用できません。 |
| 可用性ゾーン | Free レベルでは使用できません。 |
| セマンティック ランカー | Free レベルで実行されますが、大規模なワークロードでは推奨されません。 |
リソース集中型の機能は、十分な容量を与えない限り、うまくいかない場合があります。 たとえば、AI エンリッチメントには、データセットのサイズが小さい場合を除いて Free サービスではタイムアウトになってしまう、実行時間の長いスキルがあります。
上限
レベルによって、サービス自体の最大ストレージとともに、作成できるインデックス、インデクサー、データ ソース、スキルセット、シノニム マップの最大数が決まります。 すべての制限を完全に解除する方法については、Azure AI 検索のサービス の制限に関するページを参照してください。
パーティションのサイズと速度
各レベルの価格には、パーティションごとのストレージの詳細 (Basic レベルの 15 GB からストレージ最適化 (L2) レベルの 2 TB まで) が含まれます。 その他のハードウェア特性 (動作速度、待機時間、転送速度など) は公開されませんが、特定のソリューション アーキテクチャ向けに設計されたレベルは、そのシナリオをサポートする機能を備えたハードウェア上に構築されます。 パーティションの詳細については、「見積もりと管理容量とAzure AI 検索 での信頼性 」を参照してください。
注
2024 年 4 月に、一部のリージョンで容量の大きいパーティションを使用できるようになりました。 2024 年 5 月に、高容量パーティションの第 2 のウェーブがリリースされました。 古い検索サービスがある場合は、サービス をアップグレード して、同じ課金レートでより多くの容量を利用できる場合があります。
課金レート
課金レートはレベルによって異なり、高価なハードウェア上で実行されるレベルや、より高価な機能を提供するレベルの料金は高くなります。 レベルの課金レートは、Azure AI 検索 の Azure の価格ページで確認できます。
サービスを作成すると、課金レートは、サービスを 24 時間実行するための 固定コスト と、容量を追加することを選択した場合の 増分コスト の両方になります。
専用モデルでは、課金は、パーティション (ストレージ) とレプリカ (クエリ容量) を組み合わせた検索ユニット (SU) に基づいています。
- サービスは、1 つのパーティションと 1 つのレプリカ (1 つの SU) で始まります
- パーティションまたはレプリカを追加すると、SU の数に比例してコストが増加します
たとえば、可用性やスループットを向上させるためにレプリカを追加すると、毎月のコストが比例して増加します。
詳細については、「コストの 計画と管理」を参照してください。
請求率の例
具体的な例を次に示します。 請求レートが月あたり 100 ドルだとします。 検索サービスを初期容量である 1 つのパーティションと 1 つのレプリカで保持している場合、月末に支払うことが想定される金額は 100 ドルです。 しかし、高可用性を実現するために 2 つのレプリカを追加した場合、毎月の請求額は 300 ドル (最初のレプリカとパーティションのペアに対する 100 ドルに加えて、2 つのレプリカに対する 200 ドル) に増えます。
階層の変更
注
既存の検索サービスでは、Basic レベルと Standard レベル (S1、S2、S3) レベルを切り替えることができます。 現在のサービス構成がターゲット 層の制限を超えることはできません。また、リージョンにターゲット 層の容量制約を設定することはできません。 詳細については、「 価格レベルを変更する」を参照してください。
前述のレベルとは異なるレベルに切り替えるには:
- 新しいレベルで検索サービスを作成します。
- 新しいサービスに検索コンテンツをデプロイします。 このチェックリストに従って 、すべてのコンテンツがあることを確認します。
- 不要になった古いサービスを削除します。
最初から再構築しない大規模なインデックスの場合は、次のいずれかのバックアップと復元のサンプルを使用します。
次のステップ
価格レベルを選択する最善の方法は、最小コスト レベルから始めて、エクスペリエンスとテストを許可して、サービスを維持するか、上位レベルに切り替えるかを決定に通知することです。
次の手順では、提案するテストのレベルに対応できるレベルで検索サービスを作成し、コストと容量の見積もりについて次のガイダンスを確認することをお勧めします。