在 Serverless 和 Standard 3 High Density (S3 HD) 上執行索引子(預覽)

Note

Azure AI 搜尋服務 可透過 Azure 入口網站、REST API 及 Azure SDK 取得。 它同時也是 Foundry IQ 的基礎,這是一個管理式知識層,能將企業內容轉化為可重複使用、權限感知的知識庫,供 Microsoft Foundry 入口網站中的代理使用。

Important

標記(預覽)的功能、能力或屬性不受服務等級協議涵蓋,也不建議用於生產工作負載,且在正式上架前可能會有所變動或受限。 Azure AI 搜尋服務 預覽條款適用於所有預覽功能,無論是獨立功能還是正式推出功能的一部分。

本文介紹 Azure AI 搜尋服務 用於無伺服器及標準 3 高密度(S3 HD)搜尋服務的索引器執行模型。 這兩種方案都有服務層級的每日執行時間配額,決定每個 24 小時 UTC 時段可使用的索引器總時間。

本文所述的功能為預覽:

適用處

本文中的執行模型適用於:

  • 無伺服器搜尋服務,其使用 2026-05-01-preview REST API 或更新版本來執行索引器。
  • S3 HD 搜尋服務,透過使用 2025-11-01-preview REST API 或更新版本執行索引子。

支援的索引器定義、資料來源、技能集及索引器支持的知識來源,兩種選項皆無需修改即可運作。

執行模型

Serverless 與 S3 HD 上的索引器具有以下執行特性:

  • 你不需要配置或管理索引器基礎設施。 此服務會為你管理容量。

  • 索引器僅在 多租戶執行環境中運行。 透過 共享私有連結資源提供的私有執行環境,這些 SKU 上的索引器無法使用。

  • 對於 S3 HD,如果你需要索引器連線來避免進入公共網路,可以在搜尋服務上設定網路 安全邊界 (NSP),透過明確的存取規則控制進出流量。

  • 對於無伺服器,則不支援私有連線。

每日累計執行時間配額

索引器的執行受每日執行時間配額控制,該配額於 00:00 UTC 重置。 配額為:

  • 服務水準: 這套規則適用於整個搜尋服務。
  • 累積: 服務中每個索引器的執行時間會計入相同的預算。 配額不是按索引者計算的。

所有執行中的索引器都會根據一個共享服務預算累積時間。 該服務不會為個別索引器保留執行時間,也不會自動將配額平均分配給他們。 例如,12 個索引器若各自執行 2 小時,其累計執行時間就可能用盡全部 24 小時的總計執行時間,無論這些執行作業是否重疊,或是在不同時間進行。

下表列出每日 SKU 配額及支援的最低 API 版本:

SKU 每個 UTC 24 小時時段的每日配額 最低 API 版本
S3 高清 24 小時 2025-11-01-preview
無伺服器 24 小時 2026-05-01-preview

當每日配額用盡:

  • 目前運行的索引器大約五分鐘內就會停止。

  • 新的索引子執行不會處理文件,並會立即傳回暫時性失敗,指出已超過每日配額。

  • 計數器重置後,正常的索引器執行於 00:00 UTC 恢復。

從配額耗盡中恢復

若要從配額耗盡中復原並降低再次達到配額的可能性:

監控累積運行時間

本節說明如何利用搜尋服務 REST API 追蹤執行時使用率及剩餘預算。 在預覽期間,入口網站中沒有提供累積執行時間的相關介面。

服務層級執行時

使用 Get Service Statistics (REST API)取得目前 24 小時期間服務中所有索引器的累積執行時間:

GET {endpoint}/servicestats?api-version=2026-08-01-preview

回應中包含一個 indexersRuntime 章節。 以下 JSON 顯示一個 24 小時每日配額未被使用的服務:

"indexersRuntime": {
    "usedSeconds": 0,
    "remainingSeconds": 86400,
    "beginningTime": "2026-05-16T00:00:00.000Z",
    "endingTime": "2026-05-17T00:00:00.000Z"
}

關鍵點:

  • usedSeconds:服務中所有索引器在當前視窗內執行的總秒數。
  • remainingSeconds:在達到每日配額前還有幾秒可用。 當套用特定層級限制時顯示。
  • beginningTime 以及 endingTime:當前24小時UTC計時窗口的開始與結束。

索引器層級執行時間

使用 Get Indexer Status (REST API)來取得單一索引器的累積執行時間:

GET {endpoint}/indexers('{indexerName}')/search.status?api-version=2026-08-01-preview

回應中包含一 runtime 節。 下列 JSON 顯示一個服務索引子,其 24 小時每日配額未被使用:

"runtime": {
    "usedSeconds": 0,
    "remainingSeconds": 86400,
    "beginningTime": "2026-05-16T00:00:00.000Z",
    "endingTime": "2026-05-17T00:00:00.000Z"
}

關鍵點:

  • usedSeconds:索引器在當前視窗內執行的總秒數。
  • remainingSeconds: 這些秒數仍對 服務中所有索引器開放,不僅限於這個索引器。 當套用特定層級限制時顯示。
  • beginningTime 以及 endingTime:當前24小時UTC計時窗口的開始與結束。

最佳做法

S3 HD 和 Serverless 的索引器支援目前還在預覽階段。 請依照此指引,妥善評估工作負載規模,並為日後導入的 Serverless 計費做好規劃。

S3 高清

在預覽期間,S3 HD 索引子支援是針對沒有技能集或小型技能集的工作負載所設計。 為了維持每日配額:

  • 建議規劃約 1 GB 的小型索引。

  • 謹慎調整技能組的使用規模。 呼叫外部服務的技能,如 Azure OpenAI 嵌入技能、GenAI 提示技能,以及 Azure 內容理解技能,顯著延長執行時間,並能迅速消耗每日配額,尤其是在多租戶情境下。

  • 預覽期間可預期平行性有限。 針對大型索引子機群,請使用排程且錯開的執行,讓工作分散在 24 小時時間範圍內,而不是競爭相同預算。

示意用的拆分與內嵌工作負載

在一項受控制的 S3 HD 測試中,一項 Split 技能與一項 Azure OpenAI Embedding 技能產生了區塊與內嵌。 該工作負載平均每份來源文件約產生 2.5 個資料區塊,而在這項測試的一個 24 小時 S3 HD 測試時段內,觀察到的來源文件約有 22,000 份。

以下數值為四捨五入後、僅供說明之用的公平分攤計算結果,係根據整體觀察結果而得出。 它們不是以每個索引器的結果為單位來衡量的。

索引器數量 每個索引子每天的示意來源文件
100 大約200人
500 大約40
1,000 大約20

該服務不會為這些索引器數量預留容量,也不保證分配、執行順序或吞吐量均等。

Note

此結果在一項受控測試中觀察到。 它不是效能目標、服務保證、容量承諾、規模計算公式,也不是用來替代工作負載測試的工具。

吞吐量會因文件複雜度與配置檔、分塊、技能數量與類型及向量輸出、模型延遲、容量與配額、來源與目標效能、並行性、排程順序、限速、區域、失敗與重試、文件破解或光學字元辨識(OCR)以及租戶容量不均而有重大差異。 在規劃產能前,先用具代表性的生產投入測試。

無伺服器

在預覽期間,無伺服器索引器旨在簡化檢索增強生成(RAG)和知識庫場景的資料擷取流程:

  • 索引執行(不包括技能)目前是免費的。 將文件寫入索引會產生費用。

  • 技能集執行的計費方式與專用索引子相同。 呼叫外部服務(例如 Azure OpenAI 嵌入技能、GenAI 提示技能和 Azure 內容理解技能)時,其費用會透過所連結的 Foundry 或 Azure AI 服務資源計費。

限制和配額

關於無伺服器與 S3 HD 的索引器限制,請參見索引器限制。

服務層級的執行時配額與索引器限制並不會取代技能組中技能與外部服務的輸入、請求或處理限制。 在估算豐富化管線的規模時,請分別檢查每個技能參考。