Uruchamianie indeksatora w warstwach Serverless i Standard 3 High Density (S3 HD) (wersja zapoznawcza)

Note

Wyszukiwanie AI platformy Azure jest dostępna za pośrednictwem portalu Azure, interfejsów API REST i Azure SDKs. Jest także podstawą Foundry IQ — zarządzanej warstwy wiedzy, która przekształca treści przedsiębiorstwa w bazy wiedzy wielokrotnego użytku z uwzględnieniem uprawnień dla agentów w portalu Microsoft Foundry.

Important

Funkcje, możliwości lub właściwości oznaczone (wersja zapoznawcza) nie są objęte umową dotyczącą poziomu usług, nie są zalecane w przypadku obciążeń produkcyjnych i mogą ulec zmianie lub ograniczeniu, zanim staną się one ogólnie dostępne. Warunki Wyszukiwanie AI platformy Azure wersji zapoznawczej mają zastosowanie do wszystkich funkcji w wersji zapoznawczej, niezależnie od tego, czy jest ona autonomiczna, czy częścią ogólnie dostępnej funkcji.

W tym artykule opisano model wykonywania indeksatora używany przez usługę Wyszukiwanie AI platformy Azure dla usług wyszukiwania bezserwerowych i Standard 3 High Density (S3 HD). Obie opcje mają dzienny limit przydziału czasu wykonywania na poziomie usługi, który określa, ile całkowitego czasu indeksatora można użyć na 24-godzinne okno UTC.

Możliwości opisane w tym artykule są w wersji zapoznawczej:

Zastosowanie

Model wykonania opisany w tym artykule ma zastosowanie do:

  • Bezserwerowe usługi wyszukiwania , które uruchamiają indeksatory przy użyciu interfejsu API REST lub nowszego 2026-05-01-preview .
  • Usługi wyszukiwania S3 HD, które uruchamiają indeksatory za pomocą interfejsu 2025-11-01-preview REST API lub nowszej wersji.

Obsługiwane definicje indeksatora, źródła danych, zestawy umiejętności i źródła wiedzy oparte na indeksatorze działają bez modyfikacji obu opcji.

Model wykonania

Indeksatory w Serverless i S3 HD mają następujące charakterystyki działania:

  • Nie aprowizujesz infrastruktury indeksatora ani nie zarządzasz nią. Usługa zarządza pojemnością za Ciebie.

  • Indeksatory działają tylko w środowisku wykonywania wielodostępnym. Prywatne środowisko wykonawcze, które jest udostępniane za pośrednictwem udostępnionych zasobów łącza prywatnego, nie jest dostępne dla indeksatorów w tych jednostkach SKU.

  • W przypadku usługi S3 HD, jeśli potrzebujesz połączeń indeksatora, aby pozostać poza publicznym Internetem, skonfiguruj obwód zabezpieczeń sieci (NSP) w usłudze wyszukiwania, aby kontrolować ruch przychodzący i wychodzący za pośrednictwem jawnych reguł dostępu.

  • W przypadku Serverless połączenia prywatne nie są obsługiwane.

Dzienny skumulowany limit czasu wykonywania

Działanie indeksatora podlega dziennemu limitowi czasu działania, który resetuje się o 00:00 UTC. Limit przydziału to:

  • Poziom usługi: Dotyczy ona całej usługi wyszukiwania.
  • Łącznie: Czas działania ze wszystkich indeksatorów w usłudze jest wliczany do tego samego budżetu. Przydział nie jest stosowany dla indeksatora.

Wszystkie działające indeksatory zużywają czas w ramach jednego wspólnego budżetu usługi. Usługa nie rezerwuje czasu wykonywania dla poszczególnych indeksatorów ani nie dzieli automatycznie limitu po równo między nie. Na przykład łączny czas działania 12 indeksatorów, z których każdy działa przez dwie godziny, może wyczerpać cały limit 24 łącznych godzin działania, niezależnie od tego, czy ich uruchomienia nakładają się na siebie, czy odbywają się w różnym czasie.

W poniższej tabeli wymieniono dzienny limit przydziału według jednostki SKU i minimalną wersję interfejsu API, która go obsługuje:

SKU Dzienny limit w 24-godzinnym oknie UTC Minimalna wersja interfejsu API
S3 (wysoka gęstość) 24 godziny 2025-11-01-preview
Serverless 24 godziny 2026-05-01-preview

Po wyczerpaniu dziennego limitu przydziału:

  • Indeksatory, które są aktualnie uruchomione, zostaną zatrzymane w ciągu około pięciu minut.

  • Nowe uruchomienia indeksatora nie przetwarzają dokumentów i natychmiast zwracają błąd tymczasowy wskazujący, że dzienny limit został przekroczony.

  • Normalne wykonywanie indeksatora jest wznawiane po zresetowaniu licznika o godzinie 00:00 UTC.

Jak poradzić sobie z wyczerpaniem przydziału

Aby wyjść z sytuacji wyczerpania przydziału i zmniejszyć prawdopodobieństwo ponownego osiągnięcia limitu:

Monitoruj skumulowany czas działania

W tej sekcji wyjaśniono, jak monitorować wykorzystanie czasu wykonywania i pozostały budżet za pomocą interfejsów API REST usługi Search Service. W okresie wersji zapoznawczej nie ma obsługi w portalu dla skumulowanego czasu wykonywania.

Środowisko uruchomieniowe na poziomie usługi

Użyj operacji Get Service Statistics (interfejs API REST), aby pobrać skumulowany czas działania indeksatora dla wszystkich indeksatorów w usłudze w bieżącym 24-godzinnym oknie:

GET {endpoint}/servicestats?api-version=2026-08-01-preview

Odpowiedź zawiera sekcję indexersRuntime . Poniższy kod JSON pokazuje usługę, której dzienny limit przydziału 24 godzin nie jest używany:

"indexersRuntime": {
    "usedSeconds": 0,
    "remainingSeconds": 86400,
    "beginningTime": "2026-05-16T00:00:00.000Z",
    "endingTime": "2026-05-17T00:00:00.000Z"
}

Najważniejsze kwestie:

  • usedSeconds: Łączna liczba sekund działania wszystkich indeksatorów w usłudze w bieżącym oknie.
  • remainingSeconds: Sekundy są nadal dostępne przed osiągnięciem dziennego limitu przydziału. Obecne, gdy obowiązuje limit dla danego poziomu.
  • beginningTime i endingTime: Początek i koniec bieżącego 24-godzinnego okna zliczania UTC.

Środowisko uruchomieniowe na poziomie indeksatora

Użyj polecenia Get Indexer Status (REST API), aby pobrać skumulowany czas działania pojedynczego indeksatora:

GET {endpoint}/indexers('{indexerName}')/search.status?api-version=2026-08-01-preview

Odpowiedź zawiera sekcję runtime . Poniższy JSON pokazuje indeksator w usłudze, w której dobowy limit 24-godzinny nie jest wykorzystywany:

"runtime": {
    "usedSeconds": 0,
    "remainingSeconds": 86400,
    "beginningTime": "2026-05-16T00:00:00.000Z",
    "endingTime": "2026-05-17T00:00:00.000Z"
}

Najważniejsze kwestie:

  • usedSeconds: Łączna liczba sekund uruchomienia indeksatora w bieżącym oknie.
  • remainingSeconds: Sekundy nadal dostępne dla wszystkich indeksatorów w usłudze, a nie tylko dla tego indeksatora. Obecne, gdy obowiązuje limit dla danego poziomu.
  • beginningTime i endingTime: Początek i koniec bieżącego 24-godzinnego okna zliczania UTC.

Najlepsze rozwiązania

Obsługa indeksatorów w środowiskach S3 HD i bezserwerowych jest w wersji zapoznawczej. Postępuj zgodnie z poniższymi wskazówkami, aby odpowiednio rozmieścić obciążenia i zaplanować rozliczenia bezserwerowe, które mają zostać wprowadzone w późniejszym terminie.

S3 (wysoka gęstość)

W wersji zapoznawczej obsługa indeksatora S3 HD jest przeznaczona do obsługi obciążeń bez zestawów umiejętności lub z małymi zestawami umiejętności. Aby zmieścić się w dziennym limicie:

  • Zaplanuj małe indeksy o rozmiarze około 1 GB.

  • Starannie dobieraj zakres użycia zestawu umiejętności. Umiejętności wywołujące usługi zewnętrzne, takie jak umiejętność Azure OpenAI Embedding, umiejętność GenAI Prompt i umiejętność Azure Content Understanding, znacznie wydłużają czas wykonywania i mogą szybko wykorzystać dzienny przydział, zwłaszcza w scenariuszach wielodostępnych.

  • Należy oczekiwać ograniczonej równoległości w wersji zapoznawczej. Używaj zaplanowanych, rozłożonych przebiegów dla dużych flot indeksatora, dzięki czemu praca jest rozłożona w ciągu 24-godzinnego okna, zamiast konkurować o ten sam budżet.

Przykładowe obciążenie robocze typu split-and-embed

W jednym kontrolowanym teście S3 HD umiejętność Split i jedna umiejętność osadzania Azure OpenAI wygenerowały fragmenty i osadzenia. Obciążenie wygenerowało około 2,5 fragmentów na dokument źródłowy, a w tym teście zaobserwowano około 22 000 dokumentów źródłowych podczas jednego 24-godzinnego okna testowego S3 HD.

Poniższe wartości są zaokrąglonymi, poglądowymi wyliczeniami proporcjonalnego udziału na podstawie zbiorczych obserwacji. Nie są mierzone jako wyniki dla poszczególnych indeksatorów.

Liczba indeksatorów Przykładowe dokumenty źródłowe na jeden indeksator dziennie
100 Około 200
500 Około 40
1 000 Około 20

Usługa nie rezerwuje mocy ani nie gwarantuje równomiernego rozłożenia, kolejności wykonywania ani przepustowości dla tej liczby indeksatorów.

Note

Ten wynik zaobserwowano w jednym kontrolowanym teście. Nie jest to docelowy poziom wydajności, gwarancja świadczenia usługi, zobowiązanie dotyczące dostępnej pojemności, formuła doboru rozmiaru ani substytut testowania obciążenia.

Przepływność może się różnić w zależności od złożoności i profilu dokumentu, fragmentowania, liczby i typu umiejętności i danych wyjściowych wektorów, opóźnienia modelu, pojemności i limitu przydziału, wydajności źródłowej i docelowej, współbieżności, kolejności planowania, ograniczania przepustowości, regionu, awarii i ponownych prób, pękania dokumentów lub optycznego rozpoznawania znaków (OCR) i nierównych woluminów dzierżawy. Przetestuj z użyciem reprezentatywnych produkcyjnych danych wejściowych, zanim zaplanujesz wydajność.

Serverless

W okresie wersji zapoznawczej indeksatory bezserwerowe zaprojektowano tak, aby upraszczały pozyskiwanie danych na potrzeby scenariuszy generowania wspomaganego wyszukiwaniem (RAG) oraz scenariuszy opartych na bazie wiedzy:

  • Poniesiesz koszt wykonywania indeksatora (z wyłączeniem umiejętności) oraz za zapisywanie dokumentów w indeksie.

  • Wykonywanie zestawu umiejętności jest rozliczane tak samo jak w przypadku dedykowanych indeksatorów. Wywołania usług zewnętrznych, takich jak umiejętność Embedding usługi Azure OpenAI, umiejętność GenAI Prompt oraz umiejętność Azure Content Understanding, są rozliczane w ramach dołączonego zasobu Foundry lub Azure AI services.

Limity przydziału i ograniczenia

Informacje o limitach indeksatora w środowiskach Serverless i S3 HD można znaleźć w temacie Limity indeksatora.

Limit czasu wykonywania na poziomie usługi oraz limity indeksatora nie zastępują limitów danych wejściowych, żądań ani przetwarzania dotyczących umiejętności i usług zewnętrznych w zestawie umiejętności. Sprawdź każde odwołanie do umiejętności osobno podczas określania rozmiaru potoku wzbogacania.