Notatka
Dostęp do tej strony wymaga autoryzacji. Może spróbować zalogować się lub zmienić katalogi.
Dostęp do tej strony wymaga autoryzacji. Możesz spróbować zmienić katalogi.
Note
Wyszukiwanie AI platformy Azure jest dostępna za pośrednictwem portalu Azure, interfejsów API REST i Azure SDKs. Jest także podstawą Foundry IQ — zarządzanej warstwy wiedzy, która przekształca treści przedsiębiorstwa w bazy wiedzy wielokrotnego użytku z uwzględnieniem uprawnień dla agentów w portalu Microsoft Foundry.
Important
Funkcje, możliwości lub właściwości oznaczone (wersja zapoznawcza) nie są objęte umową dotyczącą poziomu usług, nie są zalecane w przypadku obciążeń produkcyjnych i mogą ulec zmianie lub ograniczeniu, zanim staną się one ogólnie dostępne. Warunki Wyszukiwanie AI platformy Azure wersji zapoznawczej mają zastosowanie do wszystkich funkcji w wersji zapoznawczej, niezależnie od tego, czy jest ona autonomiczna, czy częścią ogólnie dostępnej funkcji.
W tym artykule opisano model wykonywania indeksatora używany przez usługę Wyszukiwanie AI platformy Azure dla usług wyszukiwania bezserwerowych i Standard 3 High Density (S3 HD). Obie opcje mają dzienny limit przydziału czasu wykonywania na poziomie usługi, który określa, ile całkowitego czasu indeksatora można użyć na 24-godzinne okno UTC.
Możliwości opisane w tym artykule są w wersji zapoznawczej:
- Obsługa indeksatora w usłudze S3 HD wymaga interfejsu API REST lub nowszego
2025-11-01-preview. - Obsługa indeksatora bezserwerowego wymaga interfejsu API REST lub nowszego
2026-05-01-preview.
Zastosowanie
Model wykonania opisany w tym artykule ma zastosowanie do:
-
Bezserwerowe usługi wyszukiwania , które uruchamiają indeksatory przy użyciu interfejsu API REST lub nowszego
2026-05-01-preview. - Usługi wyszukiwania S3 HD, które uruchamiają indeksatory za pomocą interfejsu
2025-11-01-previewREST API lub nowszej wersji.
Obsługiwane definicje indeksatora, źródła danych, zestawy umiejętności i źródła wiedzy oparte na indeksatorze działają bez modyfikacji obu opcji.
Model wykonania
Indeksatory w Serverless i S3 HD mają następujące charakterystyki działania:
Nie aprowizujesz infrastruktury indeksatora ani nie zarządzasz nią. Usługa zarządza pojemnością za Ciebie.
Indeksatory działają tylko w środowisku wykonywania wielodostępnym. Prywatne środowisko wykonawcze, które jest udostępniane za pośrednictwem udostępnionych zasobów łącza prywatnego, nie jest dostępne dla indeksatorów w tych jednostkach SKU.
W przypadku usługi S3 HD, jeśli potrzebujesz połączeń indeksatora, aby pozostać poza publicznym Internetem, skonfiguruj obwód zabezpieczeń sieci (NSP) w usłudze wyszukiwania, aby kontrolować ruch przychodzący i wychodzący za pośrednictwem jawnych reguł dostępu.
W przypadku Serverless połączenia prywatne nie są obsługiwane.
Dzienny skumulowany limit czasu wykonywania
Działanie indeksatora podlega dziennemu limitowi czasu działania, który resetuje się o 00:00 UTC. Limit przydziału to:
- Poziom usługi: Dotyczy ona całej usługi wyszukiwania.
- Łącznie: Czas działania ze wszystkich indeksatorów w usłudze jest wliczany do tego samego budżetu. Przydział nie jest stosowany dla indeksatora.
Wszystkie działające indeksatory zużywają czas w ramach jednego wspólnego budżetu usługi. Usługa nie rezerwuje czasu wykonywania dla poszczególnych indeksatorów ani nie dzieli automatycznie limitu po równo między nie. Na przykład łączny czas działania 12 indeksatorów, z których każdy działa przez dwie godziny, może wyczerpać cały limit 24 łącznych godzin działania, niezależnie od tego, czy ich uruchomienia nakładają się na siebie, czy odbywają się w różnym czasie.
W poniższej tabeli wymieniono dzienny limit przydziału według jednostki SKU i minimalną wersję interfejsu API, która go obsługuje:
| SKU | Dzienny limit w 24-godzinnym oknie UTC | Minimalna wersja interfejsu API |
|---|---|---|
| S3 (wysoka gęstość) | 24 godziny | 2025-11-01-preview |
| Serverless | 24 godziny | 2026-05-01-preview |
Po wyczerpaniu dziennego limitu przydziału:
Indeksatory, które są aktualnie uruchomione, zostaną zatrzymane w ciągu około pięciu minut.
Nowe uruchomienia indeksatora nie przetwarzają dokumentów i natychmiast zwracają błąd tymczasowy wskazujący, że dzienny limit został przekroczony.
Normalne wykonywanie indeksatora jest wznawiane po zresetowaniu licznika o godzinie 00:00 UTC.
Jak poradzić sobie z wyczerpaniem przydziału
Aby wyjść z sytuacji wyczerpania przydziału i zmniejszyć prawdopodobieństwo ponownego osiągnięcia limitu:
Poczekaj do następnego resetu o 00:00 UTC lub użyj operacji Pobierz statystyki usługi (REST API), aby potwierdzić uzupełnienie
remainingSecondsprzed uruchomieniem nowych przebiegów.Zaplanuj działanie indeksatorów w harmonogramach przesuniętych względem siebie, aby obciążenie rozłożyło się w ciągu 24 godzin, zamiast uruchamiać się jednocześnie.
Nie można wstrzymać ani zatrzymać aktywnych uruchomień. Użyj opcji Pobierz stan indeksatora , aby je monitorować, i zobacz Uruchamianie lub resetowanie indeksatorów pod kątem zachowania kontroli środowiska uruchomieniowego.
Jeśli środowisko uruchomieniowe nadal działa, ale uruchomienia indeksatora kończą się niepowodzeniem, zobacz Rozwiązywanie problemów z indeksatorem.
Zmniejszenie kosztów zestawu umiejętności. Umiejętności wywołujące usługi zewnętrzne, takie jak umiejętność Azure OpenAI Embedding, umiejętność GenAI Prompt oraz umiejętność Azure Content Understanding, szybko zużywają czas wykonywania. Zmniejsz liczbę umiejętności, wielkość partii dokumentów lub skonfiguruj pamięć podręczną wzbogacania, aby ponownie użyć wcześniejszych wyników zamiast przetwarzać je ponownie.
Monitoruj
remainingSecondsproaktywnie zarówno na poziomie usługi, jak i indeksatora, aby można było ograniczyć obciążenia przed ich awarią.
Monitoruj skumulowany czas działania
W tej sekcji wyjaśniono, jak monitorować wykorzystanie czasu wykonywania i pozostały budżet za pomocą interfejsów API REST usługi Search Service. W okresie wersji zapoznawczej nie ma obsługi w portalu dla skumulowanego czasu wykonywania.
Środowisko uruchomieniowe na poziomie usługi
Użyj operacji Get Service Statistics (interfejs API REST), aby pobrać skumulowany czas działania indeksatora dla wszystkich indeksatorów w usłudze w bieżącym 24-godzinnym oknie:
GET {endpoint}/servicestats?api-version=2026-08-01-preview
Odpowiedź zawiera sekcję indexersRuntime . Poniższy kod JSON pokazuje usługę, której dzienny limit przydziału 24 godzin nie jest używany:
"indexersRuntime": {
"usedSeconds": 0,
"remainingSeconds": 86400,
"beginningTime": "2026-05-16T00:00:00.000Z",
"endingTime": "2026-05-17T00:00:00.000Z"
}
Najważniejsze kwestie:
-
usedSeconds: Łączna liczba sekund działania wszystkich indeksatorów w usłudze w bieżącym oknie. -
remainingSeconds: Sekundy są nadal dostępne przed osiągnięciem dziennego limitu przydziału. Obecne, gdy obowiązuje limit dla danego poziomu. -
beginningTimeiendingTime: Początek i koniec bieżącego 24-godzinnego okna zliczania UTC.
Środowisko uruchomieniowe na poziomie indeksatora
Użyj polecenia Get Indexer Status (REST API), aby pobrać skumulowany czas działania pojedynczego indeksatora:
GET {endpoint}/indexers('{indexerName}')/search.status?api-version=2026-08-01-preview
Odpowiedź zawiera sekcję runtime . Poniższy JSON pokazuje indeksator w usłudze, w której dobowy limit 24-godzinny nie jest wykorzystywany:
"runtime": {
"usedSeconds": 0,
"remainingSeconds": 86400,
"beginningTime": "2026-05-16T00:00:00.000Z",
"endingTime": "2026-05-17T00:00:00.000Z"
}
Najważniejsze kwestie:
-
usedSeconds: Łączna liczba sekund uruchomienia indeksatora w bieżącym oknie. -
remainingSeconds: Sekundy nadal dostępne dla wszystkich indeksatorów w usłudze, a nie tylko dla tego indeksatora. Obecne, gdy obowiązuje limit dla danego poziomu. -
beginningTimeiendingTime: Początek i koniec bieżącego 24-godzinnego okna zliczania UTC.
Najlepsze rozwiązania
Obsługa indeksatorów w środowiskach S3 HD i bezserwerowych jest w wersji zapoznawczej. Postępuj zgodnie z poniższymi wskazówkami, aby odpowiednio rozmieścić obciążenia i zaplanować rozliczenia bezserwerowe, które mają zostać wprowadzone w późniejszym terminie.
S3 (wysoka gęstość)
W wersji zapoznawczej obsługa indeksatora S3 HD jest przeznaczona do obsługi obciążeń bez zestawów umiejętności lub z małymi zestawami umiejętności. Aby zmieścić się w dziennym limicie:
Zaplanuj małe indeksy o rozmiarze około 1 GB.
Starannie dobieraj zakres użycia zestawu umiejętności. Umiejętności wywołujące usługi zewnętrzne, takie jak umiejętność Azure OpenAI Embedding, umiejętność GenAI Prompt i umiejętność Azure Content Understanding, znacznie wydłużają czas wykonywania i mogą szybko wykorzystać dzienny przydział, zwłaszcza w scenariuszach wielodostępnych.
Należy oczekiwać ograniczonej równoległości w wersji zapoznawczej. Używaj zaplanowanych, rozłożonych przebiegów dla dużych flot indeksatora, dzięki czemu praca jest rozłożona w ciągu 24-godzinnego okna, zamiast konkurować o ten sam budżet.
Przykładowe obciążenie robocze typu split-and-embed
W jednym kontrolowanym teście S3 HD umiejętność Split i jedna umiejętność osadzania Azure OpenAI wygenerowały fragmenty i osadzenia. Obciążenie wygenerowało około 2,5 fragmentów na dokument źródłowy, a w tym teście zaobserwowano około 22 000 dokumentów źródłowych podczas jednego 24-godzinnego okna testowego S3 HD.
Poniższe wartości są zaokrąglonymi, poglądowymi wyliczeniami proporcjonalnego udziału na podstawie zbiorczych obserwacji. Nie są mierzone jako wyniki dla poszczególnych indeksatorów.
| Liczba indeksatorów | Przykładowe dokumenty źródłowe na jeden indeksator dziennie |
|---|---|
| 100 | Około 200 |
| 500 | Około 40 |
| 1 000 | Około 20 |
Usługa nie rezerwuje mocy ani nie gwarantuje równomiernego rozłożenia, kolejności wykonywania ani przepustowości dla tej liczby indeksatorów.
Note
Ten wynik zaobserwowano w jednym kontrolowanym teście. Nie jest to docelowy poziom wydajności, gwarancja świadczenia usługi, zobowiązanie dotyczące dostępnej pojemności, formuła doboru rozmiaru ani substytut testowania obciążenia.
Przepływność może się różnić w zależności od złożoności i profilu dokumentu, fragmentowania, liczby i typu umiejętności i danych wyjściowych wektorów, opóźnienia modelu, pojemności i limitu przydziału, wydajności źródłowej i docelowej, współbieżności, kolejności planowania, ograniczania przepustowości, regionu, awarii i ponownych prób, pękania dokumentów lub optycznego rozpoznawania znaków (OCR) i nierównych woluminów dzierżawy. Przetestuj z użyciem reprezentatywnych produkcyjnych danych wejściowych, zanim zaplanujesz wydajność.
Serverless
W okresie wersji zapoznawczej indeksatory bezserwerowe zaprojektowano tak, aby upraszczały pozyskiwanie danych na potrzeby scenariuszy generowania wspomaganego wyszukiwaniem (RAG) oraz scenariuszy opartych na bazie wiedzy:
Poniesiesz koszt wykonywania indeksatora (z wyłączeniem umiejętności) oraz za zapisywanie dokumentów w indeksie.
Wykonywanie zestawu umiejętności jest rozliczane tak samo jak w przypadku dedykowanych indeksatorów. Wywołania usług zewnętrznych, takich jak umiejętność Embedding usługi Azure OpenAI, umiejętność GenAI Prompt oraz umiejętność Azure Content Understanding, są rozliczane w ramach dołączonego zasobu Foundry lub Azure AI services.
Limity przydziału i ograniczenia
Informacje o limitach indeksatora w środowiskach Serverless i S3 HD można znaleźć w temacie Limity indeksatora.
Limit czasu wykonywania na poziomie usługi oraz limity indeksatora nie zastępują limitów danych wejściowych, żądań ani przetwarzania dotyczących umiejętności i usług zewnętrznych w zestawie umiejętności. Sprawdź każde odwołanie do umiejętności osobno podczas określania rozmiaru potoku wzbogacania.