Spouštění indexeru v bezserverové verzi a standardu 3 s vysokou hustotou (S3 HD) (Preview)

Note

Azure AI Vyhledávač je k dispozici prostřednictvím portálu Azure, rozhraní REST API a Sady Azure SDK. Podporuje také Foundry IQ, spravovanou znalostní vrstvu, která transformuje podnikový obsah na opakovaně použitelné znalostní báze s podporou oprávnění pro agenty na portálu Microsoft Foundry.

Important

Na funkce, možnosti nebo vlastnosti označené jako (Preview) se nevztahuje smlouva o úrovni služeb, nejsou doporučené pro produkční úlohy a mohou se změnit nebo být omezeny dříve, než budou obecně k dispozici. Podmínky Azure AI Vyhledávač Preview platí pro všechny funkce ve verzi Preview, ať už jsou samostatné nebo součástí obecně dostupné funkce.

Tento článek popisuje model spouštění indexeru, který služba Azure AI Vyhledávač používá pro bezserverové vyhledávací služby a vyhledávací služby Standard 3 High Density (S3 HD). Obě možnosti mají denní kvótu doby běhu na úrovni služby, která určuje, jak dlouhou celkovou dobu běhu indexeru můžete využít během každého 24hodinového okna v UTC.

Možnosti popsané v tomto článku jsou ve verzi Preview:

Kdy se to používá

Model spouštění v tomto článku se vztahuje na:

  • Bezserverové vyhledávací služby , které spouští indexery pomocí 2026-05-01-preview rozhraní REST API nebo novějšího.
  • Vyhledávací služby S3 HD, které používají rozhraní REST API 2025-11-01-preview ke spouštění indexerů a novější.

Podporované definice indexeru, zdroje dat, sady dovedností a zdroje znalostí založené na indexeru fungují beze změny obou možností.

Model spouštění

Indexátory ve službách Serverless a S3 HD mají následující charakteristiky provádění:

  • Nezřídíte ani nespravujete infrastrukturu indexeru. Služba za vás zpracovává kapacitu.

  • Indexery se spouštějí jenom v prostředí s více tenanty. Prostředí pro privátní spouštění, které je poskytováno prostřednictvím sdílených prostředků privátního připojení, není pro indexátory v těchto SKU k dispozici.

  • Pro S3 HD, pokud potřebujete, aby připojení indexeru zůstala mimo veřejný internet, nakonfigurujte ve své vyhledávací službě perimetr zabezpečení sítě (NSP), abyste mohli řídit příchozí a odchozí provoz pomocí explicitních pravidel přístupu.

  • Pro bezserverová připojení neexistuje žádná podpora privátních připojení.

Denní kvóta kumulativní doby běhu

Spouštění indexeru se řídí denní kvótou modulu runtime, která se resetuje v 00:00 UTC. Kvóta je:

  • Úroveň služby: Platí pro vyhledávací službu jako celek.
  • Kumulativně: Doba běhu všech indexerů ve službě se započítává do stejného limitu. Kvóta se neuplatňuje pro každý indexer.

Všem spuštěným indexerům se čas započítává do jednoho sdíleného servisního rozpočtu. Služba nerezervuje běhové prostředky pro jednotlivé indexery ani mezi ně automaticky nerozděluje kvótu rovným dílem. Například kumulativní doba běhu 12 indexerů, z nichž každý běží dvě hodiny, může spotřebovat všech 24 hodin souhrnné doby běhu, ať už se jejich běhy překrývají, nebo probíhají v různých časech.

Následující tabulka uvádí denní kvótu podle skladové položky a minimální verzi rozhraní API, která ji podporuje:

skladová jednotka (SKU) Denní kvóta za 24hodinový interval UTC Minimální verze rozhraní API
S3 HD 24 hodin 2025-11-01-preview
Serverless 24 hodin 2026-05-01-preview

Při vyčerpání denní kvóty:

  • Indexery, které jsou právě spuštěné, se zastaví přibližně do pěti minut.

  • Nová spuštění indexeru nezpracovávají dokumenty a okamžitě vracejí přechodné selhání s informací, že byla překročena denní kvóta.

  • Normální spuštění indexeru se obnoví po resetování čítače v 00:00 UTC.

Zotavení z vyčerpání kvóty

Pokud se chcete zotavit z vyčerpání kvóty a snížit pravděpodobnost opětovného dosažení kvóty:

Sledovat kumulativní dobu běhu

Tato část vysvětluje, jak sledovat využití modulu runtime a zbývající rozpočet pomocí rozhraní REST API vyhledávací služby. Ve verzi Preview není k dispozici prostředí portálu pro kumulativní dobu běhu.

Modul runtime na úrovni služby

Pomocí Get Service Statistics (REST API) načtěte kumulativní dobu běhu indexerů napříč všemi indexery ve službě pro aktuální 24hodinové okno:

GET {endpoint}/servicestats?api-version=2026-08-01-preview

Odpověď obsahuje sekci indexersRuntime. Následující kód JSON ukazuje službu, jejíž denní kvóta 24 hodin se nepoužívá:

"indexersRuntime": {
    "usedSeconds": 0,
    "remainingSeconds": 86400,
    "beginningTime": "2026-05-16T00:00:00.000Z",
    "endingTime": "2026-05-17T00:00:00.000Z"
}

Klíčové body:

  • usedSeconds: Celkový počet sekund, po které všechny indexery ve službě běžely během aktuálního časového období.
  • remainingSeconds: Sekundy jsou stále dostupné před dosažením denní kvóty. K dispozici, když se použije limit pro konkrétní úroveň.
  • beginningTime a endingTime: Začátek a konec aktuálního 24hodinového časového intervalu UTC.

Běhové prostředí na úrovni indexeru

Pomocí Get Indexer Status (REST API) můžete získat kumulativní dobu běhu pro konkrétní indexer:

GET {endpoint}/indexers('{indexerName}')/search.status?api-version=2026-08-01-preview

Odpověď obsahuje sekci runtime. Následující kód JSON ukazuje indexer ve službě, jehož denní kvóta 24 hodin se nepoužívá:

"runtime": {
    "usedSeconds": 0,
    "remainingSeconds": 86400,
    "beginningTime": "2026-05-16T00:00:00.000Z",
    "endingTime": "2026-05-17T00:00:00.000Z"
}

Klíčové body:

  • usedSeconds: Celkový počet sekund, po které se indexer spustil během aktuálního okna.
  • remainingSeconds: Sekundy jsou stále dostupné pro všechny indexery ve službě, nejen pro tento indexer. K dispozici, když se použije limit pro konkrétní úroveň.
  • beginningTime a endingTime: Začátek a konec aktuálního 24hodinového časového intervalu UTC.

Osvědčené postupy

Podpora indexeru pro S3 HD a Serverless je ve verzi Preview. Podle těchto pokynů odpovídajícím způsobem zvětšujte úlohy a naplánujte fakturaci bezserverové architektury, která se má zavést později.

S3 HD

Ve verzi Preview je podpora indexeru S3 HD navržena pro úlohy bez sad dovedností nebo s malými sadami dovedností. Pokud chcete zůstat v denní kvótě:

  • Naplánujte malé indexy o velikosti přibližně 1 GB.

  • Pečlivě zvětšujte využití sady dovedností. Dovednosti, které volají externí služby, jako je dovednost Azure OpenAI Embedding, dovednost GenAI Prompt a dovednost Azure Content Understanding, výrazně prodlužují dobu běhu a mohou rychle vyčerpat denní kvótu, zejména v prostředích s více tenanty.

  • Během verze Preview očekáváme omezený paralelismus. Používejte pro velké skupiny indexerů plánované spouštění v různých časech, aby se práce rozložila v průběhu 24 hodin, místo aby soutěžila o stejný rozpočet.

Ilustrativní úloha rozdělení a vložení

V jednom kontrolovaném testu S3 HD dovednost Split a jedna dovednost Azure OpenAI Embedding vygenerovaly bloky a embeddingy. Úloha vytvořila přibližně 2,5 bloků dat na zdrojový dokument a během jednoho 24hodinového testovacího okna S3 HD bylo v tomto testu pozorováno přibližně 22 000 zdrojových dokumentů.

Následující hodnoty jsou zaokrouhlené ilustrativní výpočty spravedlivého podílu na základě souhrnného pozorování. Neměří se po jednotlivých indexerech.

Počet indexerů Orientační počet zdrojových dokumentů na jeden indexer za den
100 Asi 200
500 Asi 40
1,000 Asi 20

Pro tyto počty indexerů si služba nezarezervuje kapacitu ani nezaručuje stejnou distribuci, pořadí provádění ani propustnost.

Note

Tento výsledek byl pozorován v jednom kontrolovaném testu. Nejedná se o cíl výkonu, záruku služeb, závazek kapacity, vzorec určení velikosti nebo náhradu za testování úloh.

Propustnost se může výrazně lišit v závislosti na složitosti a profilu dokumentu, dělení na bloky, počtu a typu dovedností a vektorových výstupů, latenci modelu, kapacitě a kvótě, výkonu zdroje a cíle, souběžnosti, pořadí plánování, omezování, regionu, selháních a opakovaných pokusech, extrakci obsahu z dokumentů nebo optickém rozpoznávání znaků (OCR) a nerovnoměrném objemu dat mezi tenanty. Před plánováním kapacity otestujte reprezentativní produkční vstupy.

Serverless

Ve verzi Preview jsou bezserverové indexery navrženy tak, aby zjednodušily ingesci dat pro scénáře generování rozšířeného o vyhledávání (RAG) a scénáře znalostních bází:

  • Spouštění indexeru (s výjimkou dovedností) je v současné době zdarma. Za zápis dokumentů do indexu se účtují náklady.

  • Spouštění dovednostní sady se zpoplatňuje stejným způsobem jako u vyhrazených indexerů. Volání externích služeb, jako je dovednost Azure OpenAI Embedding, dovednost GenAI Prompt a dovednost Azure Content Understanding, jsou účtována prostřednictvím připojeného prostředku Foundry nebo Služby Azure AI.

Omezení a kvóty

Informace o limitech indexeru pro Serverless a S3 HD najdete v tématu Limity indexeru.

Kvóta modulu runtime na úrovni služby a limity indexeru nenahrazují limity vstupu, požadavků ani zpracování pro dovednosti a externí služby v sadě dovedností. Při nastavení velikosti kanálu rozšiřování zkontrolujte referenční informace o jednotlivých dovednostech samostatně.