Poznámka:
Přístup k této stránce vyžaduje autorizaci. Můžete se zkusit přihlásit nebo změnit adresáře.
Přístup k této stránce vyžaduje autorizaci. Můžete zkusit změnit adresáře.
Note
Azure AI Vyhledávač je k dispozici prostřednictvím portálu Azure, rozhraní REST API a Sady Azure SDK. Podporuje také Foundry IQ, spravovanou znalostní vrstvu, která transformuje podnikový obsah na opakovaně použitelné znalostní báze s podporou oprávnění pro agenty na portálu Microsoft Foundry.
Důležité
Na funkce, možnosti nebo vlastnosti označené jako (Preview) se nevztahuje smlouva o úrovni služeb, nejsou doporučené pro produkční úlohy a mohou se změnit nebo být omezeny dříve, než budou obecně k dispozici. Podmínky Azure AI Vyhledávač Preview platí pro všechny funkce ve verzi Preview, ať už jsou samostatné nebo součástí obecně dostupné funkce.
Mezipaměť obohacení (Preview) je volitelná funkce, která ukládá obohacený obsah vytvořený během provádění sady dovedností. Zachovává obsah mezi běhy, takže jen změněné dovednosti a dokumenty vyžadují opětovné zpracování. Nejedná se o zálohu výstupů sady dovedností, stavu indexeru ani indexovaných dokumentů.
Mezipaměť obohacení vytvoříte ve službě Azure Storage. Mezipaměť obsahuje výstup z analýzy dokumentu a výstupy každé funkce pro každý dokument. I když je ukládání do mezipaměti fakturovatelné (používá Azure Storage), celkové náklady na rozšiřování se snižují, protože náklady na úložiště jsou menší než extrakce obrázků a zpracování AI.
Pokud nakonfigurujete mezipaměť obohacení, tento článek vysvětluje, jak spravovat aktualizace dovedností a zdrojů dat, abyste co nejlépe využili obohacení uložená v mezipaměti.
Požadavky
Omezení
Pozor
Pokud používáte indexer SharePoint (Preview), vyhněte se přírůstkovým rozšiřováním. Za určitých okolností se mezipaměť stane neplatnou. Pokud ho chcete znovu načíst, proveďte resetování indexeru a úplné opětovné sestavení.
Velké zdroje dat mají další omezení mezipaměti.
Pozor
U velkých zdrojů dat může mezipaměť obohacení zvýšit celkový objem opětovného zpracování při dlouho běžících dovednostech, opakovaných přerušeních nebo častých selháních dovedností. Indexer upřednostňuje správnost před minimalizací opětovného zpracování, takže nahromadění položek v mezipaměti způsobené opakovanými přerušeními vede k častějším opakovaným pokusům.
Pokud se chcete zotavit z rostoucího backlogu mezipaměti, rozdělte zdroj dat do menších kontejnerů nebo virtuálních složek. Pak použijte paralelní indexery odkazující na stejný index. Pokud chcete zrušit přidružení mezipaměti, nastavte vlastnost cache na indexeru na hodnotu null.
Konfigurace mezipaměti
Mezipaměť je fyzicky uložená v kontejneru objektů blob a tabulkách ve vašem účtu Azure Storage, jednu pro každý indexer. Každému indexeru je přiřazen jedinečný a neměnný identifikátor mezipaměti, který odpovídá kontejneru, který používá.
Mezipaměť se vytvoří při zadání cache vlastnosti a spuštění indexátoru. Do mezipaměti lze ukládat pouze obohacený obsah. Pokud váš indexer nemá připojenou sadu schopností, ukládání do mezipaměti se nepoužije.
Následující příklad ukazuje indexátor s povoleným ukládáním do mezipaměti. Úplné pokyny najdete v tématu Konfigurace ukládání do mezipaměti pro obohacení.
POST https://[YOUR-SEARCH-SERVICE-NAME].search.windows.net/indexers?api-version=2026-08-01-preview
{
"name": "myIndexerName",
"targetIndexName": "myIndex",
"dataSourceName": "myDatasource",
"skillsetName": "mySkillset",
"cache" : {
"storageConnectionString" : "<Your storage account connection string>",
"enableReprocessing": true
},
"fieldMappings" : [],
"outputFieldMappings": [],
"parameters": []
}
Správa mezipaměti
Indexer spravuje životní cyklus mezipaměti. Pokud odstraníte indexer, odstraníte také jeho mezipaměť. Pokud nastavíte vlastnost indexeru cache na hodnotu null nebo změníte připojovací řetězec, stávající mezipaměť se odstraní během dalšího spuštění indexeru.
Zatímco přírůstkové rozšiřování je navržené tak, aby detekoval změny bez zásahu a reagoval na ně, můžete nastavit parametry pro vyvolání konkrétních chování:
- Stanovení priority nových dokumentů
- Obejití kontrol sady dovedností
- Obejití kontrol zdrojů dat
- Vynucené hodnocení dovedností
Stanovení priority nových dokumentů
Tato cache vlastnost obsahuje enableReprocessing parametr, který určuje, zda se obsah uložený v mezipaměti znovu zpracoval. Pokud je hodnota true (výchozí), indexer při opětovném spuštění znovu zpracuje dokumenty uložené v mezipaměti, pokud je ovlivní aktualizace dovedností.
Pokud je hodnota false, indexer znovu nezpracovává existující dokumenty, které upřednostňují nový obsah. Nastavte enableReprocessing na hodnotu false pouze dočasně. Udržování aktuálnosti většinu času zajišťuje, že nové i existující dokumenty zůstávají platné pro současnou definici dovedností.
Vynechat vyhodnocení sady dovedností
Úprava dovednosti obvykle jde ruku v ruce s jejím opětovným zpracováním. Některé změny dovednosti by ale neměly aktivovat opětovné zpracování. Například nasazení vlastní dovednosti do nového umístění nebo pomocí nového přístupového klíče. Tyto změny jsou obvykle periferními úpravami, které nemají vliv na podstatu výstupu dovednosti.
Pokud víte, že změna dovednosti je povrchní, přepište hodnocení dovedností nastavením parametru disableCacheReprocessingChangeDetection na true:
- Vyvolejte aktualizaci skillsetu a upravte definici skillsetu.
-
disableCacheReprocessingChangeDetection=truePřipojte parametr k požadavku. - Odešlete změnu.
Při nastavování tohoto parametru se potvrdí pouze aktualizace definice sady dovedností. Změna se neposuzuje z hlediska dopadů na existující mezipaměť. Použijte verzi rozhraní API Preview, 2020-06-30 nebo novější. Použijte nejnovější rozhraní API ve verzi Preview.
PUT https://[servicename].search.windows.net/skillsets/[skillset name]?api-version=2026-08-01-preview&disableCacheReprocessingChangeDetection
Přeskočení ověřovacích kontrol zdroje dat
Většina změn definice zdroje dat zneplatní mezipaměť. V případě scénářů, ve kterých víte, že změna by neměla zneplatnit mezipaměť, například změna připojovacího řetězce nebo obměna klíče na účtu úložiště. Přidejte parametr ignoreResetRequirement k aktualizaci zdroje dat . Nastavte tento parametr na hodnotu true, aby bylo možné projít potvrzením, aniž by se aktivovala podmínka resetování, která by způsobovala, že se všechny objekty znovu sestaví a naplní od začátku.
PUT https://[search service].search.windows.net/datasources/[data source name]?api-version=2026-08-01-preview&ignoreResetRequirement
Vynucení vyhodnocení sady dovedností
Účelem mezipaměti je vyhnout se zbytečnému zpracování. Předpokládejme ale, že uděláte změnu dovednosti, kterou indexer nerozpozná (například změníte něco v externím kódu, například vlastní dovednost).
V tomto případě použijte rozhraní API pro resetování dovedností k vynucení opětovného zpracování konkrétní dovednosti, včetně všech podřízených dovedností, které mají závislost na výstupu dané dovednosti. Toto rozhraní API přijímá požadavek POST se seznamem dovedností, které by se měly zneplatnit a označit k opětovnému zpracování. Po resetování dovedností odešlete požadavek na Spuštění indexeru pro zahájení zpracování pipeline.
Opakované ukládání dokumentů do mezipaměti
Pokud indexer resetujete, všechny dokumenty ve vyhledávacím korpusu se znovu zpracují.
Ve scénářích, kdy je potřeba znovu zpracovat jenom několik dokumentů, použijte resetování dokumentů (Preview) k vynucení opětovného zpracování konkrétních dokumentů. Při resetování dokumentu indexer zneplatní mezipaměť pro tento dokument. Indexer pak dokument znovu zpracuje tak, že ho přečte ze zdroje dat. Další informace najdete v tématu Spuštění nebo resetování indexerů, dovedností a dokumentů.
Pokud chcete obnovit konkrétní dokumenty, zahrňte do požadavku seznam klíčů dokumentů, které se čtou z indexu vyhledávání. Pokud se klíč mapuje na pole v externím zdroji dat, použijte hodnotu z indexu vyhledávání.
V závislosti na tom, jak voláte rozhraní API, požadavek buď připojí, přepíše nebo zařadí do fronty seznam klíčů:
Volání rozhraní API několikrát s různými klíči připojí nové klíče k seznamu klíčů dokumentů, které se mají resetovat.
Volání rozhraní API s parametrem řetězce dotazu
overwritenastaveným natruepřepíše aktuální seznam klíčů dokumentů k resetování datovou částí požadavku.Volání API přidá klíče dokumentů do fronty úloh, které indexer zpracovává. Při dalším vyvolání indexeru( podle plánu nebo na vyžádání) určuje prioritu zpracování klíčů dokumentu pro resetování před všemi dalšími změnami ze zdroje dat.
Následující příklad znázorňuje žádost o resetování dokumentu:
POST https://[search service name].search.windows.net/indexers/[indexer name]/resetdocs?api-version=2026-08-01-preview
{
"documentKeys" : [
"key1",
"key2",
"key3"
]
}
Změny, které zneplatní mezipaměť
Když povolíte mezipaměť, indexer zkontroluje změny ve složení kanálu a rozhodne, který obsah může znovu použít a který obsah potřebuje znovu zpracovat. Tato část obsahuje seznam změn, které zneplatní mezipaměť, za nimiž následují změny, které aktivují přírůstkové zpracování.
Neplatná změna spočívá v tom, že celá mezipaměť je neplatná. Například aktualizace zdroje dat je neplatná změna. Tady je úplný seznam změn v libovolné části kanálu indexeru, který zneplatní vaši mezipaměť:
- Změna typu zdroje dat
- Změna kontejneru zdroje dat
- Změna přihlašovacích údajů ke zdroji dat
- Změna zásad detekce změn zdroje dat
- Změna zásad detekce odstranění zdroje dat
- Změna mapování polí indexeru
- Změna parametrů indexeru:
- Režim analýzy
- Vyloučené přípony názvů souborů
- Indexované přípony názvů souborů
- Indexovat metadata úložiště pouze pro příliš velké dokumenty
- Záhlaví textu s oddělovači
- Oddělovač pro ohraničovaný text
- Kořen dokumentu
- Akce obrázku (změny způsobu extrahování obrázků)
Změny, které aktivují přírůstkové zpracování
Přírůstkové zpracování vyhodnotí definici vaší sady dovedností a určí, které dovednosti se mají spustit znovu. Selektivně aktualizuje ovlivněné části stromu dokumentu. Zde je kompletní seznam změn, které vedou k postupnému obohacení:
- Změna typu dovednosti (aktualizace typu OData dovednosti)
- Aktualizace parametrů specifických pro dovednosti, jako je adresa URL, výchozí hodnoty nebo jiné parametry
- Změna výstupů dovedností, například když dovednost vrací další nebo jiné výstupy
- Změna vstupních údajů dovedností, která vede k odlišnému původu nebo zřetězení dovedností
- Jakékoli zneplatnění z předřazené dovednosti, pokud aktualizujete dovednost, která této dovednosti poskytuje vstup
- Aktualizace umístění projekce úložiště znalostí, což vede k opětovnému promítání dokumentů
- Změna projekcí úložiště znalostí, což vede k opětovnému promítání dokumentů
- Změna mapování výstupních polí v indexeru, což vede k opětovnému promítání dokumentů do indexu
Rozhraní API používaná k ukládání do mezipaměti
Rozhraní API ve verzi Preview poskytují další vlastnosti indexerů. Použijte nejnovější rozhraní API ve verzi Preview.
Pro sady dovedností a zdroje dat použijte obecně dostupnou verzi. Kromě referenční dokumentace viz téma Konfigurace ukládání do mezipaměti pro přírůstkové rozšiřování, kde najdete podrobnosti o pořadí operací.
Vytvoření nebo aktualizace indexeru (api-version=2026-08-01-preview)
Vytvoření nebo aktualizace sady dovedností (api-version=2026-08-01-preview) (nový parametr identifikátoru URI na požadavku)
Vytvoření nebo aktualizace zdroje dat (api-version=2026-08-01-preview) Při volání tohoto rozhraní API s verzí preview rozhraní API poskytuje nový parametr s názvem
ignoreResetRequirement. Nastavte tento parametr natrue, pokud vaše akce aktualizace nemá zneplatnit mezipaměť. PoužívejteignoreResetRequirementstřídmě, protože by to mohlo vést k nezamýšlené nekonzistence vašich dat, která nejsou snadno zjištěna.