Poznámka:
Přístup k této stránce vyžaduje autorizaci. Můžete se zkusit přihlásit nebo změnit adresáře.
Přístup k této stránce vyžaduje autorizaci. Můžete zkusit změnit adresáře.
Poznámka:
Azure AI Vyhledávač je k dispozici prostřednictvím portálu Azure, rozhraní REST API a Sady Azure SDK. Podporuje také Foundry IQ, spravovanou znalostní vrstvu, která transformuje podnikový obsah na opakovaně použitelné znalostní báze s podporou oprávnění pro agenty na portálu Microsoft Foundry.
Important
Tyto funkce podporují připojení k jiným služby Microsoft a službám třetích stran. Použití těchto služeb podléhá vlastním podmínkám jednotlivých služeb a může vést ke zpracování nebo ukládání dat mimo hranici souladu Azure, stejně jako k toku dat do hranice souladu Azure.
Je vaší zodpovědností spravovat, jestli budou vaše data přetékat mimo dodržování předpisů a geografické hranice vaší organizace a případné související důsledky a že se zřídí příslušná oprávnění, hranice a schválení.
Zodpovídáte za pečlivou kontrolu a testování aplikací, které vytváříte v kontextu konkrétních případů použití, a za veškerá vhodná rozhodnutí a přizpůsobení. To zahrnuje implementaci vlastního zodpovědného zmírnění rizik umělé inteligence, jako jsou metaprompty, filtry obsahu nebo jiné bezpečnostní systémy, a zajištění toho, aby vaše aplikace splňovaly příslušné standardy kvality, spolehlivosti, zabezpečení a důvěryhodnosti. Další informace najdete v informacích o transparentnosti Azure AI Vyhledávač.
Po vytvoření počátečního indexu vyhledávání můžete chtít, aby následné úlohy indexeru zabíraly jenom nové a změněné dokumenty. U indexovaného obsahu pocházejícího ze služby Azure Storage dochází k detekci změn automaticky, protože indexery sledují poslední aktualizaci pomocí předdefinovaných časových razítek u objektů a souborů ve službě Azure Storage.
I když je detekce změn samozřejmostí, detekce odstranění tomu tak není. Indexer nesleduje odstranění objektu ve zdrojích dat. Aby nedošlo k vytvoření osiřelých dokumentů vyhledávání, můžete implementovat strategii dočasného odstranění, která nejprve vede k odstranění dokumentů vyhledávání a teprve poté k fyzickému odstranění ve službě Azure Storage jako druhý krok.
Existují dva způsoby implementace strategie měkkého odstranění:
- Obnovitelné odstranění nativního objektu blob platí jenom pro službu Blob Storage.
- Měkké odstranění pomocí vlastních metadat
Strategie detekce odstranění se musí použít již od úplně prvního spuštění indexovacího procesu. Pokud jste před počátečním spuštěním zásady odstranění nevytvořili, všechny dokumenty, které byly odstraněny před implementací zásady, zůstanou ve vašem indexu, i když zásadu přidáte do indexeru později a resetujete ji. Pokud k tomu došlo, doporučujeme vytvořit nový index pomocí nového indexeru a zajistit, aby zásady odstranění byly zavedeny od začátku.
Požadavky
Použití indexeru Azure Storage pro Blob Storage, Table Storage, File Storage nebo Data Lake Storage Gen2
Používejte konzistentní klíče dokumentů a strukturu souborů. Změna klíčů dokumentů nebo názvů a cest adresářů (platí pro ADLS Gen2) naruší interní sledovací informace, které indexery používají k tomu, aby zjistily, který obsah byl indexován a kdy byl naposledy indexován.
Poznámka:
ADLS Gen2 umožňuje přejmenování adresářů. Při přejmenování adresáře se časové razítka objektů blob v daném adresáři neaktualizují. V důsledku toho indexer tyto objekty blob nepřeindexuje. Pokud potřebujete, aby se objekty blob v adresáři přeindexovaly po přejmenování adresáře, protože teď mají nové adresy URL, je potřeba aktualizovat LastModified časové razítko pro všechny objekty blob v adresáři, aby indexer věděl, že je během budoucnosti přeindexuje. Virtuální adresáře ve službě Azure Blob Storage nejde změnit, takže tento problém nemají.
Nativní měkké smazání objektů blob
V případě tohoto přístupu pro detekci odstranění služba Azure AI Vyhledávač závisí na nativní funkci obnovitelného odstranění objektů blob ve službě Azure Blob Storage a určí, jestli se objekty blob přechádly do stavu obnovitelného odstranění. Když se v tomto stavu zjistí objekty blob, použije indexer vyhledávání tyto informace k odebrání odpovídajícího dokumentu z indexu.
Požadavky na nativní měkké odstranění
Objekty blob musí být v kontejneru Azure Blob Storage, včetně kontejneru objektů blob ADLS Gen2. Zásady dočasného odstranění nativního objektu blob služby Azure AI Vyhledávač nejsou podporovány pro Azure Files.
Klíče dokumentů v indexu musí být namapovány buď na vlastnost objektu blob, nebo na metadata objektu blob, jako je "metadata_storage_path".
Ke konfiguraci podpory obnovitelného odstranění můžete použít rozhraní REST API nebo konfiguraci zdroje dat indexeru na webu Azure Portal.
Verzování objektů blob nesmí být povoleno v účtu úložiště. V opačném případě není nativní soft delete podporováno podle návrhu.
Konfigurace nativního obnovitelného odstranění
V rámci Blob Storage, když povolíte měkké mazání podle požadavků, nastavte zásady uchovávání na hodnotu, která je mnohem vyšší než plán intervalu indexeru. Pokud dojde k problému se spuštěním indexeru nebo pokud máte velký počet dokumentů k indexování, je dostatek času, aby indexer nakonec zpracoval měkce smazané soubory. Indexery služby Azure AI Vyhledávač odstraní dokument z indexu jenom tehdy, když zpracovávají objekt blob ve stavu měkkého odstranění.
Ve službě Azure AI Vyhledávač nastavte nativní zásady detekce obnovitelného odstranění objektů blob ve zdroji dat. Můžete to udělat buď z webu Azure Portal, nebo pomocí rozhraní REST API. Následující pokyny vysvětlují, jak nastavit zásady detekce odstranění na webu Azure Portal nebo prostřednictvím rozhraní REST API.
Na webu Azure Portal přejděte do vyhledávací služby.
Na stránce Přehled služby Azure AI Vyhledávač klikněte na Nový zdroj dat. Je to vizuální editor pro určení definice zdroje dat.
Následující snímek obrazovky ukazuje, kde tuto funkci najdete na webu Azure Portal.
Ve formuláři Nový zdroj dat vyplňte požadovaná pole, zaškrtněte Sledovat odstranění a zvolte Nativní měkké odstranění objektu blob. Vyberte Uložit pro aktivaci funkce pro vytvoření zdroje dat.
Přeindexování neodstraněných objektů blob pomocí nativních zásad softwarového mazání
Pokud obnovíte měkce odstraněný objekt blob ve službě Blob Storage, indexer ho nemusí vždy reindexovat. Důvodem je to, že indexer používá časové razítko objektu blob LastModified k určení, jestli je indexování potřeba. Pokud je měkkým odstraněním objekt blob obnoven, jeho časové LastModified razítko se nezmění, takže pokud indexer už zpracoval objekty blob s novějšími LastModified časovými razítky, nepřeindexuje obnovený objekt blob.
Aby bylo zajištěno, že se neodstraněný objekt blob přeindexuje, aktualizujte jeho časové razítko LastModified. Jedním ze způsobů, jak to udělat, je opětovné uložení metadat tohoto objektu blob. Metadata nemusíte měnit, ale při opětovném ukládání metadat se aktualizuje časové razítko objektu blob LastModified , aby ho indexer věděl, že je vyzvedne.
Strategie měkkého odstranění s využitím vlastních metadat
Tato metoda používá vlastní metadata k označení, zda má být vyhledávací dokument odebrán z indexu. Vyžaduje dvě samostatné akce: odstranění vyhledávacího dokumentu z indexu následované odstraněním souboru ve službě Azure Storage.
Tato funkce je obecně dostupná.
V Azure Storage i službě Azure AI Vyhledávač je potřeba postupovat podle kroků, ale neexistují žádné další závislosti funkcí.
Ve službě Azure Storage přidejte do souboru vlastní metadatovou dvojici klíč-hodnota, která přímo označuje soubor ke smazání. Můžete například pojmenovat vlastnost IsDeleted, která je nastavená na hodnotu false. Pokud chcete soubor odstranit, změňte ho na true.
Ve službě Azure AI Vyhledávač upravte definici zdroje dat tak, aby zahrnovala vlastnost dataDeletionDetectionPolicy. Následující zásada například považuje soubor za odstraněný, pokud má vlastnost
IsDeletedmetadat s hodnotoutrue:PUT https://[service name].search.windows.net/datasources/file-datasource?api-version=2026-04-01 { "name" : "file-datasource", "type" : "azurefile", "credentials" : { "connectionString" : "<your storage connection string>" }, "container" : { "name" : "my-share", "query" : null }, "dataDeletionDetectionPolicy" : { "@odata.type" :"#Microsoft.Azure.Search.SoftDeleteColumnDeletionDetectionPolicy", "softDeleteColumnName" : "IsDeleted", "softDeleteMarkerValue" : "true" } }Spusťte indexer. Jakmile indexer zpracuje soubor a odstraní dokument z indexu vyhledávání, můžete fyzický soubor odstranit ve službě Azure Storage.
Přeindexovat neodstraněné bloky a soubory
Měkké vymazání můžete vrátit zpět, pokud původní zdrojový soubor stále fyzicky existuje ve službě Azure Storage.
Změňte
"softDeleteMarkerValue" : "false"na blob nebo soubor ve službě Azure Storage.Zkontrolujte časové razítko objektu blob nebo souboru
LastModifieda ověřte, že je novější než poslední spuštění indexeru. Aktualizaci aktuálního data a času můžete vynutit opětovným uložením existujících metadat.Spusťte indexer.
Omezení
Nativní obnovitelné odstranění objektu blob ani obnovitelné odstranění prostřednictvím vlastních metadat neplatí při použití scénářů indexování 1:N . Chcete-li odstranit položku dokumentu, musíte odeslat žádost o odstranění do indexu pomocí operace odstranění rozhraní REST API.