Poznámka:
Přístup k této stránce vyžaduje autorizaci. Můžete se zkusit přihlásit nebo změnit adresáře.
Přístup k této stránce vyžaduje autorizaci. Můžete zkusit změnit adresáře.
Note
Azure AI Vyhledávač je k dispozici prostřednictvím portálu Azure, rozhraní REST API a Sady Azure SDK. Podporuje také Foundry IQ, spravovanou znalostní vrstvu, která transformuje podnikový obsah na opakovaně použitelné znalostní báze s podporou oprávnění pro agenty na portálu Microsoft Foundry.
Platí pro: Indexery blobů, Indexery souborů (ve verzi Preview)
Při použití indexeru k extrakci prohledávatelného textu objektu blob nebo obsahu souboru pro fulltextové vyhledávání můžete přiřadit režim analýzy, abyste získali lepší výsledky indexování. Ve výchozím nastavení indexer parsuje vlastnost objektu blob content jako jeden blok textu. Pokud ale všechny objekty blob a soubory obsahují prostý text ve stejném kódování, můžete výrazně zlepšit výkon indexování pomocí text režimu analýzy.
Mezi doporučení pro text analýzu patří některé z následujících charakteristik:
- Typ souboru je
.txt - Soubory jsou libovolného typu, ale samotný obsah je text (například zdrojový kód programu, HTML, XML atd.). U souborů ve značkovacím jazyce se znaky syntaxe zobrazují jako statický text.
Vzpomeňte si, že všechny indexery serializují do formátu JSON. Ve výchozím nastavení je obsah celého textového souboru indexován v rámci jednoho velkého pole jako "content": "<file-contents>". Nové řádky a návratové instrukce jsou vloženy do pole obsahu a vyjádřeny jako \r\n\.
Pokud chcete rafinovanější nebo podrobnější výsledek a pokud je typ souboru kompatibilní, zvažte následující řešení:
-
delimitedTextrežim analýzy, pokud je zdrojem CSV -
jsonArraynebojsonLines, pokud je zdrojem JSON
Alternativní třetí možnost rozdělení obsahu do více částí vyžaduje pokročilé funkce ve formě rozšiřování AI. Přidává analýzu, která identifikuje a přiřadí bloky souboru k různým vyhledávacím polím. Úplné nebo částečné řešení můžete najít prostřednictvím integrovaných dovedností , jako je rozpoznávání entit nebo extrakce klíčových slov, ale pravděpodobnějším řešením může být vlastní výukový model, který rozumí vašemu obsahu zabaleným do vlastní dovednosti.
Nastavení indexování ve formátu prostého textu
Pokud chcete indexovat objekty blob ve formátu prostý text, vytvořte nebo aktualizujte definici indexeru parsingMode s vlastností konfigurace nastavenou text v dotazu Create Indexer.
PUT https://[service name].search.windows.net/indexers/[indexer name]?api-version=2026-04-01
Content-Type: application/json
api-key: [admin key]
{
... other parts of indexer definition
"parameters" : { "configuration" : { "parsingMode" : "text" } }
}
Kódování UTF-8 se ve výchozím nastavení předpokládá. Pokud chcete zadat jiné kódování, použijte encoding vlastnost konfigurace. Podporovaný seznam kódování je ve sloupci podpory .NET 5 a novější .
{
... other parts of indexer definition
"parameters" : { "configuration" : { "parsingMode" : "text", "encoding" : "iso-8859-1" } }
}
Požadavek příkladu
Režimy analýzy se zadají v definici indexeru.
POST https://[service name].search.windows.net/indexers?api-version=2026-04-01
Content-Type: application/json
api-key: [admin key]
{
"name" : "my-plaintext-indexer",
"dataSourceName" : "my-blob-datasource",
"targetIndexName" : "my-target-index",
"parameters" : { "configuration" : { "parsingMode" : "delimitedText", "delimitedTextHeaders" : "id,datePublished,tags" } }
}