Note
Azure AI 搜尋服務 可透過 Azure 入口網站、REST API 及 Azure SDK 取得。 它同時也是 Foundry IQ 的基礎,這是一個管理式知識層,能將企業內容轉化為可重複使用、權限感知的知識庫,供 Microsoft Foundry 入口網站中的代理使用。
使用索引子擷取可搜尋的 Blob 文字或檔案內容以進行全文檢索搜尋時,您可以指派剖析模式,以取得更好的索引結果。 根據預設,索引子會將 Blob 的 content 屬性剖解析為單一文字區塊。 不過,如果所有 Blob 和檔案都包含相同編碼的純文字,您可以使用 text 解析模式,大幅改善索引效能。
推薦的 text 解析包括以下任一特性:
- 檔案類型為
.txt - 檔案是任何類型,但內容本身是文字 (例如,程式原始碼、HTML、XML 等)。 對於標記語言的檔案,語法字元會以靜態文字的形式出現。
回想一下,所有索引子都會序列化為 JSON。 依預設,整個文字檔的內容會在一個大欄位內編製索引,作為 "content": "<file-contents>"。 換行符和傳回指令會內嵌在內容欄位中,並表示為 \r\n\。
如果您想要更精緻或更細緻的結果,且檔案類型是否相容,請考慮以下解決方案:
-
delimitedText剖析模式,如果來源是CSV -
jsonArray或jsonLines,如果來源是 JSON
將內容分解為多個部分的另一種第三種選擇需要 人工智慧豐富形式的進階功能。 它添加了識別文件塊並將其分配給不同搜索字段的分析。 您可能會透過實體辨識或關鍵字擷取等 內建技能 找到完整或部分解決方案,但更可能的解決方案可能是自訂學習模型,以瞭解您的內容,並包裝在 自訂技能中。
設定純文字索引
若要為純文字 Blob 編製索引,請在parsingMode要求中建立或更新一個索引器定義,將組態屬性text設為。
PUT https://[service name].search.windows.net/indexers/[indexer name]?api-version=2026-04-01
Content-Type: application/json
api-key: [admin key]
{
... other parts of indexer definition
"parameters" : { "configuration" : { "parsingMode" : "text" } }
}
依預設,UTF-8 被假設為編碼。 若要指定不同的編碼,請使用 encoding 組態內容。 支援的編碼清單在.NET 5 及更高版本支援的資料行中。
{
... other parts of indexer definition
"parameters" : { "configuration" : { "parsingMode" : "text", "encoding" : "iso-8859-1" } }
}
範例請求
剖析模式是在索引子定義中指定。
POST https://[service name].search.windows.net/indexers?api-version=2026-04-01
Content-Type: application/json
api-key: [admin key]
{
"name" : "my-plaintext-indexer",
"dataSourceName" : "my-blob-datasource",
"targetIndexName" : "my-target-index",
"parameters" : { "configuration" : { "parsingMode" : "delimitedText", "delimitedTextHeaders" : "id,datePublished,tags" } }
}