Indexování obsahu z SharePoint v Microsoft 365 (Preview)

Poznámka

Azure AI Vyhledávač je k dispozici prostřednictvím portálu Azure, rozhraní REST API a Sady Azure SDK. Podporuje také Foundry IQ, spravovanou znalostní vrstvu, která transformuje podnikový obsah na opakovaně použitelné znalostní báze s podporou oprávnění pro agenty na portálu Microsoft Foundry.

Důležité

Na funkce, možnosti nebo vlastnosti označené jako (Preview) se nevztahuje smlouva o úrovni služeb, nejsou doporučené pro produkční úlohy a mohou se změnit nebo být omezeny dříve, než budou obecně k dispozici. Podmínky Azure AI Vyhledávač Preview platí pro všechny funkce ve verzi Preview, ať už jsou samostatné nebo součástí obecně dostupné funkce.

Důležité

Tyto funkce podporují připojení k jiným služby Microsoft a službám třetích stran. Použití těchto služeb podléhá vlastním podmínkám jednotlivých služeb a může vést ke zpracování nebo ukládání dat mimo hranici souladu Azure, stejně jako k toku dat do hranice souladu Azure.

Je vaší zodpovědností spravovat, jestli budou vaše data přetékat mimo dodržování předpisů a geografické hranice vaší organizace a případné související důsledky a že se zřídí příslušná oprávnění, hranice a schválení.

Zodpovídáte za pečlivou kontrolu a testování aplikací, které vytváříte v kontextu konkrétních případů použití, a za veškerá vhodná rozhodnutí a přizpůsobení. To zahrnuje implementaci vlastního zodpovědného zmírnění rizik umělé inteligence, jako jsou metaprompty, filtry obsahu nebo jiné bezpečnostní systémy, a zajištění toho, aby vaše aplikace splňovaly příslušné standardy kvality, spolehlivosti, zabezpečení a důvěryhodnosti. Další informace najdete v informacích o transparentnosti Azure AI Vyhledávač.

SharePoint v indexeru Microsoft 365 (Preview) importuje dokumenty z knihoven dokumentů SharePoint a umožňuje je prohledávat v Azure AI Vyhledávač. Nejprve jsou kroky konfigurace následované chováním a scénáři.

V Azure AI Vyhledávač indexer extrahuje prohledávatelná data a metadata ze zdroje dat. SharePoint v indexeru Microsoft 365 poskytuje následující funkce:

  • Indexuje soubory a metadata z jedné nebo více knihoven dokumentů.
  • Indexuje seznamy služby SharePoint a hodnoty polí jejich položek, přičemž každý sloupec seznamu je k dispozici jako zdrojové pole pro mapování polí. Tato funkce je dostupná ve verzi Preview od REST API verze 2026-05-01-preview.
  • Indexuje stránky webu ASPX (moderní stránky webu). Tato funkce je dostupná ve verzi Preview od REST API verze 2026-05-01-preview.
  • Indexuje smíšený obsah SharePoint (knihovny dokumentů, seznamy a stránky webu) v jednom indexeru pomocí hodnoty kontejneru allSiteContent. Tato funkce je dostupná ve verzi Preview od REST API verze 2026-05-01-preview.
  • Indexuje obsah mezi podřízenými weby, pokud includeSubsites=true je nastaven v dotazu zdroje dat. Tato funkce je dostupná ve verzi Preview od REST API verze 2026-05-01-preview.
  • Indexuje přírůstkově a zahrnuje pouze nové a změněné soubory, položky seznamu, stránky a metadata.
  • Rozpozná odstraněný obsah automaticky. Při dalším spuštění indexeru se zjistí odstranění souborů, položek seznamu nebo stránek a příslušný vyhledávací dokument se odebere z indexu.
  • Automaticky extrahuje text a normalizované obrázky z indexovaných dokumentů. Volitelně můžete přidat sadu dovedností pro hlubší rozšiřování umělé inteligence, jako je optické rozpoznávání znaků (OCR) nebo rozpoznávání entit.
  • Podporuje příjem základních seznamů řízení přístupu (ACL) dokumentů ve verzi Preview. Od verze 2026-05-01-preview se zjistí a postupně aktualizují změny seznamu ACL u každého úspěšného spuštění indexeru pro položky s jedinečnými oprávněními. Tato verze také rozšiřuje ingestaci ACL na položky seznamu, webové stránky ASPX a skupiny SharePointu. Upozornění a kroky konfigurace najdete v tématu Použití indexeru SharePoint k ingestování metadat oprávnění.
  • Podporuje příjem a zohlednění popisků citlivosti Microsoft Purview v době dotazu. Tato funkce je ve verzi Preview.

Požadavky

Volba nastavení oprávnění

Před vytvořením registrace aplikace v kroku 3 identifikujte váš scénář v následující tabulce. Poznamenejte si požadovaná oprávnění Microsoft Graph, oprávnění rozhraní API SharePoint a typ přihlašovacích údajů. Pak je použijte podle propojených kroků dále v tomto článku.

Scenario Oprávnění pro Microsoft Graph oprávnění rozhraní API SharePoint Credential Použít v
Indexovat pouze knihovny dokumentů, bez načítání ACL Files.Read.All, Sites.Read.All (aplikace) nebo delegované ekvivalenty None Tajný klíč klienta (aplikace) nebo kód zařízení (delegovaný) Krok 3, krok 6
Seznamy indexu, stránky ASPX nebo smíšený obsah (bez načítání ACL) Files.Read.All, Sites.Read.All (aplikace) None Tajný klíč klienta nebo federované přihlašovací údaje Krok 3
Příjem ACL nebo řešení doby dotazování SharePoint skupin webů Podívejte se na matici oprávnění ACL. Podívejte se na matici oprávnění ACL. Podívejte se na matici oprávnění ACL. Scénář oprávnění pomocí ACL

Při nastavování oprávnění zvažte následující informace:

  • Delegovaná oprávnění se dají použít jenom pro malé testování a nepodporují příjem seznamů ACL.
  • Federovaný přihlašovací údaj je doporučeným způsobem ověřování bez použití tajných údajů. Zahrnuje jak ověřování indexeru, tak překlad skupin SharePointu při dotazování.
  • Při použití Sites.Selected udělte aplikaci explicitní přístup ke každému cílovému SharePoint webu před indexováním. Souhlas správce pro Sites.Selected v Microsoft Entra ID sám o sobě aplikaci neuděluje oprávnění k přístupu k obsahu webu. Musíte také přiřadit oprávnění na každém cílovém webu. Pokud do zdroje dat přidáte web bez explicitního udělení oprávnění webu, indexer selže. Viz Udělení přístupu k webu při použití Sites.Selected.

Podporované formáty dokumentů

SharePoint v indexeru Microsoft 365 může extrahovat text z následujících formátů dokumentu:

Omezení a důležité informace

Tady jsou omezení této funkce:

  • OneNote soubory poznámkového bloku se nepodporují.

  • Omezení přírůstkového indexování:

    • Přejmenování složky SharePoint přeruší přírůstkové indexování. Přejmenovaná složka se považuje za nový obsah.

    • Microsoft 365 procesy, které aktualizují SharePoint metadata systému souborů, můžou aktivovat přírůstkové indexování, i když nedojde k žádným dalším změnám obsahu. Před tím, než se budete spoléhat na rozšíření indexeru nebo AI, otestujte nastavení. Ověřte, jak Microsoft 365 zpracovává vaše dokumenty.

  • Omezení zabezpečení:

Při používání této funkce je potřeba vzít v úvahu následující skutečnosti:

  • Pokud chcete vytvořit vlastní aplikaci Copilot nebo generaci rozšířenou o načítání (RAG), která komunikuje s daty SharePoint pomocí Azure AI Vyhledávač, Microsoft doporučuje použít vzdálený zdroj znalostí SharePoint. Tento zdroj znalostí používá rozhraní API pro načítání Copilot k dotazování textového obsahu přímo z SharePoint v Microsoft 365 a vrací výsledky do modulu načítání agentů pro sloučení, řazení a formulaci odpovědí. Tento zdroj znalostí nepoužívá žádný vyhledávací index a jsou dotazovány pouze textové obsahy. Azure AI Vyhledávač nereplikuje data. Vynucuje model oprávnění SharePoint vrácením pouze výsledků, které má každý uživatel oprávnění k zobrazení.

  • Pokud potřebujete vytvořit vlastní aplikaci Copilot/RAG nebo agenta AI pro chatování s daty SharePoint v produkčních prostředích, zvažte jeho vytvoření napřed přímo prostřednictvím Microsoft Copilot Studio. Pokud Copilot Studio nevyhovuje vašim potřebám, zvažte:

Bez ohledu na to, který přístup zvolíte, bez ohledu na to, jestli vytváříte vlastní konektor s SharePoint webhooky nebo vytváříte pracovní postup Azure Logic Apps, nezapomeňte implementovat robustní bezpečnostní opatření. Mezi tato opatření patří konfigurace sdílených privátních propojení, nastavení firewalů a zachování uživatelských oprávnění ze zdroje a omezování těchto oprávnění při dotazování. Měli byste také pravidelně auditovat a monitorovat svůj pipeline.

Pokud indexujete ACL v SharePointu, projděte si podporované vztahy mezi skupinami. Skupiny Microsoft Entra vnořené do skupin SharePoint se nerozšiřují.

Konfigurace SharePoint v indexeru Microsoft 365

K nastavení SharePoint v indexeru Microsoft 365 použijte rozhraní REST API ve verzi Preview. Tato část obsahuje kroky.

(Volitelné) Krok 1: Povolení spravované identity přiřazené systémem

Povolte spravovanou identitu přiřazenou systémem, aby automaticky rozpoznala tenant Microsoft Entra, ve kterém je vyhledávací služba nasazená.

Tento krok proveďte, pokud jsou web SharePointu a vyhledávací služba ve stejném tenantovi služby Microsoft Entra. Tento krok přeskočte, pokud jsou v různých tenantech Microsoft Entra. Identita se používá k detekci tenanta. Tento krok můžete také přeskočit, pokud chcete do připojovací řetězec vložit ID tenanta Microsoft Entra. Pokud chcete pro indexování bez tajných kódů použít spravovanou identitu přiřazenou systémem nebo přiřazenou uživatelem, nakonfigurujte oprávnění aplikace s ověřováním bez tajných kódů.

Snímek obrazovky znázorňující povolení spravované identity přiřazené systémem

Po výběru možnosti Uložit obdržíte ID objektu přiřazené vaší vyhledávací službě.

Krok 2: Rozhodnutí, která oprávnění indexer vyžaduje

Rozhodovací matici, která pokrývá scénáře s ACL i bez ACL, najdete v článku Výběr nastavení oprávnění. Pokud zvolíte delegovaná oprávnění, platnost uživatelsky delegovaných tokenů vyprší po 75 minutách a po vypršení jejich platnosti je nutné provést ruční indexování pomocí Run Indexer (preview). Delegovaná oprávnění se doporučují jenom pro malé testovací operace.

Krok 3: Vytvoření registrace Microsoft Entra aplikace

SharePoint v indexeru Microsoft 365 používá k ověřování Microsoft Entra aplikaci. Před konfigurací oprávnění a přihlašovacích údajů vytvořte registraci aplikace.

  1. Přihlaste se k portálu Azure.

  2. Vyhledejte nebo přejděte na Microsoft Entra ID.

  3. Na stránce Přehled vyberte + Přidat>registraci aplikace.

    1. Zadejte název aplikace.
    2. Vyberte pouze jednoho tenanta – název tenanta.
    3. Přeskočte krok označení identifikátoru URI. Není vyžadováno žádné URI pro přesměrování.
    4. Vyberte Zaregistrovat.
  4. V levém podokně vyberte Spravovat>oprávnění rozhraní API.

  5. Vyberte + Přidat oprávnění a pak vyberte Microsoft Graph.

    • Pokud váš indexer používá oprávnění rozhraní API aplikace, vyberte Oprávnění aplikace.

      • Pro standardní indexování vyberte:

        • Files.Read.All
        • Sites.Read.All

        Snímek obrazovky s oprávněními rozhraní API aplikace

      • Pokud povolujete příjem dat ACL (Preview), požadovaná oprávnění závisí na typech položek (soubory knihovny dokumentů, položky seznamu, stránky ASPX) a typech skupin (Microsoft Entra oproti SharePoint skupinám webů), které indexujete. Než tento krok dokončíte, viz Scénář oprávnění podle ACL. Souhrn napříč scénáři najdete v článku Výběr konfigurace oprávnění.

        Použití oprávnění aplikace znamená, že indexer přistupuje k webu SharePoint v kontextu služby. Proto při spuštění indexeru má přístup ke všemu obsahu v tenantovi SharePoint, který vyžaduje schválení správce tenanta. Pro ověřování se také vyžaduje tajný klíč klienta nebo konfigurace bez tajných kódů. Nastavení mechanismu ověřování je popsáno dále v tomto článku v části Dostupné metody ověřování pouze pro oprávnění rozhraní API aplikace.

    • Pokud váš indexer používá delegovaná oprávnění rozhraní API, vyberte Delegovaná oprávnění a pak vyberte:

      • Files.Read.All
      • Sites.Read.All
      • User.Read

      Snímek obrazovky s delegovanými oprávněními rozhraní API

      Delegovaná oprávnění umožňují klientovi vyhledávání připojit se k SharePoint pod identitou zabezpečení aktuálního uživatele.

  6. Vyberte možnost Udělit souhlas administrátora pro název tenanta.

    Souhlas správce tenanta se vyžaduje při použití oprávnění rozhraní API aplikace. Někteří tenanti jsou uzamčeni takovým způsobem, že pro delegovaná oprávnění rozhraní API se vyžaduje také souhlas správce tenanta. Pokud platí některý z podmínek, musí správce tenanta před vytvořením indexeru udělit souhlas pro tuto Microsoft Entra aplikaci.

    Snímek obrazovky zobrazující udělení správcovského souhlasu aplikaci Microsoft Entra.

  7. V levém podokně vyberte Spravovat>Ověřování (Preview).

  8. Na kartě Konfigurace identifikátoru URI přesměrování vyberte + Přidat identifikátor URI přesměrování.

    1. Vyberte Mobilní a desktopové aplikace.
    2. Vyberte identifikátor URI pro přesměrování https://login.microsoftonline.com/common/oauth2/nativeclient.
    3. Vyberte Konfigurovat.
  9. Na kartě Nastavení zapněte přepínač Povolit toky veřejného klienta a potom vyberte Uložit.

  10. Nakonfigurujte metodu ověřování indexeru podle potřeb vašeho řešení.

Udělení přístupu k webu při použití Sites.Selected

Pokud nakonfigurujete registraci aplikace pomocí Sites.Selected, před spuštěním indexeru proveďte následující kroky. Souhlas správce pro Sites.Selected Microsoft Entra ID umožňuje aplikaci používat jenom vymezená oprávnění SharePoint. Neuděluje přístup k žádnému webu, dokud nepřiřadíte oprávnění k webu samostatně.

  1. V Microsoft Entra ID: Přidejte Sites.Selected do registrace aplikace a udělte souhlas správce. Přidejte oprávnění v části rozhraní API, které váš scénář vyžaduje, například Microsoft Graph a v případě scénářů ingestace seznamů ACL také SharePoint.

  2. V SharePoint: Přiřaďte aplikaci roli oprávnění na každém cílovém webu. Pro indexování obsahu udělte alespoň přístup pro čtení.

    Pokud chcete udělit oprávnění webu, použijte Microsoft Graph. Nahraďte {siteId} ID svého webu:

    POST https://graph.microsoft.com/v1.0/sites/{siteId}/permissions
    Content-Type: application/json
    
    {
      "roles": ["read"],
      "grantedToIdentities": [
        {
          "application": {
            "id": "<application-client-id>",
            "displayName": "<application-display-name>"
          }
        }
      ]
    }
    

    Udělení stejného oprávnění pomocí PowerShellu PnP:

    Grant-PnPEntraIDAppSitePermission `
      -AppId "<application-client-id>" `
      -DisplayName "<application-display-name>" `
      -Site "https://<tenant>.sharepoint.com/sites/<site-name>" `
      -Permissions Read
    

Dostupné metody ověřování pouze pro oprávnění rozhraní API aplikace

K ověření Microsoft Entra aplikace s oprávněními aplikace používá indexer buď tajný klíč klienta, nebo konfiguraci bez tajných kódů.

Použití tajného klíče klienta

Tyto pokyny nakonfigurují aplikaci tak, aby používala tajný klíč klienta k ověření indexeru, aby mohl ingestovat data z SharePoint.

  • V nabídce vlevo vyberte Certifikáty a tajné kódy a pak vyberte Tajné kódy klienta a Nový tajný klíč klienta.

    Snímek obrazovky zobrazující nový tajný klíč klienta

  • V nabídce, která se zobrazí, zadejte popis nového tajného klíče klienta. V případě potřeby upravte datum vypršení platnosti. Pokud vyprší platnost tajného kódu, musíte ho znovu vytvořit a aktualizovat indexer novým tajným kódem.

    Snímek obrazovky znázorňující, jak nastavit tajný klíč klienta

  • Nový tajný klíč klienta se zobrazí v seznamu tajných kódů. Jakmile přejdete mimo stránku, tajný kód není viditelný, zkopírujte hodnotu pomocí tlačítka kopírování a uložte ho do zabezpečeného umístění.

    Snímek obrazovky znázorňující, kde kopírovat tajný klíč klienta

Získání tokenů aplikace s využitím ověřování bez tajných kódů

K přihlášení bez tajného klíče klienta použijte federované přihlašovací údaje. Microsoft Entra důvěřuje spravované identitě k získání tokenu aplikace, takže indexer může ingestovat data z SharePoint bez uloženého tajného kódu. Další část vás provede konfigurací spravované identity.

Konfigurace registrované aplikace se spravovanou identitou

  1. Vytvořte (nebo vyberte) uživatelsky přiřazenou spravovanou identitu a přiřaďte ji ke své vyhledávací službě nebo systémově přiřazenou spravovanou identitu, v závislosti na požadavcích vašeho scénáře.

  2. Zachyťte ID objektu (hlavního). Tuto hodnotu použijte jako součást konfigurace přihlašovacích údajů při vytváření zdroje dat.

  3. V nabídce vlevo vyberte Certifikáty a tajné kódy .

  4. V části Federované přihlašovací údaje vyberte + Přidat přihlašovací údaje.

  5. V části Scénář federovaných přihlašovacích údajů vyberte Spravovanou identitu.

  6. Výběr spravované identity: Zvolte spravovanou identitu vytvořenou v kroku 1.

  7. Přidejte název přihlašovacích údajů a vyberte Uložit.

Krok 4: Vytvoření zdroje dat

Počínaje touto částí použijte nejnovější rozhraní REST API verze Preview a klienta REST nebo nejnovější podporovanou beta sadu SDK pro zbývající kroky.

Zdroj dat určuje, která data se mají indexovat, přihlašovací údaje a zásady pro efektivní identifikaci změn v datech (nové, změněné nebo odstraněné řádky). Stejný zdroj dat může používat více indexerů ve stejné vyhledávací službě.

Pro SharePoint indexování musí zdroj dat mít následující požadované vlastnosti:

  • name je jedinečný název zdroje dat ve vaší vyhledávací službě.
  • typ musí být "SharePoint". U této hodnoty se rozlišují malá a velká písmena.
  • credentials zadejte koncový bod SharePoint a metodu ověřování povolenou aplikacím požadovat tokeny Microsoft Entra. Příkladem SharePoint koncového bodu je https://[your-tenant-name].sharepoint.com/teams/MySharePointSite. Koncový bod můžete získat tak, že přejdete na domovskou stránku webu SharePoint a zkopírujete adresu URL z prohlížeče. Informace o podporované syntaxi najdete ve formátu připojovací řetězec.
  • kontejner určuje, která knihovna dokumentů se má indexovat. Vlastnosti určují, které dokumenty jsou indexovány.

Pokud chcete vytvořit zdroj dat, zavolejte vytvořit zdroj dat (Preview).

Tady je ukázka definice zdroje dat pro přihlašovací údaje s tajným kódem aplikace nebo spravovanou identitou přiřazenou systémem.

POST https://[service name].search.windows.net/datasources?api-version=2026-08-01-preview
Content-Type: application/json
api-key: [admin key]

{
    "name" : "sharepoint-datasource",
    "type" : "sharepoint",
    "credentials" : { "connectionString" : "[connection-string]" },
    "container" : { "name" : "defaultSiteLibrary", "query" : null }
}

Konfigurace federovaných přihlašovacích údajů vyžadují FederatedCredentialApplicationId v připojovací řetězec. Hodnota se liší podle typu identity:

  • Spravovaná identita přiřazená systémem: Nastavte FederatedCredentialApplicationId na ID aplikace spravované identity přiřazené systémem (klient). Vynechat identity blok.
  • Spravovaná identita přiřazená uživatelem: Do bloku identity zadejte cestu k prostředku spravované identity přiřazené uživatelem. Nastavte FederatedCredentialApplicationId na ID vlastní aplikace (klienta) spravované identity přiřazené uživatelem.

Poznámka

ApplicationId a FederatedCredentialApplicationId jsou různé hodnoty. ApplicationId je vaše registrovaná aplikace Entra pro ingestaci dat, která má oprávnění pro SharePoint. FederatedCredentialApplicationId je ID aplikace (klienta) samotné spravované identity, což je entita, jejíž token prokáže identitu spravované identity.

POST https://[service name].search.windows.net/datasources?api-version=2026-08-01-preview
Content-Type: application/json
api-key: [admin key]

{
    "name" : "sharepoint-datasource",
    "type" : "sharepoint",
    "credentials" : { "connectionString" : "[connection-string]" },
    "container" : { "name" : "defaultSiteLibrary", "query" : null },
    "identity": {
      "@odata.type": "#Microsoft.Azure.Search.DataUserAssignedIdentity",
      "userAssignedIdentity": "/subscriptions/[Azure subscription ID]/resourceGroups/[resource-group]/providers/Microsoft.ManagedIdentity/userAssignedIdentities/[user-assigned managed identity]"
    }
}

Formát připojovacího řetězce

Formát připojovací řetězec se mění podle toho, jestli indexer používá delegovaná oprávnění rozhraní API nebo oprávnění rozhraní API aplikace.

  • Formát připojovacího řetězce pro delegovaná oprávnění rozhraní API

    SharePointOnlineEndpoint=[SharePoint site URL];ApplicationId=[Microsoft Entra application ID];TenantId=[SharePoint site's Microsoft Entra tenant ID]

  • Formát připojovací řetězec s tajným kódem aplikace pro oprávnění rozhraní API aplikace

    SharePointOnlineEndpoint=[SharePoint site URL];ApplicationId=[Microsoft Entra application ID];ApplicationSecret=[Microsoft Entra application client secret];TenantId=[SharePoint site's Microsoft Entra tenant ID]

  • Oprávnění rozhraní API aplikace s připojovacím řetězcem bez tajného kódu (přihlašovací údaje federované identity):

    SharePointOnlineEndpoint=[SharePoint site URL];ApplicationId=[Microsoft Entra application ID];FederatedCredentialApplicationId=[managed identity's application (client) ID];TenantId=[SharePoint site's Microsoft Entra tenant ID]

Následující tabulka popisuje každé pole připojovací řetězec.

Pole Povinné Popis
SharePointOnlineEndpoint Ano SharePoint adresu URL webu (například https://[your-tenant-name].sharepoint.com).
ApplicationId Ano ID aplikace (klienta) Microsoft Entra aplikace pro příjem dat. Musí být platný identifikátor GUID.
TenantId Volitelné Microsoft Entra ID tenanta (GUID) pro tenanta, který vlastní web SharePoint. Tento tenant nemusí být nutně tenant Microsoft Entra přidružený k vyhledávací službě. Vyžaduje se, když jsou web SharePointu a vyhledávací služba v různých tenantech Microsoft Entra.
ApplicationSecret Conditional Tajný kód klienta aplikace pro příjem dat. Používá se pro ověřování na základě tajných kódů.
FederatedCredentialApplicationId Podmíněný (přihlašovací údaje federované identity) Microsoft Entra ID aplikace (klienta) použité k ověření spravované identity. Musí být platný identifikátor GUID. Pro spravovanou identitu přiřazenou systémem použijte ID aplikace (klienta) této identity. Pro uživatelem přiřazenou spravovanou identitu použijte vlastní ID aplikace (klienta) dané identity. Pro spravovanou identitu přiřazenou uživatelem napříč tenanty s federatedIdentityClientId nastavenou v identity bloku použijte ID klienta aplikace s více tenanty.

Důležité

FederatedCredentialApplicationId a ApplicationSecret vzájemně se vylučují. Připojovací řetězce, které je kombinují, jsou odmítnuty při vytváření nebo aktualizaci zdroje dat.

Při nastavování oprávnění zvažte následující informace:

Kvůli zpětné kompatibilitě indexer SharePointu stále přijímá FederatedCredentialObjectId (ID objektu / objektu zabezpečení přihlašovacích údajů federované identity v ingestní aplikaci) v připojovacím řetězci, takže stávající zdroje dat budou i nadále fungovat beze změn. Použijte FederatedCredentialApplicationId pro nové a aktualizované zdroje dat.

Pokud chcete získat TenantId, otevřete centrum pro správu Microsoft Entra pro tenanta, který vlastní web SharePointu, a zkopírujte ID tenanta z oddílu Přehled.

Spravovanou identitu object (principal) ID můžete získat z části Konfigurace registrované aplikace se spravovanou identitou.

Při nastavování oprávnění zvažte následující informace:

Pokud jsou web SharePointu a vyhledávací služba ve stejném tenantovi Microsoft Entra a je povolená spravovaná identita přiřazená systémem, nemusíte do připojovacího řetězce zahrnout TenantId. Pokud jsou v různých tenantech Microsoft Entra, musíte uvést TenantId.

Následující příklady ukazují zdroje dat vytvořené pomocí FederatedCredentialApplicationId:

Spravovaná identita přiřazená systémem s federovanými přihlašovacími údaji:

POST https://[service name].search.windows.net/datasources?api-version=2026-08-01-preview
Content-Type: application/json
api-key: [admin key]

{
  "name": "sharepoint-ds",
  "type": "sharepoint",
  "credentials": {
    "connectionString": "SharePointOnlineEndpoint=https://[your-tenant-name].sharepoint.com;ApplicationId=[Microsoft Entra application ID];TenantId=[SharePoint site's Microsoft Entra tenant ID];FederatedCredentialApplicationId=[system-assigned managed identity's application (client) ID]"
  },
  "container": { "name": "defaultSiteLibrary" }
}

Spravovaná identita přiřazená uživatelem s federovaným přihlašovacím údajem (pro jednoho tenanta):

{
  "name": "sharepoint-uami-fed",
  "type": "sharepoint",
  "credentials": {
    "connectionString": "SharePointOnlineEndpoint=https://[your-tenant-name].sharepoint.com;ApplicationId=[Microsoft Entra application ID];TenantId=[SharePoint site's Microsoft Entra tenant ID];FederatedCredentialApplicationId=[user-assigned managed identity application (client) ID]"
  },
  "container": { "name": "defaultSiteLibrary" },
  "identity": {
    "@odata.type": "#Microsoft.Azure.Search.DataUserAssignedIdentity",
    "userAssignedIdentity": "/subscriptions/[subscription-id]/resourceGroups/[resource-group]/providers/Microsoft.ManagedIdentity/userAssignedIdentities/[uami-name]"
  }
}

Poznámka

U spravované identity přiřazené uživatelem musí být FederatedCredentialApplicationId stejné jako ID aplikace (klienta) spravované identity přiřazené uživatelem, nikoli ID aplikace pro příjem dat (ApplicationId). Pokud blok vynecháte identity , indexer se vrátí do spravované identity přiřazené systémem.

Uživatelem přiřazená spravovaná identita pro více tenantů s federovaným přihlašovacím údajem (pokročilé):

Před použitím této konfigurace se ujistěte, že vaše uživatelem přiřazená spravovaná identita je nakonfigurovaná s pověřením federované identity, které důvěřuje multitenantní aplikaci Microsoft Entra. Postup nastavení najdete v tématu Konfigurace registrované aplikace se spravovanou identitou.

{
  "name": "sharepoint-uami-crosstenantfed",
  "type": "sharepoint",
  "credentials": {
    "connectionString": "SharePointOnlineEndpoint=https://[your-tenant-name].sharepoint.com;ApplicationId=[Microsoft Entra application ID];TenantId=[SharePoint site's Microsoft Entra tenant ID];FederatedCredentialApplicationId=[multitenant app client ID]"
  },
  "container": { "name": "defaultSiteLibrary" },
  "identity": {
    "@odata.type": "#Microsoft.Azure.Search.DataUserAssignedIdentity",
    "userAssignedIdentity": "/subscriptions/[subscription-id]/resourceGroups/[resource-group]/providers/Microsoft.ManagedIdentity/userAssignedIdentities/[uami-name]",
    "federatedIdentityClientId": "[multi-tenant app client ID]"
  }
}

Konfiguraci spravované identity přiřazené uživatelem pro více tenantů použijte, když sama spravovaná identita přiřazená uživatelem navazuje federaci s multitenantní aplikací Microsoft Entra. V tomto případě nastavte federatedIdentityClientId v bloku identity na ID klienta víceklientské aplikace a FederatedCredentialApplicationId v připojovacím řetězci nastavte na ID klienta stejné víceklientské aplikace. Nastavení FederatedCredentialApplicationId na vlastní ID klienta spravované identity přiřazené uživatelem v tomto scénáři neprojde ověřením.

Pokud váš indexer používá konfiguraci seznamu ACL pro SharePoint (Preview) nebo zachovává a dodržuje popisky citlivosti Microsoft Purview (Preview), před vytvořením indexeru si přečtěte související články. Každá funkce má konkrétní postup konfigurace zdroje dat, indexu a sady dovedností.

Krok 5: Vytvoření indexu

Index určuje pole v dokumentu, atributech a dalších konstruktorech, které tvarují vyhledávací prostředí.

Pokud chcete vytvořit index, zavolejte Create Index (preview).

POST https://[service name].search.windows.net/indexes?api-version=2026-08-01-preview
Content-Type: application/json
api-key: [admin key]

{
    "name" : "sharepoint-index",
    "fields": [
        { "name": "id", "type": "Edm.String", "key": true, "searchable": false },
        { "name": "metadata_spo_item_name", "type": "Edm.String", "key": false, "searchable": true, "filterable": false, "sortable": false, "facetable": false },
        { "name": "metadata_spo_item_path", "type": "Edm.String", "key": false, "searchable": false, "filterable": false, "sortable": false, "facetable": false },
        { "name": "metadata_spo_item_content_type", "type": "Edm.String", "key": false, "searchable": false, "filterable": true, "sortable": false, "facetable": true },
        { "name": "metadata_spo_item_last_modified", "type": "Edm.DateTimeOffset", "key": false, "searchable": false, "filterable": false, "sortable": true, "facetable": false },
        { "name": "metadata_spo_item_size", "type": "Edm.Int64", "key": false, "searchable": false, "filterable": false, "sortable": false, "facetable": false },
        { "name": "content", "type": "Edm.String", "searchable": true, "filterable": false, "sortable": false, "facetable": false }
    ]
}

Důležité

Pole klíče v indexu naplněném indexerem SharePointu v Microsoftu 365 závisí na typu kontejneru ve zdroji dat:

  • Pro obsah knihovny dokumentů (defaultSiteLibraryallSiteLibrariesnebo useQuery s filtry knihoven nebo složek) použijte metadata_spo_site_library_item_id. Pokud ve zdroji dat neexistuje pole klíče, metadata_spo_site_library_item_id se automaticky mapuje na pole klíče.
  • Pro seznam, stránku nebo smíšený obsah (allSiteLists, allSitePagesnebo allSiteContent), použijte metadata_spo_site_asset_item_id. Toto klíčové pole je ve verzi Preview počínaje rozhraním REST API 2026-05-01-preview. Automatické mapování se na toto pole nevztahuje – definujte explicitní fieldMappings položku z metadata_spo_site_asset_item_id pole klíče indexu.

Použijte funkci mapování base64Encode při mapování těchto klíčových polí na pole id indexu.

Krok 6: Vytvoření indexeru

Indexer propojuje zdroj dat s cílovým vyhledávacím indexem a poskytuje plán pro automatizaci aktualizace dat. Po vytvoření zdroje dat a indexu vytvořte indexer.

Vytvoření indexeru:

  1. Odešli žádost o vytvoření indexátoru (Preview)

    POST https://[service name].search.windows.net/indexers?api-version=2026-08-01-preview
    Content-Type: application/json
    api-key: [admin key]
    
    {
        "name" : "sharepoint-indexer",
        "dataSourceName" : "sharepoint-datasource",
        "targetIndexName" : "sharepoint-index",
        "parameters": {
        "batchSize": null,
        "maxFailedItems": null,
        "base64EncodeKeys": null,
        "maxFailedItemsPerBatch": null,
        "configuration": {
            "indexedFileNameExtensions" : ".pdf, .docx",
            "excludedFileNameExtensions" : ".png, .jpg",
            "dataToExtract": "contentAndMetadata"
          }
        },
        "schedule" : { },
        "fieldMappings" : [
            { 
              "sourceFieldName" : "metadata_spo_site_library_item_id", 
              "targetFieldName" : "id", 
              "mappingFunction" : { 
                "name" : "base64Encode" 
              } 
             }
        ]
    }
    

    Pro zdroje dat, které používají hodnoty kontejneru allSiteLists, allSitePages nebo allSiteContent, namapujte metadata_spo_site_asset_item_id místo metadata_spo_site_library_item_id.

    Při použití oprávnění aplikace můžete dotazovat index, zatímco probíhá počáteční spuštění indexeru, ale pouze položky, které jsou již indexovány, vrátí výsledky. Počkejte, až se běh dokončí, pro úplné pokrytí. Zbývající pokyny v tomto kroku platí pouze pro delegovaná oprávnění.

  2. Když indexer poprvé vytvoříte, požadavek Create Indexer (Preview) počká, až dokončíte další krok. Pokud chcete získat odkaz, musíte zavolat Get Indexer Status a zadat nový kód zařízení.

    GET https://[service name].search.windows.net/indexers/sharepoint-indexer/status?api-version=2026-08-01-preview
    Content-Type: application/json
    api-key: [admin key]
    

    Pokud během 10 minut nezavoláte Získat stav indexeru , platnost kódu vyprší a musíte zdroj dat vytvořit znovu.

  3. Zkopírujte přihlašovací kód zařízení z odpovědi Získat stav indexeru . Přihlašovací kód zařízení najdete v chybové zprávě.

    {
        "lastResult": {
            "status": "transientFailure",
            "errorMessage": "To sign in, use a web browser to open the page https://microsoft.com/devicelogin and enter the code <CODE> to authenticate."
        }
    }
    
  4. Zadejte kód, který byl součástí chybové zprávy.

    Snímek obrazovky znázorňující, jak zadat kód zařízení

  5. Indexer SharePointu v Microsoftu 365 přistupuje k obsahu SharePointu pod identitou přihlášeného uživatele. Uživatel, který se přihlásí během tohoto kroku, je přihlášený uživatel. Pokud se tedy přihlásíte pomocí uživatelského účtu, který nemá přístup k dokumentu v knihovně dokumentů, kterou chcete indexovat, nebude mít indexer k danému dokumentu přístup.

    Pokud je to možné, vytvořte nový uživatelský účet organizace a udělte mu přesná oprávnění, která má indexer mít.

  6. Schvalte požadovaná oprávnění.

    Snímek obrazovky znázorňující, jak schválit oprávnění rozhraní API

  7. Počáteční požadavek Create Indexer (Preview) se dokončí, pokud jsou všechna dříve poskytnutá oprávnění správná a v rámci 10minutového časového rámce.

Při nastavování oprávnění zvažte následující informace:

Pokud aplikace Microsoft Entra vyžaduje schválení správcem a nebyla schválena před přihlášením, může se zobrazit následující obrazovka. Aby bylo potřeba pokračovat, je vyžadováno schválení správcem.

Snímek obrazovky s požadovaným schválením správce

Krok 7: Kontrola stavu indexeru

Po vytvoření indexeru zavolejte Získat stav indexeru:

GET https://[service name].search.windows.net/indexers/sharepoint-indexer/status?api-version=2026-08-01-preview
Content-Type: application/json
api-key: [admin key]
GET https://[service-name].search.windows.net/indexes/[index-name]/docs?search=*&$count=true&api-version=2026-08-01-preview
api-key: [admin-api-key]

Aktualizace zdroje dat

Pokud objekt zdroje dat neaktualizujete, indexer běží podle plánu bez zásahu uživatele.

Pokud změníte zdroj dat během vypršení platnosti kódu zařízení, přihlaste se znovu a spusťte indexer. Pokud například změníte dotaz zdroje dat, přihlaste se znovu pomocí https://microsoft.com/devicelogin kódu a získejte nový kód zařízení.

Pokud chcete aktualizovat zdroj dat, postupujte podle těchto kroků za předpokladu, že vypršela platnost kódu zařízení:

  1. Zavolejte funkci Spustit indexer (náhled) pro manuální spuštění indexeru.

    POST https://[service name].search.windows.net/indexers/sharepoint-indexer/run?api-version=2026-08-01-preview
    Content-Type: application/json
    api-key: [admin key]
    
  2. Zkontrolujte stav indexeru.

    GET https://[service name].search.windows.net/indexers/sharepoint-indexer/status?api-version=2026-08-01-preview
    Content-Type: application/json
    api-key: [admin key]
    
  3. Pokud se zobrazí chyba s výzvou k návštěvě https://microsoft.com/devicelogin, otevřete stránku a zkopírujte nový kód.

  4. Vložte kód do dialogového okna.

  5. Znovu spusťte indexer ručně a zkontrolujte stav indexeru. Tentokrát by se spuštění indexeru mělo úspěšně spustit.

Indexování metadat dokumentu

Pokud indexujete metadata dokumentu ("dataToExtract": "contentAndMetadata"), můžete k indexování použít následující metadata.

Identifikátor Typ Popis
metadata_spo_site_knihovna_id_položky Edm.String Kombinace klíče ID webu, ID knihovny a ID položky, která jednoznačně identifikuje položku v knihovně dokumentů pro web. Toto pole použijte jako indexový klíč pro hodnoty kontejneru defaultSiteLibrary, allSiteLibrariesa useQuery (filtry knihoven nebo složek).
metadata_spo_site_asset_item_id Edm.String Kombinovaný klíč, který jednoznačně identifikuje položku seznamu, stránku webu ASPX nebo jakýkoli prostředek v režimu smíšeného obsahu. Toto pole použijte jako indexový klíč pro hodnoty kontejnerů allSiteLists, allSitePages a allSiteContent. Preview, počínaje verzí REST API 2026-05-01-preview.
metadata_spo_site_id Edm.String ID webu SharePoint.
metadata_spo_library_id Edm.String ID knihovny dokumentů.
metadata_spo_item_id Edm.String ID položky (dokumentu) v knihovně.
metadata_spo_item_last_modified Edm.DateTimeOffset Datum a čas poslední změny (UTC) položky.
metadata_spo_název_položky Edm.String Název položky.
metadata_spo_velikost_položky Edm.Int64 Velikost položky (v bajtech).
metadata_spo_item_typ_obsahu Edm.String Typ obsahu položky.
metadata_spo_rozšíření_položky Edm.String Rozšíření položky.
metadata_spo_item_weburi Edm.String Identifikátor URI položky.
metadata_spo_item_path Edm.String Kombinace nadřazené cesty a názvu položky
metadata_spo_site_url Edm.String Adresa URL sharepointového webu. Vyžaduje se, když povolíte SharePoint rozlišení skupiny webů. Viz Konfigurace podpory skupin SharePointu.

SharePoint v indexeru Microsoft 365 podporuje také metadata specifická pro každý typ dokumentu. Pro více informací se podívejte na Vlastnosti metadat obsahu použitých v Azure AI Vyhledávač.

Při nastavování oprávnění zvažte následující informace:

Pokud chcete indexovat vlastní metadata, v parametru dotazu zdroje dat zadejte "additionalColumns".

Indexování SharePoint seznamů

Seznamy SharePointu je možné indexovat ve verzi Preview, a to od rozhraní REST API verze 2026-05-01-preview. Nastavte zdroj dat container.name na allSiteLists, aby se indexovaly všechny položky seznamu z webu, nebo na allSiteContent, aby se položky seznamu zkombinovaly s knihovnami dokumentů a stránkami webu v jednom indexeru. Chcete-li zahrnout seznamy podřízených webů, přidejte includeSubsites=true do souboru container.query.

U indexerů založených na seznamu nebo kombinovaném obsahu musí být pole klíče indexu namapováno z metadata_spo_site_asset_item_id. Obsah položky seznamu se zobrazí v content poli jako hodnoty polí ve formátu JSON a pro každou položku seznamu se vyplní standardní metadata_spo_item_* pole (například metadata_spo_item_name, metadata_spo_item_weburia metadata_spo_item_last_modified).

Mapování sloupců seznamu na indexová pole

Každý sloupec, který definujete na SharePoint list, se zobrazí jako zdrojové pole se stejným názvem jako sloupec SharePoint. Pomocí mapování polí namapujte každý sloupec na pole indexu.

Představte si například SharePoint list s následujícími sloupci.

Sloupec SharePoint typ sloupce SharePoint
Title Jeden řádek textu
Price Number
InStock Yes/No
Category Výběr

Přidejte odpovídající pole do definice indexu a pak namapujte každý sloupec na jeho cílové pole v indexeru:

{
  "name": "my-sharepoint-list-indexer",
  "dataSourceName": "my-sharepoint-list-ds",
  "targetIndexName": "products-index",
  "fieldMappings": [
    {
      "sourceFieldName": "metadata_spo_site_asset_item_id",
      "targetFieldName": "id",
      "mappingFunction": { "name": "base64Encode" }
    },
    { "sourceFieldName": "Title", "targetFieldName": "productName" },
    { "sourceFieldName": "Price", "targetFieldName": "price" },
    { "sourceFieldName": "InStock", "targetFieldName": "available" },
    { "sourceFieldName": "Category", "targetFieldName": "category" },
    { "sourceFieldName": "metadata_spo_item_last_modified", "targetFieldName": "lastUpdated" },
    { "sourceFieldName": "metadata_spo_item_weburi", "targetFieldName": "itemUrl" }
  ]
}

Ujistěte se, že každé cílové pole ve vašem indexu má kompatibilní typ (například Edm.String pro Title, Edm.Double nebo Edm.Int64 pro Price, Edm.Boolean pro InStock).

Indexování stránek webu ASPX

Moderní stránky webu ASPX můžete indexovat ve verzi Preview počínaje rozhraním REST API 2026-05-01-preview. Nastavte zdroj dat container.name na allSitePages pro indexaci všech stránek z webu nebo na allSiteContent pro kombinaci stránek s knihovnami dokumentů a seznamy v jednom indexeru. Chcete-li zahrnout stránky podřízeného webu, přidejte includeSubsites=true do souboru container.query.

U stránkových indexerů nebo indexerů se smíšeným obsahem musí být pole klíče indexování namapováno z metadata_spo_site_asset_item_id. Text stránky se extrahuje do content pole a pro každou stránku se vyplní standardní metadata_spo_item_* pole (například metadata_spo_item_namemetadata_spo_item_weburi, ametadata_spo_item_last_modified) .

Zahrnout nebo vyloučit podle typu souboru

Nastavte kritéria zahrnutí a vyloučení v části "parameters" definice indexeru pro řízení, které soubory jsou indexovány.

Pokud chcete zahrnout konkrétní přípony souborů, nastavte "indexedFileNameExtensions" na čárkami oddělený seznam přípon souborů začínajících tečkou. Pokud chcete vyloučit konkrétní přípony souborů, nastavte "excludedFileNameExtensions" přípony, které chcete přeskočit. Pokud se v obou seznamech zobrazí stejné rozšíření, indexer ho vyloučí z indexování.

PUT /indexers/[indexer name]?api-version=2026-08-01-preview
{
    "parameters" : { 
        "configuration" : { 
            "indexedFileNameExtensions" : ".pdf, .docx",
            "excludedFileNameExtensions" : ".png, .jpeg" 
        } 
    }
}

Určete, které dokumenty se budou indexovat

Jeden SharePoint v indexeru Microsoft 365 může indexovat obsah z jedné nebo více knihoven dokumentů. Pokud chcete určit, které weby a knihovny dokumentů se mají indexovat, použijte parametr "kontejner" v definici zdroje dat.

Oddíl "kontejner" zdroje dat má dvě vlastnosti pro tento úkol: "name" a "query".

Jméno

Vlastnost name je povinná a musí se jednat o jednu z následujících hodnot:

Hodnota Popis
defaultSiteLibrary Indexujte veškerý obsah z výchozí knihovny dokumentů webu.
všechnyKnihovnyWebu Indexuje veškerý obsah ze všech knihoven dokumentů na webu. Knihovny dokumentů z podřízeného webu jsou mimo rozsah, pokud v dotazu (Preview) nenastavíte includeSubsites=true . Můžete také zvolit useQuery a určit includeLibrariesInSite rozsah pro konkrétní weby nebo podřízené weby.
allSiteLists Indexuje všechny položky SharePoint list z webu. Preview, počínaje verzí REST API 2026-05-01-preview.
allSitePages Indexování všech moderních stránek webu ASPX z webu Preview, počínaje verzí REST API 2026-05-01-preview.
allSiteContent Indexovací knihovny, seznamy a stránky z webu v jednom indexeru Preview, počínaje verzí REST API 2026-05-01-preview.
useQuery Indexuje pouze obsah definovaný v objektu query.

Pro zdroje dat, které používají allSiteLists, allSitePages nebo allSiteContent, musí mapování pole klíče indexeru používat metadata_spo_site_asset_item_id místo metadata_spo_site_library_item_id. Podrobnosti najdete v kroku 6: Vytvoření indexeru.

Dotazu

Parametr dotazu zdroje dat se skládá z párů klíčových slov a hodnot. Použijte následující klíčová slova. Tyto hodnoty jsou adresy URL webu nebo adresy URL knihoven dokumentů.

Při nastavování oprávnění zvažte následující informace:

Pokud chcete získat hodnotu pro konkrétní klíčové slovo, přejděte do knihovny dokumentů, kterou chcete zahrnout nebo vyloučit, a zkopírujte identifikátor URI z prohlížeče. Tato metoda je nejjednodušší způsob, jak získat hodnotu, která se má použít s klíčovým slovem v dotazu.

Klíčové slovo Popis hodnot a příklady
null Pokud je hodnota null nebo prázdná, indexujte buď výchozí knihovnu dokumentů, nebo všechny knihovny dokumentů v závislosti na názvu kontejneru.

Příklad:

"container" : { "name" : "defaultSiteLibrary", "query" : null }
Zahrnout podweby Pokud je nastavená hodnota true, indexer prochází kořenový web a všechny podřízené weby. Kombinovat s allSiteLibraries, allSiteLists, allSitePagesnebo allSiteContent. Preview, počínaje verzí REST API 2026-05-01-preview.

Příklad:

"container" : { "name" : "allSiteLibraries", "query" : "includeSubsites=true" }
zahrnoutKnihovnyDoStránky Indexujte obsah ze všech knihoven v zadaném webu v připojovací řetězec. Hodnota by měla být identifikátor URI lokality nebo podřízeného webu.

Příklad 1:

"container" : { "name" : "useQuery", "query" : "includeLibrariesInSite=https://mycompany.sharepoint.com/mysite" }

Příklad 2 (zahrnout pouze několik podřízených webů):

"container" : { "name" : "useQuery", "query" : "includeLibrariesInSite=https://mycompany.sharepoint.com/sites/TopSite/SubSite1;includeLibrariesInSite=https://mycompany.sharepoint.com/sites/TopSite/SubSite2" }
ZahrnoutKnihovnu Indexuje veškerý obsah z této knihovny. Hodnota je plně kvalifikovaná cesta ke knihovně, kterou můžete zkopírovat z prohlížeče:

Příklad 1 (plně specifikovaná cesta):

"container" : { "name" : "useQuery", "query" : "includeLibrary=https://mycompany.sharepoint.com/mysite/MyDocumentLibrary" }

Příklad 2 (identifikátor URI zkopírovaný z prohlížeče):

"container" : { "name" : "useQuery", "query" : "includeLibrary=https://mycompany.sharepoint.com/teams/mysite/MyDocumentLibrary/Forms/AllItems.aspx" }
vyloučit knihovnu Neindexujte obsah z této knihovny. Hodnota je plně kvalifikovaná cesta ke knihovně, kterou můžete zkopírovat z prohlížeče:

Příklad 1 (plně specifikovaná cesta):

"container" : { "name" : "useQuery", "query" : "includeLibrariesInSite=https://mysite.sharepoint.com/subsite1; excludeLibrary=https://mysite.sharepoint.com/subsite1/MyDocumentLibrary" }

Příklad 2 (identifikátor URI zkopírovaný z prohlížeče):

"container" : { "name" : "useQuery", "query" : "includeLibrariesInSite=https://mycompany.sharepoint.com/teams/mysite; excludeLibrary=https://mycompany.sharepoint.com/teams/mysite/MyDocumentLibrary/Forms/AllItems.aspx" }
přidatSložku Indexuje obsah z konkrétní složky a jejích podsložek. Hodnota musí být úplná adresa URL složky SharePoint.

Chování: Rekurzivně se vztahuje na všechny podsložky. Více složek lze zadat opakováním parametru středníky. Filtry složek jsou omezeny na jednu knihovnu dokumentů. Kořenové cesty nejsou podporovány. Pokud je přejmenována složka odkazovaná, musí být dotaz aktualizován.

Příklad 1 (jedna složka):
"container": { "name": "useQuery", "query": "includeFolder=[your-tenant-name].sharepoint.com/sites/hr/Shared Documents/Policies" }

Příklad 2 (více složek):
"container": { "name": "useQuery", "query": "includeFolder=[your-tenant-name].sharepoint.com/sites/hr/Shared Documents/Specs;includeFolder=[your-tenant-name].sharepoint.com/sites/hr/Shared Documents/Designs" }
vyloučitSložku Neindexujte obsah z konkrétní složky a jejích podsložek. Hodnota musí být úplná adresa URL složky SharePoint.

Chování: Rekurzivně se vztahuje na všechny podsložky. Pokud se soubor shoduje s pravidly zahrnutí i vyloučení, má přednost vyloučení a soubor se přeskočí. Filtry složek jsou omezeny na jednu knihovnu dokumentů.

Příklad 1 (vyloučit složku)
"container": { "name": "useQuery", "query": "excludeFolder=[your-tenant-name].sharepoint.com/sites/hr/Shared Documents/Policies/Archive" }

Příklad 2 (kombinování zahrnutí + vyloučení):
"container": { "name": "useQuery", "query": "includeFolder=[your-tenant-name].sharepoint.com/sites/hr/Shared Documents/Policies;excludeFolder=[your-tenant-name].sharepoint.com/sites/hr/Shared Documents/Policies/Drafts" }
dalšíSloupce Indexujte sloupce z knihovny dokumentů. Hodnota je čárkami oddělený seznam názvů sloupců, které chcete indexovat. Dvojité zpětné lomítko použijte ke zpětnému lomítkování středníků a čárek v názvech sloupců.

Příklad 1 (additionalColumns=MyCustomColumn,MyCustomColumn2):

"container" : { "name" : "useQuery", "query" : "includeLibrary=https://mycompany.sharepoint.com/mysite/MyDocumentLibrary;additionalColumns=MyCustomColumn,MyCustomColumn2" }

Příklad 2 (znaky úniku pomocí dvojitého zpětného lomítka):

"container" : { "name" : "useQuery", "query" : "includeLibrary=https://mycompany.sharepoint.com/teams/mysite/MyDocumentLibrary/Forms/AllItems.aspx;additionalColumns=MyCustomColumnWith\\,,MyCustomColumnWith\\;" }

Řešte chyby

Invalid AAD tenant Informace o chybě Microsoft Entra ID tenanta nebo neshodě tenanta, které se zobrazují v historii provádění indexeru, najdete v tématu Řešení běžných chyb a upozornění indexeru.

Ve výchozím nastavení se SharePoint v indexeru Microsoft 365 zastaví, jakmile narazí na dokument s nepodporovaným typem obsahu, například obrázkem. Pomocí parametru excludedFileNameExtensions můžete přeskočit určité typy obsahu. Je však možné, že budete muset indexovat dokumenty, aniž byste předem znali všechny možné typy obsahu. Pokud chcete pokračovat v indexování, když indexer narazí na nepodporovaný typ obsahu, nastavte failOnUnsupportedContentType parametr konfigurace na hodnotu false:

PUT https://[service name].search.windows.net/indexers/[indexer name]?api-version=2026-08-01-preview
Content-Type: application/json
api-key: [admin key]

{
    ... other parts of indexer definition
    "parameters" : { "configuration" : { "failOnUnsupportedContentType" : false } }
}

U některých dokumentů Azure AI Vyhledávač nemůže určit typ obsahu nebo nemůže zpracovat dokument jiného podporovaného typu obsahu. Pokud chcete tento režim selhání ignorovat, nastavte failOnUnprocessableDocument parametr konfigurace na hodnotu false:

"parameters" : { "configuration" : { "failOnUnprocessableDocument" : false } }

Zdrojové soubory SharePointu používají sdílené limity velikosti zdrojových souborů a počtu extrahovaných znaků pro indexery podobné objektům blob. Ve výchozím nastavení se nadměrné dokumenty považují za chyby. Pokud ale nastavíte indexStorageMetadataOnlyForOversizedDocuments parametr konfigurace na hodnotu true, můžete stále indexovat metadata úložiště nadlimitních dokumentů:

"parameters" : { "configuration" : { "indexStorageMetadataOnlyForOversizedDocuments" : true } }

Pokud přidáte sadu dovedností, zkontrolujte limity vstupních a podřízených služeb jednotlivých dovedností samostatně. Dovednost může přijímat méně dat, než kolik extrahuje indexer SharePointu.

Můžete také pokračovat v indexování, pokud dojde k chybám v jakémkoli okamžiku zpracování, a to buď při analýze dokumentů, nebo při přidávání dokumentů do indexu. Pokud chcete ignorovat určitý počet chyb, nastavte maxFailedItems parametry konfigurace maxFailedItemsPerBatch na požadované hodnoty. Příklad:

{
    ... other parts of indexer definition
    "parameters" : { "maxFailedItems" : 10, "maxFailedItemsPerBatch" : 10 }
}