Konfigurieren eines Anreicherungscaches (Vorschau)

Note

Azure KI-Suche ist über das Azure Portal, REST-APIs und Azure SDKs verfügbar. Es unterstützt auch Foundry IQ, die verwaltete Wissensschicht, die Unternehmensinhalte in wiederverwendbare, berechtigungsfähige Wissensbasen für Agenten im Microsoft Foundry-Portal transformiert.

Wichtig

Features, Funktionen oder Eigenschaften, die als (Vorschau) gekennzeichnet sind, werden von keiner Dienstebenenvereinbarung (SLA) abgedeckt, werden für Produktionsworkloads nicht empfohlen und können geändert oder eingeschränkt werden, bevor sie allgemein verfügbar sind. Die Azure KI-Suche Vorschaubedingungen gelten für alle Vorschaufunktionen, unabhängig davon, ob sie eigenständig oder Teil eines allgemein verfügbaren Features ist.

In diesem Artikel wird erläutert, wie Sie einer Skillset-Pipeline Zwischenspeicherung hinzufügen, damit Sie nachgelagerte Anreicherungsschritte ändern können, ohne jedes Mal vollständig neu zu erstellen. Die Anreicherungszwischenspeicherung (Vorschauversion) erfordert eine Vorschau-REST-API. Standardmäßig ist ein Skillset zustandslos, und eine Änderung eines beliebigen Teils seiner Komposition erfordert eine vollständige erneute Ausführung des Indexers. Mit einem Anreicherungscache bestimmt der Indexer, welche Teile der Dokumentstruktur basierend auf Änderungen der Fähigkeiten oder Indexerdefinition aktualisiert werden müssen. Der Indexer behält vorhandene verarbeitete Ausgabe bei, sofern möglich, und verwendet sie wieder.

Sie platzieren zwischengespeicherte Inhalte in Azure Storage mithilfe einer von Ihnen bereitgestellten Verbindungszeichenfolge. Der Indexer erstellt diese Objekte, wenn er ausgeführt wird. Berücksichtigen Sie den Anreicherungscache einer internen Komponente, die von Ihrem Suchdienst verwaltet wird, die Sie nicht ändern dürfen.

Wichtig

Ein Anreicherungscache ist keine Sicherung von Skillset-Ausgaben, Indexerstatus oder indizierten Dokumenten. Es wird nicht nachverfolgt, welche Dokumente die Verarbeitung abgeschlossen haben. Überprüfen Sie für große Datenquellen den Abschnitt "Einschränkungen" , bevor Sie die Zwischenspeicherung aktivieren.

  • Ein Container mit dem Namen ms-az-search-indexercache-<alpha-numeric-string>
  • Tabellen mit dem Namen MsAzSearchIndexerCacheIndex<alpha-numeric-string>

Voraussetzungen

  • Azure Storage zum Speichern zwischengespeicherter Anreicherungen. Das Speicherkonto muss General Purpose v2 sein.

  • Gilt nur für die Blob-Indizierung: Wenn Sie eine synchronisierte Löschung von Dokumenten aus dem Cache und dem Index benötigen, wenn Blobs aus Ihrer Datenquelle gelöscht werden, aktivieren Sie eine Löschrichtlinie im Indexer. Ohne diese Richtlinie wird das Löschen von Dokumenten aus dem Cache nicht unterstützt.

Sie sollten mit der Einrichtung von Indexern und Skillsets vertraut sein. Beginnen Sie mit der Indexer-Übersicht und fahren Sie dann mit skillsets fort, um mehr über Anreicherungspipelines zu erfahren.

Einschränkungen

Vorsicht

Wenn Sie den SharePoint Indexer (Vorschau) verwenden, vermeiden Sie die inkrementelle Anreicherung. Unter bestimmten Umständen wird der Cache ungültig. Um sie neu zu laden, führen Sie ein Zurücksetzen des Indexers und eine vollständige Neuindizierung durch.

Große Datenquellen haben eine zusätzliche Cachebeschränkung.

Vorsicht

Bei großen Datenquellen kann ein Anreicherungscache die gesamte Neuverarbeitung erhöhen, wenn lange laufende Fähigkeiten, wiederholte Unterbrechungen oder häufige Fähigkeitsfehler auftreten. Der Indexer priorisiert die Korrektheit gegenüber der Minimierung der Neuverarbeitung, sodass ein Cache-Backlog von wiederholten Unterbrechungen das Wiederholungsverhalten verstärkt. Dieses Verhalten wird erwartet, kein Fehler.

Um aus einem wachsenden Cache-Backlog wiederherzustellen, partitionieren Sie die Datenquelle in kleinere Container oder virtuelle Ordner. Verwenden Sie dann parallele Indexer , die auf denselben Index zeigen. Wenn Sie die Zuordnung des Caches aufheben möchten, legen Sie die cache Eigenschaft auf NULL für den Indexer fest. Anleitungen zum Partitionierungsmuster finden Sie unter "Große Datensätze indizieren ".

Berechtigungen

Eine Azure KI-Suche Identität benötigt Schreibzugriff auf Azure Storage:

  • Speicher-Blob-Daten Mitwirkender
  • Mitwirkender an Storage-Tabellendaten

Die syntax Verbindungszeichenfolge bestimmt, ob eine vom System zugewiesene oder vom Benutzer zugewiesene Identität verwendet wird. Weitere Informationen finden Sie unter Connect to Azure Storage using a managed identity.

Festlegen der Cacheeigenschaft

Verwenden Sie dieses Verfahren sowohl für neue als auch für vorhandene Indexer.

Definieren Sie in der Indexerdefinition cache mit Folgendem:

  • (Erforderlich) storageConnectionString auf eine Azure Storage Verbindungszeichenfolge festgelegt.
  • (Optional) enableReprocessing (true standardmäßig). Stellen Sie es auf false, um die inkrementelle Anreicherung vorübergehend anzuhalten, und stellen Sie es später wieder auf true um.
  1. Wählen Sie auf der linken Seite die Option "Indexer" aus.

  2. Wählen Sie "Indexer hinzufügen" aus, um einen neuen Indexer zu erstellen, oder öffnen Sie eine vorhandene im JSON-Bearbeitungsmodus.

  3. Aktivieren Sie die inkrementelle Anreicherung, legen Sie das Speicherkonto für die Anreicherung fest, und speichern Sie den Indexer.

    Screenshot der Azure-Portaloption zum Anreicherungscache.

  4. Setzen Sie den Indexer zurück, wenn er bereits vorhanden ist.

  5. Führen Sie den Indexer aus. Dieser einmalige vollständige Neuaufbau initialisiert den Cache. Nach dem Laden gilt die inkrementelle Wiederverwertung für nachfolgende Durchläufe.