Verwalten eines Anreicherungscaches (Vorschau)

Note

Azure KI-Suche ist über das Azure Portal, REST-APIs und Azure SDKs verfügbar. Es unterstützt auch Foundry IQ, die verwaltete Wissensschicht, die Unternehmensinhalte in wiederverwendbare, berechtigungsfähige Wissensbasen für Agenten im Microsoft Foundry-Portal transformiert.

Wichtig

Features, Funktionen oder Eigenschaften, die als (Vorschau) gekennzeichnet sind, werden von keiner Dienstebenenvereinbarung (SLA) abgedeckt, werden für Produktionsworkloads nicht empfohlen und können geändert oder eingeschränkt werden, bevor sie allgemein verfügbar sind. Die Azure KI-Suche Vorschaubedingungen gelten für alle Vorschaufunktionen, unabhängig davon, ob sie eigenständig oder Teil eines allgemein verfügbaren Features ist.

Ein Anreicherungs-Cache (Vorschau) ist eine optionale Funktion, die angereicherte Inhalte speichert, die während der Skillset-Ausführung erstellt werden. Es behält Inhalte zwischen Denläufen bei, sodass nur geänderte Fähigkeiten und Dokumente neu verarbeitet werden müssen. Es handelt sich nicht um eine Sicherung von Skillset-Ausgaben, Indexerstatus oder indizierten Dokumenten.

Sie erstellen den Anreicherungscache in Azure Storage. Der Cache enthält die Ausgaben aus der Dokumententschlüsselung sowie die Ausgaben der einzelnen Skills für jedes Dokument. Obwohl Caching abgerechnet wird (es nutzt Azure Storage), werden die Gesamtkosten der Anreicherung reduziert, da die Speicherkosten geringer sind als die der Bildextraktion und KI-Verarbeitung.

Wenn Sie einen Anreicherungscache konfigurieren, wird in diesem Artikel erläutert, wie Sie Aktualisierungen an Skills und Datenquellen verwalten, damit Sie den größtmöglichen Nutzen aus im Cache gespeicherten Anreicherungen ziehen.

Voraussetzungen

Einschränkungen

Vorsicht

Wenn Sie den SharePoint Indexer (Vorschau) verwenden, vermeiden Sie die inkrementelle Anreicherung. Unter bestimmten Umständen wird der Cache ungültig. Um sie neu zu laden, führen Sie ein Zurücksetzen des Indexers und eine vollständige Neuindizierung durch.

Große Datenquellen haben eine zusätzliche Cachebeschränkung.

Vorsicht

Bei großen Datenquellen kann ein Anreicherungscache die gesamte Neuverarbeitung erhöhen, wenn lange laufende Fähigkeiten, wiederholte Unterbrechungen oder häufige Fähigkeitsfehler auftreten. Der Indexer priorisiert die Korrektheit gegenüber der Minimierung der Neuverarbeitung, sodass ein Cache-Backlog von wiederholten Unterbrechungen das Wiederholungsverhalten verstärkt.

Um aus einem wachsenden Cache-Backlog wiederherzustellen, partitionieren Sie die Datenquelle in kleinere Container oder virtuelle Ordner. Verwenden Sie dann parallele Indexer , die auf denselben Index zeigen. Wenn Sie die Zuordnung des Caches aufheben möchten, legen Sie die cache Eigenschaft auf NULL für den Indexer fest.

Cachekonfiguration

Physisch wird der Cache in einem BLOB-Container und Tabellen in Ihrem Azure Storage Konto gespeichert, eines pro Indexer. Jedem Indexer wird ein eindeutiger und unveränderlicher Cachebezeichner zugewiesen, der dem verwendeten Container entspricht.

Der Cache wird erstellt, wenn Sie die cache Eigenschaft angeben und den Indexer ausführen. Nur angereicherte Inhalte können zwischengespeichert werden. Wenn Ihr Indexer nicht über ein angefügtes Skillset verfügt, gilt die Zwischenspeicherung nicht.

Im folgenden Beispiel wird ein Indexer mit aktivierter Zwischenspeicherung veranschaulicht. Ausführliche Anweisungen finden Sie unter Konfigurieren des Anreicherungszwischenspeicherns .

POST https://[YOUR-SEARCH-SERVICE-NAME].search.windows.net/indexers?api-version=2026-08-01-preview
    {
        "name": "myIndexerName",
        "targetIndexName": "myIndex",
        "dataSourceName": "myDatasource",
        "skillsetName": "mySkillset",
        "cache" : {
            "storageConnectionString" : "<Your storage account connection string>",
            "enableReprocessing": true
        },
        "fieldMappings" : [],
        "outputFieldMappings": [],
        "parameters": []
    }

Cacheverwaltung

Der Indexer verwaltet den Cachelebenszyklus. Wenn Sie einen Indexer löschen, löschen Sie auch den Cache. Wenn Sie die Eigenschaft des cache Indexers auf NULL festlegen oder die Verbindungszeichenfolge ändern, wird der vorhandene Cache während der nächsten Indizierungsausführung gelöscht.

Während die inkrementelle Anreicherung so konzipiert ist, dass Änderungen ohne Interventionen erkannt und reagiert werden, können Sie Parameter festlegen, um bestimmte Verhaltensweisen aufzurufen:

Priorisieren neuer Dokumente

Die cache Eigenschaft enthält einen enableReprocessing Parameter, der steuert, ob zwischengespeicherte Inhalte erneut verarbeitet werden. Wenn diese Option auf „true“ gesetzt ist (Standard), verarbeitet der Indexer zwischengespeicherte Dokumente erneut, wenn Sie ihn erneut ausführen und eine Skill-Aktualisierung diese betrifft.

Wenn "false" lautet, verarbeitet der Indexer vorhandene Dokumente nicht erneut, wodurch neue Inhalte priorisiert werden. Legen Sie enableReprocessing nur vorübergehend auf "false" fest. Die Wahrung der Korrektheit für die meiste Zeit stellt sicher, dass sowohl neue als auch bestehende Dokumente für die aktuelle Definition des Skillsets gültig bleiben.

Umgehen der Skillsetauswertung

Das Ändern einer Fähigkeit geht in der Regel hand in Hand mit der Umarbeitung dieser Fähigkeit. Einige Änderungen an einer Fähigkeit sollten jedoch nicht die Neuverarbeitung auslösen. Stellen Sie z. B. eine benutzerdefinierte Fähigkeit an einem neuen Speicherort oder mit einem neuen Zugriffsschlüssel bereit. Diese Änderungen sind in der Regel eher periphere Anpassungen, die die inhaltliche Substanz der Skill-Ausgabe nicht beeinträchtigen.

Wenn Sie wissen, dass eine Änderung der Fähigkeit oberflächlich ist, überschreiben Sie die Qualifikationsbewertung, indem Sie den disableCacheReprocessingChangeDetection Parameter auf "true" festlegen:

  1. Rufen Sie Update Skillset auf und ändern Sie die Fähigkeitssatz-Definition.
  2. Fügen Sie den disableCacheReprocessingChangeDetection=true Parameter an die Anforderung an.
  3. Änderung einreichen.

Wenn Sie diesen Parameter festlegen, werden nur Aktualisierungen der Skillset-Definition übernommen. Die Änderung wird nicht für Auswirkungen auf den vorhandenen Cache ausgewertet. Verwenden Sie eine Vorschau-API-Version, 2020-06-30-Preview oder höher. Verwenden Sie die neueste Vorschau-API.

PUT https://[servicename].search.windows.net/skillsets/[skillset name]?api-version=2026-08-01-preview&disableCacheReprocessingChangeDetection
  

Umgehen von Validierungsprüfungen für Datenquellen

Die meisten Änderungen an einer Datenquellendefinition machen den Cache ungültig. Für Szenarien, in denen Sie wissen, dass eine Änderung den Cache nicht ungültig machen sollte, z. B. das Ändern einer Verbindungszeichenfolge oder das Erneuern des Schlüssels für das Speicherkonto, fügen Sie den Parameter ignoreResetRequirement an die Aktualisierung der Datenquelle Aktualisierung der Datenquelle an. Legen Sie diesen Parameter auf "true" fest, damit der Commit durchlaufen kann, ohne eine Zurücksetzungsbedingung auszulösen, die dazu führen würde, dass alle Objekte neu erstellt und von Grund auf ausgefüllt werden.

PUT https://[search service].search.windows.net/datasources/[data source name]?api-version=2026-08-01-preview&ignoreResetRequirement
 

Erzwingen der Skillsetauswertung

Der Zweck des Caches besteht darin, unnötige Verarbeitung zu vermeiden. Angenommen, Sie ändern eine Fähigkeit, die der Indexer nicht erkennt (z. B. ändern etwas in externem Code, z. B. eine benutzerdefinierte Fähigkeit).

Verwenden Sie in diesem Fall die Reset Skills API, um die Neuverarbeitung einer bestimmten Qualifikation zu erzwingen, einschließlich der nachgeschalteten Fähigkeiten, die eine Abhängigkeit von der Leistung dieser Qualifikation haben. Diese API akzeptiert eine POST-Anforderung mit einer Liste von Fähigkeiten, die für die Neuverarbeitung ungültig und markiert werden sollen. Führen Sie nach dem Zurücksetzen von Skills eine Run Indexer-Anforderung aus, um die Pipelineverarbeitung aufzurufen.

Erneutes Zwischenspeichern bestimmter Dokumente

Wenn Sie einen Indexer zurücksetzen, werden alle Dokumente im Suchkorpus neu verarbeitet.

Verwenden Sie in Szenarien, in denen nur wenige Dokumente neu verarbeitet werden müssen, das Zurücksetzen von Dokumenten (Vorschau), um die Erneute Verarbeitung bestimmter Dokumente zu erzwingen. Wenn Sie ein Dokument zurücksetzen, wird der Cache für dieses Dokument vom Indexer ungültig. Der Indexer verarbeitet das Dokument dann erneut, indem es aus der Datenquelle gelesen wird. Weitere Informationen finden Sie unter Ausführen oder Zurücksetzen von Indexern, Skills und Dokumenten.

Um bestimmte Dokumente zurückzusetzen, fügen Sie der Anfrage eine Liste von Dokumentschlüsseln hinzu, die aus dem Suchindex ausgelesen wurden. Wenn der Schlüssel einem Feld in der externen Datenquelle zugeordnet ist, verwenden Sie den Wert aus dem Suchindex.

Je nachdem, wie Sie die API aufrufen, hängt die Anforderung entweder an, überschreibt oder stellt die Schlüsselliste in die Warteschlange:

  • Wenn Sie die API mehrmals mit verschiedenen Schlüsseln aufrufen, werden die neuen Schlüssel an die Liste der zurückgesetzten Dokumentschlüssel angefügt.

  • Wenn Sie die API mit auf overwrite festgelegtem querystring-Parameter true aufrufen, wird die aktuelle Liste der zurückzusetzenden Dokumentschlüssel mit den Nutzdaten der Anforderung überschrieben.

  • Durch den Aufruf der API werden die Dokumentschlüssel zur Warteschlange der vom Indexer verarbeiteten Aufgaben hinzugefügt. Wenn der Indexer das nächste Mal ausgeführt wird, entweder planmäßig oder bei Bedarf, verarbeitet er die zurückgesetzten Dokumentenschlüssel vorrangig vor allen anderen Änderungen aus der Datenquelle.

Das folgende Beispiel illustriert eine Dokumentrücksetzungsanfrage.

POST https://[search service name].search.windows.net/indexers/[indexer name]/resetdocs?api-version=2026-08-01-preview
    {
        "documentKeys" : [
            "key1",
            "key2",
            "key3"
        ]
    }

Änderungen, die den Cache ungültig machen

Wenn Sie einen Cache aktivieren, sucht der Indexer nach Änderungen in Ihrer Pipelinekomposition, um zu entscheiden, welche Inhalte sie wiederverwenden kann und welche Inhalte neu verarbeitet werden müssen. In diesem Abschnitt werden Änderungen aufgelistet, die den Cache ungültig haben, gefolgt von Änderungen, die die inkrementelle Verarbeitung auslösen.

Eine ungültige Änderung ist eine Änderung, bei der der gesamte Cache ungültig wird. Beispielsweise ist das Aktualisieren der Datenquelle eine ungültige Änderung. Hier ist die vollständige Liste der Änderungen an einem Beliebigen Teil der Indexerpipeline, die Ihren Cache ungültig machen:

  • Ändern des Datenquellentyps
  • Ändern des Datenquellencontainers
  • Ändern von Datenquellenanmeldeinformationen
  • Ändern der Richtlinie zur Erkennung von Änderungen für die Datenquelle
  • Ändern der Richtlinie zur Erkennung von Löschungen für die Datenquelle
  • Indexer-Feldzuordnungen ändern
  • Ändern von Indexerparametern:
    • Analysemodus
    • Ausgeschlossene Dateinamenerweiterungen
    • Indizierte Dateinamenerweiterungen
    • Indexspeichermetadaten nur für überdimensionierte Dokumente
    • Durch Trennzeichen getrennte Textüberschriften
    • Trennzeichen für Text mit Trennzeichen
    • Dokumentstamm
    • Bildaktion (Änderungen an der Extraktion von Bildern)

Änderungen, die die inkrementelle Verarbeitung auslösen

Inkrementelle Verarbeitung wertet Ihre Skillsetdefinition aus und bestimmt, welche Fähigkeiten erneut ausgeführt werden sollen. Es aktualisiert gezielt die betroffenen Teile des Dokumentbaums. Hier ist die vollständige Liste der Änderungen, die zu inkrementeller Anreicherung führen:

  • Ändern des Qualifikationstyps (Aktualisieren des OData-Typs der Fähigkeit)
  • Aktualisieren von qualifikationsspezifischen Parametern, z. B. URL, Standardwerte oder andere Parameter
  • Änderung der Ausgaben eines Skills, z. B. wenn der Skill zusätzliche oder andere Ausgaben zurückgibt
  • Ändern von Qualifikationseingaben, die zu unterschiedlichen Herkunfts- oder Qualifikationsketten führen
  • Jede Invalidierung einer vorgelagerten Fähigkeit, wenn Sie eine Fähigkeit aktualisieren, die eine Eingabe für diese Fähigkeit bereitstellt
  • Aktualisieren des Speicherorts der Wissensspeicherprojektion, was dazu führt, dass Dokumente erneut projiziert werden
  • Ändern der Wissensspeicherprojektionen, was dazu führt, dass Dokumente neu projiziert werden
  • Ändern von Ausgabefeldzuordnungen für einen Indexer, was dazu führt, dass Dokumente erneut in den Index projiziert werden

Zum Zwischenspeichern verwendete APIs

Vorschau-APIs stellen zusätzliche Eigenschaften für Indexer bereit. Verwenden Sie die neueste Vorschau-API.

Verwenden Sie die allgemein verfügbare Version für Skillsets und Datenquellen. Zusätzlich zur Referenzdokumentation finden Sie unter Konfigurieren der Zwischenspeicherung für inkrementelle Anreicherung details zur Reihenfolge der Vorgänge.