Configurare una cache di arricchimento (anteprima)

Note

Azure AI Search è disponibile tramite il portale di Azure, le API REST e Azure SDK. È inoltre alla base di Foundry IQ, il livello di conoscenza gestito che trasforma il contenuto aziendale in knowledge base riutilizzabili e con riconoscimento delle autorizzazioni per gli agenti nel portale di Microsoft Foundry.

Importante

Le funzionalità, le funzionalità o le proprietà contrassegnate (anteprima) non sono coperte da un contratto di servizio, non sono consigliate per i carichi di lavoro di produzione e potrebbero cambiare o essere vincolate prima che diventino disponibili a livello generale. Le condizioni di anteprima Azure AI Search si applicano a tutte le funzionalità di anteprima, indipendente o parte di una funzionalità disponibile a livello generale.

Questo articolo illustra come aggiungere la memorizzazione nella cache a una pipeline del set di competenze in modo da poter modificare i passaggi di arricchimento downstream senza una ricompilazione completa ogni volta. La memorizzazione nella cache per l'arricchimento (anteprima) richiede un'API REST di anteprima. Per impostazione predefinita, un set di competenze è senza stato e la modifica di qualsiasi parte della sua composizione richiede una riesecuzione completa dell'indicizzatore. Con una cache di arricchimento, l'indicizzatore determina quali parti dell'albero del documento devono essere aggiornate in base alle modifiche apportate al set di competenze o alla definizione dell'indicizzatore. L'indicizzatore mantiene e riutilizza l'output elaborato esistente, se possibile.

Il contenuto memorizzato nella cache viene inserito in Archiviazione di Azure usando un stringa di connessione fornito dall'utente. L'indicizzatore crea questi oggetti quando viene eseguito. Considerare la cache di arricchimento un componente interno gestito dal servizio di ricerca che non è necessario modificare.

Importante

Una cache di arricchimento non è un backup degli output del set di competenze, dello stato dell'indicizzatore o dei documenti indicizzati. Non tiene traccia dei documenti che completano l'elaborazione. Per le origini dati di grandi dimensioni, vedere la sezione Limitazioni prima di abilitare la memorizzazione nella cache.

  • Contenitore denominato ms-az-search-indexercache-<alpha-numeric-string>
  • Tabelle chiamate MsAzSearchIndexerCacheIndex<alpha-numeric-string>

Prerequisiti

È necessario avere familiarità con la configurazione di indicizzatori e set di competenze. Iniziare con la panoramica dell'indicizzatore e quindi passare ai set di competenze per informazioni sulle pipeline di arricchimento.

Limitazioni

Attenzione

Se si usa l'indicizzatore SharePoint (anteprima), evitare l'arricchimento incrementale. In determinate circostanze, la cache diventa non valida. Per ricaricarlo, eseguire una reimpostazione dell'indicizzatore e la ricompilazione completa.

Le origini dati di grandi dimensioni presentano una limitazione aggiuntiva della cache.

Attenzione

Per le origini dati di grandi dimensioni, una cache di arricchimento può aumentare la rielaborazione complessiva quando si verificano skill a esecuzione prolungata, interruzioni ripetute o errori frequenti delle skill. L'indicizzatore privilegia la correttezza rispetto alla minimizzazione della rielaborazione, quindi un accumulo nella cache dovuto a interruzioni ripetute incrementa i ritentativi. Questo comportamento è previsto, non un bug.

"Per eseguire il ripristino da un backlog della cache in crescita, partizionare l'origine dati in contenitori o cartelle virtuali più piccole. Quindi utilizzare indicizzatori paralleli che puntano allo stesso indice. Per annullare l'associazione della cache, impostare la cache proprietà su null nell'indicizzatore. Per indicazioni sul modello di partizionamento, vedere Indicizzare set di dati di grandi dimensioni .

Autorizzazioni

Un'identità di Azure AI Search richiede l'accesso in scrittura ad Archiviazione di Azure:

  • Collaboratore ai dati del BLOB di archiviazione
  • Contributore ai dati delle tabelle di archiviazione

La sintassi stringa di connessione determina se viene usata un'identità assegnata dal sistema o assegnata dall'utente. Per altre informazioni, vedere Connetti ad Archiviazione di Azure utilizzando un'identità gestita.

Impostare la proprietà della cache

Utilizzare questa procedura sia per gli indicizzatori nuovi che per gli indicizzatori esistenti.

Nella definizione dell'indicizzatore impostare cache con:

  • (Obbligatorio) storageConnectionString impostato su una stringa di connessione di Archiviazione di Azure.
  • (Facoltativo) enableReprocessing (true per impostazione predefinita). Impostarlo su false per sospendere temporaneamente l'arricchimento incrementale e tornare a true in un secondo momento.
  1. A sinistra selezionare Indicizzatori.

  2. Selezionare Aggiungi indicizzatore per creare un nuovo indicizzatore o aprirne uno esistente in modalità di modifica JSON.

  3. Abilitare l'arricchimento incrementale, impostare l'account di archiviazione della cache di arricchimento e salvare l'indicizzatore.

    Screenshot dell'opzione portale di Azure per l'arricchimento cache.

  4. Reimpostare l'indicizzatore se esiste già.

  5. Eseguire l'indicizzatore. Questa ricompilazione completa una tantum consente di eseguire il seeding della cache. Dopo il caricamento, il riutilizzo incrementale viene applicato alle esecuzioni successive.