Configurare il ranker semantico e restituire didascalie nei risultati della ricerca

Nota

Azure AI Search è disponibile tramite il portale di Azure, le API REST e Azure SDK. È inoltre alla base di Foundry IQ, il livello di conoscenza gestito che trasforma il contenuto aziendale in knowledge base riutilizzabili e con riconoscimento delle autorizzazioni per gli agenti nel portale di Microsoft Foundry.

Importante

Le funzionalità, le funzionalità o le proprietà contrassegnate (anteprima) non sono coperte da un contratto di servizio, non sono consigliate per i carichi di lavoro di produzione e potrebbero cambiare o essere vincolate prima che diventino disponibili a livello generale. Le condizioni di anteprima Azure AI Search si applicano a tutte le funzionalità di anteprima, indipendente o parte di una funzionalità disponibile a livello generale.

La classificazione semantica esegue l'iterazione su un set di risultati iniziale, applicando una metodologia di classificazione L2 che promuove i risultati più pertinenti semanticamente all'inizio dello stack. È anche possibile ottenere didascalie semantiche, con evidenziazioni sui termini e sulle frasi più rilevanti e risposte semantiche.

Questo articolo illustra come configurare un indice di ricerca per il reranking semantico.

Nota

Se si dispone di codice esistente che chiama versioni di anteprima o api precedenti, vedere Eseguire la migrazione del codice di classificazione semantica per informazioni sulla modifica del codice.

Prerequisiti

Scegliere un client

È possibile specificare una configurazione semantica in indici nuovi o esistenti, usando uno degli strumenti e degli SDK seguenti per aggiungere una configurazione semantica:

Aggiungere una configurazione semantica

Alcuni carichi di lavoro creano automaticamente una configurazione semantica. Se si usa il recupero agentico e un'origine della conoscenza che indicizza il contenuto in Azure AI Search, l'indice generato ha già una configurazione semantica che funziona per il tuo contenuto.

Tip

A partire dalla versione dell'API 2026-05-01-preview, i flussi supportati della base di conoscenza per il recupero agentico non richiedono una configurazione semantica esplicita. Questa eccezione non si applica alle query di classificazione semantica classiche o alle versioni precedenti dell'API. Per altre informazioni, vedere Creare un'origine dati delle conoscenze per un indice di ricerca.

Per altri carichi di lavoro, è possibile configurare manualmente una configurazione semantica. Una configurazione semantica è una sezione dell'indice che stabilisce gli input di campo usati per la classificazione semantica. È possibile aggiungere o aggiornare una configurazione semantica in qualsiasi momento, senza alcuna ricompilazione necessaria. Se si creano più configurazioni, è possibile specificare un valore predefinito. In fase di query specificare una configurazione semantica in una richiesta di query o lasciarla vuota per usare l'impostazione predefinita.

È possibile creare fino a 100 configurazioni semantiche in un singolo indice.

Una configurazione semantica ha un nome e le proprietà seguenti:

Proprietà Caratteristiche
Campo Titolo Stringa breve, idealmente sotto 25 parole. Questo campo può essere il titolo di un documento, il nome di un prodotto o un identificatore univoco. Se non si dispone di un campo appropriato, lasciarlo vuoto.
Campi contenuto Blocchi di testo più lunghi in formato in linguaggio naturale, soggetti ai limiti massimi di input dei token nei modelli di Machine Learning. Esempi comuni includono il corpo di un documento, la descrizione di un prodotto o un altro testo in formato libero.
Campi parola chiave Elenco di parole chiave, ad esempio i tag di un documento o un termine descrittivo, ad esempio la categoria di un elemento.

È possibile specificare un solo campo titolo, ma è possibile avere il numero di campi di contenuto e parola chiave desiderati. Per i campi contenuto e parola chiave, elencare i campi in ordine di priorità perché i campi con priorità inferiore potrebbero essere troncati.

In tutte le proprietà di configurazione semantica, i campi assegnati devono essere:

  • Attribuito come searchable e retrievable
  • Stringhe di tipo Edm.String, Collection(Edm.String), sottocampi della stringa di Edm.ComplexType
  1. Passare al servizio di ricerca nel portale Azure.

  2. In Indici nel riquadro di spostamento a sinistra selezionare un indice.

  3. Selezionare Configurazioni semantiche e quindi Aggiungi configurazione semantica.

    Screenshot che mostra l'opzione per aggiungere una configurazione semantica nel Azure portal.

  4. Nella pagina Nuova configurazione semantica immettere un nome di configurazione semantica e selezionare i campi da usare nella configurazione semantica. Sono idonei solo i campi stringa ricercabili e recuperabili. Assicurarsi di elencare i campi del contenuto e i campi delle parole chiave in ordine di priorità.

    Screenshot che illustra come creare una configurazione semantica nel Azure portal.

  5. Selezionare Salva per salvare le impostazioni di configurazione.

  6. Selezionare di nuovo Salva nella pagina dell'indice per salvare la configurazione semantica nell'indice.

Acconsentire esplicitamente ai modelli di classificazione semantica non definitiva (anteprima)

Usando le API REST in anteprima e gli SDK di Azure in anteprima che includono la proprietà, è possibile configurare facoltativamente un indice per usare modelli di ranking semantico pre-rilascio, se ne è stato distribuito uno nella propria area geografica. Non esiste alcun meccanismo per sapere se è disponibile una versione preliminare o se è stato usato in una query specifica. Per questo motivo, è consigliabile usare questa proprietà negli ambienti di test e solo se si è interessati a provare i modelli di classificazione semantica più recenti.

La proprietà di configurazione è "flightingOptIn": truee viene impostata nella sezione di configurazione semantica di un indice. La proprietà è impostata a null o false per impostazione predefinita. È possibile impostare la proprietà su vero in una richiesta di creazione o aggiornamento in qualsiasi momento, e ciò influenzerà le query semantiche che si effettuano successivamente, supponendo che la query stipuli una configurazione semantica che includa la proprietà.

PUT https://myservice.search.windows.net/indexes('hotels')?allowIndexDowntime=False&api-version=2026-08-01-preview

{
  "name": "hotels",
  "fields": [ ],
  "scoringProfiles": [ ],
  "defaultScoringProfile": "geo",
  "suggesters": [ ],
  "analyzers": [ ],
  "corsOptions": { },
  "encryptionKey": { },
  "similarity": { },
  "semantic": {
    "configurations": [
      {
        "name": "semanticHotels",
        "prioritizedFields": {
          "titleField": {
            "fieldName": "hotelName"
          },
        "prioritizedContentFields": [
            {
              "fieldName": "description"
            },
            {
              "fieldName": "description_fr"
            }
          ],
        "prioritizedKeywordsFields": [
            {
              "fieldName": "tags"
            },
            {
              "fieldName": "category"
            }
          ],
        "flightingOptIn": true
        }
      }
    ]
  },
  "vectorSearch": {  }
}

Passaggi successivi

Verifica la configurazione semantica eseguendo una query semantica.