Configurer le classificateur sémantique et afficher des légendes dans les résultats de recherche

Note

Recherche Azure AI est disponible via le portail Azure, les API REST et les SDK Azure. Il sous-tend également Foundry IQ, la couche de connaissances managée qui transforme le contenu d’entreprise en bases de connaissances réutilisables et prenant en charge les autorisations pour les agents dans le portail Microsoft Foundry.

Important

Les fonctionnalités, capacités ou propriétés marquées (préversion) ne sont pas couvertes par un accord de niveau de service, ne sont pas recommandées pour les workloads de production et peuvent être modifiées ou faire l’objet de restrictions avant leur mise à disposition générale. Les Recherche Azure AI termes de la préversion s'appliquent à toutes les fonctionnalités d'aperçu, qu'il s'agisse d'une fonctionnalité autonome ou d'une partie d'une fonctionnalité généralement disponible.

Le classement sémantique itère sur un jeu de résultats initial, en appliquant une méthodologie de classement L2 qui promeut les résultats les plus sémantiquement pertinents en haut de la pile. Vous pouvez également obtenir des légendes sémantiques, avec des mises en surbrillance sur les termes et expressions les plus pertinents et les réponses sémantiques.

Cet article explique comment configurer un index de recherche pour la reclassement sémantique.

Note

Si vous avez du code existant qui appelle la préversion ou les versions précédentes de l’API, consultez Migrer le code de classement sémantique pour obtenir de l’aide sur la modification de votre code.

Conditions préalables

Choisir un client

Vous pouvez spécifier une configuration sémantique sur des index nouveaux ou existants, à l’aide de l’un des outils et kits de développement logiciel (SDK) suivants pour ajouter une configuration sémantique :

Ajouter une configuration sémantique

Certaines charges de travail créent automatiquement une configuration sémantique. Si vous utilisez la récupération agentique et une source knowledge qui indexe le contenu sur Recherche Azure AI, votre index généré a déjà une configuration sémantique qui fonctionne pour votre contenu.

Tip

À compter de la version de l’API 2026-05-01-preview , les flux de base de connaissances de récupération agentique pris en charge ne nécessitent pas de configuration sémantique explicite. Cette exception ne s’applique pas aux requêtes de classement sémantique classique ou aux versions antérieures de l’API. Pour plus d’informations, consultez Créer une source de connaissances d’index de recherche.

Pour les autres charges de travail, vous pouvez configurer vous-même une configuration sémantique. Une configuration sémantique est une section de votre index qui établit les entrées de champ utilisées pour le classement sémantique. Vous pouvez ajouter ou mettre à jour une configuration sémantique à tout moment, aucune reconstruction n’est nécessaire. Si vous créez plusieurs configurations, vous pouvez spécifier une valeur par défaut. Au moment de la requête, spécifiez une configuration sémantique sur une requête de requête ou laissez-la vide pour utiliser la valeur par défaut.

Vous pouvez créer jusqu’à 100 configurations sémantiques dans un seul index.

Une configuration sémantique a un nom et les propriétés suivantes :

Propriété Caractéristiques
Champ Titre Une chaîne courte, idéalement inférieure à 25 mots. Ce champ peut être le titre d’un document, d’un nom de produit ou d’un identificateur unique. Si vous n’avez pas de champ approprié, laissez-le vide.
Champs de contenu Blocs de texte plus longs sous forme de langage naturel, soumis à des limites d’entrée de jeton maximales sur les modèles Machine Learning. Les exemples courants incluent le corps d’un document, la description d’un produit ou d’autres textes de forme libre.
Champs de mot clé Liste de mots clés, tels que les balises d’un document ou un terme descriptif, tel que la catégorie d’un élément.

Vous ne pouvez spécifier qu’un seul champ de titre, mais vous pouvez avoir autant de champs de contenu et de mot clé que vous le souhaitez. Pour les champs de contenu et de mot clé, répertoriez les champs dans l’ordre de priorité, car les champs de priorité inférieure peuvent être tronqués.

Dans toutes les propriétés de configuration sémantique, les champs que vous affectez doivent être :

  • Attribué comme searchable et retrievable
  • Chaînes de type Edm.String, Collection(Edm.String), sous-champs de chaîne de Edm.ComplexType
  1. Accédez à votre service de recherche dans le portail Azure.

  2. Dans les index du volet de navigation gauche, sélectionnez un index.

  3. Sélectionnez Configurations sémantiques , puis sélectionnez Ajouter une configuration sémantique.

    Screenshot qui affiche l’option permettant d’ajouter une configuration sémantique dans le Azure portal.

  4. Dans la page Nouvelle configuration sémantique , entrez un nom de configuration sémantique et sélectionnez les champs à utiliser dans la configuration sémantique. Seuls les champs de chaîne pouvant faire l’objet d’une recherche et d’une récupération sont éligibles. Veillez à répertorier les champs de contenu et les champs de mot clé dans l’ordre de priorité.

    Screenshot qui montre comment créer une configuration sémantique dans le portail Azure portal.

  5. Sélectionnez Enregistrer pour enregistrer les paramètres de configuration.

  6. Sélectionnez Enregistrer à nouveau dans la page d’index pour enregistrer la configuration sémantique dans l’index.

Activez les modèles de classement sémantique en préversion (préversion)

À l’aide des API REST en préversion et des SDK Azure en préversion qui prennent en charge cette propriété, vous pouvez configurer facultativement un index pour utiliser des modèles de classement sémantique en préversion si l’un d’eux est déployé dans votre région. Il n’existe aucun mécanisme permettant de savoir si une préversion est disponible ou si elle a été utilisée sur une requête spécifique. Pour cette raison, nous vous recommandons d’utiliser cette propriété dans des environnements de test, et seulement si vous souhaitez essayer les derniers modèles de classement sémantique.

La propriété de configuration est , et elle est "flightingOptIn": truedéfinie dans la section de configuration sémantique d’un index. La propriété a la valeur null ou false par défaut. Vous pouvez définir la valeur true sur une demande de création ou de mise à jour à tout moment et affecter les requêtes sémantiques en avance, en supposant que la requête stipule une configuration sémantique qui inclut la propriété.

PUT https://myservice.search.windows.net/indexes('hotels')?allowIndexDowntime=False&api-version=2026-08-01-preview

{
  "name": "hotels",
  "fields": [ ],
  "scoringProfiles": [ ],
  "defaultScoringProfile": "geo",
  "suggesters": [ ],
  "analyzers": [ ],
  "corsOptions": { },
  "encryptionKey": { },
  "similarity": { },
  "semantic": {
    "configurations": [
      {
        "name": "semanticHotels",
        "prioritizedFields": {
          "titleField": {
            "fieldName": "hotelName"
          },
        "prioritizedContentFields": [
            {
              "fieldName": "description"
            },
            {
              "fieldName": "description_fr"
            }
          ],
        "prioritizedKeywordsFields": [
            {
              "fieldName": "tags"
            },
            {
              "fieldName": "category"
            }
          ],
        "flightingOptIn": true
        }
      }
    ]
  },
  "vectorSearch": {  }
}

Étapes suivantes

Testez votre configuration sémantique en exécutant une requête sémantique.