Remarque
L’accès à cette page nécessite une autorisation. Vous pouvez essayer de vous connecter ou de modifier des répertoires.
L’accès à cette page nécessite une autorisation. Vous pouvez essayer de modifier des répertoires.
Note
Recherche Azure AI est disponible via le portail Azure, les API REST et les SDK Azure. Il sous-tend également Foundry IQ, la couche de connaissances managée qui transforme le contenu d’entreprise en bases de connaissances réutilisables et prenant en charge les autorisations pour les agents dans le portail Microsoft Foundry.
La compétence Extraction de mots clés évalue le texte non structuré et, pour chaque enregistrement, renvoie une liste de phrases clés. Cette compétence utilise les modèles d’apprentissage automatique Mots fournis par Azure Language in Foundry Tools.
Cette capacité est utile si vous devez rapidement identifier les principaux points de discussion du dossier. Par exemple, dans le texte d’entrée « La nourriture était délicieuse et il y avait un personnel formidable », le service répond « nourriture » et « personnel formidable ».
Note
Cette compétence est liée à Foundry Tools et nécessite une ressource facturable pour les transactions dépassant 20 documents par indexeur et par jour. L’exécution des compétences intégrées est facturée au prix standard des outils Foundry existants.
@odata.type
Microsoft.Skills.Text.KeyPhraseExtractionSkill
Limites des données
La taille maximale d’un enregistrement doit être de 50 000 caractères mesurée par String.Length. Si vous devez fragmenter vos données avant de les envoyer à l’extracteur de mots-clés, envisagez d’utiliser la compétence Répartition de texte. Si vous utilisez une compétence de division de texte, réglez la longueur de la page à 5000 pour les meilleures performances.
Paramètres de compétence
Les paramètres respectent la casse.
| Entrées | Description |
|---|---|
defaultLanguageCode |
(Optionnel) Le code de langage à appliquer aux documents qui ne spécifient pas explicitement le langage. Si le code de langue par défaut n’est pas spécifié, l’anglais (en) est utilisé comme code par défaut. Voir la liste complète des langages pris en charge. |
maxKeyPhraseCount |
(Optionnel) Le nombre maximal de mots-clés à produire. |
modelVersion |
(Optionnel) Spécifie la version du modèle à utiliser lors de l’appel de l’API des mots-clés. Par défaut, il affiche la dernière version disponible quand ce n’est pas spécifié. Nous vous recommandons de ne pas spécifier cette valeur sauf si cela est nécessaire. |
Données de compétences
| Input | Description |
|---|---|
text |
Le texte à analyser. |
languageCode |
Une chaîne indiquant la langue des archives. Si ce paramètre n’est pas spécifié, le code de langage par défaut est utilisé pour analyser les enregistrements. Voir la liste complète des langages pris en charge. |
Résultats des compétences
| Sortie | Description |
|---|---|
keyPhrases |
Une liste de mots-clés extraits du texte d’entrée. Les phrases-clés sont renvoyées dans l’ordre d’importance. |
Exemple de définition
Considérons un enregistrement SQL qui possède les champs suivants :
{
"content": "Glaciers are huge rivers of ice that ooze their way over land, powered by gravity and their own sheer weight. They accumulate ice from snowfall and lose it through melting. As global temperatures have risen, many of the world’s glaciers have already started to shrink and retreat. Continued warming could see many iconic landscapes – from the Canadian Rockies to the Mount Everest region of the Himalayas – lose almost all their glaciers by the end of the century.",
"language": "en"
}
Alors ta définition de compétence pourrait ressembler à ceci :
{
"@odata.type": "#Microsoft.Skills.Text.KeyPhraseExtractionSkill",
"inputs": [
{
"name": "text",
"source": "/document/content"
},
{
"name": "languageCode",
"source": "/document/language"
}
],
"outputs": [
{
"name": "keyPhrases",
"targetName": "myKeyPhrases"
}
]
}
Exemple de résultat
Pour l’exemple précédent, la sortie de votre compétence est écrite sur un nouveau nœud de l’arbre enrichi appelé « document/myKeyPhrases » puisque c’est celui targetName que nous avons spécifié. Si vous ne spécifiez pas de targetName, alors ce serait « document/keyPhrases ».
document/myKeyPhrases
[
"world’s glaciers",
"huge rivers of ice",
"Canadian Rockies",
"iconic landscapes",
"Mount Everest region",
"Continued warming"
]
Vous pouvez utiliser « document/myKeyPhrases » comme entrée dans d’autres compétences, ou comme source de mappage de champ de sortie.
Warnings
Si vous fournissez un code de langue non pris en charge, un avertissement est généré et les mots-clés ne sont pas extraits. Si votre texte est vide, un avertissement est produit. Si votre texte dépasse 50 000 caractères, seuls les 50 000 premiers caractères sont analysés et un avertissement est émis.