Microsoft Foundry modelcatalogus-vectoriseerder (preview)

Note

Azure AI Zoeken is beschikbaar via de Azure-portal, REST API's en Azure-SDK's. Het vormt ook een basis voor Foundry IQ, de beheerde kennislaag die bedrijfsinhoud transformeert in herbruikbare, machtigingsbewuste knowledge bases voor agents in de Microsoft Foundry-portal.

Belangrijk

Functies, mogelijkheden of eigenschappen die zijn gemarkeerd (preview) vallen niet onder een service level agreement, worden niet aanbevolen voor productieworkloads en kunnen worden gewijzigd of beperkt voordat ze algemeen beschikbaar worden. De Azure AI Zoeken preview-voorwaarden zijn van toepassing op alle preview-functionaliteit, ongeacht of deze zelfstandig is of deel uitmaakt van een algemeen beschikbare functie.

De Microsoft Foundry-modelcatalogusvectorizer (preview) maakt verbinding met een insluitmodel dat is geïmplementeerd vanuit de Foundry-modelcatalogus of een AML-eindpunt (Azure Machine Learning). Uw gegevens worden verwerkt in de geografische locatie waar uw model wordt geïmplementeerd.

Als u geïntegreerde vectorisatie gebruikt om de vectormatrices te maken, moet de vaardighedenset een AML-vaardigheid bevatten die verwijst naar hetzelfde model dat is opgegeven in de vectorizer.

Voorwaarden

  • Een Microsoft Foundry-hubproject of een AML-werkruimte voor een aangepast model dat u maakt.

  • Alleen voor hubprojecten is er een implementatie zonder server van een ondersteund model uit de Microsoft Foundry-modelcatalogus. U kunt de Azure CLI gebruiken om de serverloze implementatie in te richten.

Vectorizer-parameters

Parameters zijn hoofdlettergevoelig. De parameters die u gebruikt, zijn afhankelijk van de verificatie die uw modelprovider nodig heeft, indien van toepassing.

Parameternaam Beschrijving
uri (Vereist voor sleutelverificatie) De doel-URI van de serverloze implementatie uit de Microsoft Foundry-modelcatalogus of de scoring-URI van het online-eindpunt van AML. Alleen het HTTPS-URI-schema is toegestaan.
key (Vereist voor sleutelverificatie) De API-sleutel van de modelprovider.
resourceId (Vereist voor tokenverificatie) De Azure Resource Manager resource-id van de modelprovider. Gebruik voor een online AML-eindpunt de indeling subscriptions/{guid}/resourceGroups/{resource-group-name}/Microsoft.MachineLearningServices/workspaces/{workspace-name}/onlineendpoints/{endpoint_name}.
modelName De naam van het insluitmodel uit de Microsoft Foundry-modelcatalogus die is geïmplementeerd op de opgegeven uri. Ondersteunde modellen (alleen serverloze implementaties) zijn:

  • Cohere-embed-v3-english
  • Cohere-embed-v3-multilingual
  • Cohere-embed-v4
region (Optioneel voor tokenverificatie) De regio waarin de modelprovider wordt geïmplementeerd. Vereist als de regio verschilt van de regio van de zoekservice.
timeout (Optioneel) De time-out voor de HTTP-client die de API-aanroep maakt. Deze moet worden opgemaakt als een XSD-waarde 'dayTimeDuration' (een beperkte subset van een ISO 8601-duurwaarde ). Bijvoorbeeld PT60S gedurende 60 seconden. Als dit niet is ingesteld, wordt een standaardwaarde van 30 seconden gekozen. De time-out kan worden ingesteld op maximaal 230 seconden en minimaal 1 seconde.

Welke verificatieparameters moeten worden gebruikt

De vectorizer voor de Microsoft Foundry-modelcatalogus biedt twee verificatieopties:

  • Verificatie op basis van sleutels. U geeft een statische sleutel op voor het verifiëren van scoreaanvragen van de vectorizer. Stel de uri en key parameters voor deze verbinding in.

  • Verificatie op basis van tokens. Het foundry hub-project of het online-eindpunt van AML wordt geïmplementeerd met behulp van verificatie op basis van tokens. De Azure AI Zoeken-service moet een beheerde identiteit en een roltoewijzing hebben voor de modelprovider. De vectorizer gebruikt vervolgens de identiteit van de zoekservice om zich te authenticeren bij de modelprovider, zonder dat statische sleutels vereist zijn. De identiteit van de zoekservice moet de rol Eigenaar of Inzender hebben. Stel de resourceId parameter in en als de zoekservice zich in een andere regio bevindt dan de modelprovider, stelt u de region parameter in.

Ondersteunde vectorquerytypen

Welke vectorquerytypen worden ondersteund door de Microsoft Foundry model catalog vectorizer is afhankelijk van de modelName die is geconfigureerd.

Model insluiten Ondersteunt text queries Ondersteunt imageUrl queries Ondersteunt imageBinary queries
Cohere-embed-v3-english X X
Cohere-embed-v3-multilingual X X
Cohere-embed-v4 X X

Verwachte velddimensies

De verwachte velddimensies voor een vectorveld dat is geconfigureerd met een Microsoft Foundry-modelcatalogusvectorizer, zijn afhankelijk van de modelName die is geconfigureerd.

modelName Verwachte dimensies
Cohere-embed-v3-english 1024
Cohere-embed-v3-multilingual 1024
Cohere-embed-v4 256–1536

Voorbeelddefinitie

Voorgestelde modelnamen in de Foundry-modelcatalogus bestaan uit het basismodel plus een willekeurig achtervoegsel van drie letters. De naam van uw model verschilt van de naam die in dit voorbeeld wordt weergegeven.

"vectorizers": [
    {
        "name": "my-model-catalog-vectorizer",
        "kind": "aml",
        "amlParameters": {
            "uri": "https://Cohere-embed-v3-multilingual-hin.eastus.models.ai.azure.com",
            "key": "aaaaaaaa-0b0b-1c1c-2d2d-333333333333",
            "timeout": "PT60S",
            "modelName": "Cohere-embed-v3-multilingual-hin",
            "resourceId": null,
            "region": null,
        },
    }
]

Zie ook