Nota:
El acceso a esta página requiere autorización. Puede intentar iniciar sesión o cambiar directorios.
El acceso a esta página requiere autorización. Puede intentar cambiar los directorios.
Nota:
Búsqueda de Azure AI está disponible a través del portal de Azure, las API REST y los SDK de Azure. También respalda Foundry IQ, la capa de conocimiento administrada que transforma el contenido empresarial en bases de conocimiento reutilizables y compatibles con permisos para agentes en el portal de Microsoft Foundry.
Importante
Estas características y funcionalidades admiten conexiones a otros servicios de servicios Microsoft y de terceros. El uso de estos servicios está sujeto a sus respectivos términos y podría dar lugar a procesamiento o almacenamiento de datos fuera del límite de cumplimiento de Azure, así como a los datos que fluyen a los límites de cumplimiento de Azure.
Es su responsabilidad administrar si los datos fluirán fuera del cumplimiento y los límites geográficos de su organización, así como las implicaciones relacionadas, y que se aprovisionan los permisos, límites y aprobaciones adecuados.
Es responsable de revisar y probar cuidadosamente las aplicaciones que compile en el contexto de sus casos de uso específicos y de tomar todas las decisiones y personalizaciones adecuadas. Esto incluye implementar sus propias mitigaciones de IA responsables, como metaprompts, filtros de contenido u otros sistemas de seguridad, y garantizar que las aplicaciones cumplan los estándares de calidad, confiabilidad, seguridad y confiabilidad adecuados. Para obtener más información, consulte la nota de transparencia Búsqueda de Azure AI.
La habilidad GenAI (IA Generativa) ejecuta una solicitud chat completion contra un gran modelo de lenguaje (LLM) desplegado en Azure OpenAI en Foundry Models o Microsoft Foundry. Utiliza esta habilidad para crear nueva información que pueda indexarse y almacenarse como contenido buscable.
Aquí tienes algunos ejemplos de cómo la habilidad de prompt de GenAI puede ayudarte a crear contenido:
- Verbalizar imágenes
- Resume los largos pasajes de texto
- Simplificar contenido complejo
- Realiza cualquier otra tarea que puedas expresar en un prompt
La habilidad GenAI Prompt está generalmente disponible en la API REST del servicio de búsqueda 2026-04-01 API y en SDK de Azure que se dirigen a esta versión. Esta habilidad soporta texto, imagen y contenido multimodal, como imágenes con imágenes y texto extraído de archivos PDF.
Sugerencia
Es común combinar esta habilidad con una habilidad de fragmentación de datos. El tutorial multimodal demuestra la verbalización de imágenes con dos estrategias diferentes de fragmentación de datos.
Modelos compatibles
Puede usar cualquier modelo de inferencia de finalización de chat implementado en Foundry, como modelos GPT, DeepSeek-R#, Llama-4-Maverick y Cohere-command-r. Para los modelos GPT específicamente, solo se soportan los endpoints de la API de completación de chats. Los endpoints que usan la API de Azure OpenAI Responses (que contiene
/openai/responsesen el URI) no son compatibles actualmente.Para la verbalización de imágenes, el modelo que usas para analizar la imagen determina qué formatos de imagen se soportan.
Para los modelos GPT-5, el
temperatureparámetro no está soportado de la misma manera que en modelos anteriores. Si está definido, debe establecerse en1.0, ya que otros valores provocarán errores.La facturación se basa en el precio del modelo que uses.
Nota:
El servicio de búsqueda se conecta a tu modelo a través de un endpoint público, por lo que no hay requisitos de ubicación regional. Sin embargo, si usas una solución Azure completa, deberías consultar las regiones Búsqueda de Azure AI y las regiones del modelo OpenAI Azure para encontrar pares adecuados, especialmente si tienes requisitos de residencia de datos.
Prerequisites
Un recurso Azure OpenAI en Foundry Models o Foundry.
Un modelo soportado desplegado en tu recurso o proyecto.
Para Azure OpenAI, copia el endpoint con el dominio
openai.azure.comdesde la página Keys y Endpoint en el portal Azure. Usa este endpoint como parámetroUrien esta habilidad.Para Foundry, copia el URI objetivo para el despliegue desde la página de Modelos en el portal de Foundry. Usa este endpoint como parámetro
Urien esta habilidad.
La autenticación puede basarse en claves con una clave API de tu recurso OpenAI de Foundry o Azure. Sin embargo, recomendamos el acceso basado en roles usando una identidad gestionada por servicio de búsqueda asignada a un rol.
En Azure OpenAI, asigna Cognitive Services OpenAI User a la identidad gestionada.
En Foundry, asigne Foundry User a la identidad administrada.
Importante
Recientemente se cambió el nombre de los roles RBAC de Foundry. Foundry User, Foundry Owner, Foundry Account Owner y Foundry Project Manager se denominaron anteriormente Azure usuario de IA, propietario de Azure ai, propietario de Azure cuenta de IA y Azure AI Project Manager. Es posible que siga viendo los nombres anteriores en algunos lugares mientras se implementa el cambio de nombre. El cambio de nombre no modifica los identificadores de rol y los permisos principales.
@odata.type
#Microsoft.Skills.Custom.ChatCompletionSkill
Límites de datos
| Limit | Notas |
|---|---|
maxTokens |
El valor por defecto es 1024 si se omite. El valor máximo depende del modelo. |
| Tiempo de espera de la solicitud | Solucionado a los 30 segundos. Ten en cuenta este límite cuando elijas un modelo para indexación masiva, ya que los modelos de razonamiento (como o1 y o3) podrían excederlo. |
| Imágenes | Se admiten imágenes codificadas en base 64 y URLs de imagen. El límite de tamaño depende del modelo. |
Parámetros de aptitud
| Propiedad | Tipo | Obligatorio | Notas |
|---|---|---|---|
uri |
string | Sí | Punto de conexión del modelo implementado. Los dominios soportados son:
también se admiten los puntos de conexión Azure API Management, incluidos los dominios personalizados de API Management. Para la configuración, incluida la autenticación, RBAC y la conectividad privada opcional, consulte Use Azure API Management con Azure aptitudes y vectorizadores openAI. |
apiKey |
string | Cond.* | Llave secreta para el modelo. Deja en blanco al usar la identidad gestionada. |
authIdentity |
string | Cond.* | User-assigned ID de cliente de identidad gestionada (Azure solo OpenAI). Deja en blanco para usar la identidad asignada por el sistema . |
commonModelParameters |
object | No | Controles de generación estándar como temperature, maxTokens, etc. |
extraParameters |
object | No | El diccionario abierto pasó a la API del modelo subyacente. |
extraParametersBehavior |
string | No |
"pass-through"
|
"drop"
|
"error" (por defecto "error"). |
responseFormat |
object | No | Controla si el modelo devuelve texto, un objeto JSON de forma libre o un esquema JSON fuertemente tipado.
responseFormat Ejemplos de cargas útiles: {responseFormat: { type: text }}, {responseFormat: { type: json_object }}, {responseFormat: { type: json_schema }} |
*
Debe usarse exactamente una de apiKey, authIdentity, o la identidad asignada por el sistema del servicio.
commonModelParameters Predeterminados
| Parámetro | Predeterminado |
|---|---|
model |
(valor predeterminado de implementación) |
frequencyPenalty |
0 |
presencePenalty |
0 |
maxTokens |
1024 |
temperature |
0,7 |
seed |
nulo |
stop |
nulo |
Entradas de habilidades
| Nombre de entrada | Tipo | Obligatorio | Descripción |
|---|---|---|---|
systemMessage |
string | Sí | Instrucción a nivel de sistema (por ejemplo: "Eres un asistente útil."). |
userMessage |
string | Sí | Aviso del usuario. |
text |
string | No | Texto opcional añadido a userMessage (escenarios solo de texto). |
image |
cadena (Base 64 data-URL) | No | Añade una imagen al prompt (solo modelos multimodales). |
imageDetail |
cuerda (low | high | auto) |
No | Fidelity hint para modelos multimodales Azure OpenAI. |
Resultados de habilidades
| Nombre de salida | Tipo | Descripción |
|---|---|---|
response |
cadena de cadenas u objeto JSON | Salida del modelo en el formato solicitado por responseFormat.type. |
usageInformation |
Json (objeto) | Conteo de tokens y eco de los parámetros del modelo. |
Definiciones de ejemplo
Resumen de solo texto
{
"@odata.type": "#Microsoft.Skills.Custom.ChatCompletionSkill",
"name": "Summarizer",
"description": "Summarizes document content.",
"context": "/document",
"inputs": [
{ "name": "text", "source": "/document/content" },
{ "name": "systemMessage", "source": "='You are a concise AI assistant.'" },
{ "name": "userMessage", "source": "='Summarize the following text:'" }
],
"outputs": [ { "name": "response" } ],
"uri": "https://demo.openai.azure.com/openai/deployments/gpt-4o/chat/completions",
"apiKey": "<api-key>",
"commonModelParameters": { "temperature": 0.3 }
}
Descripción de texto + imagen
{
"@odata.type": "#Microsoft.Skills.Custom.ChatCompletionSkill",
"name": "Image Describer",
"context": "/document/normalized_images/*",
"inputs": [
{ "name": "image", "source": "/document/normalized_images/*/data" },
{ "name": "imageDetail", "source": "=high" },
{ "name": "systemMessage", "source": "='You are a useful AI assistant.'" },
{ "name": "userMessage", "source": "='Describe this image:'" }
],
"outputs": [ { "name": "response" } ],
"uri": "https://demo.openai.azure.com/openai/deployments/gpt-4o/chat/completions",
"authIdentity": "11111111-2222-3333-4444-555555555555",
"responseFormat": { "type": "text" }
}
Buscador numérico estructurado de hechos
{
"@odata.type": "#Microsoft.Skills.Custom.ChatCompletionSkill",
"name": "NumericalFactFinder",
"context": "/document",
"inputs": [
{ "name": "systemMessage", "source": "='You are an AI assistant that helps people find information.'" },
{ "name": "userMessage", "source": "='Find all the numerical data and put it in the specified fact format.'"},
{ "name": "text", "source": "/document/content" }
],
"outputs": [ { "name": "response" } ],
"uri": "https://demo.openai.azure.com/openai/deployments/gpt-4o/chat/completions",
"apiKey": "<api-key>",
"responseFormat": {
"type": "json_schema",
"jsonSchemaProperties": {
"name": "NumericalFactObj",
"strict": true,
"schema": {
"type": "object",
"properties": "{\"facts\":{\"type\":\"array\",\"items\":{\"type\":\"object\",\"properties\":{\"number\":{\"type\":\"number\"},\"fact\":{\"type\":\"string\"}},\"required\":[\"number\",\"fact\"]}}}",
"required": [ "facts" ],
"additionalProperties": false
}
}
}
}
Salida de muestra (truncada)
{
"response": {
"facts": [
{ "number": 32.0, "fact": "Jordan scored 32 points per game in 1986-87." },
{ "number": 6.0, "fact": "He won 6 NBA championships." }
]
},
"usageInformation": {
"usage": {
"completion_tokens": 203,
"prompt_tokens": 248,
"total_tokens": 451
}
}
}
procedimientos recomendados
- Agrupa documentos largos con la habilidad División de Texto para mantenerlos dentro de la ventana de contexto del modelo.
- Para indexación de alto volumen, dedica un despliegue de modelo separado a esta habilidad para que las cuotas de tokens para cargas de trabajo RAG en tiempo de consulta permanezcan intactas.
- Para minimizar la latencia, coloca el modelo y tu servicio Búsqueda de Azure AI en la misma región de Azure.
- Úsalo
responseFormat.json_schemacon GPT-4o para una extracción estructurada fiable y un mapeo más fácil a campos de índice. - Monitoriza el uso de tokens y envía solicitudes de aumento de cuota si el indexador satura tus límites de Tokens por Minuto (TPM).
Errores y advertencias
| Condition | Resultado |
|---|---|
Faltantes o inválidas uri |
Error |
| No se especifica ningún método de autenticación | Error |
Tanto apiKey como authIdentity suministrado |
Error |
| Modelo no soportado para prompt multimodal | Error |
| La entrada supera el límite de token de modelo | Error |
El modelo devuelve JSON inválido para json_schema |
Advertencia: Cadena sin formato devuelta en response |
Consideraciones de seguridad para la autenticación de identidad administrada
Cuando la aptitud Preguntar de GenAI usa la autenticación de identidad administrada, Búsqueda de Azure AI obtiene un token de acceso de Microsoft Entra para la audiencia de Foundry Tools (https://cognitiveservices.azure.com) e incluye en las solicitudes enviadas al punto de conexión especificado por uri. La autenticación de identidad administrada se aplica cuando authIdentity se establece, o cuando ambos apiKey y authIdentity están vacíos y el servicio usa la identidad asignada por el sistema.
Se espera que el punto de conexión al uri que hace referencia sea su propio recurso Azure OpenAI o Foundry. Los dominios soportados son:
openai.azure.comcognitiveservices.azure.comservices.ai.azure.com
también se admiten los puntos de conexión de Azure API Management (*.azure-api.netAPIM) y dominios personalizados que tienen delante estos recursos. Dado que un dominio personalizado o un nombre de host de APIM no se pueden comprobar solo desde su nombre, Búsqueda de Azure AI valida estos puntos de conexión con una comprobación de conectividad activa en el momento de la configuración en lugar de mediante la coincidencia de dominios. Usted es responsable de configurar y mantener la relación entre el punto de conexión y el Azure recurso OpenAI o Foundry detrás de él.
Nota:
Un token de identidad administrada emitido para la audiencia de Foundry Tools es válido en cualquier recurso de Foundry Tools o Azure recurso de OpenAI en el que se autoriza la identidad. Enviarlo a un punto de conexión que no es de confianza podría exponer el token.
Procedimientos de seguridad recomendados
Para ayudar a mantener una implementación segura, siga estos procedimientos:
- Establezca
urisolo en los puntos de conexión que posee y confíe. Prefiere los dominios de Foundry Tools enumerados anteriormente. Si usa un punto de conexión de APIM o de dominio personalizado, confirme que frente a su propio recurso antes de habilitar la identidad administrada. Un nombre de host de aspecto de confianza no es prueba de propiedad. - Aplique el principio de privilegios mínimos a la identidad administrada usada por el servicio de búsqueda:
- En Azure OpenAI, asigne solo el usuario openAI de Cognitive Services.
- En Foundry, asigne solo el usuario foundry. Evite conceder roles más amplios.
- Use el perímetro de seguridad de red (NSP) y los puntos de conexión privados o la integración de red virtual para restringir los puntos de conexión a los que puede llegar el servicio de búsqueda y los orígenes desde los que el recurso de destino acepta solicitudes.
- Si usa un punto de conexión de APIM o de dominio personalizado, asegúrese de que la puerta de enlace valida las solicitudes entrantes y las reenvía solo al back-end previsto. También debe revisar periódicamente sus directivas de acceso.
- Se prefiere la identidad administrada a través de
apiKey. Si usaapiKey, almacene y gire de forma segura y no lo inserte en el control de código fuente. El servicio rechaza las configuraciones que establecen yapiKeyauthIdentity. - Revise periódicamente las definiciones del conjunto de aptitudes, las asignaciones de roles de identidad administrada y apiM y las configuraciones de dominio personalizado para confirmar que
urilos valores, los controles de acceso y los permisos de identidad siguen siendo actuales y adecuados. Revise los cambios de configuración a través de los procesos establecidos de administración de cambios y revisión de seguridad. - Supervise Azure registros de inicio de sesión de OpenAI, Foundry Tools y Foundry, eventos de autenticación y registros de acceso para actividades inesperadas o no autorizadas.
- Quite las aptitudes, los puntos de conexión, las asignaciones de roles y las claves de API que ya no son necesarias.
Restricción del acceso a la configuración del conjunto de aptitudes
Los usuarios que pueden crear, modificar o ejecutar conjuntos de aptitudes controlan tanto el punto de conexión de destino (uri) como la configuración de autenticación usada por la aptitud. Dado que la aptitud envía un token de identidad administrada para la audiencia de Foundry Tools a ese punto de conexión, restrinja estos permisos a los administradores de confianza y siga los procesos estándar de administración de cambios y revisión de seguridad al configurar aptitudes habilitadas para identidad administrada.