Nota:
El acceso a esta página requiere autorización. Puede intentar iniciar sesión o cambiar directorios.
El acceso a esta página requiere autorización. Puede intentar cambiar los directorios.
Note
Búsqueda de Azure AI está disponible a través del portal de Azure, las API REST y los SDK de Azure. También respalda Foundry IQ, la capa de conocimiento administrada que transforma el contenido empresarial en bases de conocimiento reutilizables y compatibles con permisos para agentes en el portal de Microsoft Foundry.
Importante
Las características, funcionalidades o propiedades marcadas (versión preliminar) no están cubiertas por un contrato de nivel de servicio, no se recomiendan para cargas de trabajo de producción y pueden cambiar o restringirse antes de que estén disponibles con carácter general. Los términos de la versión preliminar Búsqueda de Azure AI se aplican a todas las funciones de vista previa, ya sea independiente o parte de una característica disponible con carácter general.
En este artículo se describe el modelo de ejecución del indexador que Búsqueda de Azure AI usa para los servicios de búsqueda de alta densidad estándar y sin servidor (S3 HD). Ambas opciones tienen una cuota diaria de tiempo de ejecución a nivel de servicio que determina cuánto tiempo total de ejecución del indexador se puede utilizar en cada periodo de 24 horas en UTC.
Las funcionalidades descritas en este artículo se encuentran en versión preliminar:
- La compatibilidad con indizadores en S3 HD requiere la
2025-11-01-previewAPI REST o posterior. - La compatibilidad con indexadores sin servidor requiere la
2026-05-01-previewAPI REST o posterior.
Dónde se aplica
El modelo de ejecución de este artículo se aplica a:
-
Servicios de búsqueda sin servidor que ejecutan indexadores mediante la
2026-05-01-previewAPI REST o posterior. - Servicios de búsqueda S3 HD que ejecutan indexadores con la API
2025-11-01-previewREST o versiones posteriores.
Las definiciones de indexador admitidas, los orígenes de datos, los conjuntos de aptitudes y los orígenes de conocimiento respaldados por el indexador funcionan sin modificaciones en ambas opciones.
Modelo de ejecución
Los indexadores en Serverless y S3 HD tienen las siguientes características de ejecución:
No tienes que aprovisionar ni administrar la infraestructura del indizador. El servicio controla la capacidad.
Los indexadores solo se ejecutan en el entorno de ejecución multiinquilino. El entorno de ejecución privado, que se proporciona a través de recursos de vínculo privado compartidos, no está disponible para los indexadores de estas SKU.
Para S3 HD, si necesita conexiones de indexador para mantenerse fuera de la red pública de Internet, configure un perímetro de seguridad de red (NSP) en el servicio de búsqueda para controlar el tráfico entrante y saliente a través de reglas de acceso explícitas.
En el caso de Sin servidor, no hay compatibilidad con conexiones privadas.
Cuota diaria de tiempo de ejecución acumulado
La ejecución del indexador se rige por una cuota diaria en tiempo de ejecución que se restablece a las 00:00 UTC. La cuota es:
- Nivel de servicio: Se aplica al servicio de búsqueda en su conjunto.
- Acumulado: El tiempo de ejecución de todos los indexadores del servicio se contabiliza dentro del mismo presupuesto. El cupo no se aplica a cada indexador.
Todos los indexadores en ejecución acumulan tiempo en un presupuesto de servicio compartido. El servicio no reserva el tiempo de ejecución para indizadores individuales ni divide automáticamente la cuota entre ellos. Por ejemplo, las duraciones acumulativas de 12 indizadores que se ejecutan durante dos horas pueden consumir las 24 horas de tiempo de ejecución agregados, tanto si las ejecuciones se superponen como si se producen en momentos diferentes.
En la tabla siguiente se muestra la cuota diaria por SKU y la versión mínima de la API que lo admite:
| SKU | Cuota diaria por ventana UTC de 24 horas | Versión mínima de la API |
|---|---|---|
| S3 HD | 24 horas | 2025-11-01-preview |
| Serverless | 24 horas | 2026-05-01-preview |
Cuando se agota la cuota diaria:
Los indexadores que se ejecutan actualmente se detienen en unos cinco minutos.
Las nuevas ejecuciones del indexador no procesan documentos y devuelven inmediatamente un error transitorio que indica que se ha superado la cuota diaria.
La ejecución normal del indexador se reanuda después de que el contador se restablezca a las 00:00 UTC.
Recuperarse del agotamiento de la cuota
Para recuperarse del agotamiento de cuotas y reducir la probabilidad de volver a alcanzarla:
Espere hasta el siguiente reinicio de las 00:00 UTC, o use Obtener estadísticas del servicio (API REST) para confirmar
remainingSecondsque se ha restablecido antes de iniciar nuevas ejecuciones.Coloque indizadores en programaciones escalonadas para que el trabajo se extienda a través de la ventana de 24 horas en lugar de ejecutarse simultáneamente.
No se pueden pausar ni detener ejecuciones activas. Use Obtener el estado del indizador para supervisarlos y vea Ejecutar o restablecer indizadores para obtener información sobre el comportamiento del control en tiempo de ejecución.
Si el tiempo de ejecución permanece pero se produce un error en las ejecuciones del indexador, consulte Solución de problemas del indexador.
Reduzca el coste de las habilidades. Las aptitudes que llaman a servicios externos, como la aptitud Azure OpenAI Embedding, GenAI Prompt y Azure Content Understanding, consumen tiempo de ejecución rápidamente. Reduzca el número de aptitudes, documentos por lotes o configure una caché de enriquecimiento para reutilizar los resultados anteriores en lugar de volver a procesarlos.
Supervise
remainingSecondsde forma proactiva tanto en el nivel de servicio como en el indexador para que pueda limitar las cargas de trabajo antes de que produzcan un error.
Supervisión del tiempo de ejecución acumulado
En esta sección se explica cómo realizar un seguimiento del uso en tiempo de ejecución y el presupuesto restante mediante las API REST del servicio de búsqueda. No hay experiencia en el portal para el tiempo de ejecución acumulado durante la versión preliminar.
Tiempo de ejecución de nivel de servicio
Use Get Service Statistics (API REST) para recuperar el tiempo de ejecución del indexador acumulativo en todos los indexadores del servicio para la ventana actual de 24 horas:
GET {endpoint}/servicestats?api-version=2026-08-01-preview
La respuesta incluye una indexersRuntime sección. El siguiente JSON muestra un servicio cuya cuota diaria de 24 horas no se usa:
"indexersRuntime": {
"usedSeconds": 0,
"remainingSeconds": 86400,
"beginningTime": "2026-05-16T00:00:00.000Z",
"endingTime": "2026-05-17T00:00:00.000Z"
}
Puntos clave:
-
usedSeconds: segundos totales que todos los indexadores del servicio han estado en ejecución durante la ventana actual. -
remainingSeconds: segundos que aún quedan antes de que se alcance la cuota diaria. Se muestra cuando se aplica un límite específico de un nivel. -
beginningTimeyendingTime: inicio y finalización de la ventana de recuento UTC actual de 24 horas.
Tiempo de ejecución de nivel de indexador
Use Get Indexer Status (REST API) para recuperar el tiempo de ejecución acumulado para un indexador individual:
GET {endpoint}/indexers('{indexerName}')/search.status?api-version=2026-08-01-preview
La respuesta incluye una runtime sección. El siguiente JSON muestra un indexador en un servicio cuya cuota diaria de 24 horas no se usa:
"runtime": {
"usedSeconds": 0,
"remainingSeconds": 86400,
"beginningTime": "2026-05-16T00:00:00.000Z",
"endingTime": "2026-05-17T00:00:00.000Z"
}
Puntos clave:
-
usedSeconds: número total de segundos que el indexador ha estado en ejecución durante el intervalo actual. -
remainingSeconds: los segundos siguen estando disponibles para todos los indexadores del servicio, no solo para este indexador. Se muestra cuando se aplica un límite específico de un nivel. -
beginningTimeyendingTime: inicio y finalización de la ventana de recuento UTC actual de 24 horas.
procedimientos recomendados
La compatibilidad con indizadores en S3 HD y Sin servidor está en versión preliminar. Siga estas instrucciones para ajustar el tamaño de las cargas de trabajo de forma adecuada y planear la facturación de Serverless que se va a introducir en una fecha posterior.
S3 HD
Durante la versión preliminar, la compatibilidad del indexador S3 HD se ha diseñado para cargas de trabajo sin conjuntos de aptitudes o con conjuntos de aptitudes pequeños. Para permanecer dentro de la cuota diaria:
Planifique índices pequeños de unos 1 GB.
Dimensiona cuidadosamente el uso del conjunto de aptitudes. Las habilidades que llaman a servicios externos, como la habilidad de inserción de Azure OpenAI, la habilidad GenAI Prompt y la habilidad Azure Content Understanding, aumentan significativamente el tiempo de ejecución y pueden consumir rápidamente la cuota diaria, especialmente en entornos multiinquilino.
Se espera un paralelismo limitado en la versión preliminar. Use ejecuciones programadas y escalonadas para grandes flotas de indexadores para que el trabajo se extienda a través de la ventana de 24 horas en lugar de competir por el mismo presupuesto.
Carga de trabajo ilustrativa de split-and-embed
En una prueba controlada de S3 HD, una habilidad Split y una habilidad Azure OpenAI Embedding generaron fragmentos y representaciones. La carga de trabajo produjo aproximadamente 2,5 fragmentos por documento de origen y aproximadamente 22 000 documentos de origen se observaron en esta prueba durante una ventana de prueba de S3 HD de 24 horas.
Los siguientes valores son aproximados y sirven para ilustrar el cálculo de distribución equitativa basado en la observación agregada. No se miden los resultados de cada indexador.
| Recuento de indexadores | Documentos de origen ilustrativos por indexador al día |
|---|---|
| 100 | Alrededor de 200 |
| 500 | Alrededor de 40 |
| 1,000 | Aproximadamente 20 |
El servicio no reserva capacidad ni garantiza la misma distribución, orden de ejecución o rendimiento para estos recuentos de indexadores.
Note
Este resultado se observó en una prueba controlada. No es un objetivo de rendimiento, una garantía de servicio, un compromiso de capacidad, una fórmula de dimensionamiento ni un sustituto de las pruebas de su carga de trabajo.
El rendimiento puede variar de forma considerable en función de la complejidad y el perfil del documento, la fragmentación, el número y el tipo de habilidades y salidas vectoriales, la latencia del modelo, la capacidad y la cuota, el rendimiento del origen y del destino, la concurrencia, el orden de programación, el estrangulamiento, la región, los errores y los reintentos, la extracción de contenido de documentos o el reconocimiento óptico de caracteres (OCR), y los volúmenes desiguales entre inquilinos. Pruebe con entradas de producción representativas antes de planear la capacidad.
Serverless
Durante la versión preliminar, los indexadores sin servidor están diseñados para simplificar la ingesta para escenarios de generación aumentada por recuperación (RAG) y knowledge base:
La ejecución del indexador (excepto las habilidades) es actualmente gratuita. La escritura de documentos en un índice conlleva un costo.
La ejecución del conjunto de aptitudes se factura de la misma manera que en los indexadores dedicados. Las llamadas a servicios externos, como la aptitud de inserción de Azure OpenAI, la aptitud de indicaciones de GenAI y la aptitud de Azure Content Understanding, se facturan a través del Recurso de servicios de Foundry o Azure AI.
Límites y cuotas
Para conocer los límites del indexador en Serverless y S3 HD, consulte Límites del indexador.
La cuota de tiempo de ejecución a nivel de servicio y los límites del indexador no reemplazan los límites de entrada, solicitud o procesamiento de las habilidades y los servicios externos de un conjunto de habilidades. Compruebe cada referencia de habilidad por separado al dimensionar una canalización de enriquecimiento.