Planeamiento y administración de los costos de un servicio Azure AI Search

Note

Búsqueda de Azure AI está disponible a través del portal de Azure, las API REST y los SDK de Azure. También respalda Foundry IQ, la capa de conocimiento administrada que transforma el contenido empresarial en bases de conocimiento reutilizables y compatibles con permisos para agentes en el portal de Microsoft Foundry.

Búsqueda de Azure AI está disponible en dos modelos de precios:

  • Dedicado: capacidad aprovisionada con precios fijos. Seleccione un nivel de servicio y se le facturará por hora en función de las unidades de búsqueda (SU). Mejor para cargas de trabajo estables, predecibles y de uso elevado.

  • Sin servidor (versión preliminar): precios basados en el consumo medidos por unidades de proceso por hora (CU/hr) y por GB/mes para el almacenamiento indexado. Ideal para cargas de trabajo poco frecuentes, con picos o muy variables.

En este artículo se explica cómo funciona la facturación en cada modelo y se proporcionan instrucciones para la estimación, minimización y supervisión de costos.

Descripción del modelo de precios

Búsqueda de Azure AI tiene dos modelos de precios principales: Dedicado y sin servidor. Ambos modelos conllevan cargos adicionales por separado para características prémium, como clasificador semántico, recuperación de agentes y enriquecimiento con IA.

Los costes de Búsqueda de Azure AI son un componente de tu factura total de Azure. Se le facturan todos los servicios y recursos de Azure usados en la suscripción, incluidos los servicios fuera de Búsqueda de Azure AI.

Para los servicios dedicados, utilice la calculadora de precios de Azure para estimar los costes en función de la capacidad y las características previstas. Una hoja de cálculo de planeamiento de capacidad puede ayudarle a modelar el tamaño esperado del índice, el rendimiento de indexación y los costos de indexación.

A medida que evoluciona la carga de trabajo de búsqueda, siga estas sugerencias para minimizar los costos durante la implementación y la operación. También puede usar métricas integradas para supervisar las solicitudes de consulta y Cost Management para crear presupuestos, alertas y exportaciones de datos.

Modelo de precios dedicado

Al crear o usar un servicio de búsqueda dedicado, pagas por la combinación mínima necesaria de réplicas y particiones (R × P) a la tarifa horaria prorrateada del nivel de servicio que elijas. Cada combinación de réplicas y particiones representa una unidad de capacidad dedicada.

Para obtener más información sobre los niveles de servicio disponibles, consulte Elegir un modelo de precios y un nivel de servicio.

A medida que aumenta o disminuye el número de réplicas o particiones, el total de unidades de búsqueda cambia y los costes se ajustan en consecuencia. Para obtener más información y ejemplos, consulte Tarifas de facturación.

Modelo de precios sin servidor (versión preliminar)

Important

El nivel Desarrollador sin servidor está actualmente en versión preliminar. Esta versión preliminar se ofrece sin contrato de nivel de servicio y no es aconsejable usarla en las cargas de trabajo de producción. Es posible que algunas características no se admitan o que tengan funcionalidades restringidas. Para más información, consulte Términos de uso complementarios para las versiones preliminares de Microsoft Azure.

La facturación del plan Serverless Developer comenzó el 13 de septiembre de 2026. Los cargos por el uso en o después de esa fecha aparecen en la factura de Azure. No se le cobrará por el uso antes del 13 de septiembre de 2026. El nivel Desarrollador sin servidor no admite la migración a ni desde otros planes de tarifa y algunas características disponibles en otros niveles no se admiten durante la versión preliminar pública. Los límites de servicio, las características admitidas y los detalles de precios pueden cambiar antes de la disponibilidad general.

Durante la versión preliminar, el modelo de precios sin servidor solo se admite en regiones específicas.

El modelo de precios sin servidor cobra en función del uso, sin capacidad aprovisionada previamente o inactiva. Solo pagas por los recursos informáticos que consumen las operaciones y el almacenamiento que utilizan tus índices.

A diferencia del modelo dedicado, no configura réplicas ni particiones. El servicio administra automáticamente la capacidad en función de la demanda de la carga de trabajo y de los límites del servicio.

La facturación sin servidor tiene dos dimensiones independientes:

  • Cómputo (unidades de cómputo, CU):
    El uso de proceso se mide en unidades de proceso por hora (RU/hr). El costo de proceso se basa en factores como la complejidad de las consultas, el tamaño del índice, el volumen de datos y el tipo de operación (consulta, indexación o enriquecimiento).

  • Almacenamiento indexado:
    El almacenamiento se factura por GB al mes en función del tamaño en disco de los índices. Este tamaño incluye contenido indizado y estructuras de datos auxiliares usadas para la recuperación.

Cómo se le cobra por las características premium

Las características Premium incurren en cargos además de los cargos de proceso y almacenamiento del servicio de búsqueda, independientemente de si usa el modelo de precios dedicado o sin servidor.

En la tabla siguiente se enumeran las características premium y sus unidades de facturación. Todas estas características son opcionales, por lo que si no las usa, no incurre en cargos.

Feature Unidad de facturación
Extracción de imágenes (enriquecimiento con IA) 1 Por cada 1000 imágenes. Consulte la página de precios.
Aptitud de búsqueda de entidades personalizadas (enriquecimiento con IA) Por cada 1000 registros de texto. Consulte la página de precios
Aptitudes integradas o personalizadas (enriquecimiento con IA) 2 Número de transacciones. Facturado según la tarifa del proveedor del modelo: Microsoft Foundry o modelos o recursos alojados en Azure.
Vectorizers2 Número de operaciones de vectorización. Facturado a la tarifa del proveedor de modelos: Azure Vision en Foundry Tools, Azure OpenAI o Foundry.
Clasificador semántico Número de consultas de queryType=semantic. Facturado a una tarifa progresiva. Consulte la página de precios.
Recuperación de agente Número de tokens de razonamiento agente, más el número de tokens usados en la planificación de consultas y la formulación de respuestas. Consulte la página de precios.
Vínculo privado compartido Se factura el ancho de banda. siempre que el vínculo privado compartido exista y se use.

1 Hace referencia a las imágenes extraídas de un archivo dentro de la canalización del indexador. La extracción de texto es libre. La extracción de imágenes se factura cuando habilita el parámetroindexAction o cuando se llama a la aptitud extracción de documentos.

2 Los cargos de los modelos de Azure OpenAI y los modelos Foundry aparecen en la factura de ambos servicios.

Cómo se le cobra de otro modo

En función de la configuración y el uso, se pueden aplicar los siguientes cargos:

1 Las sesiones de depuración solo están disponibles en servicios del modelo de precios dedicados.

Note

En los servicios dedicados, no se le factura por consulta. Sin embargo, los límites de servicio se aplican a cada plan de tarifa. En Serverless, las consultas consumen CU/h según la complejidad y el tamaño del índice.

Estimación y planeamiento de los costos del modelo de precios dedicado

Para calcular los costos del modelo de precios dedicado, use la calculadora de precios Azure para calcular los costos de línea base de Búsqueda de Azure AI. También puede encontrar estimaciones de costos y comparaciones de niveles en la página Seleccionar Nivel de Precios durante la creación del servicio.

Para las pruebas iniciales del modelo de precios dedicado, cree una hoja de cálculo de planeamiento de capacidad. La hoja de cálculo le ayuda a comprender la relación de índice a origen y el efecto de las características de enriquecimiento o vector en la capacidad y el costo.

Para crear una hoja de cálculo de planeamiento de capacidad:

  1. Indexe una pequeña muestra (de 1 a 5%) de los datos. Incluya cualquier habilidades de OCR, enriquecimiento o integración que planee usar.

  2. Mida el tamaño del índice, el rendimiento de indexación y los costos de indexación.

  3. Extrapola los resultados para calcular los requisitos a escala completa de los datos.

Cálculo y planeamiento de los costos del modelo de precios sin servidor

Para calcular y administrar los costos en Sin servidor, supervise tanto el consumo de proceso como el tamaño del índice, y optimice las consultas y el diseño del esquema para reducir el uso de recursos.

En primer lugar, indexe un ejemplo representativo y, a continuación, ejecute consultas típicas y mida el consumo de CU a través de x-ms-request-charge. Una vez que tenga un promedio de consumo, extrapole los costos en función de ese promedio. Para obtener orientación sobre cómo supervisar el uso de recursos de proceso, consulte Optimice los costes con el modelo de precios sin servidor.

Minimizar los costos del modelo de precios dedicado

Para minimizar los costos del modelo de precios dedicado, use las estrategias siguientes:

Implementación y configuración

  • Cree un servicio de búsqueda en una región con más almacenamiento por partición.

  • Cree todos los recursos de Azure relacionados en la misma región (o tan pocas regiones como sea posible) para minimizar o eliminar los cargos de ancho de banda.

  • Elija el nivel de servicio más ligero que satisfaga sus necesidades. Basic y S1 ofrecen acceso completo a la API moderna a la tarifa horaria más baja por SU. * En el caso de las cargas de trabajo con tráfico variable o de ráfaga, el modelo de precios sin servidor podría ser más rentable que un servicio Básico o S1 aprovisionado continuamente.

  • Use Azure Web Apps para la aplicación front-end para mantener las solicitudes y respuestas dentro del límite del centro de datos.

Scaling

  • Agregar particiones solo cuando el rendimiento de ingesta o tamaño del índice lo requiere.

  • Agregue réplicas solo cuando aumenten las consultas por segundo, cuando las consultas complejas limite el servicio o cuando se requiera alta disponibilidad.

  • Aumente la escala para operaciones que consumen muchos recursos, como la indexación, y luego reduzca la escala para cargas de trabajo de consultas normales.

  • Escriba código para automatizar el escalado para patrones de carga de trabajo predecibles.

  • Recuerde que la capacidad y los precios no son lineales. Duplicar la capacidad aumenta los costos más del doble en el mismo nivel. Para mejorar el rendimiento a un precio similar, considere la posibilidad de cambiar a un nivel superior.

Indexación y enriquecimiento

Minimizar los costos del modelo de precios sin servidor

Para minimizar los costos del modelo de precios dedicado, use las estrategias siguientes:

  • Supervise la telemetría de CU/hr para identificar consultas costosas.
  • Use el tipo de consulta más sencillo que satisfaga las necesidades de relevancia.
  • Quite los índices no utilizados para reducir los costos de almacenamiento.

Más información: Optimización de los costos con el modelo de precios sin servidor.

Supervisión de costos

En el nivel de servicio, puede supervisar las métricas integradas para las consultas por segundo (QPS), la latencia de búsqueda, las consultas limitadas y el tamaño del índice.

El uso de estas métricas depende del modelo de precios:

  • Modelo de precios dedicado:
    Utilice las métricas de QPS, latencia y limitación de velocidad para determinar cuándo añadir o quitar réplicas o particiones. El escalado de la capacidad afecta directamente al rendimiento y al costo, por lo que la supervisión de estas señales le ayuda a optimizar las unidades de búsqueda.

  • Modelo de precios sin servidor:
    Use estas métricas para comprender los patrones de carga de trabajo e identificar los controladores de costos. Dado que la capacidad sin servidor se administra automáticamente, no se escala mediante la adición de réplicas o particiones. En su lugar, céntrese en supervisar el consumo de proceso y optimizar el uso.

Para Sin servidor puede supervisar el uso de proceso por solicitud mediante el encabezado de respuesta x-ms-request-charge y analizar los patrones de consulta mediante los registros de Azure Monitor. El seguimiento del consumo de CU por tipo de consulta o carga de trabajo ayuda a identificar oportunidades para reducir el costo a través de la optimización de consultas, el diseño del esquema o la distribución de cargas de trabajo.

En el nivel de suscripción o grupo de recursos, Cost Management proporciona herramientas para realizar un seguimiento, analizar y controlar los costos. Use Gestión de costos para:

  • Cree presupuestos que definan y realicen un seguimiento del progreso con respecto a los límites de gasto. Para una supervisión más granular, personalice los presupuestos mediante filters para recursos o servicios específicos de Azure. Los filtros ayudan a garantizar que el seguimiento de costos se alinea con cargas de trabajo o implementaciones específicas.

  • Cree alertas que notifiquen automáticamente a las partes interesadas las anomalías de gasto o riesgos excesivos. Las alertas se basan en el gasto en comparación con los umbrales de presupuesto y costo, y se aplican en el nivel de suscripción o grupo de recursos.

  • Exportar datos de costos a una cuenta de almacenamiento para un análisis más profundo. Por ejemplo, los equipos financieros pueden analizar los datos exportados mediante Excel o Power BI. La exportación de datos de costos según una programación es el método recomendado para recuperar conjuntos de datos de costos.

FAQ

¿Puedo apagar temporalmente un servicio Search para ahorrar costos?

Search se ejecuta como un servicio continuo. Los recursos dedicados siempre están operativos y se asignan para su uso exclusivo durante la vigencia del servicio.

En el modelo de precios dedicado, para detener la facturación por completo, debe eliminar el servicio. La eliminación de un servicio es permanente y también elimina los datos asociados.

En el modelo de precios sin servidor, no hay ningún cargo de proceso cuando está inactivo. Solo paga por el almacenamiento indexado mientras el servicio no procesa las solicitudes.

¿Puedo cambiar el modelo de precios o la tasa de facturación (nivel) de un servicio de búsqueda existente?

Después de elegir el modelo de precios Dedicado o Sin servidor, no se pueden convertir los servicios de AI Search de uno a otro.

Si elige el modelo de precios dedicado, los servicios existentes pueden cambiar entre los niveles Básico y Estándar (S1, S2 y S3). La configuración del servicio actual no puede superar los límites del nivel de destino y la región no puede tener restricciones de capacidad en el nivel de destino. Para obtener más información, consulte Cambio del plan de tarifa.