Escolha um modelo de preços e uma camada de serviço no Pesquisa de IA do Azure 

Observação

Pesquisa de IA do Azure  está disponível por meio do portal Azure, APIs REST e SDKs do Azure. Ele também sustenta o IQ do Foundry, a camada de conhecimento gerenciado que transforma o conteúdo da empresa em bases de conhecimento reutilizáveis e com reconhecimento de permissão para agentes no portal do Microsoft Foundry.

Ao criar um serviço de pesquisa, você deve escolher um modelo de preço e uma camada de serviço. Pesquisa de IA do Azure  oferece dois modelos de preços, cada um adequado para diferentes padrões de carga de trabalho, com camadas de serviço associadas que determinam a capacidade e os recursos:

Modelo de preços Mais adequado para Como você é cobrado
Dedicado Cargas de trabalho estáveis, previsíveis e de alta utilização Capacidade fixa por SUs (Unidades de Pesquisa); tarifa por hora com base na seleção de um nível de serviço
Sem servidor (versão prévia) Cargas de trabalho pouco frequentes, com intermitência ou altamente variáveis Baseado em consumo: medido por CUs (Unidades de Computação ) e armazenamento indexado (GB/mês)

Observação

SUs (Unidades de Pesquisa de modelo dedicado) e CUs (unidades de computação) de modelo sem servidor não são as mesmas e não podem ser usadas de forma intercambiável. Não use calculadoras de preços baseadas em SU ou estimativas para cargas de trabalho sem servidor.

Ambos os modelos fornecem os mesmos recursos de pesquisa principais (com algumas pequenas exceções para a visualização sem servidor indicada abaixo). A principal diferença é o comportamento de preços e escala, não os recursos.

Selecionar o modelo de preço dedicado requer estimar suas necessidades de carga de trabalho e, em seguida, escolher uma camada de serviço com a capacidade pré-provisionada apropriada.

Selecionar o modelo de preços sem servidor não requer a seleção de uma camada de serviço pré-provisionada, mas usa preços baseados em consumo, portanto, a otimização de desempenho afetará diretamente o custo.

Modelo de preço sem servidor (versão prévia)

Important

A camada desenvolvedor sem servidor está atualmente em versão prévia. Essa versão prévia é fornecida sem um contrato de nível de serviço e não é recomendada para cargas de trabalho de produção. Alguns recursos podem não ter suporte ou podem ter restrição de recursos. Para obter mais informações, consulte Termos de Uso Complementares para Versões Prévias do Microsoft Azure.

A cobrança pelo nível Serverless Developer começou em 13 de setembro de 2026. Os encargos de uso em ou após essa data aparecem em sua fatura Azure. Você não é cobrado pelo uso antes de 13 de setembro de 2026. A camada de Desenvolvedor sem Servidor não dá suporte à migração para ou de outros tipos de preço e alguns recursos disponíveis em outras camadas não têm suporte durante a Visualização Pública. Limites de serviço, recursos com suporte e detalhes de preços podem ser alterados antes da disponibilidade geral.

Durante a visualização, o modelo de preços sem servidor tem suporte apenas em regiões específicas.

O modelo de preços sem servidor é uma oferta baseada em consumo que dimensiona automaticamente a computação e o armazenamento com base em sua carga de trabalho. Elimina a necessidade de provisionar a capacidade antecipadamente, permitindo que você pague apenas pelos recursos usados.

Ao usar o modelo sem servidor, você não configura réplicas, partições ou unidades de pesquisa. Em vez disso, o serviço gerencia a capacidade dinamicamente em resposta ao volume de consulta, à atividade de indexação e à complexidade da carga de trabalho.

A cobrança é baseada em duas dimensões primárias:

  • Uso de computação: medido em UNIDADES de Computação por hora (/h) e cobrado com base no trabalho executado (consultas, indexação e outras operações).
  • Armazenamento indexado: cobrado por GB por mês com base no tamanho dos índices.

Esse modelo foi projetado para cargas de trabalho com demanda variável, incluindo tráfego intermitente e aplicativos multilocatários. Ele dá suporte aos mesmos recursos de pesquisa principais e APIs que os serviços dedicados, para que você possa criar e executar aplicativos de pesquisa sem reescrever o código.

A camada de Desenvolvedor sem Servidor está em Versão Prévia Pública e atualmente não dá suporte aos seguintes recursos:

  • Aliases de índice: sem suporte
  • Sessões de depuração: sem suporte
  • Rede privada para indexadores: sem suporte
  • Recursos de Link Privado compartilhados: sem suporte planejado para o modelo sem servidor
  • Contrato de nível de serviço (SLA): não disponível durante a visualização pública

Para saber mais, consulte Service Limits in Pesquisa de IA do Azure .

Para obter opções adicionais de implantação em larga escala sem servidor, entre em contato com a Microsoft usando o formulário de inscrição Pesquisa de IA do Azure  Serverless Private Preview Sign-up Form.

Modelo de preço dedicado

O modelo de preço dedicado é uma oferta de capacidade provisionada que fornece desempenho e custo previsíveis alocando infraestrutura fixa para sua carga de trabalho. Você configura a capacidade com antecedência, o que permite ao serviço lidar com demandas consistentes de indexação e consulta com recursos garantidos.

Com as camadas dedicadas, você configura explicitamente réplicas, partições e SUs (unidades de pesquisa). As réplicas fornecem taxa de transferência de consulta e alta disponibilidade, enquanto as partições definem a capacidade de armazenamento e indexação. Juntos, eles determinam as características totais de capacidade e desempenho do serviço de pesquisa.

A cobrança é baseada em:

  • Camada de serviço: A capacidade provisionada pré-selecionada.
  • Unidades de pesquisa (SUs): a unidade de cobrança para serviços dedicados, calculada como réplicas × partições. Você paga uma taxa fixa por hora com base no número de unidades de pesquisa e na camada de serviço selecionada.

Esse modelo foi projetado para cargas de trabalho com demanda estável e previsível, em que o desempenho consistente, a baixa latência e o dimensionamento controlado são importantes.

No modelo de preço dedicado, a camada de serviço selecionada determina:

  • Número máximo de índices e outros objetos permitidos no serviço.
  • Tamanho e velocidade das partições (armazenamento físico).
  • Valor faturável como um custo mensal fixo, mas também como um custo incremental ao adicionar capacidade.
  • Características da carga de trabalho. Algumas camadas são otimizadas para cargas de trabalho específicas.

Em alguns casos, o nível também determina a disponibilidade de recursos premium.

Descrições de camada

Os níveis faturáveis mais comumente usados incluem:

  • O Básico dá suporte a cargas de trabalho de produção e pode atender aos requisitos de SLA com até três réplicas.

  • Standard (S1, S2, S3) é a camada padrão. Ele dá suporte ao dimensionamento de partições e réplicas, habilitando cargas de trabalho maiores e melhor desempenho.

Algumas camadas são projetadas para determinados tipos de trabalho:

  • Standard 3 High Density (S3 HD) é um modo de hospedagem para S3 otimizado para multilocatário. O HD S3 tem o mesmo custo por unidade que o S3, mas dá suporte a um grande número de índices menores e usa hardware otimizado para leituras rápidas de arquivos e cenários de armazenamento de alta densidade.

  • As camadas com otimização de armazenamento (L1, L2) fornecem armazenamento de menor custo por TB e são projetadas para índices grandes e com menos frequência atualizados. Normalmente, essas camadas têm latência de consulta mais alta.

Há também uma camada de serviço de pesquisa gratuita e limitada:

  • Gratuito oferece um serviço de busca limitado para projetos de pequeno porte, como tutoriais e desenvolvimento. Os recursos são compartilhados entre locatários e não há suporte para dimensionamento. Alguns recursos premium não estão disponíveis e o serviço pode ser excluído após períodos de inatividade. Você pode ter um serviço de pesquisa gratuito por assinatura do Azure.

Você verá as taxas de cobrança no portal do Azure ao criar um novo serviço de Pesquisa de IA do Azure  na página Selecionar Tipo de Preço.

Captura de tela do portal Azure Selecione um gráfico de tipo de preço listando as camadas de serviço e suas SKU.

Você pode verificar a página de preços para obter taxas regionais.

Examine o Plano e gerencie os custos para saber mais sobre o modelo de preços dedicado e como ele se compara ao modelo sem servidor.

Verifique os limites de Serviço em Pesquisa de IA do Azure  ou limites de armazenamento, cargas de trabalho e contagens de objetos por camada.

Como selecionar uma camada

No portal Azure, as camadas de serviço são especificadas na página Select Pricing Tier quando você cria o serviço.

No PowerShell ou na CLI do Azure, a camada é especificada por meio do parâmetro -Sku.

Disponibilidade da região por nível

A lista de regiões fornece os locais em que o Pesquisa de IA do Azure  é oferecido. Algumas regiões podem ter restrições de capacidade para determinadas camadas, o que impede a criação de novos serviços de pesquisa nessas camadas. A lista usa notas de rodapé para indicar regiões e camadas restritas.

Quando você cria um serviço de pesquisa no portal do Azure, combinações de camadas de região indisponíveis são excluídas automaticamente.

Disponibilidade de recursos por camada

A maioria dos recursos está disponível em todas as camadas. Em alguns casos, a disponibilidade do recurso depende da camada selecionada:

Recurso Considerações sobre a camada de serviço
Indexadores Os indexadores estão disponíveis no HD S3 com cota de execução diária entre indexadores e outras considerações (versão prévia). Os indexadores têm mais limitações na camada gratuita.
Parâmetro de configuraçãoexecutionEnvironment do indexador A capacidade de fixar todo o processamento do indexador apenas para os clusters de pesquisa alocados para seu serviço de pesquisa requer S2 e superior.
Enriquecimento de IA É executado na camada Gratuita, mas não recomendado para cargas de trabalho grandes.
Identidades gerenciadas ou confiáveis para acesso de saída (indexador) Não disponível na camada gratuita.
Chaves de criptografia gerenciadas pelo cliente Não disponível na camada gratuita.
Acesso de firewall de IP Não disponível na camada gratuita.
Ponto de extremidade privado (integração com o Link Privado do Azure) Para conexões de entrada para um serviço de pesquisa, não disponível na camada gratuita.
Para conexões de saída de indexadores com outros recursos do Azure, não disponível em Gratuito ou S3 HD.
Para indexadores que usam conjuntos de habilidades, não disponível em Gratuito, Básico, S1 ou S3 HD.
Zonas de Disponibilidade Não disponível na camada gratuita.
Classificador semântico É executado na camada Gratuita, mas não recomendado para cargas de trabalho grandes.

Recursos com uso intensivo de funcionalidades podem não funcionar bem, a menos que você forneça capacidade suficiente. Por exemplo, o Enriquecimento de IA tem habilidades de longa execução que atingirão o tempo limite em um serviço Gratuito, a menos que o conjunto de dados seja pequeno.

Limites máximos

As camadas determinam o armazenamento máximo do próprio serviço, além do número máximo de índices, indexadores, fontes de dados, conjuntos de habilidades e mapas de sinônimos que você pode criar. Para obter uma interrupção completa de todos os limites, consulte Limites de serviço na IA do Azure Search.

Tamanho e velocidade da partição

O preço da camada inclui detalhes sobre o armazenamento por partição, que varia de 15 GB para camadas Básico a 2 TB para camadas Otimizadas para Armazenamento (L2). Outras características de hardware, como velocidade de operações, latência e taxas de transferência, não são publicadas, mas as camadas projetadas para arquiteturas de solução específicas são criadas em hardware que tem os recursos para dar suporte a esses cenários. Para obter mais informações sobre partições, consulte Estimar e gerenciar a capacidade e Confiabilidade na IA do Azure Search.

Observação

Partições de maior capacidade ficaram disponíveis em regiões selecionadas em abril de 2024. Uma segunda onda de partições de maior capacidade foi lançada em maio de 2024. Se você tiver um serviço de pesquisa mais antigo, poderá atualizar seu serviço para se beneficiar de mais capacidade na mesma taxa de cobrança.

Taxas de cobrança

As camadas têm taxas de cobrança diferentes, com taxas mais altas para camadas que são executadas em hardware mais caro ou fornecem recursos mais caros. A taxa de cobrança da camada pode ser encontrada nas páginas de preços do Azure para a Pesquisa de IA do Azure.

Depois de criar um serviço, a taxa de cobrança se torna um custo fixo de execução do serviço 24 horas por dia e um custo incremental se você optar por adicionar mais capacidade.

No modelo dedicado, a cobrança é feita com base em SUs (Unidades de Pesquisa), que combinam partições (armazenamento) e réplicas (capacidade de consulta).

  • Um serviço começa com uma partição e uma réplica (um SU)
  • Adicionar partições ou réplicas aumenta o custo linearmente com o número de SUs

Por exemplo, adicionar réplicas para melhorar a disponibilidade ou a taxa de transferência aumenta proporcionalmente o custo mensal.

Para obter mais informações, consulte Planejar e gerenciar custos.

Exemplo de taxa de cobrança

O exemplo a seguir ilustra esse cenário. Imagine uma taxa de cobrança hipotética de US$ 100 por mês. Se você mantiver o serviço de pesquisa em sua capacidade inicial de uma partição e uma réplica, US$ 100 será o que você pode esperar pagar no final do mês. No entanto, se você adicionar mais duas réplicas para obter alta disponibilidade, a fatura mensal aumentará para US$ 300 (US$ 100 para o primeiro par de partição e réplica e US$ 200 para as duas réplicas).

Alterações de camada

Observação

Os serviços de pesquisa existentes podem alternar entre as camadas Básica e Standard (S1, S2 e S3). Sua configuração de serviço atual não pode exceder os limites da camada de destino e sua região não pode ter restrições de capacidade na camada de destino. Para obter mais informações, consulte Alterar seu tipo de preço.

Para alternar para uma camada diferente daquelas listadas anteriormente:

  1. Crie um serviço de pesquisa na nova camada.
  2. Implante o conteúdo da sua pesquisa no novo serviço. Siga esta lista de verificação para garantir que você tenha todo o conteúdo.
  3. Exclua o serviço antigo quando tiver certeza de que ele não é mais necessário.

Para índices grandes que você não deseja recriar do zero, use um dos seguintes exemplos de backup e restauração:

Próximas etapas

A melhor maneira de escolher um tipo de preço é começar com uma camada de menor custo e, em seguida, permitir experiência e teste para informar sua decisão de manter o serviço ou mudar para uma camada mais alta.

Para as próximas etapas, recomendamos que você crie um serviço de pesquisa em uma camada que possa acomodar o nível de teste que você propõe fazer e examine as seguintes diretrizes sobre como estimar o custo e a capacidade: