Pianificare e gestire i costi di un servizio Azure AI Search

Note

Azure AI Search è disponibile tramite il portale di Azure, le API REST e Azure SDK. È inoltre alla base di Foundry IQ, il livello di conoscenza gestito che trasforma il contenuto aziendale in knowledge base riutilizzabili e con riconoscimento delle autorizzazioni per gli agenti nel portale di Microsoft Foundry.

Azure AI Search è disponibile in due modelli di prezzi:

  • Dedicata: capacità allocata a prezzo fisso. Si seleziona un livello di servizio e la fatturazione avviene su base oraria in base alle unità di ricerca (SU). Ideale per carichi di lavoro costanti, prevedibili e ad alto utilizzo.

  • Serverless (anteprima): prezzi basati sul consumo misurati dalle unità di calcolo all'ora (CU/hr) e per GB/mese per l'archiviazione indicizzata. Ideale per carichi di lavoro sporadici, discontinui o altamente variabili.

Questo articolo illustra il funzionamento della fatturazione in ogni modello e fornisce indicazioni per la stima dei costi, la riduzione al minimo e il monitoraggio.

Informazioni sul modello di determinazione prezzi

Azure AI Search ha due modelli di prezzi principali: dedicato e serverless. Entrambi i modelli comportano addebiti separati per le funzionalità Premium, ad esempio il ranker semantico, il recupero agentico e l'arricchimento tramite intelligenza artificiale.

Azure AI Search addebiti sono un componente della fattura complessiva Azure. Vengono addebitati tutti i servizi e le risorse Azure usati nella sottoscrizione, inclusi i servizi all'esterno di Azure AI Search.

Per i servizi dedicati, usare il calcolatore prezzi Azure per stimare i costi in base al capacity e alle funzionalità pianificate. Un foglio di lavoro di pianificazione della capacità consente di modellare le dimensioni previste degli indici, la velocità effettiva di indicizzazione e i costi di indicizzazione.

Man mano che il tuo carico di lavoro di ricerca si evolve, segui questi suggerimenti per ridurre al minimo i costi sia durante la distribuzione sia durante il funzionamento. È anche possibile usare le metriche predefinite per monitorare le richieste di query e Gestione costi per creare budget, avvisi ed esportazioni di dati.

Modello di determinazione prezzi dedicato

Quando si crea o si usa un servizio di ricerca dedicato, si paga per la combinazione minima di replica e partizione richiesta (R × P) alla tariffa oraria ripartita del livello di servizio selezionato. Ogni combinazione di repliche e partizioni rappresenta un'unità di capacità dedicata.

Per altri dettagli sui livelli di servizio disponibili, vedere Scegliere un modello tariffario e un livello di servizio.

Quando si aumenta o diminuisce il numero di repliche o partizioni, le unità di ricerca totali cambiano e i costi vengono ridimensionati di conseguenza. Per altre informazioni ed esempi, vedere Tariffe di fatturazione.

Modello di prezzi serverless (anteprima)

Importante

Il livello serverless per sviluppatori è attualmente in anteprima. Questa anteprima viene fornita senza un contratto di servizio e non è consigliata per i carichi di lavoro di produzione. Alcune funzionalità potrebbero non essere supportate o potrebbero avere funzionalità limitate. Per ulteriori informazioni, vedere Condizioni supplementari per l'uso delle versioni di anteprima di Microsoft Azure.

La fatturazione per il piano Serverless Developer è iniziata il 13 settembre 2026. Addebiti per l'utilizzo su o dopo tale data vengono visualizzati nella fattura Azure. Non ti verrà addebitato alcun costo per l'utilizzo prima del 13 settembre 2026. Il livello Developer serverless non supporta la migrazione verso o da altri livelli tariffari e alcune funzionalità disponibili in altri livelli non sono disponibili durante l'anteprima pubblica. I limiti del servizio, le funzionalità supportate e i dettagli dei prezzi possono cambiare prima della disponibilità generale.

Durante l'anteprima, il modello di determinazione prezzi serverless è supportato solo in aree specifiche.

Il modello tariffario serverless addebita i costi in base all’utilizzo, senza capacità preallocata o inutilizzata. Si paga solo per le risorse di calcolo utilizzate dalle operazioni e l'archiviazione usata dagli indici.

A differenza del modello dedicato, non si configurano repliche o partizioni. Il servizio gestisce automaticamente la capacità in base alla domanda del carico di lavoro e ai limiti del servizio.

La fatturazione serverless ha due dimensioni indipendenti:

  • Calcolo (unità di calcolo, CU):
    L'utilizzo del calcolo viene misurato in unità di calcolo all'ora (UR/hr). Il costo di calcolo è basato su fattori quali complessità delle query, dimensioni dell'indice, volume di dati e tipo di operazione (esecuzione di query, indicizzazione o arricchimento).

  • Archiviazione indicizzata:
    Lo spazio di archiviazione viene fatturato per GB al mese in base alla dimensione su disco degli indici. Queste dimensioni includono contenuto indicizzato e strutture di dati di supporto usate per il recupero.

Come vengono addebitati i costi per le funzionalità Premium

Le funzionalità Premium comportano addebiti oltre ai costi di calcolo e archiviazione per il servizio di ricerca, indipendentemente dal fatto che si usi il modello tariffario dedicato o serverless.

La tabella seguente elenca le funzionalità Premium e le relative unità di fatturazione. Tutte queste funzionalità sono facoltative, quindi se non vengono usate, non vengono addebitati costi.

Feature Unità di fatturazione
Estrazione di immagini (arricchimento tramite intelligenza artificiale) 1 Per 1.000 immagini. Vedi la pagina dei prezzi.
Competenza ricerca entità personalizzata (arricchimento tramite intelligenza artificiale) Ogni 1.000 registrazioni di testo. Vedere la pagina dei prezzi
Competenze predefinite o personalizzate (arricchimento tramite intelligenza artificiale) 2 Numero di transazioni. Fatturata alla tariffa del provider del modello: Microsoft Foundry oppure modelli o risorse ospitati in Azure.
Vectorizers2 Numero di operazioni di vettorizzazione. Fatturata alla tariffa applicata dal provider dei modelli: Azure Vision in Foundry Tools, Azure OpenAI o Foundry.
Classificatore semantico Numero di query di queryType=semantic. Fatturazione in base a una tariffa progressiva. Vedi la pagina dei prezzi.
Recupero agentic Numero di token di ragionamento agente, oltre al numero di token usati nella pianificazione delle query e nella formulazione delle risposte. Vedi la pagina dei prezzi.
Collegamento privato condiviso Fatturato per larghezza di banda purché il collegamento privato condiviso esista e venga usato.

1 Fa riferimento alle immagini estratte da un file all'interno della pipeline dell'indicizzatore. L'estrazione del testo è libera. L'estrazione di immagini viene fatturata quando si abilita il indexAction parametro o quando si chiama la competenza Estrazione documenti.

2 Gli addebiti per i modelli OpenAI di Azure e i modelli Foundry vengono visualizzati nella fattura per tali servizi.

Modalità di addebito in caso contrario

A seconda della configurazione e dell'utilizzo, potrebbero essere applicati gli addebiti seguenti:

1 Le sessioni di debug sono disponibili solo nei servizi del modello tariffario dedicato.

Note

Nei servizi dedicati, non ti viene addebitato alcun costo per query. Tuttavia, i limiti del servizio si applicano a ogni piano tariffario. In Serverless le query usano CU/hr in base alla complessità e alle dimensioni dell'indice.

Stimare e pianificare i costi per il modello tariffario dedicato

Per stimare i costi per il modello tariffario dedicato, usare il calcolatore prezzi Azure per stimare i costi di base per Azure AI Search. È anche possibile trovare i confronti stimati tra costi e livelli nella pagina Seleziona piano tariffario durante la creazione del servizio.

Per il test iniziale del modello tariffario dedicato, creare un foglio di lavoro di pianificazione della capacità. Il foglio di lavoro consente di comprendere il rapporto tra indice e origine e l'effetto delle funzionalità di arricchimento o vettore sia sulla capacità che sui costi.

Per creare un foglio di lavoro di pianificazione della capacità:

  1. Indicizzare un piccolo campione (1-5%) dei dati. Includere tutte le competenze di riconoscimento ottico dei caratteri (OCR), arricchimento o incorporamento che si prevede di usare.

  2. Misurare le dimensioni dell'indice, la velocità effettiva di indicizzazione e i costi di indicizzazione.

  3. Estrapolare i risultati per stimare i requisiti di scalabilità completa per i dati.

Stimare e pianificare i costi per il modello di prezzi serverless

Per stimare e gestire i costi in Serverless, monitorare sia il consumo di calcolo che le dimensioni dell'indice e ottimizzare le query e la progettazione dello schema per ridurre l'utilizzo delle risorse.

Prima indicizzare un campione rappresentativo, quindi eseguire query tipiche e misurare il consumo di CU tramite x-ms-request-charge. Una volta ottenuta una media di consumo, estrapolare i costi in base a tale media. Per indicazioni sul monitoraggio dell'utilizzo delle risorse di calcolo, vedere Ottimizzare i costi con il modello di determinazione prezzi serverless.

Ridurre al minimo i costi per il modello di determinazione prezzi dedicato

Per ridurre al minimo i costi per il modello tariffario dedicato, usare le strategie seguenti:

Distribuzione e configurazione

  • Creare un servizio di ricerca in un'area con più spazio di archiviazione per partizione.

  • Creare tutte le risorse di Azure correlate nella stessa area (o il minor numero possibile di aree) per ridurre al minimo o eliminare i costi di larghezza di banda.

  • Scegliere il livello di servizio più leggero che soddisfi le esigenze. Basic e S1 offrono l'accesso completo all'API moderna alla tariffa oraria più bassa per SU. * Per i carichi di lavoro caratterizzati da traffico variabile o con picchi, il modello tariffario serverless potrebbe essere più conveniente rispetto a un servizio Basic o S1 con provisioning continuo.

  • Usare App Web di Azure per l'applicazione front-end per mantenere le richieste e le risposte entro il limite del data center.

Scaling

  • Aggiungere partizioni solo quando sono necessarie le dimensioni dell'indice o la velocità effettiva di inserimento.

  • Aggiungere repliche solo quando le query al secondo aumentano, quando le query complesse rallentano il servizio o quando si verifica la necessità di disponibilità elevata.

  • Aumentare le prestazioni per operazioni a elevato utilizzo di risorse, ad esempio l'indicizzazione, e quindi regolare verso il basso per i normali carichi di lavoro di query.

  • Scrivere codice per automatizzare il ridimensionamento per i modelli di carico di lavoro prevedibili.

  • Tenere presente che la capacità e i prezzi non sono lineari. Quando la capacità viene raddoppiata, i costi più che raddoppiano nello stesso livello. Per ottenere prestazioni migliori a un prezzo simile, è consigliabile passare a un livello superiore.

Indicizzazione e arricchimento

Ridurre al minimo i costi per il modello di prezzi serverless

Per ridurre al minimo i costi per il modello tariffario dedicato, usare le strategie seguenti:

  • Monitora i dati di telemetria CU/hr per individuare le query dispendiose.
  • Usare il tipo di query più semplice che soddisfi le esigenze di pertinenza.
  • Rimuovere gli indici inutilizzati per ridurre i costi di archiviazione.

Altre informazioni: Ottimizzare i costi con il modello di prezzi serverless.

Monitorare i costi

A livello di servizio, è possibile monitorare le metriche predefinite per le query al secondo (QPS), la latenza di ricerca, le query limitate e le dimensioni dell'indice.

Il modo in cui si usano queste metriche dipende dal modello di determinazione prezzi:

  • Modello di determinazione prezzi dedicato:
    Usa le metriche di QPS, latenza e throttling per determinare quando aggiungere o rimuovere le repliche o le partizioni. La capacità di ridimensionamento influisce direttamente sulle prestazioni e sui costi, quindi il monitoraggio di questi segnali consente di ottimizzare le unità di ricerca.

  • Modello di determinazione prezzi serverless:
    Usare queste metriche per comprendere i modelli di carico di lavoro e identificare i driver dei costi. Poiché la capacità serverless viene gestita automaticamente, non è possibile ridimensionare aggiungendo repliche o partizioni. Concentrarsi invece sul monitoraggio del consumo di calcolo e sull'ottimizzazione dell'utilizzo.

Per Serverless, è possibile monitorare l'utilizzo di calcolo per richiesta usando l'intestazione di risposta x-ms-request-charge e analizzare i modelli di query usando Monitoraggio di Azure log. Tenere traccia del consumo di CU in base al tipo di query o al carico di lavoro consente di identificare le opportunità per ridurre i costi tramite ottimizzazione delle query, progettazione dello schema o distribuzione del carico di lavoro.

A livello di sottoscrizione o gruppo di risorse, Gestione costi offre strumenti per tenere traccia, analizzare e controllare i costi. Usare la Gestione costi per:

  • Creare budget che definiscono e tengono traccia dello stato di avanzamento rispetto ai limiti di spesa. Per un monitoraggio più granulare, personalizzare i budget usando filters per risorse o servizi specifici di Azure. I filtri consentono di garantire che il rilevamento dei costi sia allineato a carichi di lavoro o distribuzioni specifici.

  • Creare avvisi che notificano automaticamente agli stakeholder anomalie di spesa o rischi di spese eccessive. Gli avvisi sono basati sulla spesa rispetto alle soglie di budget e costo e si applicano a livello di sottoscrizione o gruppo di risorse.

  • Esportare i dati dei costi in un account di archiviazione per un'analisi più approfondita. Ad esempio, i team finanziari possono analizzare i dati esportati usando Excel o Power BI. L'esportazione dei dati sui costi in base a una pianificazione è il metodo consigliato per il recupero dei set di dati dei costi.

FAQ

È possibile arrestare temporaneamente un servizio di ricerca per risparmiare sui costi?

La ricerca viene eseguita come servizio continuo. Le risorse dedicate sono sempre operative e allocate per l'uso esclusivo per la durata del servizio.

Nel modello di determinazione prezzi dedicato, per interrompere completamente la fatturazione, è necessario eliminare il servizio. L'eliminazione di un servizio è permanente ed elimina anche i dati associati.

Nel modello di determinazione prezzi serverless non è previsto alcun addebito di calcolo quando è inattiva. Si paga solo per l'archiviazione indicizzata mentre il servizio non elabora le richieste.

È possibile modificare il modello tariffario o la tariffa di fatturazione (livello) di un servizio di ricerca esistente?

Dopo aver scelto il modello di determinazione prezzi dedicato o serverless, non è possibile convertire i servizi di ricerca di intelligenza artificiale tra i due.

Se si sceglie il modello tariffario Dedicato, i servizi esistenti possono passare dai livelli Basic e Standard (S1, S2 e S3). La configurazione del servizio corrente non può superare i limiti del livello di destinazione e l'area non può avere vincoli di capacità nel livello di destinazione. Per altre informazioni, vedere Modificare il piano tariffario.