Nota
L'accesso a questa pagina richiede l'autorizzazione. È possibile provare ad accedere o modificare le directory.
L'accesso a questa pagina richiede l'autorizzazione. È possibile provare a modificare le directory.
Note
Azure AI Search è disponibile tramite il portale di Azure, le API REST e Azure SDK. È inoltre alla base di Foundry IQ, il livello di conoscenza gestito che trasforma il contenuto aziendale in knowledge base riutilizzabili e con riconoscimento delle autorizzazioni per gli agenti nel portale di Microsoft Foundry.
Quando si crea un servizio di ricerca, è necessario scegliere un modello tariffario e un livello di servizio. Azure AI Search offre due modelli tariffari, ognuno adatto a modelli di carico di lavoro diversi, con i livelli di servizio associati che determinano capacità e funzionalità:
| Modello di determinazione prezzi | Migliore per | Modalità di fatturazione |
|---|---|---|
| Dedicated | Carichi di lavoro costanti, prevedibili e ad alto utilizzo | Capacità fissa tramite unità di ricerca (SU); tariffa oraria in base al livello di servizio selezionato |
| Serverless (anteprima) | Carichi di lavoro poco frequenti, a picchi o altamente variabili | Basato sul consumo: misurato dalle unità di calcolo (CU) e dall'archiviazione indicizzata (GB/mese) |
Note
Le unità di ricerca del modello dedicato e le unità di calcolo del modello serverless non sono uguali e non possono essere usate in modo intercambiabile. Non utilizzare calcolatori di prezzi o preventivi basati su SU per i carichi di lavoro serverless.
Entrambi i modelli forniscono le stesse funzionalità di ricerca di base (con alcune piccole eccezioni per l'anteprima serverless annotata di seguito). La differenza principale è il comportamento dei prezzi e della scalabilità, non le funzionalità.
La selezione del modello tariffario dedicato richiede di stimare le esigenze del carico di lavoro e quindi scegliere un livello di servizio con la capacità preallocata appropriata.
La selezione del modello tariffario serverless non richiede la selezione di un livello di servizio preprovisionato, ma adotta una tariffazione basata sul consumo, quindi l'ottimizzazione delle prestazioni influirà direttamente sui costi.
Modello di prezzi serverless (anteprima)
Importante
Il livello serverless per sviluppatori è attualmente in anteprima. Questa anteprima viene fornita senza un contratto di servizio e non è consigliata per i carichi di lavoro di produzione. Alcune funzionalità potrebbero non essere supportate o potrebbero avere funzionalità limitate. Per ulteriori informazioni, vedere Condizioni supplementari per l'uso delle versioni di anteprima di Microsoft Azure.
La fatturazione per il piano Serverless Developer è iniziata il 13 settembre 2026. Addebiti per l'utilizzo su o dopo tale data vengono visualizzati nella fattura Azure. Non ti verrà addebitato alcun costo per l'utilizzo prima del 13 settembre 2026.
Il livello Developer serverless non supporta la migrazione verso o da altri livelli tariffari e alcune funzionalità disponibili in altri livelli non sono disponibili durante l'anteprima pubblica. I limiti del servizio, le funzionalità supportate e i dettagli dei prezzi possono cambiare prima della disponibilità generale.
Durante l'anteprima, il modello di determinazione prezzi serverless è supportato solo in aree specifiche.
Il modello di determinazione prezzi serverless è un'offerta basata sul consumo che ridimensiona automaticamente le risorse di calcolo e archiviazione in base al carico di lavoro. Elimina la necessità di effettuare il provisioning iniziale della capacità, consentendo di pagare solo le risorse usate.
Quando si usa il modello serverless, non si configurano repliche, partizioni o unità di ricerca. Il servizio gestisce invece la capacità in modo dinamico in risposta al volume di query, all'attività di indicizzazione e alla complessità del carico di lavoro.
La fatturazione si basa su due dimensioni principali:
- Utilizzo calcolo: misurato in unità di calcolo all'ora (CU/h) e addebitato in base al lavoro eseguito (query, indicizzazione e altre operazioni).
- Archiviazione indicizzata: con addebito per GB al mese in base alle dimensioni degli indici.
Questo modello è progettato per carichi di lavoro con domanda variabile, incluso il traffico bursty e le applicazioni multi-tenant. Supporta le stesse funzionalità di ricerca di base e le stesse API dei servizi dedicati, in modo da poter compilare ed eseguire applicazioni di ricerca senza riscrivere il codice.
Il livello Serverless Developer è disponibile in anteprima pubblica e attualmente non supporta le funzionalità seguenti:
- Alias di indice: non supportato
- Sessioni di debug: non supportate
- Rete privata per gli indicizzatori: non supportata
- Risorse di collegamento privato condivise: nessun supporto pianificato per il modello serverless
- Contratto di servizio (SLA): non disponibile durante l'anteprima pubblica
Per altre informazioni, vedi Limiti del servizio in Azure AI Search.
Per ulteriori opzioni di distribuzione Serverless su larga scala, contattare Microsoft tramite il modulo di registrazione per Azure AI Search Serverless Private Preview.
Modello di determinazione prezzi dedicato
Il modello tariffario dedicato è un'offerta a capacità preallocata che garantisce prestazioni e costi prevedibili assegnando un'infrastruttura dedicata al tuo carico di lavoro. È possibile configurare la capacità iniziale, consentendo al servizio di gestire richieste di indicizzazione e query coerenti con risorse garantite.
Con i livelli Dedicati è possibile configurare in modo esplicito repliche, partizioni e unità di ricerca . Le repliche offrono velocità effettiva delle query e disponibilità elevata, mentre le partizioni definiscono la capacità di archiviazione e indicizzazione. Insieme, determinano la capacità totale e le caratteristiche delle prestazioni del servizio di ricerca.
La fatturazione è basata su:
- Livello di servizio: La capacità preconfigurata preselezionata.
- Unità di ricerca (SU): L'unità di fatturazione per i servizi dedicati, calcolata come numero di repliche moltiplicato per il numero di partizioni. Si paga una tariffa oraria fissa in base al numero di unità di ricerca e al livello di servizio selezionato.
Questo modello è progettato per carichi di lavoro con domanda costante e prevedibile, in cui le prestazioni coerenti, la bassa latenza e il ridimensionamento controllato sono importanti.
Nel modello tariffario Dedicato, il livello di servizio selezionato determina:
- Numero massimo di indici e altri oggetti consentiti nel servizio.
- Dimensioni e velocità delle partizioni (archiviazione fisica).
- Tariffa fatturabile come costo mensile fisso, ma anche un costo incrementale se si aggiunge capacità.
- Caratteristiche del carico di lavoro. Alcuni livelli sono ottimizzati per carichi di lavoro specifici.
In alcuni casi, il livello determina anche la disponibilità delle funzionalità Premium.
Descrizioni dei livelli
I livelli fatturabili più comunemente usati includono:
Basic supporta i carichi di lavoro di produzione e può soddisfare i requisiti del contratto di servizio con un massimo di tre repliche.
Standard (S1, S2, S3) è il livello predefinito. Supporta il ridimensionamento di partizioni e repliche, consentendo carichi di lavoro più grandi e prestazioni migliorate.
Alcuni livelli sono progettati per determinati tipi di lavoro:
Standard 3 High Density (S3 HD) è una modalità di hosting ottimizzata per S3 per la multi-tenancy. S3 HD ha lo stesso addebito per unità di S3, ma supporta un numero elevato di indici più piccoli e usa l'hardware ottimizzato per letture di file veloci e scenari di archiviazione ad alta densità.
I livelli ottimizzati per l'archiviazione (L1, L2) offrono un'archiviazione a costi inferiori per TB e sono progettati per indici di grandi dimensioni e meno aggiornati. Questi livelli hanno in genere una latenza di query più elevata.
È disponibile anche un livello di servizio di ricerca gratuito e limitato:
- Gratuito crea un servizio di ricerca limitato per progetti di piccole dimensioni, ad esempio esercitazioni e sviluppo. Le risorse vengono condivise tra tenant e il ridimensionamento non è supportato. Alcune funzionalità Premium non sono disponibili e il servizio potrebbe essere eliminato dopo periodi di inattività. È possibile disporre di un solo servizio di ricerca gratuito per ogni sottoscrizione di Azure.
Le tariffe di fatturazione vengono visualizzate nel portale di Azure quando si crea un nuovo servizio Azure AI Search nella pagina Seleziona piano tariffario.
È possibile controllare la pagina dei prezzi per le tariffe regionali.
Vedere Pianificare e gestire i costi per altre informazioni sul modello di determinazione prezzi dedicato e sul relativo confronto con il modello serverless.
Controlla i limiti del servizio in Azure AI Search o i limiti relativi ad archiviazione, carichi di lavoro e numero di oggetti in base al livello.
Come selezionare un livello
Nel portale di Azure i livelli di servizio vengono specificati nella pagina Selezionare il piano tariffario quando si crea il servizio.
In PowerShell o nell'interfaccia della riga di comando di Azure il livello viene specificato tramite il parametro -Sku.
Disponibilità a livello di area per livello
L'elenco delle aree fornisce le località in cui è disponibile Ricerca di intelligenza artificiale di Azure. Alcune aree potrebbero avere vincoli di capacità per determinati livelli, impedendo la creazione di nuovi servizi di ricerca su tali livelli. L'elenco usa note a piè di pagina per indicare aree e livelli vincolati.
Quando si crea un servizio di ricerca nel portale di Azure, le combinazioni di livelli di area non disponibili vengono escluse automaticamente.
Disponibilità delle funzionalità per livello
La maggior parte delle funzionalità è disponibile in tutti i livelli. In alcuni casi, la disponibilità delle funzionalità dipende dal livello selezionato:
| Funzionalità | Altre considerazioni |
|---|---|
| Indicizzatori | Gli indicizzatori sono disponibili in S3 HD con quota di esecuzione giornaliera tra indicizzatori e altre considerazioni (anteprima). Gli indicizzatori hanno più limitazioni nel livello gratuito. |
Parametro di configurazioneexecutionEnvironment dell'indicizzatore |
La possibilità di aggiungere tutte le elaborazioni dell'indicizzatore solo ai cluster di ricerca allocati al servizio di ricerca richiede S2 e versioni successive. |
| Arricchimento tramite intelligenza artificiale | Viene eseguito nel livello Gratuito, ma non consigliato per carichi di lavoro di grandi dimensioni. |
| Identità gestite o attendibili per l'accesso in uscita (indicizzatore) | Non disponibile nel livello gratuito. |
| Chiavi di crittografia gestite dal cliente | Non disponibile nel livello gratuito. |
| Accesso firewall IP | Non disponibile nel livello gratuito. |
| Endpoint privato (integrazione con Collegamento privato di Azure) | Per le connessioni in ingresso a un servizio di ricerca, non disponibili nel livello gratuito. Per le connessioni in uscita da indicizzatori ad altre risorse di Azure, non disponibili nel livello gratuito o S3 HD. Per gli indicizzatori che usano set di competenze, non disponibili nei livelli gratuito, Basic, S1 o S3 HD. |
| Zone di disponibilità | Non disponibile nel livello gratuito. |
| Classificatore semantico | Viene eseguito nel livello Gratuito, ma non consigliato per carichi di lavoro di grandi dimensioni. |
Le funzionalità a elevato utilizzo di risorse potrebbero non funzionare correttamente a meno che non venga fornita una capacità sufficiente. Ad esempio, l'arricchimento tramite intelligenza artificiale ha competenze a esecuzione prolungata che subiscono un timeout nel servizio gratuito, a meno che il set di dati non sia ridotto.
Limiti superiori
I livelli determinano l'archiviazione massima del servizio stesso, oltre al numero massimo di indici, indicizzatori, origini dati, set di competenze e mappe sinonimiche che è possibile creare. Per un'interruzione completa di tutti i limiti, vedere Limiti del servizio in Azure AI Search.
Dimensioni e velocità delle partizioni
I prezzi dei piani includono informazioni dettagliate sull'archiviazione per partizione, che variano da 15 GB per Basic, fino a 2 TB per i livelli L2 (Ottimizzata per l'archiviazione). Altre caratteristiche hardware, ad esempio velocità delle operazioni, latenza e velocità di trasferimento, non vengono pubblicate, ma i livelli progettati per architetture di soluzioni specifiche sono basati su hardware con le funzionalità per supportare tali scenari. Per altre informazioni sulle partizioni, vedere Stimare e gestire la capacità e Affidabilità in Azure AI Search.
Note
Le partizioni con capacità più elevata sono diventate disponibili nelle aree selezionate nell'aprile 2024. Nel maggio 2024 è stata rilasciata una seconda ondata di partizioni con capacità più elevata. Se si dispone di un servizio di ricerca meno recente, potrebbe essere possibile aggiornare il servizio per trarre vantaggio da una maggiore capacità alla stessa tariffa di fatturazione.
Tariffe di fatturazione
I livelli hanno tariffe di fatturazione diverse, con tariffe più elevate per i livelli eseguiti su hardware più costoso o che offrono funzionalità più costose. La tariffa di fatturazione del livello è disponibile nelle pagine dei prezzi di Azure per Azure AI Search.
Dopo aver creato un servizio, la tariffa di fatturazione diventa sia un costo fisso per l'esecuzione del servizio tutto il giorno che un costo incrementale se si sceglie di aggiungere più capacità.
Nel modello dedicato, la fatturazione si basa sulle unità di ricerca (Search Unit, SU), che combinano partizioni (archiviazione) e repliche (capacità di interrogazione).
- Un servizio inizia con una partizione e una replica (un SU)
- L'aggiunta di partizioni o repliche aumenta linearmente il costo con il numero di UR
Ad esempio, l'aggiunta di repliche per migliorare la disponibilità o la velocità effettiva aumenta proporzionalmente il costo mensile.
Per altre informazioni, vedere Pianificare e gestire i costi.
Esempio di tariffa di fatturazione
Di seguito ne viene illustrato un esempio. Si supponga una tariffa di fatturazione ipotetica di $ 100 al mese. Se si mantiene il servizio di ricerca alla capacità iniziale di una partizione e di una replica, si pagheranno $ 100 alla fine del mese. Tuttavia, se si aggiungono altre due repliche per ottenere una disponibilità elevata, la fattura mensile aumenta a $ 300 ($ 100 per la prima coppia di partizioni di replica, seguita da $ 200 per le due repliche).
Modifiche al livello
Note
I servizi di ricerca esistenti possono passare dai livelli Basic e Standard (S1, S2 e S3). La configurazione del servizio corrente non può superare i limiti del livello di destinazione e l'area non può avere vincoli di capacità nel livello di destinazione. Per altre informazioni, vedere Modificare il piano tariffario.
Per passare a un livello diverso da quelli elencati in precedenza:
- Creare un servizio di ricerca nel nuovo livello.
- Distribuire il contenuto di ricerca nel nuovo servizio. Seguire questo elenco di controllo per assicurarsi di avere tutto il contenuto.
- Eliminare il servizio precedente quando si è certi che non sia più necessario.
Per indici di grandi dimensioni che non si desidera ricompilare da zero, usare uno degli esempi di backup e ripristino seguenti:
- Esempio di backup e ripristino (C#)
- Esempio di backup e ripristino (Python)
- Esempio di backup e ripristino per indici molto grandi (Python)
Passaggi successivi
Il modo migliore per scegliere un piano tariffario consiste nell'iniziare con un piano meno costoso e quindi consentire a esperienza e test di informare la decisione di mantenere il servizio o passare a un livello superiore.
Per i passaggi successivi, è consigliabile creare un servizio di ricerca a un livello in grado di supportare il livello di test che si propone di eseguire e quindi esaminare le indicazioni seguenti sulla stima dei costi e della capacità: