你当前正在访问 Microsoft Azure Global Edition 技术文档网站。 如果需要访问由世纪互联运营的 Microsoft Azure 中国技术文档网站,请访问 https://docs.azure.cn。

规划和管理 Azure AI 搜索服务的成本

Note

Azure AI 搜索可通过Azure门户、REST API 和Azure SDK获取。 它也是 Foundry IQ 的基础;Foundry IQ 是一个托管式知识层,可将企业内容转化为供 Microsoft Foundry 门户中的智能体使用的、可复用且具备权限感知能力的知识库。

Azure AI 搜索在两种定价模型中可用:

  • 专用:具有固定定价的预配容量。 您选择服务层,系统会根据搜索单位(SUs)按小时向您计费。 最适合稳定、可预测且高利用率的工作负载。

  • 无服务器(预览版):基于用量的定价,按每小时计算单元(CU/小时)和索引存储每 GB/月计费。 最适合不经常、突发或高度可变的工作负荷。

本文介绍了计费在每个模型中的工作原理,并提供成本估算、最小化和监视指南。

了解定价模型

Azure AI 搜索有两个主要定价模型:专用和无服务器。 这两种模型都会对高级功能(例如语义排名器、代理检索和 AI 扩充)产生单独的费用。

Azure AI 搜索费用是整体Azure账单的一个组成部分。 订阅中使用的所有Azure服务和资源(包括Azure AI 搜索以外的服务)都会向你计费。

对于专用服务,请使用 Azure 定价计算器根据计划容量和功能估算成本。 容量规划工作表可以帮助你为预期的索引大小、索引吞吐量和索引成本建模。

随着搜索工作负载的发展,请按照这些提示在部署和操作期间降低成本。 还可以使用内置指标来监视查询请求和 成本管理 ,以创建预算、警报和数据导出。

专用定价模型

创建或使用专用搜索服务时,需按照所选服务层级按比例折算的小时费率,为最低要求的副本和分区组合 (R × P) 付费。 每个副本和分区组合表示一个专用容量单元。

有关可用的服务层的更多详细信息,请参阅 “选择定价模型和服务层”。

当您增加或减少副本或分区的数量时,搜索单位总数会发生变化,成本也会随之变化。 有关详细信息和示例,请参阅 计费费率。

无服务器定价模型(预览版)

Important

无服务器开发者层级目前为预览版。 此预览版在没有服务级别协议的情况下提供,不建议用于生产工作负荷。 某些功能可能不受支持,或者可能具有受限功能。 有关详细信息,请参阅 Microsoft Azure 预览版补充使用条款。

无服务器开发人员层的计费从 2026 年 9 月 13 日开始。 该日期当日及之后产生的使用费用会显示在您的 Azure 发票中。 2026 年 9 月 13 日之前,不会向你收取使用费。 无服务器开发人员层不支持迁移到其他定价层或从其他定价层迁移,其他层上提供的某些功能在公共预览版期间不受支持。 正式发布之前,服务限制、支持的功能和定价详细信息可能会更改。

在预览期间,无服务器定价模型仅在 特定区域中受支持。

无服务器定价模型根据使用情况收费,无需预先预配或空闲容量。 只需为操作使用的计算资源以及索引使用的存储付费。

与专用模型不同,不配置副本或分区。 该服务根据工作负荷需求和服务限制自动管理容量。

无服务器计费具有两个独立的维度:

  • 计算(计算单位,CU):
    计算使用情况以每小时计算单位(OU/小时)度量。 计算成本由查询复杂性、索引大小、数据量和操作类型(查询、索引或扩充)等因素驱动。

  • 索引存储:
    存储按索引的磁盘占用大小,以每 GB 每月计费。 此大小包括索引内容和支持用于检索的数据结构。

如何为高级功能付费

无论您使用专用定价模型还是无服务器定价模型,高级功能都需在搜索服务的计算和存储费用之外另行付费。

下表列出了高级功能及其计费单位。 所有这些功能都是可选的,因此如果不使用这些功能,则不会产生任何费用。

Feature 计费单位
图像提取 (AI 扩充) 1 每 1000 张图片。 请参阅定价页。
自定义实体查找技能 (AI 扩充) 每 1000 条文本记录。 请参阅定价页
内置或自定义技能 (AI 扩充) 2 交易数量。 按模型提供方的费率计费:Microsoft Foundry 或由 Azure 托管的模型或资源。
Vectorizers2 矢量化操作的数量。 按模型提供方的费率计费:Foundry Tools 中的 Azure视觉、Azure OpenAI 或 Foundry。
语义排序器 queryType=semantic 的查询次数。 按渐进率计费。 请参阅定价页。
代理检索 代理推理令牌数,以及查询规划和答案表述中使用的令牌数。 请参阅定价页。
共享专用链接 只要共享专用链接存在且处于使用状态,就需要支付带宽费用。

1 引用从索引器管道中的文件中提取的图像。 文本提取是免费的。 启用indexAction参数或调用文档提取技能时,将按图像提取计费。

2 Azure OpenAI 模型和 Foundry 模型的费用会显示在这些服务的帐单上。

其他收费方式

根据配置和使用情况,可能会收取以下费用:

1 调试会话仅在专用定价模型服务中可用。

Note

在专用服务上,不会按查询计费。 但是, 服务限制 适用于每个定价层。 在无服务器模式下,查询会根据复杂度和索引大小消耗 CU/hr。

专用定价模型的估算和计划成本

若要估算专用定价模型的成本,请使用 Azure 定价计算器估算Azure AI 搜索的基准成本。 还可以在创建服务期间在 “选择定价层 ”页上找到估计的成本和层比较。

若要对专用定价模型进行初始测试,请创建容量规划工作表。 工作表可帮助你了解索引与源比率以及扩充或向量功能对容量和成本的影响。

若要创建容量规划工作表,请按照以下步骤执行。

  1. 对数据中的少量样本 (1–5%) 编制索引。 包括计划使用的任何 OCR、扩充或嵌入技能。

  2. 测量索引大小、索引吞吐量和索引成本。

  3. 请根据结果推断来估算您的数据的整体需求。

无服务器定价模型的估算和计划成本

若要估算和管理无服务器成本,请监视计算消耗量和索引大小,并优化查询和架构设计,以减少资源使用量。

首先对代表性示例编制索引,然后通过 x-ms-request-charge运行典型查询并测量 CU 消耗量。 获得平均消耗量后,根据该平均值推断成本。 有关监视计算使用情况的指导,请参阅 使用无服务器定价模型优化成本。

最小化专用定价模型的成本

若要将专用定价模型的成本降到最低,请使用以下策略:

部署和配置

  • 在 每个分区具有更多存储的区域中创建搜索服务。

  • 在同一区域(或尽可能少的区域)中创建所有相关的 Azure 资源,以最大程度地减少或消除带宽费用。

  • 选择满足需求的最轻 的服务层 。 Basic和S1以最低的每小时收费标准为每个SU提供对现代API的完整访问权限。 * 对于具有可变流量或突发流量的工作负荷,无服务器定价模型可能比持续预配的基本或 S1 服务更具成本效益。

  • 使用适用于前端应用程序的 Azure Web 应用 在数据中心边界内保留请求和响应。

Scaling

  • 仅当索引大小或引入吞吐量需要分区时,才添加分区。

  • 仅当每秒查询增加、复杂查询限制服务或需要高可用性时,才添加副本。

  • 针对资源密集型操作(例如索引)扩展规模,然后针对常规查询工作负荷进行向下调整。

  • 编写代码以自动扩展应对可预测的工作负载模式。

  • 请记住,容量和定价不是线性的。 在同一层上容量翻倍会导致成本增加超过两倍。 若要以类似的价格获得更好的性能,请考虑 切换到更高的层。

索引和扩充

最小化无服务器定价模型的成本

若要将专用定价模型的成本降到最低,请使用以下策略:

  • 监视 CU/hr 遥测,以识别昂贵的查询。
  • 使用满足相关性需求的最简单的查询类型。
  • 删除未使用的索引以减少存储成本。

了解详细信息: 使用无服务器定价模型优化成本。

监控成本

在服务级别,可以监视每秒查询的 内置指标 (QPS)、搜索延迟、受限查询和索引大小。

使用这些指标的方式取决于定价模型:

  • 专用定价模型:
    使用 QPS、延迟和限制指标来确定何时添加或删除副本或分区。 缩放容量直接影响性能和成本,因此监视这些信号有助于优化搜索单位。

  • 无服务器定价模型:
    使用这些指标了解工作负荷模式并识别成本驱动因素。 由于无服务器容量是自动管理的,因此无法通过添加副本或分区进行缩放。 而是专注于监视计算消耗量和优化使用情况。

对于无服务器,可以使用 x-ms-request-charge 响应标头监视每个请求的计算使用情况,并使用Azure Monitor日志分析查询模式。 通过查询类型或工作负荷跟踪 CU 消耗有助于确定通过查询优化、架构设计或工作负荷分布降低成本的机会。

在订阅或资源组级别, 成本管理功能 提供了用于跟踪、分析和控制成本的工具。 使用成本管理可以:

  • 创建预算,用于定义和跟踪支出限制的进度。 若要进行更精细的监视,请使用筛选器针对特定Azure资源或服务自定义预算。 筛选器有助于确保成本跟踪与特定工作负荷或部署保持一致。

  • 创建警报 ,自动通知利益干系人支出异常或超支风险。 警报根据支出相对于预算和成本阈值的情况生成,适用于订阅或资源组级别。

  • 将成本数据导出 到存储帐户进行更深入的分析。 例如,财务团队可以使用Excel或Power BI来分析导出的数据。 建议按计划导出成本数据以检索成本数据集。

FAQ

是否可以暂时关闭搜索服务以节省成本?

搜索是作为持续性服务运行的。 专用资源始终正常运行,并在服务期间专用于您的独占使用。

在专用定价模型中,若要完全停止计费,必须删除该服务。 删除服务这项操作是永久性的,也会删除其关联的数据。

在无服务器定价模型中,空闲时不收取计算费用。 仅在服务未处理请求时为索引存储付费。

是否可以更改现有搜索服务的定价模型或计费费率(层) ?

选择专用或无服务器定价模型后,不能在两者之间转换 AI 搜索服务。

如果选择专用定价模型,现有服务可以在基本层和标准层(S1、S2 和 S3)之间切换。 当前服务配置不能超过目标层的限制,并且区域在目标层上不能有容量约束。 有关详细信息,请参阅更改定价层。