Примечание.
Для доступа к этой странице требуется авторизация. Вы можете попробовать войти или изменить каталоги.
Для доступа к этой странице требуется авторизация. Вы можете попробовать изменить каталоги.
Note
Поиск с использованием ИИ Azure доступна через портал Azure, REST API и Azure SDKs. Он также лежит в основе Foundry IQ — управляемого слоя знаний, который преобразует корпоративный контент в многократно используемые базы знаний с учетом разрешений доступа для агентов на портале Microsoft Foundry.
Important
Функции, возможности или свойства, помеченные (предварительная версия), не охватываются соглашением об уровне обслуживания, не рекомендуются для рабочих нагрузок и могут изменяться или ограничиваться до того, как они становятся общедоступными. Условия предварительной версии Поиск с использованием ИИ Azure применяются ко всем функциям предварительной версии, независимо от того, является ли он автономным или частью общедоступной функции.
В этой статье описывается модель выполнения индексатора, которую Поиск с использованием ИИ Azure использует для бессерверных служб поиска и служб поиска уровня Standard 3 High Density (S3 HD). Оба варианта имеют суточную квоту времени выполнения на уровне службы, которая определяет общий объём времени работы индексатора, который можно использовать в течение 24-часового периода по UTC.
Возможности, описанные в этой статье, доступны в предварительной версии:
- Для поддержки индексатора в S3 HD требуется
2025-11-01-previewREST API или более поздней версии. - Для поддержки бессерверного
2026-05-01-previewиндексатора требуется REST API или более поздней версии.
Где это применяется
Модель выполнения в этой статье относится к:
-
Бессерверные службы поиска , запускающие индексаторы с помощью
2026-05-01-previewREST API или более поздней версии. - Службы поиска S3 HD, в которых индексаторы запускаются с помощью REST API версии
2025-11-01-previewили более поздней.
Поддерживаемые определения индексатора, источники данных, наборы навыков и источники знаний, поддерживаемые индексатором, работают без изменения обоих вариантов.
Модель выполнения
Индексаторы в Serverless и S3 HD имеют следующие особенности выполнения:
Вы не подготавливаете или управляете инфраструктурой индексатора. Служба сама управляет выделением ресурсов за вас.
Индексаторы выполняются только в мультитенантной среде выполнения. Среда частного выполнения, которая предоставляется с помощью ресурсов общего частного канала, недоступна для индексаторов для этих SKU.
Для S3 HD, если вам нужны подключения индексатора, чтобы оставаться вне общедоступного Интернета, настройте периметр безопасности сети (NSP) в службе поиска для управления входящим и исходящим трафиком с помощью явных правил доступа.
Для бессерверных подключений нет поддержки частных подключений.
Квота на совокупное время выполнения за день
Выполнение индексатора определяется ежедневной квотой времени выполнения, которая сбрасывается в 00:00 UTC. Квота:
- Уровень обслуживания: Она применяется к службе поиска в целом.
- Совокупно: Время выполнения всех индексаторов в службе засчитывается в общий бюджет. Квота не применяется к каждому индексатору.
Время работы всех запущенных индексаторов учитывается в рамках одного общего бюджета службы. Служба не резервирует вычислительные ресурсы для отдельных индексаторов и не распределяет квоту поровну между ними. Например, суммарное время работы 12 индексаторов, каждый из которых работает по два часа, может исчерпать все 24 суммарных часа выполнения независимо от того, перекрываются ли эти запуски или происходят в разное время.
В следующей таблице перечислены ежедневные квоты по номеру SKU и минимальной версии API, поддерживающей ее:
| Артикул | Ежедневная квота в 24-часовом окне UTC | Минимальная версия API |
|---|---|---|
| S3 HD | 24 часа | 2025-11-01-preview |
| Бессерверный | 24 часа | 2026-05-01-preview |
При исчерпании ежедневной квоты:
Индексаторы, которые в данный момент запущены, остановятся примерно через пять минут.
Новые запуски индексатора не обрабатывают документы и немедленно возвращают временный сбой, указывающий на превышение ежедневной квоты.
Обычное выполнение индексатора возобновляется после сброса счетчика в 00:00 UTC.
Восстановиться после исчерпания квоты
Чтобы восстановиться после исчерпания квоты и снизить вероятность повторного исчерпания квоты:
Дождитесь следующего сброса в 00:00 UTC или используйте метод Get Service Statistics (REST API), чтобы убедиться, что
remainingSecondsвосполнен, прежде чем инициировать новые запуски.Настройте индексаторы на смещённые графики, чтобы нагрузка распределялась в течение 24 часов, а не выполнялась одновременно.
Вы не можете приостановить или остановить активные запуски. Используйте Получить состояние индексатора, чтобы следить за их состоянием, и см. Запуск или сброс индексаторов для получения сведений о поведении элементов управления во время выполнения.
Если среда выполнения продолжает работать, но запуски индексатора завершаются сбоем, см. раздел Устранение неполадок индексатора.
Сокращение затрат на набор навыков. Навыки, вызывающие внешние службы, такие как навык эмбеддинга Azure OpenAI, навык подсказок GenAI и навык понимания содержимого Azure, быстро расходуют ресурсы среды выполнения. Уменьшите количество навыков, пакетных документов или настройте кэш обогащения для повторного использования предыдущих результатов вместо повторной обработки.
Проактивно отслеживайте
remainingSecondsна уровне службы и индексатора, чтобы можно было ограничить рабочие нагрузки до того, как они приведут к сбою.
Отслеживать суммарное время работы
В этом разделе объясняется, как отслеживать использование среды выполнения и оставшиеся бюджеты с помощью REST API службы поиска. В рамках предварительной версии портал для кумулятивной среды выполнения недоступен.
Среда выполнения на уровне сервиса
Используйте Get Service Statistics (REST API), чтобы получить совокупное время выполнения для всех индексаторов в службе за текущее 24-часовое окно:
GET {endpoint}/servicestats?api-version=2026-08-01-preview
Ответ содержит раздел indexersRuntime. В следующем формате JSON показана служба, 24-часовая квота которой не используется:
"indexersRuntime": {
"usedSeconds": 0,
"remainingSeconds": 86400,
"beginningTime": "2026-05-16T00:00:00.000Z",
"endingTime": "2026-05-17T00:00:00.000Z"
}
Основные моменты:
-
usedSeconds: Общее количество секунд, в течение которых все индексаторы в службе работали в текущем окне. -
remainingSeconds: Осталось ещё несколько секунд до исчерпания ежедневной квоты. Присутствует, когда применяется ограничение для определенного уровня. -
beginningTimeиendingTime: начало и конец текущего 24-часового окна подсчёта UTC.
Среда выполнения на уровне индексатора
Используйте Get Indexer Status (REST API), чтобы получить совокупное время выполнения для отдельного индексатора:
GET {endpoint}/indexers('{indexerName}')/search.status?api-version=2026-08-01-preview
Ответ содержит раздел runtime. В следующем формате JSON показан индексатор службы, 24-часовая квота которой не используется:
"runtime": {
"usedSeconds": 0,
"remainingSeconds": 86400,
"beginningTime": "2026-05-16T00:00:00.000Z",
"endingTime": "2026-05-17T00:00:00.000Z"
}
Основные моменты:
-
usedSeconds: Общее количество секунд, в течение которых индексатор работал в текущем окне. -
remainingSeconds: Секунды по-прежнему доступны всем индексаторам в рамках службы, а не только этому индексатору. Присутствует, когда применяется ограничение для определенного уровня. -
beginningTimeиendingTime: начало и конец текущего 24-часового окна подсчёта UTC.
Лучшие практики
Поддержка индексатора в S3 HD и бессерверном режиме доступна в предварительной версии. Следуйте этим рекомендациям, чтобы правильно подобрать масштаб рабочих нагрузок и спланировать тарификацию Serverless, которая будет введена позднее.
S3 HD
На этапе предварительной версии поддержка индексатора S3 HD предназначена для рабочих нагрузок без наборов навыков или с небольшими наборами навыков. Чтобы остаться в пределах ежедневной квоты, выполните следующие действия.
Планируйте небольшие индексы размером около 1 ГБ.
Тщательно оценивайте объём использования набора навыков. Навыки, вызывающие внешние службы, такие как навык Azure OpenAI Embedding, навык GenAI Prompt и навык Azure Content Understanding, значительно увеличивают время выполнения и могут быстро расходовать ежедневную квоту, особенно в мультитенантных сценариях.
Следует ожидать ограниченного параллелизма на этапе предварительной версии. Используйте запланированные запуски со смещением по времени для больших парков индексаторов, чтобы нагрузка распределялась в течение 24 часов, а не конкурировала за один и тот же бюджет.
Иллюстрирующая рабочая нагрузка разделения и внедрения
В одном контролируемом тесте S3 HD навык Split и один навык Azure OpenAI Embedding создали фрагменты и эмбеддинги. При этой нагрузке формировалось примерно 2,5 части на каждый исходный документ, а в ходе данного теста в течение одного 24-часового окна тестирования S3 HD было зафиксировано примерно 22 000 исходных документов.
Следующие значения округлены и приведены в качестве иллюстрации арифметических расчётов справедливого распределения на основе совокупного наблюдения. Их не измеряют по каждому индексатору отдельно.
| Число индексатора | Примерные исходные документы на одного индексатора в день |
|---|---|
| 100 | Около 200 |
| 500 | Около 40 |
| 1,000 | Около 20 |
Служба не резервирует ресурсы и не гарантирует равномерное распределение, порядок выполнения или пропускную способность для этих количеств индексаторов.
Note
Этот результат наблюдался в одном управляемом тесте. Это не целевой показатель производительности, не гарантия уровня обслуживания, не обязательство по предоставлению емкости, не формула подбора размера и не замена тестированию рабочей нагрузки.
Пропускная способность может существенно различаться в зависимости от сложности документа и его характеристик, разбиения на фрагменты, количества и типа навыков и векторных выходов, задержки модели, доступной мощности и квоты, производительности источника и целевой системы, уровня параллелизма, порядка планирования, троттлинга, региона, сбоев и повторных попыток, извлечения содержимого документа или оптического распознавания символов (OCR), а также неравномерной нагрузки по тенантам. Протестируйте с помощью репрезентативных рабочих входных данных перед планированием емкости.
Бессерверный
На этапе предварительной версии бессерверные индексаторы предназначены для упрощения приема и обработки данных для сценариев генерации с дополнением поиском (RAG) и использования баз знаний:
Выполнение индексатора (за исключением навыков) в настоящее время бесплатно. Написание документов в индекс повлечет за собой затраты.
Выполнение набора навыков тарифицируется по тому же принципу, что и на выделенных индексаторах. Вызовы внешних служб, таких как навык Azure OpenAI Embedding, навык GenAI Prompt и навык Azure Content Understanding, оплачиваются через связанный ресурс Foundry или Azure AI services.
Ограничения и квоты
Ограничения индексатора для бессерверных и S3 HD см. в разделе "Ограничения индексатора".
Квота времени выполнения на уровне службы и ограничения индексатора не отменяют ограничения на входные данные, запросы и обработку для навыков и внешних служб в наборе навыков. Проверяйте каждую ссылку на навык отдельно при определении размера конвейера обогащения.