Примечание.
Для доступа к этой странице требуется авторизация. Вы можете попробовать войти или изменить каталоги.
Для доступа к этой странице требуется авторизация. Вы можете попробовать изменить каталоги.
Примечание.
Поиск с использованием ИИ Azure доступна через портал Azure, REST API и Azure SDKs. Он также лежит в основе Foundry IQ — управляемого слоя знаний, который преобразует корпоративный контент в многократно используемые базы знаний с учетом разрешений доступа для агентов на портале Microsoft Foundry.
Максимальные ограничения на хранилище, рабочие нагрузки и количество индексов и других объектов зависят от модели ценообразования службы Поиск с использованием ИИ Azure.
Поиск с использованием ИИ Azure поддерживает две модели ценообразования, каждая из которых содержит связанные уровни служб. Уровень, который вы выбираете, влияет на ограничения служб, описанные в этом руководстве.
- Выделенный: фиксированные цены, измеряемые единицами поиска (SUS). Параметры уровня служб включают: "Базовый", "Стандартный" (S1-S3, включая S3 HD), "Оптимизировано для хранения" (L1-L2) и уровень "Бесплатный" с ограниченными возможностями службы поиска.
- Бессерверные (предварительная версия): цены на основе потребления, измеряемые единицами вычислений в час (CU/hr) и за ГБ в месяц для индексированного хранилища. Текущий уровень предварительной версии: бессерверный разработчик. Ограничения определяются лимитами для каждого индекса, количеством объектов для каждого сервиса и поведением механизма ограничения пропускной способности в Serverless.
Внимание
Уровень Serverless Developer в настоящее время доступен в предварительной версии. Эта предварительная версия предоставляется без соглашения об уровне обслуживания и не рекомендуется для использования в производственной среде. Некоторые функции могут не поддерживаться или их возможности могут быть ограничены. Для получения дополнительной информации см. Дополнительные условия использования для предварительных версий Microsoft Azure.
Выставление счетов за уровень "Бессерверный разработчик" началось 13 сентября 2026 года. Плата за использование начиная с этой даты отображается в счете Azure. Плата за использование не взимается до 13 сентября 2026 г.
Уровень "Бессерверный разработчик" не поддерживает миграцию на другие ценовые категории и некоторые функции, доступные на других уровнях, не поддерживаются во время общедоступной предварительной версии. Ограничения служб, поддерживаемые функции и сведения о ценах могут изменяться до общедоступной доступности.
Во время предварительной версии модель ценообразования без сервера поддерживается только в определенных регионах.
Дополнительные сведения см. в разделе "Выбор модели ценообразования" и уровня служб.
Диагностика сбоев, связанных с квотами, емкостью или лимитами
Ошибки квоты и емкости вызваны разными механизмами управления. Используйте ошибку из завершенной операции, чтобы найти, какой из них применяется.
Если операция создания, масштабирования или обновления по-прежнему выполняется, дождитесь, пока состояние подготовки ресурсов не станет Succeeded или Failed. То, что операция всё ещё выполняется, не является признаком проблемы с квотой или нехваткой ресурсов. Если операция масштабирования завершается ошибкой, см. ошибки во время масштабирования.
| Failure | Вероятная причина | Первое действие |
|---|---|---|
| Создание службы заблокировано для данной подписки и региона | Квота подписки | В службе "Квоты" проверьте ограничение для уровня и региона, а затем запросите дополнительные службы. |
| Сбой при создании, масштабировании или обновлении даже при наличии доступной квоты | Рассмотрите альтернативные регионы и развертывание в непиковое время | Проверьте сноски в поддержке регионов для уровней повышенного спроса, затем рассмотрите альтернативный вариант. |
| Реплика, раздел, уровень или запрос к объекту отклонён | Предел службы или индекса | Сравните количество конфигураций и объектов с ограничениями служб и индексами. |
| Служба поиска возвращает ответы об ограничении запросов при высокой нагрузке | Throttling | Уменьшите частоту запросов или добавьте единицы поиска. См. ограничения троттлинга. |
| Индексирование завершается сбоем рядом с ограничением хранилища или вектора | Квота хранилища или вектора | Сравнение storageSize с хранилищем секций для диска и vectorIndexSizeограничениями размера векторного индекса для памяти. |
| Индексатор, навык или векторизатор сообщает 429 из другой службы | Azure OpenAI или другая квота службы | Следуйте инструкциям по квоте для службы, которая выпустила ошибку, например Azure OpenAI. |
Доступная квота подписки не гарантирует региональную емкость, и запрос на увеличение квоты не устраняет ограничение емкости. Если сбой сохраняется, откройте запрос поддержка Azure, включающий подписку, регион, уровень, запрошенную конфигурацию, полный текст ошибки, время UTC и любой идентификатор корреляции или операции.
Ограничения подписки
Вы можете создать несколько платных служб поиска (базового и более высокого уровня), до максимального количества, разрешенного для каждого уровня в каждом регионе. Например, можно создать до 16 служб на уровне "Базовый" и еще 16 служб на уровне S1 в пределах одной подписки и региона. Затем можно создать еще 16 служб уровня Basic в другом регионе, чтобы в общей сложности получить 32 службы уровня Basic в рамках той же подписки. Дополнительные сведения о уровнях служб см. в разделе "Выбор модели ценообразования" и уровня служб.
Вы можете увеличить максимальные ограничения службы по запросу. Если вам требуется больше служб для одной подписки, отправьте запрос на поддержку.
| Ресурс | Бесплатно 1 | Базовая | С1 | S2 | S3 | S3 HD | Уровень 1 | L2 | Бессерверный разработчик |
|---|---|---|---|---|---|---|---|---|---|
| Максимальное количество служб в каждом регионе | 1 | 16 | 16 | 8 | 6 | 6 | 6 | 6 | 5 |
| Максимальное количество единиц поиска (SU)2 | Н/П | 3 СУ | 36 СССР | 36 СССР | 36 СССР | 36 СССР | 36 СССР | 36 СССР | Н/П |
1 Вы можете использовать бесплатную службу поиска для каждой подписки Azure. Уровень "Бесплатный" основан на инфраструктуре, общей для других клиентов. Так как оборудование не выделено, масштабирование не поддерживается, а хранилище ограничено 50 МБ. Бесплатная служба поиска может быть удалена после длительных периодов бездействия, чтобы освободить место для дополнительных служб.
2 Единицы поиска (ЕП) — это оплачиваемые единицы, выделяемые в виде реплик или секций. Вам нужно и то, и другое. Дополнительные сведения о сочетаниях SU см. в статье "Оценка емкости службы поиска" и управление ими.
Ограничения сервисов
В выделенной модели ценообразования запланируйте емкость путем умножения реплик по секциям (единицам поиска).
| Ресурс | Бесплатно | Базовая | С1 | S2 | S3 | S3 HD | Уровень 1 | L2 | Бессерверный разработчик |
|---|---|---|---|---|---|---|---|---|---|
| Разделы | Н/П | 3 1 | 12 | 12 | 12 | 3 | 12 | 12 | Н/П |
| Копии | Н/П | 3 | 12 | 12 | 12 | 12 | 12 | 12 | Н/П |
1 Уровень "Базовый" поддерживает три секции и три реплики для общей сложности девяти единиц поиска (SU) в новых службах поиска , созданных после 3 апреля 2024 года. Устаревшие службы уровня Basic поддерживают только один раздел и три реплики.
Служба поиска имеет максимальный размер хранилища (размер секции, умноженный на число секций) или жесткое ограничение на максимальное число индексов или индексаторов, в зависимости от того, какое ограничение приходится первым.
Соглашения об уровне обслуживания применяются к оплачиваемым службам с двумя или более репликами для рабочих нагрузок запросов или тремя или более репликами для рабочих нагрузок запросов и индексирования. При применении соглашения об уровне обслуживания количество разделов не учитывается. Дополнительные сведения см. в статье Надежность в службе Поиск с использованием ИИ Azure.
Бесплатные службы не имеют фиксированных разделов или реплик и делят ресурсы с другими подписчиками.
Хранилище секций (ГБ)
Ограничения хранилища для каждой службы зависят от двух факторов: даты создания службы и региона. Большинство поддерживаемых регионов предлагают более высокие ограничения для новых служб.
В этой таблице показано увеличение квоты хранилища на ГБ с течением времени. Начиная с апреля 2024 года, в регионах, перечисленных в сносках, стали доступны разделы с более высокой емкостью. Если у вас есть более старая служба в поддерживаемом регионе, проверьте, можно ли обновить службу , чтобы получить более высокие ограничения хранилища.
| Дата создания службы | Базовая | С1 | S2 | S3/HD | Уровень 1 | L2 | Бессерверный разработчик |
|---|---|---|---|---|---|---|---|
| До 3 апреля 2024 г. | 2 | двадцать пять | 100 | 200 | 1024 | 2048 | Н/П |
| 3 апреля 2024 г. – 17 мая 2024 г. | 15 | 160 | 512 | 1,024 | 1024 | 2048 | Н/П |
| После 17 мая 2024 2 | 15 | 160 | 512 | 1024 | 2,048 | 4,096 | Н/П |
| После 10 февраля 2025 г. 3 | 15 | 160 | 512 | 1024 | 2048 | 4096 | Н/П |
1 Хранилище большей ёмкости для Basic, S1, S2 и S3 в этих регионах. Америка: Южная Бразилия, Центральная Канада, Восточная Канада, Восточная часть США, Восточная часть США 2, Центральная часть США, Северо-центральная часть США, Южно-центральная часть США, Западная часть США, Западная часть США 2, Западная часть США 3, Западно-центральная часть США. Европа: Центральная Франция. Италия Северная Европа, Северная Европа, Восточная Норвегия, Центральная Польша, Северная Швейцария, Центральная Швеция, Южная Великобритания, Западная Часть Великобритании. Ближний Восток: Север ОАЭ. Африка: Северная Африка. Азиатско-Тихоокеанский регион: Восточная Австралия, Юго-Восточная Австралия, Центральная Индия, Jio India West, Восточная Азия, Восточная Азия, Восточная Япония, Западная Япония, Центральная Корея, Южная Корея.
2 накопители большей емкости для L1 и L2. Больше регионов обеспечивают более высокую емкость на каждом оплачиваемом уровне. Америка: Восточная часть США 2 EUAP. Европа: Северная Германия, Западная Германия, Западная Швейцария. Azure для государственных организаций: Техас, Аризона, Вирджиния. Африка: Северная Африка. Азиатско-Тихоокеанский регион: Китай Северная 3, Восточная Китай 3.
3 Доступны варианты хранилищ с большей емкостью в Западной Европе.
Внимание
В настоящее время более высокие ограничения хранилища недоступны в следующих регионах, которые подлежат ограничениям до 3 апреля.
- Центральный Израиль
- Центральный Катар
- Spain Central
- Южная Индия
Ограничения индексов
| Ресурс | Бесплатно | Базовая | С1 | S2 | S3 | S3 HD | Уровень 1 | L2 | Бессерверный разработчик |
|---|---|---|---|---|---|---|---|---|---|
| Максимальное число индексов | 3 | 5 или 15 1 | 50 | 200 | 200 | 1000 на раздел или 3000 на службу | 10 | 10 | 30 |
| Максимальное количество простых полей на индекс 2 | 1000 | 100 или 1000 3 | 1000 | 1000 | 1000 | 1000 | 1000 | 1000 | 1000 |
| Максимальное количество измерений на поле вектора | 4096 | 4096 | 4096 | 4096 | 4096 | 4096 | 4096 | 4096 | 4096 |
| Максимальное количество сложных коллекций на индекс | 40 | 40 | 40 | 40 | 40 | 40 | 40 | 40 | 40 |
| Максимальное количество элементов во всех сложных коллекциях на документ 4 | 3000 | 3000 | 3000 | 3000 | 3000 | 3000 | 3000 | 3000 | 3000 |
| Максимальная глубина сложных полей | 10 | 10 | 10 | 10 | 10 | 10 | 10 | 10 | 10 |
| Максимальное количество подсказчиков на индекс | 1 | 1 | 1 | 1 | 1 | 1 | 1 | 1 | 1 |
| Максимальное количество профилей оценки на индекс | 100 | 100 | 100 | 100 | 100 | 100 | 100 | 100 | 100 |
| Максимальные семантические конфигурации на индекс | 100 | 100 | 100 | 100 | 100 | 100 | 100 | 100 | 100 |
| Максимальное число функций на профиль | 8 | 8 | 8 | 8 | 8 | 8 | 8 | 8 | 8 |
| Максимальный размер индекса 5 | Н/П | Н/П | Н/П | 1,88 ТБ | 2,34 ТБ | 100 ГБ | Н/П | Н/П | 1 ГБ |
1 Службы категории "Базовый", созданные до декабря 2017 г., имеют более низкие ограничения индексов (5 вместо 15).
2 Верхний предел полей включает как поля первого уровня, так и вложенные подфилды в сложной коллекции. Например, если индекс содержит 15 полей и содержит две сложные коллекции с пятью подфилдами, число полей индекса равно 25. Индексы с очень большими коллекциями полей могут быть медленными, особенно в старых службах Basic. Ограничьте поля и атрибуты только тем, которые вам нужны, и запустите индексирование и тесты запросов, чтобы обеспечить производительность.
3 Базовые службы, созданные до 3 апреля 2024 года, поддерживают не более 100 полей на индекс. Новые службы Basic поддерживают 1000 полей на индекс.
4 Верхний предел существует для элементов, так как при наличии большого количества из них значительно увеличивается хранилище, необходимое для индекса. Элемент сложной коллекции определяется как член этой коллекции. Например, предположим, что документ "Отель" с сложной коллекцией комнат. Каждая комната в коллекции Комнат считается элементом. Во время индексирования подсистема индексирования может безопасно обрабатывать не более 3000 элементов в документе в целом.
Это ограничение появилось в api-version=2019-05-06 и применяется только к сложным коллекциям, а не к коллекциям строк или к сложным полям.
5 Для большинства уровней максимальный размер индекса — это общее доступное хранилище в службе поиска. Для служб S2, S3 и S3 HD с несколькими разделами, что означает больше пространства для хранения, максимально допустимый размер одного индекса указан в таблице. Применяется к службам поиска, созданным после 3 апреля 2024 г. Индексы для служб, настроенных с помощью бессерверной модели (предварительная версия), имеют максимальный размер, предоставленный в таблице.
Если ваша служба окажется развернута в более мощном кластере, могут быть изменения в максимальных пределах. Ограничения здесь представляют общий знаменатель. Индексы, созданные в указанных выше спецификациях, переносятся по эквивалентным уровням служб в любом регионе.
Ограничения документов
Каждый индекс поддерживает до следующего числа документов:
- 24 миллиарда в Basic, S1, S2 и S3
- 2 миллиарда на S3 HD
- 288 млрд на L1
- 576 млрд на L2
Каждый документ может быть размером около 16 МБ. Ограничение размера документа фактически применяется к размеру полезных данных запроса API индексирования, что составляет 16 МБ. Эта полезная нагрузка может представлять собой один документ или пакет документов. Для пакета с одним документом максимальный размер документа составляет 16 МБ данных JSON.
Ограничение размера документа применяется к индексации в режиме принудительной отправки документов в службу поиска. Если вы используете индексатор для индексирования в режиме извлечения, исходные файлы могут иметь любой размер файла, при условии ограничений индексатора. Для индексатора блобов ограничения размера файла больше для более высоких уровней доступа. Например, ограничение S1 составляет 128 МБ, а ограничение S2 — 256 МБ.
При оценке размера документа не забудьте индексировать только поля, добавляющие значение в сценарии поиска. Исключите исходные поля, которые не предназначены для выполнения запросов.
Ограничения размера векторного индекса
При индексировании документов с помощью векторных полей поиск Azure ИИ создает внутренние индексы векторов с помощью предоставленных вами параметров алгоритма.
Размер этих векторных индексов ограничен:
- Память, зарезервированная для векторного поиска уровня службы (или
SKU) в выделенной модели ценообразования. - Ограничения на хранилище по индексам в модели ценообразования без сервера.
Рекомендации по управлению и максимизации векторного хранилища см. в разделе "Размер индекса вектора" и их сохранение в пределах ограничений.
Ограничения векторов зависят от:
Более высокие ограничения векторов с апреля 2024 года существуют на новых службах поиска в регионах, предоставляющих дополнительную емкость, которая является большинством из них. Если у вас есть более старая служба в поддерживаемом регионе, проверьте, можно ли обновить службу до более высоких ограничений векторов.
В модели ценообразования без сервера ограничения векторов определяются на индекс, а не на секцию.
-
Максимальный размер индекса вектора на индекс (бессерверный): 300 МБ
- Этот размер представляет примерно 30% общего хранилища индексов, в соответствии с соотношением векторов к хранилищу, используемым на выделенных уровнях служб.
- Этот размер является жестким ограничением для каждого индекса. Попытки превысить это ограничение при индексировании завершаются сбоем.
В этой таблице показано, как изменение квоты векторов в ГБ происходит с течением времени. Квота установлена на раздел, поэтому при масштабировании новой службы уровня "Стандартный" (S1) до 6 разделов общая квота вектора будет равна 35, умноженным на 6.
| Дата создания службы | Базовая | С1 | S2 | S3/HD | Уровень 1 | L2 |
|---|---|---|---|---|---|---|
| До 1 июля 2023г. | 0,5 | 1 | 6 | 12 | 12 | 36 |
| 1 июля 2023 г. –3 апреля 2024г. | 1 | 3 | 12 | 36 | 12 | 36 |
| 3 апреля 2024 г. – 17 мая 2024г. | 5 | 35 | 150 | 300 | 12 | 36 |
| После 17 мая 20244 | 5 | 35 | сто пятьдесят | 300 | 150 | 300 |
1 Начальные ограничения векторов во время ранней предварительной версии.
2 Ограничения вектора в течение более позднего предварительного периода. Три региона не имели более высоких ограничений: Западная Германия, Западная Индия, Центральная Катар.
3 Более высокая векторная квота, исходя из более крупных разделов, для поддерживаемых уровней и регионов.
4 Более высокая векторная квота для дополнительных уровней и регионов на основе обновлений размера раздела.
Служба применяет квоту размера векторного индекса:
- Выделено: На каждый раздел в службе поиска
- Бессерверный режим: на индекс
Эта квота является жестким ограничением, чтобы обеспечить работоспособность службы. Дальнейшие попытки индексирования после превышения предела приводят к сбою. После освобождения доступной квоты можно возобновить индексирование:
- Удаление векторных документов
- Уменьшение размера вектора или размерности
- (Только для выделенных) Горизонтальное масштабирование разделов
Внимание
Более высокие ограничения векторов привязаны к большим размерам секций. В настоящее время более высокие ограничения векторов недоступны в следующих регионах, которые подвергаются ограничениям в июле–апреле.
- Центральный Израиль
- Центральный Катар
- Центральная Испания
- Южная Индия
Ограничения индексатора
Для поддержания баланса и стабильности службы в целом применяется максимально допустимое время выполнения, но некоторые большие наборы данных требуют на индексирование больше времени, чем предусмотрено. Если задание индексирования не может завершиться в течение максимального времени, попробуйте запустить его по расписанию. Планировщик сохраняет сведения о состоянии индексирования. Если запланированное задание индексирования прервано по какой-либо причине, индексатор может продолжить выполнение с того же места при следующем запланированном выполнении.
Примечание.
В модели ценообразования без сервера поведение индексатора отличается от выделенных служб. Емкость не определяется репликами или секциями. Вместо этого ограничения для каждого объекта службы, ограничения хранилища на индексы и регулирование уровня обслуживания управляют ограничениями индексирования. Максимальное время выполнения для каждого запуска индексатора Serverless Developer составляет два часа.
Ограничения объектов и пропускной способности индексатора
| Ресурс | Бесплатно 1 | Базовый 2 | С1 | S2 | S3 | S3 HD 3 | Уровень 1 | L2 | Бессерверный разработчик |
|---|---|---|---|---|---|---|---|---|---|
| Максимальное число индексаторов | 3 | 5 или 15 | 50 | 200 | 200 | Н/П | 10 | 10 | 30 |
| Максимальное количество источников данных | 3 | 5 или 15 | 50 | 200 | 200 | Н/П | 10 | 10 | 30 на каждую службу |
| Максимальное число наборов квалификационных навыков 4 | 3 | 5 или 15 | 50 | 200 | 200 | Н/П | 10 | 10 | 30 |
| Максимальная нагрузка индексирования на вызов | 10 000 документов | Ограничено только максимальным количеством документов | Ограничено только максимальным количеством документов | Ограничено только максимальным количеством документов | Ограничено только максимальным количеством документов | Н/П | Без ограничений | Без ограничений | Ограничено только максимальным количеством документов |
| Минимальное расписание | 5 мин. | 5 мин. | 5 мин. | 5 мин. | 5 мин. | 5 мин. | 5 мин. | 5 мин. | 5 мин. |
| Максимальное время выполнения одного запуска индексатора 5 | 1-3 или 3-10 мин | 2 или 24 часа | 2 или 24 часа | 2 или 24 часа | 2 или 24 часа | 2 часа | 2 или 24 часа | 2 или 24 часа | 2 часа |
| Совокупное время выполнения индексатора для каждой службы 6 | Н/П | Н/П | Н/П | Н/П | Н/П | 24 часа | Н/П | Н/П | 24 часа |
1 Максимальное время выполнения индексатора для служб уровня "Бесплатный" составляет 3 минуты для источников больших двоичных объектов или 1 минуту для прочих источников данных. Вызов индексатора каждые 180 секунд. Для индексирования данных искусственного интеллекта, использующего средства Foundry, бесплатные услуги ограничены 20 бесплатными транзакциями на индексатор в день, где под транзакцией понимается документ, который успешно проходит через процесс обогащения. (Совет. Вы можете сбросить индексатор для сброса его количества.)
2 Службы категории "Базовый", созданные до декабря 2017 г., имеют более низкие ограничения для индексов (5 вместо 15), источников данных и наборов навыков.
3 Поддержка индексатора S3 HD доступна в предварительной версии и требует версии REST API 2025-11-01-preview или более поздней. Индексаторы S3 HD выполняются только в многопользовательской среде выполнения и не поддерживают общие ресурсы Private Link. В предварительной версии поддержка индексатора S3 HD оптимальна для небольших рабочих нагрузок (размер индекса — около 1 ГБ) без навыков или с минимальным набором навыков. Сведения о совокупном поведении, мониторинге и рекомендациях по планированию см. в разделе «Выполнение индексатора в Serverless и S3 HD».
4 До 30 навыков на набор квалификационных навыков.
5 Относительно максимальной продолжительности 2 или 24 часа для индексаторов: 2-часовое ограничение является наиболее распространенным, и его следует планировать. Он относится к индексаторам, которые работают в общедоступной среде, разгружая вычислительные задачи интенсивной обработки и оставляя больше ресурсов для запросов. Ограничение в 24 часа применяется, если индексатор настроен для запуска в частной среде, используя только инфраструктуру, выделенную службе поиска. Некоторые старые индексаторы не могут работать в общедоступной среде, и эти индексаторы всегда имеют 24-часовой диапазон обработки. Если у вас есть незапланированные индексаторы, которые выполняются непрерывно в течение 24 часов, можно предположить, что эти индексаторы не могут быть перенесены в более новую инфраструктуру. Как правило, для заданий индексирования, которые не могут завершиться в течение двух часов, поместите индексатор в 5-минутное расписание, чтобы он смог быстро продолжить с того места, где остановился. На бесплатном уровне максимальное время работы составляет 3–10 минут для индексаторов с наборами навыков.
6 В службах S3 HD и Serverless все индексаторы совместно используют 24 часа совокупного времени выполнения на одну службу в каждом 24-часовом окне UTC. Сведения об использовании квот, мониторинге и планировании см. в разделе Выполнение индексатора в бессерверной среде и S3 HD (предварительная версия).
Ограничения исходных файлов для blob-подобных индексаторов
Обработка файлов выполняется на этапах, и каждая стадия имеет собственные ограничения:
- Соединитель источника данных загружает исходный элемент с учетом ограничений, относящихся к источнику.
- Поиск с использованием ИИ Azure извлекает содержимое элемента с учетом ограничений на максимальный размер исходного файла и количество извлекаемых символов, указанных в следующей таблице.
- При необходимости набор навыков отправляет это содержимое в службы последующей обработки, где ограничение на входные данные для отдельного навыка может быть меньше, чем объем данных, извлекаемых индексатором.
Максимальный размер исходного файла и ограничения на количество извлекаемых символов в следующей таблице применяются к индексаторам Хранилище BLOB-объектов Azure, ADLS Gen2, SharePoint в Microsoft 365, OneLake и Файлы Azure. Сведения о ограничениях на навыки см. в справочной статье для каждого навыка в наборе навыков.
| Ресурс | Бесплатно | Базовая | С1 | S2 | S3 | S3 HD | Уровень 1 | L2 | Бессерверный разработчик |
|---|---|---|---|---|---|---|---|---|---|
| Максимальный размер исходного файла, МБ 24 | 16 | 16 | 128 | 256 | 256 | Н/П | 256 | 256 | 256 |
| Максимальные символы, извлеченные из исходного файла 134 | 256 000 | 512 000 | 4 мил | 8 мил | 16 мил | Н/П | 4 мил | 4 мил | 16 мил |
1 Максимальное количество символов основано на единицах кода Юникода, в частности UTF-16.
2 При использовании delimitedText режима синтаксического анализа для CSV-файлов применяется ограничение размера буфера в 10 МБ на строку файла.
3 При использовании delimitedText режима синтаксического анализа для CSV-файлов ограничение "максимальный размер извлеченного содержимого" не применяется.
4 Индексаторы для хранилищ BLOB-объектов включают индексатор Хранилище BLOB-объектов Azure (индексатор BLOB-объектов), индексатор ADLS Gen2, индексатор SharePoint в Microsoft 365, индексатор OneLake и индексатор Файлы Azure. Источник знаний о файле прямого отправки не использует индексатор и имеет отдельные ограничения.
Ограничения ресурсов общих приватных ссылок
Индексаторы могут получать доступ к другим ресурсам Azure через частные конечные точки, управляемые через API приватного канала. В этом разделе описываются связанные с этой возможностью ограничения.
Примечание.
Уровень разработчика модели ценообразования без сервера не поддерживает общие частные каналы или периметр безопасности сети (NSP) для источников данных. Поддерживаются частные конечные точки и правила IP-брандмауэра для частного подключения к службе уровня Serverless Developer.
| Ресурс | Бесплатно | Базовая | С1 | S2 | S3 | S3 HD | Уровень 1 | L2 | Бессерверный разработчик |
|---|---|---|---|---|---|---|---|---|---|
| Поддержка индексаторов частных конечных точек | Нет | Да | Да | Да | Да | Нет | Да | Да | Нет |
| Поддержка приватной конечной точки для индексаторов с набором навыков 1 | Нет | Нет | Да | Да | Да | Нет | Да | Да | Нет |
| Поддержка частных конечных точек для наборов навыков с использованием навыка встраивания 2 | Нет | Да | Да | Да | Да | Нет | Да | Да | Нет |
| Максимальное количество частных конечных точек | Н/П | 10 или 30 | 100 | 400 | 400 | Н/П | 20 | 20 | Н/П |
| Максимальное количество различных типов ресурсов 3 | Н/П | 4 | 7 | 15 | 15 | Н/П | 4 | 4 | Н/П |
1 Обогащение с помощью ИИ и анализ изображений требуют большой объем вычислительных ресурсов и потребляют непропорциональные объемы доступных вычислительных мощностей. По этой причине частные подключения отключены на более низких уровнях, чтобы обеспечить производительность и стабильность самой службы поиска. В службах Basic частные подключения к ресурсу Microsoft Foundry не поддерживаются для сохранения стабильности службы. Для уровня S1 убедитесь, что служба была создана с более высокими ограничениями после 3 апреля 2024 года. Индексаторы с более чем двумя навыками встраивания Azure OpenAI или многомодальными встраиваниями Azure Vision не допускаются к работе в частной среде, и частные подключения недоступны.
2 Частные подключения к модели внедрения поддерживаются в службах поиска "Базовый" и "S1 с высокой емкостью", созданных после 3 апреля 2024 г. с более высокими ограничениями для хранения и вычислительной обработки.
3 Число различных типов ресурсов вычисляется как количество уникальных groupId значений, используемых во всех общих ресурсах приватного канала для данной службы поиска независимо от состояния ресурса.
Ограничения синонимов
Максимальное количество карт синонимов зависит от уровня. Каждое правило может иметь до 20 расширений, которые представляют собой эквивалентные термины. Например, для слова "cat" ассоциации с "kitty", "feline" и "felis" (род кошек) считаются тремя расширениями.
| Ресурс | Бесплатно | Базовая | С1 | S2 | S3 | S3 HD | Уровень 1 | L2 | Бессерверный разработчик |
|---|---|---|---|---|---|---|---|---|---|
| Максимальные карты синонимов | 3 | 3 | 5 | 10 | 20 | 20 | 10 | 10 | 20 на сервис |
| Максимальное количество правил на карту | 5 000 | 20000 | 20000 | 20000 | 20000 | 20000 | 20000 | 20000 | 20000 |
Ограничения индексного псевдонима
Максимальное число псевдонимов индекса зависит от уровня и даты создания службы. На всех уровнях, если служба была создана после октября 2022 года, максимальное число псевдонимов вдвое превышает разрешенное количество индексов. Если служба была создана до октября 2022 года, ограничение — это допустимое количество индексов.
Примечание.
Уровень разработчика бессерверной модели не поддерживает псевдонимы индексов.
| Дата создания службы | Бесплатно | Базовая | С1 | S2 | S3 | S3 HD | Уровень 1 | L2 | Бессерверный разработчик |
|---|---|---|---|---|---|---|---|---|---|
| До октября 2022 г. | 3 | 5 или 15 1 | 50 | 200 | 200 | 1000 на раздел или 3000 на службу | 10 | 10 | Н/П |
| После октября 2022 г. | 6 | 30 | 100 | 400 | 400 | 2000 на раздел или 6000 на сервис | 20 | 20 | Н/П |
1 Службы категории "Базовый", созданные до декабря 2017 г., имеют более низкие ограничения индексов (5 вместо 15).
Ограничения агентского извлечения
База знаний определяет один или несколько источников знаний и уровень аналитической обработки при извлечении (предварительная версия), который регулирует уровень обработки с помощью большой языковой модели (LLM) для агентного извлечения. Ограничения зависят от ценовой категории, версии API и уровня усилий по соображениям.
| Ресурс | Бесплатно | Базовая | С1 | S2 | S3 | S3 HD | Уровень 1 | L2 | Бессерверный разработчик |
|---|---|---|---|---|---|---|---|---|---|
| Максимальное количество источников знаний для каждой службы | 3 | 5 или 15 1 | 50 | 200 | 200 | 1000 на раздел или 3000 на сервис 2 | 10 | 10 | 30 |
| Максимальное количество баз знаний на службу | 3 | 5 или 15 1 | 50 | 200 | 200 | 1000 для каждого раздела или 3000 для каждой службы 2 | 10 | 10 | 30 |
| Максимальное количество источников знаний на базу знаний | 3 | 5 или 10 1 | 10 | 10 | 10 | 10 2 | 10 | 10 | 10 |
1 Базовые службы, созданные до 3 апреля 2024 года, имеют более низкие ограничения (5) для источников знаний и баз знаний.
2 Эти ограничения применяются к службам S3 HD, которые поддерживают базы знаний и источники знаний. Некоторые старые службы S3 HD не поддерживают эти ресурсы.
Выбор источника знаний во время извлечения
База знаний может содержать не более максимального количества, предусмотренного для соответствующего уровня и указанного выше, независимо от версии API или уровня усилий при логическом выводе во время извлечения. Вместо этого версия API и уровень вычислительных усилий для рассуждения влияют на то, сколько источников знаний можно выбрать при извлечении.
| Версия API | Усилия по восстановлению логического вывода | Бесплатно | Базовая | С1 | S2 | S3 | S3 HD | Уровень 1 | L2 |
|---|---|---|---|---|---|---|---|---|---|
2026-05-01-preview и более поздние версии |
minimal, low, medium |
3 | 5 или 10 1 | 10 | 10 | 10 | 10 | 10 | 10 |
2026-04-01, 2025-11-01-preview |
minimal
2 |
3 | 5 или 10 1 | 10 | 10 | 10 | 10 | 10 | 10 |
2025-11-01-preview |
low |
3 | 3 | 3 | 3 | 3 | 3 | 3 | 3 |
2025-11-01-preview |
medium |
3 | 5 | 5 | 5 | 5 | 5 | 5 | 5 |
2025-08-01-preview использует устаревший контракт агента знаний и не поддерживает retrievalReasoningEffort.
2 Процесс рассуждения minimal использует все источники знаний в базе знаний, поскольку он минует планирование запросов на базе LLM.
Получить время выполнения запроса
Ограничение maxRuntimeInSeconds одинаково для всех поддерживаемых уровней.
| Минимум | По умолчанию | Максимум |
|---|---|---|
| 10 секунд | 90 секунд | 600 секунд (10 минут) |
Максимум применяется только к запросу на извлечение в Поиск с использованием ИИ Azure. Примеры конфигурации см. в Переопределение усилия рассуждения по умолчанию и настройка ограничений запросов.
Ограничения по данным (обогащение с помощью ИИ)
Действуют ограничения на объем данных для конвейера обогащения с помощью ИИ, который обращается к службе Azure Language в Foundry Tools. Максимальное количество входных данных составляет 50 000 символов, измеряемых навыком String.Length, навыком связывания сущностей, навыкомизвлечения ключевых фраз, навыкомобнаружения языка и навыком обнаружения PII. Навык Sentiment skill имеет ограничение в 5 000 символов.
Используйте навык разделения текста , если необходимо разделить более крупный текст перед последующей обработкой.
Эти ограничения применяются как к выделенным, так и бессерверным моделям ценообразования.
Ограничения пропускной способности
Ограничения регулирования помогают обеспечить стабильность службы, управляя скоростью запросов API.
В модели ценообразования Dedicated ограничение основано на количестве единиц поиска (реплики × разделы).
В бессерверной модели ценообразования ограничение пропускной способности не зависит от единиц поиска. Вместо этого ограничения операций уровня обслуживания и общее поведение потребления управляют пропускной способностью. Ограничения использования и службы управляют емкостью, а не конфигурацией реплик и секций.
| Операция | Выделено (на поисковую единицу) | Бессерверный (для каждой службы или для каждого индекса) |
|---|---|---|
| Список индексов (GET /indexes) | 3 запроса/с/SU | 3 запроса/с |
| Получение индекса (GET /indexes/{index}) | 10 запросов/с/SU | 10 запросов в секунду |
| Создание индекса (POST /indexes) | 12 запросов/мин/SU | 12 запросов/мин |
| Создание или обновление индекса (PUT /indexes/{index}) | 6 запросов/с/SU | 6 запросов в секунду |
| Удаление индекса (DELETE /indexes/{index}) | 12 запросов/мин/SU | 12 запросов/мин |
| Статистика служб (GET /servicestats) | 4 запроса/с/SU | 4 запроса/с |
| Поисковые запросы (POST /indexes/{index}/docs/search) | Зависит от количества SU и сложности запроса. | 50 запросов/с (совокупное ограничение на чтение для каждого индекса) |
| Индексировать документы (POST /indexes/{index}/docs/index) | Зависит от количества единиц SU и нагрузки индексирования | 5 запросов в секунду на индекс |
| Предложение (POST /indexes/{index}/docs/suggest) | Зависит от количества SU | Не определен явным образом |
| Автозавершение (POST /indexes/{index}/docs/autocomplete) | Зависит от количества SU | Не определен явным образом |
Ограничения на управление семантическим ранжированием
Семантический ранжатор использует систему очередей для управления параллельными запросами. Эта система позволяет службам поиска получать наибольшее количество запросов в секунду. Когда достигнуто ограничение одновременных запросов, система помещает дополнительные запросы в очередь. Если очередь заполнена, система отклоняет последующие запросы, и их необходимо отправить повторно.
Общее количество запросов семантического ранжирования в секунду зависит от следующих факторов:
- Уровень службы поиска. Емкость очереди и ограничения одновременных запросов зависят от уровня.
- Количество поисковых единиц в поисковом сервисе. Самый простой способ увеличить максимальное количество одновременных запросов семантического ранджера — добавить в службу поиска больше единиц поиска.
- Общая доступная емкость для семантического ранжирования в регионе.
- Время, необходимое для обслуживания запроса с помощью семантического рангера. Это время зависит от загруженности службы поиска.
В следующей таблице описаны ограничения использования семантического ранжирования по уровням, при условии доступности ресурсов в регионе. Вы можете обратиться в службу поддержки Майкрософт, чтобы запросить увеличение лимита.
| Ресурс | Базовая | С1 | S2 | S3 | S3 HD | Уровень 1 | L2 | Бессерверный разработчик |
|---|---|---|---|---|---|---|---|---|
| Максимальное число одновременных запросов (на единицу поиска) | 2 | 3 | 4 | 4 | 4 | 4 | 4 | 4 (на службу) |
| Максимальный размер очереди запросов (на единицу поиска) | 4 | 6 | 8 | 8 | 8 | 8 | 8 | 8 (на сервис) |
Ограничения запросов к API
Ограничения на запросы существуют, так как несвязанные запросы могут дестабилизировать службу поиска. Как правило, такие запросы создаются программным способом. Если приложение создает поисковые запросы программным способом, проектируйте его таким образом, чтобы он не создавал запросы несвязанного размера.
Ограничения на нагрузки существуют по аналогичным причинам, чтобы обеспечить стабильность службы поиска. Ограничение применяется ко всему запросу, включая все его компоненты. Например, если запрос объединяет несколько документов или команд, весь запрос должен вмещаться в поддерживаемый лимит.
Если необходимо превысить поддерживаемое ограничение, проверьте рабочую нагрузку , чтобы вы знали, что ожидать.
За исключением отмеченных, следующие запросы API применяются ко всем программируемым интерфейсам, включая пакеты SDK Azure.
Общие сведения:
- Поддерживаемый максимальный предел полезных данных составляет 16 МБ для индексирования и запроса через REST API и SDK.
- Максимальная длина URL-адреса 8 КБ (применяется только к REST API).
Api индексирования:
- Максимально поддерживается 1000 документов на одну партию загрузок индекса, слияний или удалений.
- Каждый запрос поддерживает от 1 до 32 000 действий индексирования.
API запросов:
- Максимум 10 полей в векторном запросе
- Не более 32 полей в предложении $orderby.
- Максимум 100 000 символов в предложении поиска.
- Максимальное количество условий в поиске составляет 3000.
- Максимальная квота на запросы с подстановочными знаками и регулярными выражениями, применяемая Lucene. Он ограничивает количество шаблонов, вариантов или совпадений до 1000 экземпляров. Это ограничение применяется, чтобы избежать перегрузки двигателя.
Условия поиска:
- Поддерживаемый максимальный размер термина поиска составляет 32 766 байт (32 КБ минус 2 байта) в кодировке UTF-8. Применяется к поиску ключевых слов и свойству текста векторного поиска.
- Поддерживаемый максимальный размер термина поиска составляет 1000 символов для поиска по префиксу и поиска по регулярным выражениям.
Ограничения ответов API
- Каждая страница результатов поиска возвращает до 1000 документов.
- Каждый запрос API предложения возвращает до 100 предложений.
Поисковая система возвращает 50 результатов по умолчанию, но вы можете переопределить этот параметр до максимального предела.
Ограничения ключей API
Используйте ключи API для проверки подлинности службы. Существуют два типа ключей API. Ключи администратора, указанные в заголовке запроса, предоставляют полный доступ на чтение и запись в службу. Ключи запросов, указанные в URL-адресе, доступны только для чтения и обычно распределяются по клиентским приложениям.
- Каждая служба поддерживает до двух ключей администратора.
- Каждая служба поддерживает до 50 ключей запросов.