서버리스 및 표준 3 고밀도(S3 HD)에서 인덱서 실행(미리 보기)

메모

Azure AI 검색 Azure 포털, REST API 및 Azure SDK 통해 사용할 수 있습니다. 또한 엔터프라이즈 콘텐츠를 Microsoft Foundry 포털의 에이전트에 대해 재사용 가능한 사용 권한 인식 기술 자료로 변환하는 관리되는 기술 계층인 Foundry IQ를 뒷받침합니다.

Important

기능, 기능 또는 표시된 속성(미리 보기)은 서비스 수준 계약에 포함되지 않으며 프로덕션 워크로드에는 권장되지 않으며 일반적으로 사용 가능해지기 전에 변경되거나 제한될 수 있습니다. Azure AI 검색 미리 보기 용어는 독립 실행형 기능이든 일반 공급 기능의 일부이든 관계없이 모든 미리 보기 기능에 적용됩니다.

이 문서에서는 Azure AI 검색 서버리스 및 표준 3 고밀도(S3 HD) 검색 서비스에 사용하는 인덱서 실행 모델을 설명합니다. 두 옵션 모두 24시간 UTC 기간당 사용할 수 있는 총 인덱서 시간을 제어하는 서비스 수준 일일 런타임 할당량이 있습니다.

이 문서에 설명된 기능은 미리 보기로 제공됩니다.

적용되는 곳

이 문서의 실행 모델은 다음에 적용됩니다.

지원되는 인덱서 정의, 데이터 원본, 기술 세트 및 인덱서 지원 기술 원본은 두 옵션을 모두 수정하지 않고 작동합니다.

실행 모델

서버리스 및 S3 HD의 인덱서는 다음과 같은 실행 특성을 갖습니다.

  • 인덱서 인프라를 프로비전하거나 관리하지 않습니다. 서비스가 사용자를 대신해 용량을 관리합니다.

  • 인덱서는 다중 테넌트 실행 환경에서만 실행됩니다. 공유 프라이빗 링크 리소스를 통해 제공되는 프라이빗 실행 환경은 이러한 SKU의 인덱서에서 사용할 수 없습니다.

  • S3 HD의 경우 공용 인터넷에서 벗어나기 위해 인덱서 연결이 필요한 경우 명시적 액세스 규칙을 통해 인바운드 및 아웃바운드 트래픽을 제어하도록 검색 서비스에서 NSP( 네트워크 보안 경계 )를 구성합니다.

  • 서버리스의 경우 프라이빗 연결을 지원하지 않습니다.

일일 누적 런타임 할당량

인덱서 실행은 00:00 UTC에 다시 설정되는 일일 런타임 할당량에 의해 제어됩니다. 할당량은 다음과 같습니다.

  • 서비스 수준: 검색 서비스 전체에 적용됩니다.
  • 누적: 서비스의 모든 인덱서의 런타임은 동일한 예산으로 계산됩니다. 할당량은 인덱서당 적용되지 않습니다.

실행 중인 모든 인덱서는 하나의 공유 서비스 예산에 대해 시간을 계산합니다. 서비스는 개별 인덱서에 대한 런타임을 예약하거나 할당량을 자동으로 동일하게 나누지 않습니다. 예를 들어 각각 2시간 동안 실행되는 12개의 인덱서의 누적 기간은 실행이 겹치거나 다른 시간에 발생하는지 여부에 관계없이 24개의 집계 런타임 시간을 모두 사용할 수 있습니다.

다음 표에서는 SKU별 일일 할당량과 이를 지원하는 최소 API 버전을 나열합니다.

SKU 24시간 UTC 기간당 일일 할당량 최소 API 버전
S3 HD 24시간 2025-11-01-preview
Serverless 24시간 2026-05-01-preview

일일 할당량이 소진된 경우:

  • 현재 실행 중인 인덱서는 약 5분 이내에 중지됩니다.

  • 새 인덱서 실행은 문서를 처리하지 않으며 일별 할당량이 초과되었음을 나타내는 일시적인 오류를 즉시 반환합니다.

  • 카운터가 00:00 UTC에 다시 설정되면 일반 인덱서 실행이 다시 시작됩니다.

할당량 고갈에서 복구

할당량 고갈에서 복구하고 다시 적중할 가능성을 줄이려면 다음을 수행합니다.

누적 런타임 모니터링

이 섹션에서는 Search Service REST API를 사용하여 런타임 사용량 및 남은 예산을 추적하는 방법을 설명합니다. 미리 보기 기간에는 누적 런타임에 대한 포털 환경이 제공되지 않습니다.

서비스 수준 런타임

REST API( 서비스 통계 가져오기 )를 사용하여 현재 24시간 동안 서비스의 모든 인덱서에서 누적 인덱서 런타임을 검색합니다.

GET {endpoint}/servicestats?api-version=2026-08-01-preview

응답에는 indexersRuntime 섹션이 포함됩니다. 다음 JSON은 24시간 일별 할당량이 사용되지 않는 서비스를 보여줍니다.

"indexersRuntime": {
    "usedSeconds": 0,
    "remainingSeconds": 86400,
    "beginningTime": "2026-05-16T00:00:00.000Z",
    "endingTime": "2026-05-17T00:00:00.000Z"
}

핵심 사항:

  • usedSeconds: 현재 창에서 서비스의 모든 인덱서가 실행된 총 시간(초)입니다.
  • remainingSeconds: 일일 할당량에 도달하기 전에 계속 사용할 수 있는 시간(초)입니다. 계층별 제한이 적용되는 경우 표시됩니다.
  • beginningTime 및 endingTime: 현재 24시간 UTC 계산 창의 시작 및 끝입니다.

인덱서 수준 런타임

REST API( 인덱서 상태 가져오기 )를 사용하여 개별 인덱서에 대한 누적 런타임을 검색합니다.

GET {endpoint}/indexers('{indexerName}')/search.status?api-version=2026-08-01-preview

응답에는 runtime 섹션이 포함됩니다. 다음 JSON은 24시간 일별 할당량이 사용되지 않는 서비스의 인덱서입니다.

"runtime": {
    "usedSeconds": 0,
    "remainingSeconds": 86400,
    "beginningTime": "2026-05-16T00:00:00.000Z",
    "endingTime": "2026-05-17T00:00:00.000Z"
}

핵심 사항:

  • usedSeconds: 현재 창에서 인덱서가 실행된 총 시간(초)입니다.
  • remainingSeconds: 이 인덱서뿐만 아니라 서비스의 모든 인덱서에서 계속 사용할 수 있는 시간(초)입니다. 계층별 제한이 적용되는 경우 표시됩니다.
  • beginningTime 및 endingTime: 현재 24시간 UTC 계산 창의 시작 및 끝입니다.

모범 사례

S3 HD 및 서버리스의 인덱서 지원은 미리 보기로 제공됩니다. 워크로드 크기를 적절하게 조정하고 나중에 도입될 Serverless에 대한 청구를 계획하려면 이 지침을 따르세요.

S3 HD

프리뷰 기간 동안 S3 HD 인덱서 지원은 스킬셋이 없거나 작은 스킬셋을 사용하는 워크로드를 위해 설계되었습니다. 일일 할당량을 유지하려면 다음을 수행합니다.

  • 약 1GB 크기의 작은 인덱스를 계획합니다.

  • 스킬셋 사용량을 신중하게 조정하세요. 외부 서비스를 호출하는 기술, Azure OpenAI Embedding skill, GenAI 프롬프트 기술 및 Azure Content Understanding 기술 같이 런타임이 크게 증가하고 특히 다중 테넌트 시나리오에서 일일 할당량을 빠르게 사용할 수 있습니다.

  • 미리 보기 중에는 제한된 병렬 처리가 예상됩니다. 동일한 예산을 위해 경쟁하는 대신 24시간 동안 작업이 분산되도록 대규모 인덱서 플릿에 대해 예약되고 시차를 둔 실행을 사용합니다.

예시 분할 및 임베드 워크로드

한 번의 통제된 S3 HD 테스트에서 Split 스킬 1개와 Azure OpenAI Embedding 스킬 1개가 청크와 임베딩을 생성했습니다. 워크로드는 원본 문서당 약 2.5개의 청크를 생성했으며, 24시간 S3 HD 테스트 기간 동안 이 테스트에서 약 22,000개의 원본 문서가 관찰되었습니다.

다음 값은 집계된 관측치를 기반으로 반올림한 예시용 공정 배분 계산값입니다. 이는 인덱서별 결과로 측정되지 않습니다.

인덱서 수 인덱서별 일일 예시 소스 문서
100 약 200
500 약 40
1,000 약 20

서비스는 용량을 예약하거나 이러한 인덱서 수에 대해 동일한 배포, 실행 순서 또는 처리량을 보장하지 않습니다.

메모

이 결과는 하나의 제어된 테스트에서 관찰되었습니다. 성능 목표, 서비스 보장, 용량 약정, 크기 조정 수식 또는 워크로드 테스트 대신 사용할 수 없습니다.

처리량은 문서 복잡성 및 프로필, 청크, 기술 및 벡터 출력의 수와 유형, 모델 대기 시간, 용량 및 할당량, 원본 및 대상 성능, 동시성, 예약 순서, 제한, 지역, 실패 및 재시도, 문서 크래킹 또는 OCR(광학 문자 인식) 및 고르지 않은 테넌트 볼륨에 따라 크게 달라질 수 있습니다. 용량을 계획하기 전에 대표적인 프로덕션 입력으로 테스트합니다.

Serverless

미리 보기 중에 서버리스 인덱서는 RAG(검색 보강 생성) 및 기술 자료 시나리오에 대한 수집을 간소화하도록 설계되었습니다.

  • 인덱서 실행(기술 제외)은 현재 무료입니다. 인덱스에 문서를 쓰면 비용이 발생합니다.

  • 기술 세트 실행은 전용 인덱서와 동일한 방식으로 청구됩니다. Azure OpenAI 포함 기술, GenAI 프롬프트 기술 및 Azure Content Understanding 기술과 같은 외부 서비스에 대한 호출은 연결된 Foundry 또는 Azure AI 서비스 리소스 통해 청구됩니다.

한도 및 할당량

서버리스 및 S3 HD의 인덱서 제한은 인덱서 제한을 참조하세요.

서비스 수준 런타임 할당량 및 인덱서 제한은 기술 세트의 기술 및 외부 서비스의 입력, 요청 또는 처리 제한을 대체하지 않습니다. 보강 파이프라인의 크기를 산정할 때는 각 스킬 참조를 별도로 확인하세요.