참고
Azure AI 검색 Azure 포털, REST API 및 Azure SDK 통해 사용할 수 있습니다. 또한 엔터프라이즈 콘텐츠를 Microsoft Foundry 포털의 에이전트에 대해 재사용 가능한 사용 권한 인식 기술 자료로 변환하는 관리되는 기술 계층인 Foundry IQ를 뒷받침합니다.
스토리지, 워크로드 및 인덱스 및 기타 개체의 수량에 대한 최대 제한은 Azure AI 검색 서비스의 가격 책정 모델에 따라 달라집니다.
Azure AI 검색 각각 연결된 서비스 계층이 있는 두 가지 가격 책정 모델을 지원합니다. 선택하는 계층은 이 지침에 설명된 서비스 제한에 영향을 줍니다.
- 전용:SU(검색 단위)로 측정된 고정 가격 책정입니다. 서비스 계층 옵션에는 기본, 표준(S1-S3, S3 HD 포함), 스토리지 최적화(L1-L2) 및 제한된 검색 서비스 기능이 있는 무료 계층이 포함됩니다.
- 서버리스(미리 보기): 시간당 컴퓨팅 단위(CU/hr) 및 인덱싱된 스토리지의 경우 GB/월 단위로 측정된 소비 기반 가격 책정입니다. 현재 미리 보기 계층은 서버리스 개발자입니다. 제한은 인덱스별 상한, 서비스별 객체 수, 그리고 Serverless의 스로틀링 동작에 의해 정의됩니다.
중요한
서버리스 개발자 계층은 현재 미리 보기로 제공됩니다. 이 미리 보기는 서비스 수준 계약 없이 제공되며 프로덕션 워크로드에는 권장되지 않습니다. 특정 기능이 지원되지 않거나 기능이 제한될 수 있습니다. 자세한 내용은 Microsoft Azure Preview에 대한 추가 사용 약관을 참조하세요.
서버리스 개발자 계층에 대한 청구는 2026년 9월 13일에 시작되었습니다. 해당 날짜 또는 이후 사용량에 대한 요금은 Azure 청구서에 표시됩니다. 2026년 9월 13일 이전에는 사용 요금이 청구되지 않습니다.
서버리스 개발자 계층은 다른 가격 책정 계층으로의 마이그레이션을 지원하지 않으며, 다른 계층에서 사용할 수 있는 일부 기능은 공개 미리 보기 중에 지원되지 않습니다. 서비스 제한, 지원되는 기능 및 가격 책정 세부 정보는 일반 공급 전에 변경 될 수 있습니다.
미리 보기 중에 서버리스 가격 책정 모델은 특정 지역에서만 지원됩니다.
자세한 내용은 가격 책정 모델 및 서비스 계층 선택을 참조하세요.
할당량, 용량 또는 제한 오류 진단
할당량 및 용량 오류는 별도의 컨트롤에서 발생합니다. 완료된 작업의 오류를 사용하여 적용되는 항목을 찾습니다.
만들기, 크기 조정 또는 업그레이드 작업이 여전히 실행 중인 경우 프로비전 상태가 될 SucceededFailed때까지 기다립니다. 진행 중인 작업은 할당량 또는 용량 문제의 증거가 아닙니다. 크기 조정 작업이 실패하면 크기 조정 중 오류를 참조하세요.
| Failure | 가능한 원인 | 첫 번째 작업 |
|---|---|---|
| 구독 및 지역에서의 서비스 만들기 차단 | 구독 할당량 | 할당량 서비스에서 계층 및 지역에 대한 제한을 확인한 다음, 더 많은 서비스를 요청합니다. |
| 할당량을 사용할 수 있더라도 만들기, 크기 조정 또는 업그레이드가 실패합니다. | 대체 지역과 사용량이 적은 시간대 배포를 고려하세요 | 수요가 많은 계층에 대한 지역 지원 의 각주를 확인한 다음 , 대안을 고려합니다. |
| 복제본, 파티션, 계층 또는 개체 요청이 거부됨 | 서비스 또는 인덱스 제한 | 구성 및 개체 수를 서비스 제한 및 인덱스 제한과 비교합니다. |
| 검색 서비스는 부하 상태에서 스로틀링 응답을 반환합니다. | Throttling | 요청 속도를 줄이거나 검색 단위를 추가합니다. 스로틀링 한도를 참조하세요. |
| 스토리지 또는 벡터 제한에 가까운 인덱싱 실패 | 스토리지 또는 벡터 할당량 | 디스크의 경우 vectorIndexSize와 비교하고, 메모리의 경우 storageSize과 비교합니다. |
| 인덱서, 기술 또는 벡터라이저가 다른 서비스에서 429를 보고합니다. | Azure OpenAI 또는 기타 서비스 할당량 | Azure OpenAI와 같이 오류를 실행한 서비스에 대한 할당량 지침을 따릅니다. |
사용 가능한 구독 할당량은 지역 용량을 보장하지 않으며 더 많은 할당량을 요청해도 용량 제약 조건이 해결되지 않습니다. 오류가 지속되면 구독, 지역, 계층, 요청된 구성, 전체 오류 텍스트, UTC 시간 및 상관 관계 또는 작업 ID를 포함하는 Azure 지원 요청을 엽니다.
구독 제한
지역당 각 계층에서 허용되는 최대 서비스 수까지 여러 청구 가능한 검색 서비스(기본 및 이상)를 만들 수 있습니다. 예를 들어 기본 계층에서 최대 16개의 서비스를 만들고 동일한 구독 및 지역 내의 S1 계층에 다른 16개의 서비스를 만들 수 있습니다. 그런 다음, 동일한 구독에서 총 32개의 기본 서비스를 조합하여 다른 지역에 16개의 기본 서비스를 추가로 만들 수 있습니다. 서비스 계층에 대한 자세한 내용은 가격 책정 모델 및 서비스 계층 선택을 참조하세요.
요청으로 최대 서비스 제한을 높일 수 있습니다. 동일한 구독 내에서 더 많은 서비스가 필요한 경우 지원 요청을 제출합니다.
| 리소스 | 무료 1 | 기본 | S1 | S2 | S3 | S3 HD | 레벨 1 | L2 | 서버리스 개발자 |
|---|---|---|---|---|---|---|---|---|---|
| 지역당 최대 서비스 | 1 | 16 | 16 | 8 (여덟) | 6 | 6 | 6 | 6 | 5 |
| 최대 SU(검색 단위)2 | 해당 없음 | 3 SU (설명: 'SU'가 정확히 무엇을 의미하는지) | 36 SU | 36 SU | 36 SU | 36 SU | 36 SU | 36 SU | 해당 없음 |
1 Azure 구독당 하나의 무료 검색 서비스를 사용할 수 있습니다. 무료 계층은 다른 고객과 공유되는 인프라를 기반으로 합니다. 하드웨어는 전용이 아니므로 스케일 업이 지원되지 않으며 스토리지는 50MB로 제한됩니다. 추가 서비스를 위한 공간을 확보하기 위해 비활성 기간이 연장된 후 무료 검색 서비스가 삭제될 수 있습니다.
2 SU(검색 단위)는 복제본 또는 파티션으로 할당되는 청구 가능 단위입니다. 둘 다 필요합니다. SU 조합에 대해 자세히 알아보려면 검색 서비스 용량 예측 및 관리를 참조하세요.
서비스 제한
전용 가격 책정 모델에서는 복제본 수에 파티션 수(검색 단위)를 곱하여 용량을 산정합니다.
| 리소스 | 무료 | 기본 | S1 | S2 | S3 | S3 HD | 레벨 1 | L2 | 서버리스 개발자 |
|---|---|---|---|---|---|---|---|---|---|
| 파티션 | 해당 없음 | 3 1 | 12 | 12 | 12 | 3 | 12 | 12 | 해당 없음 |
| 복제본 | 해당 없음 | 3 | 12 | 12 | 12 | 12 | 12 | 12 | 해당 없음 |
1 기본 계층은 2024년 4월 3일 이후에 만들어진 새 검색 서비스에서 총 9개의 SU(검색 단위)에 대해 3개의 파티션과 3개의 복제본을 지원합니다. 이전 기본 서비스는 하나의 파티션과 3개의 복제본으로 제한됩니다.
검색 서비스에는 최대 스토리지 제한(파티션 크기, 파티션 수 곱하기) 또는 최대 인덱스 또는 인덱서 수에 대한 하드 제한이 적용됩니다.
SLA(서비스 수준 계약)는 쿼리 워크로드에 대한 복제본이 두 개 이상 있는 청구 가능 서비스 또는 쿼리 및 인덱싱 워크로드에 대한 복제본 3개 이상에 적용됩니다. 파티션의 수는 SLA 고려사항이 아닙니다. 자세한 내용은 Azure AI 검색의 안정성을 참조하세요.
무료 서비스에는 고정 파티션 또는 복제본이 없으며 다른 구독자와 리소스를 공유합니다.
파티션 스토리지(GB)
서비스별 스토리지 제한은 서비스 생성 날짜 및 지역이라는 두 가지 요인에 따라 달라집니다. 지원되는 대부분의 지역은 최신 서비스에 대해 더 높은 제한을 제공합니다.
이 표에서는 시간이 지남에 따라 스토리지 할당량이 증가했음을 GB 단위로 보여 줍니다. 2024년 4월부터 각주에 나열된 지역에서 더 높은 용량 파티션이 온라인 상태가 됩니다. 지원되는 지역에 이전 서비스가 있는 경우 더 높은 스토리지 제한을 얻기 위해 서비스를 업그레이드 할 수 있는지 확인합니다.
| 서비스 생성 날짜 | 기본 | S1 | S2 | S3/HD | 레벨 1 | L2 | 서버리스 개발자 |
|---|---|---|---|---|---|---|---|
| 2024년 4월 3일 이전 | 2 | 이십오 (25) | 100 | 200 | 1,024 | 2,048 | 해당 없음 |
| 2024년 4월 3일부터 2024년 5월 17일까지 1 | 15 | 160 | 512 | 1,024 | 1,024 | 2,048 | 해당 없음 |
| 2024년 5월 17일 이후 2 | 15 | 160 | 512 | 1,024 | 2,048 | 4,096 | 해당 없음 |
| 2025 년 2월 10일 이후 3 | 15 | 160 | 512 | 1,024 | 2,048 | 4,096 | 해당 없음 |
1 이러한 지역의 Basic, S1, S2 및 S3용 더 높은 용량 스토리지. 아메리카: 브라질 남부, 캐나다 중부, 캐나다 동부, 미국 동부, 미국 동부 2, 미국 중부, 미국 중북부, 미국 중남부, 미국 중서부, 미국 서부 2, 미국 서부 3, 미국 중서부. 유럽: 프랑스 중부. 이탈리아 북부, 북유럽, 노르웨이 동부, 폴란드 중부, 스위스 북부, 스웨덴 중부, 영국 남부, 영국 서부. 중동: 아랍에미리트 북부. 아프리카: 남아프리카 공화국 북부. 아시아 태평양: 오스트레일리아 동부, 오스트레일리아 남동부, 인도 중부, 지오 인도 서부, 동아시아, 동남 아시아, 일본 동부, 일본 서부, 한국 중부, 한국 남부.
2 L1 및 L2용 대용량 스토리지입니다. 더 많은 지역이 청구 가능한 모든 계층에서 더 높은 용량을 제공합니다. 아메리카: 미국 동부 2 EUAP. 유럽: 독일 북부, 독일 중서부, 스위스 서부. Azure Government: 텍사스, 애리조나, 버지니아. 아프리카: 남아프리카 공화국 북부. 아시아 태평양: 중국 북부 3, 중국 동부 3.
3 더 높은 용량의 스토리지는 서유럽에서 사용할 수 있습니다.
중요한
현재 4월 3일 이전 제한이 적용되는 다음 지역에서는 더 높은 스토리지 제한을 사용할 수 없습니다.
- 이스라엘 중부
- 카타르 중부
- Spain Central
- 인도 남부
인덱스 제한
| 리소스 | 무료 | 기본 | S1 | S2 | S3 | S3 HD | 레벨 1 | L2 | 서버리스 개발자 |
|---|---|---|---|---|---|---|---|---|---|
| 최대 인덱스 | 3 | 5 또는 15 1 | 50 | 200 | 200 | 파티션당 1000 또는 서비스당 3000 | 10 | 10 | 30 |
| 인덱스당 최대 단순 필드 2 | 1000 | 100 또는 1000 3 | 1000 | 1000 | 1000 | 1000 | 1000 | 1000 | 1000 |
| 벡터 필드당 최대 크기 | 4096 | 4096 | 4096 | 4096 | 4096 | 4096 | 4096 | 4096 | 4096 |
| 인덱스당 최대 복합 컬렉션 | 40 | 40 | 40 | 40 | 40 | 40 | 40 | 40 | 40 |
| 문서당 모든 복합 컬렉션의 최대 요소 4 | 3000 | 3000 | 3000 | 3000 | 3000 | 3000 | 3000 | 3000 | 3000 |
| 복합 필드의 최대 깊이 | 10 | 10 | 10 | 10 | 10 | 10 | 10 | 10 | 10 |
| 인덱스당 최대 추천기 수 | 1 | 1 | 1 | 1 | 1 | 1 | 1 | 1 | 1 |
| 인덱스당 최대 점수 프로필 수 | 100 | 100 | 100 | 100 | 100 | 100 | 100 | 100 | 100 |
| 인덱스당 최대 의미 체계 구성 | 100 | 100 | 100 | 100 | 100 | 100 | 100 | 100 | 100 |
| 프로필당 최대 함수 | 8 (여덟) | 8 (여덟) | 8 (여덟) | 8 (여덟) | 8 (여덟) | 8 (여덟) | 8 (여덟) | 8 (여덟) | 8 (여덟) |
| 최대 인덱스 크기 5 | 해당 없음 | 해당 없음 | 해당 없음 | 1.88TB | 2.34TB | 100GB | 해당 없음 | 해당 없음 | 1GB |
1 2017년 12월 이전에 생성된 기본 서비스는 인덱스에서 낮은 제한(15 대신 5)을 갖습니다.
2 필드의 상한에는 복합 컬렉션의 첫 번째 수준 필드와 중첩된 하위 필드가 모두 포함됩니다. 예를 들어 인덱스에 15개의 필드가 있고 각각 5개의 하위 필드가 있는 2개의 복합 컬렉션이 있는 경우 인덱스의 필드 수는 25입니다. 필드 컬렉션이 매우 큰 인덱스는 특히 이전 Basic 서비스에서 느려질 수 있습니다. 필드와 특성을 필요한 항목으로 제한하고 인덱싱 및 쿼리 테스트를 실행하여 성능이 허용되는지 확인합니다.
3 2024년 4월 3일 이전에 만든 기본 서비스는 인덱스당 최대 100개의 필드를 지원합니다. 최신 Basic 서비스는 인덱스당 1,000개의 필드를 지원합니다.
4 요소 수가 많으면 인덱스에 필요한 스토리지가 크게 증가하므로 요소에 대한 상한이 존재합니다. 복합 컬렉션의 요소는 해당 컬렉션의 멤버로 정의됩니다. 예를 들어 Rooms 복합 컬렉션이 있는 Hotel 문서를 가정합니다. Rooms 컬렉션의 각 회의실은 요소로 간주됩니다. 인덱싱 중에 인덱싱 엔진은 문서 전체에서 최대 3000개의 요소를 안전하게 처리할 수 있습니다.
이 제한은 api-version=2019-05-06에서 도입되었으며, 문자열 컬렉션이나 복합 필드에는 적용되지 않고 복합 컬렉션에만 적용됩니다.
5 대부분의 계층에서 최대 인덱스 크기는 검색 서비스에서 사용 가능한 총 스토리지입니다. 여러 파티션이 있는 S2, S3 및 S3 HD 서비스의 경우 스토리지가 많으므로 단일 인덱스의 최대 크기가 테이블에 제공됩니다. 2024년 4월 3일 이후 만들어진 검색 서비스에 적용됩니다. 서버리스 모델(미리 보기)으로 설정된 서비스에 대한 인덱스에는 테이블에 제공되는 최대 크기가 설정됩니다.
서비스가 더 강력한 클러스터에서 프로비전되는 경우 최대 제한에 다소 차이가 있을 수 있습니다. 여기서 제한은 공통 분모를 나타냅니다. 위의 사양에 따라 빌드된 인덱스는 모든 지역의 동등한 서비스 계층에서 이식할 수 있습니다.
문서 제한
각 인덱스는 다음 문서 수를 지원합니다.
- Basic, S1, S2 및 S3에서 240억
- S3 HD에서 20억
- L1에 2880억
- L2에 5760억
각 문서의 크기는 약 16MB입니다. 문서 크기 제한은 실제로 인덱싱 API 요청 페이로드의 크기(16MB)에 적용됩니다. 해당 페이로드는 단일 문서 또는 문서 일괄 처리일 수 있습니다. 단일 문서를 포함하는 배치의 경우 최대 문서 크기는 16MB의 JSON입니다.
문서 크기 제한은 문서를 검색 서비스에 업로드하는 푸시 모드 인덱싱에 적용됩니다. 끌어오기 모드 인덱싱에 인덱서를 사용하는 경우 원본 파일은 인덱서 제한에 따라 모든 파일 크기일 수 있습니다. Blob 인덱서의 경우 더 높은 계층에 대해 파일 크기 제한이 더 큽니다. 예를 들어 S1 제한은 128MB이고 S2 제한은 256MB입니다.
문서 크기를 추정할 때는 검색 시나리오에 값을 추가하는 필드만 인덱싱해야 합니다. 실행하려는 쿼리에 목적이 없는 원본 필드를 제외합니다.
벡터 인덱스 크기 제한
벡터 필드로 문서를 인덱싱할 때 Azure AI 검색은 사용자가 제공하는 알고리즘 매개 변수를 사용하여 내부 벡터 인덱스를 구성합니다.
이러한 벡터 인덱스의 크기는 다음으로 제한됩니다.
- 전용 가격 책정 모델에서 서비스의 계층(또는
SKU)에 대한 벡터 검색을 위해 예약된 메모리입니다. - 서버리스 가격 책정 모델의 인덱스당 스토리지 한도입니다.
벡터 스토리지를 관리하고 최대화하는 방법에 대한 지침은 벡터 인덱스 크기 및 제한 유지를 참조하세요.
벡터 제한은 다음에 따라 다릅니다.
2024년 4월부터 추가 용량을 제공하는 대부분의 지역에서 새 검색 서비스에 더 높은 벡터 제한이 존재합니다. 지원되는 지역에 이전 서비스가 있는 경우 서비스를 더 높은 벡터 제한으로 업그레이드 할 수 있는지 확인합니다.
서버리스 가격 책정 모델에서 벡터 제한은 파티션당이 아닌 인덱스별로 정의됩니다.
-
인덱스당 최대 벡터 인덱스 크기(서버리스): 300MB
- 이 크기는 전용 서비스 계층에서 사용되는 벡터 대 스토리지 비율과 일치하는 총 인덱스 스토리지의 약 30% 나타냅니다.
- 이 크기는 인덱스당 하드 제한입니다. 인덱싱 중에 이 제한을 초과하려고 하면 실패합니다.
이 표에서는 시간이 지남에 따라 벡터 할당량 증가 진행률을 GB 단위로 보여 줍니다. 할당량은 파티션당이므로 새 표준(S1) 서비스를 6개 파티션으로 확장하는 경우 총 벡터 할당량은 35에 6을 곱합니다.
| 서비스 생성 날짜 | 기본 | S1 | S2 | S3/HD | 레벨 1 | L2 |
|---|---|---|---|---|---|---|
| 2023년 7월 1일 이전에1 | 0.5 | 1 | 6 | 12 | 12 | 36 |
| 2023년 7월 1일부터 2024년 4월 3일까지2 | 1 | 3 | 12 | 36 | 12 | 36 |
| 2024년 4월 3일부터 2024년 5월 17일까지3 | 5 | 35 | 150 | 300 | 12 | 36 |
| 2024년 5월 17일4일 이후 | 5 | 35 | 150 | 300 | 150 | 300 |
1 초기 미리 보기 동안 초기 벡터 제한.
2 이후 미리 보기 기간 동안 2개의 벡터 제한. 독일 중서부, 인도 서부, 카타르 중부의 세 지역은 더 높은 제한을 가지고 있지 않았습니다.
3 지원되는 계층 및 지역에 대한 더 큰 파티션에 따라 더 높은 벡터 할당량.
4 파티션 크기 업데이트에 따라 더 많은 계층 및 지역에 대한 더 높은 벡터 할당량.
서비스는 벡터 인덱스 크기 할당량을 적용합니다.
- 전용: 검색 서비스의 각 파티션당
- 서버리스: 인덱스당
이 할당량은 서비스가 정상 상태로 유지되도록 하기 위한 하드 한도입니다. 제한을 초과하면 추가 인덱싱 시도가 실패합니다. 사용 가능한 할당량을 확보한 후에는 다음을 통해 인덱싱을 다시 시작할 수 있습니다.
- 벡터 문서 삭제
- 벡터 크기 또는 차원 감소
- (전용 전용) 파티션 확장
중요한
더 높은 벡터 제한은 더 큰 파티션 크기에 연결됩니다. 현재 7월~4월 제한이 적용되는 다음 지역에서는 더 높은 벡터 제한을 사용할 수 없습니다.
- 이스라엘 중부
- 카타르 중부
- 스페인 중부
- 인도 남부
인덱서 제한
최대 실행 시간은 서비스에 대한 균형 및 안정성을 제공하기 위해 존재하지만 큰 데이터 세트는 최대 허용보다 많은 인덱싱 시간이 필요할 수 있습니다. 인덱싱 작업이 허용된 최대 시간 내에 완료될 수 없는 경우에는 일정에 따라 실행해 보세요. 스케줄러는 인덱싱 상태를 추적합니다. 어떤 이유로든 예약된 인덱싱 작업이 중단되면 다음에 예약된 실행에서 인덱서가 지난 번에 중단된 위치부터 작업을 이어갈 수 있습니다.
참고
서버리스 가격 책정 모델에서 인덱서 동작은 전용 서비스와 다릅니다. 용량은 복제본 또는 파티션에 의해 정의되지 않습니다. 대신 서비스별 개체 제한, 인덱스당 스토리지 한도 및 서비스 수준 제한은 인덱싱 제한을 제어합니다. 서버리스 개발자 인덱서 실행당 최대 실행 시간은 2시간입니다.
인덱서 개체 및 처리량 제한
| 리소스 | 무료 1 | 기본 2 | S1 | S2 | S3 | S3 HD 3 | 레벨 1 | L2 | 서버리스 개발자 |
|---|---|---|---|---|---|---|---|---|---|
| 최대 인덱서 | 3 | 5 또는 15 | 50 | 200 | 200 | 해당 없음 | 10 | 10 | 30 |
| 최대 데이터 소스 | 3 | 5 또는 15 | 50 | 200 | 200 | 해당 없음 | 10 | 10 | 서비스당 30 |
| 최대 기술 집합 4 | 3 | 5 또는 15 | 50 | 200 | 200 | 해당 없음 | 10 | 10 | 30 |
| 호출당 최대 인덱싱 로드 | 문서 10,000개 | 최대 문서로만 제한됨 | 최대 문서로만 제한됨 | 최대 문서로만 제한됨 | 최대 문서로만 제한됨 | 해당 없음 | 제한 없음 | 제한 없음 | 최대 문서로만 제한됨 |
| 최소 일정 | 5분 | 5분 | 5분 | 5분 | 5분 | 5분 | 5분 | 5분 | 5분 |
| 인덱서당 최대 실행 시간 5 | 1-3 또는 3-10분 | 2시간 또는 24시간 | 2시간 또는 24시간 | 2시간 또는 24시간 | 2시간 또는 24시간 | 2시간 | 2시간 또는 24시간 | 2시간 또는 24시간 | 2시간 |
| 서비스 6당 누적 인덱서 런타임 | 해당 없음 | 해당 없음 | 해당 없음 | 해당 없음 | 해당 없음 | 24시간 | 해당 없음 | 해당 없음 | 24시간 |
1 무료 계층의 인덱서 최대 실행 시간은 Blob 원본의 경우 3분이고 기타 모든 데이터 원본의 경우 1분입니다. 인덱서 호출은 180초마다 한 번입니다. Foundry Tools를 호출하는 AI 인덱싱의 경우 무료 서비스는 하루에 인덱서당 20개의 무료 트랜잭션으로 제한되며, 트랜잭션은 보강 파이프라인을 성공적으로 통과하는 문서로 정의됩니다. (팁: 인덱서의 카운트를 초기화하려면 인덱서를 재설정하세요.)
2 2017년 12월 이전에 생성된 기본 서비스는 인덱스, 데이터 원본 및 기술 세트에서 낮은 제한(15 대신 5)을 갖습니다.
3 S3 HD 인덱서 지원은 미리 보기 상태이며 REST API 버전 이상이 필요합니다 2025-11-01-preview . S3 HD 인덱서는 다중 테넌트 실행 환경에서 만 실행되며 공유 프라이빗 링크 리소스를 지원하지 않습니다. 미리 보기 중에 S3 HD 인덱서 지원은 기술 세트가 없거나 최소인 소규모 워크로드(약 1GB 인덱스 크기)에 가장 적합합니다. 집계 동작, 모니터링 및 계획 지침은 서버리스 및 S3 HD에서 인덱서 실행을 참조하세요.
4 기술 집합당 최대 30개의 기술입니다.
5 인덱서의 최대 기간은 2시간 또는 24시간입니다. 최대 2시간이 가장 일반적이며 이를 계획해야 합니다. 공용 환경에서 실행되는 인덱서를 참조하여 계산 집약적인 처리를 오프로드하고 쿼리에 더 많은 리소스를 남깁니다. 검색 서비스에 할당된 인프라만 사용하여 프라이빗 환경에서 실행되도록 인덱서가 구성되면 24시간 제한이 적용됩니다. 일부 이전 인덱서는 공용 환경에서 실행할 수 없으며 이러한 인덱서는 항상 24시간 처리 범위를 갖습니다. 24시간 동안 지속적으로 실행되는 예약되지 않은 인덱서가 있는 경우 해당 인덱서를 최신 인프라로 마이그레이션할 수 없다고 가정할 수 있습니다. 일반적으로 2시간 이내에 완료할 수 없는 인덱싱 작업의 경우 인덱서가 중단된 위치를 신속하게 선택할 수 있도록 인덱서의 일정을 5분 으로 설정합니다. 무료 계층에서 최대 실행 시간은 기술 세트가 있는 인덱서의 경우 3-10분입니다.
6 S3 HD 및 서버리스 서비스에서 모든 인덱서는 각 24시간 UTC 창에서 서비스당 24시간의 누적 런타임을 공유합니다. 할당량 동작, 모니터링 및 계획 지침은 서버리스 및 S3 HD(미리 보기)에서 인덱서 실행을 참조하세요.
Blob과 유사한 인덱서에 대한 소스 파일 제한
파일 처리는 단계별로 수행되며 각 단계에는 고유한 제한이 있습니다.
- 데이터 원본 커넥터는 원본별 커넥터 제한에 따라 원본 항목을 다운로드합니다.
- Azure AI 검색 다음 표의 최대 소스 파일 크기 및 추출된 문자 제한에 따라 항목의 콘텐츠를 추출합니다.
- 필요에 따라 기술 세트는 해당 콘텐츠를 다운스트림 서비스로 전송합니다. 여기서 개별 기술의 입력 제한은 인덱서가 추출하는 것보다 작을 수 있습니다.
다음 표의 최대 원본 파일 크기 및 추출 문자 수 제한은 Azure Blob Storage, ADLS Gen2, Microsoft 365의 SharePoint, OneLake 및 Azure Files 인덱서에 적용됩니다. 기술별 제한에 대해서는 기술 세트의 각 기술에 대한 참조 문서를 확인합니다.
| 리소스 | 무료 | 기본 | S1 | S2 | S3 | S3 HD | 레벨 1 | L2 | 서버리스 개발자 |
|---|---|---|---|---|---|---|---|---|---|
| 최대 원본 파일 크기, MB 24 | 16 | 16 | 128 | 256 | 256 | 해당 없음 | 256 | 256 | 256 |
| 원본 파일 134에서 추출된 최대 문자 | 256,000 | 512,000 | 4밀 | 8 mil | 16밀리 | 해당 없음 | 4밀 | 4밀 | 16밀리 |
1 최대 문자 수는 유니코드 코드 단위, 특히 UTF-16을 기반으로 합니다.
2 CSV 파일에 구문 분석 모드를 사용하는 delimitedText 경우 파일 행당 10MB의 버퍼 크기 제한이 적용됩니다.
3 CSV 파일에 구문 분석 모드를 사용하는 delimitedText 경우 "추출된 최대 콘텐츠 크기" 제한은 적용되지 않습니다.
4 Blob 형식 인덱서에는 Azure Blob Storage 인덱서(blob 인덱서), ADLS Gen2 인덱서, Microsoft 365의 SharePoint 인덱서, OneLake 인덱서 및 Azure Files 인덱서가 포함됩니다. 직접 업로드 파일 지식 원본은 인덱서가 사용되지 않으며 별도의 제한이 있습니다.
공유 프라이빗 링크 리소스 제한
인덱서는 공유 프라이빗 링크 리소스 API를 통해 관리되는 프라이빗 엔드포인트를 통해 다른 Azure 리소스에 액세스할 수 있습니다. 이 섹션에서는 이 기능과 관련된 제한 사항을 설명합니다.
참고
서버리스 가격 책정 모델 개발자 계층은 데이터 원본에 대한 공유 프라이빗 링크 또는 NSP(네트워크 보안 경계)를 지원하지 않습니다. 서버리스 개발자 계층 서비스에 대한 프라이빗 연결에 대한 프라이빗 엔드포인트 및 IP 방화벽 규칙이 지원됩니다.
| 리소스 | 무료 | 기본 | S1 | S2 | S3 | S3 HD | 레벨 1 | L2 | 서버리스 개발자 |
|---|---|---|---|---|---|---|---|---|---|
| 프라이빗 엔드포인트 인덱서 지원 | 아니요 | 예 | 예 | 예 | 예 | 아니요 | 예 | 예 | 아니요 |
| 기술 세트가 1인 인덱서에 대한 프라이빗 엔드포인트 지원 | 아니요 | 아니요 | 예 | 예 | 예 | 아니요 | 예 | 예 | 아니요 |
| 임베딩 기술을 포함한 스킬 세트에 대한 프라이빗 엔드포인트 지원 2 | 아니요 | 예 | 예 | 예 | 예 | 아니요 | 예 | 예 | 아니요 |
| 최대 프라이빗 엔드포인트 | 해당 없음 | 10 또는 30 | 100 | 400 | 400 | 해당 없음 | 20 | 20 | 해당 없음 |
| 최대 고유 리소스 종류 3 | 해당 없음 | 4 | 7 | 15 | 15 | 해당 없음 | 4 | 4 | 해당 없음 |
1 AI 보강 및 이미지 분석은 계산 집약적이며 사용 가능한 처리 능력을 과도하게 많이 소비합니다. 이러한 이유로 검색 서비스 자체의 성능 및 안정성을 보장하도록 하위 계층에서는 프라이빗 연결을 사용하지 않도록 설정합니다. 기본 서비스에서 Microsoft Foundry 리소스에 대한 프라이빗 연결은 서비스 안정성을 유지하기 위해 지원되지 않습니다. S1 계층의 경우 서비스가 2024년 4월 3일 이후에 더 높은 제한 으로 만들어졌는지 확인합니다. Azure OpenAI 포함 또는 Azure Vision 다중 모달 포함 기술이 2개 이상인 인덱서는 프라이빗 환경에서 실행이 제한되며 프라이빗 연결을 사용할 수 없습니다.
2 포함 모델에 대한 프라이빗 연결은 2024년 4월 3일 이후에 생성된 기본 및 S1 대용량 검색 서비스에서 지원되며 스토리지 및 계산 처리에 대한 제한은 더 높습니다 .
3 고유 리소스 유형의 수는 리소스 상태에 관계없이 지정된 검색 서비스에 대한 모든 공유 프라이빗 링크 리소스에서 사용되는 고유 groupId 값의 수로 계산됩니다.
동의어 제한
동의어 맵의 최대 수는 계층에 따라 다릅니다. 각 규칙에는 최대 20개의 확장이 있을 수 있습니다. 여기서 확장은 동일한 용어입니다. 예를 들어 "cat"가 지정된 경우 "kitty", "feline" 및 "felis"(고양이 속)와의 연결은 세 가지 확장으로 계산됩니다.
| 리소스 | 무료 | 기본 | S1 | S2 | S3 | S3 HD | 레벨 1 | L2 | 서버리스 개발자 |
|---|---|---|---|---|---|---|---|---|---|
| 최대 동의어 맵 | 3 | 3 | 5 | 10 | 20 | 20 | 10 | 10 | 서비스당 20개 |
| 맵당 최대 규칙 수 | 5,000 | 20000 | 20000 | 20000 | 20000 | 20000 | 20000 | 20000 | 20000 |
인덱스 별칭 제한
인 덱스 별칭 의 최대 수는 계층 및 서비스 생성 날짜에 따라 다릅니다. 모든 계층에서 서비스가 2022년 10월 이후에 만들어진 경우 최대 별칭 수는 허용되는 최대 인덱스 수의 두 배입니다. 서비스가 2022년 10월 이전에 만들어진 경우 허용되는 인덱스 수가 제한됩니다.
참고
서버리스 모델 개발자 계층은 인덱스 별칭을 지원하지 않습니다.
| 서비스 생성 날짜 | 무료 | 기본 | S1 | S2 | S3 | S3 HD | 레벨 1 | L2 | 서버리스 개발자 |
|---|---|---|---|---|---|---|---|---|---|
| 2022년 10월 이전 | 3 | 5 또는 15 1 | 50 | 200 | 200 | 파티션당 1000 또는 서비스당 3000 | 10 | 10 | 해당 없음 |
| 2022년 10월 이후 | 6 | 30 | 100 | 400 | 400 | 파티션당 2000 또는 서비스당 6000 | 20 | 20 | 해당 없음 |
1 2017년 12월 이전에 생성된 기본 서비스는 인덱스에서 낮은 제한(15 대신 5)을 갖습니다.
에이전트 기반 정보 검색 제한
지식 베이스는 하나 이상의 지식 소스와 에이전트 검색을 위한 LLM(대규모 언어 모델) 처리 수준을 제어하는 검색 추론 수준(미리 보기)을 지정합니다. 한도는 가격 책정 계층, API 버전 및 추론 작업 수준에 따라 다릅니다.
| 리소스 | 무료 | 기본 | S1 | S2 | S3 | S3 HD | 레벨 1 | L2 | 서버리스 개발자 |
|---|---|---|---|---|---|---|---|---|---|
| 서비스당 최대 지식 소스 | 3 | 5 또는 15 1 | 50 | 200 | 200 | 파티션당 1000 또는 서비스 2당 3000 | 10 | 10 | 30 |
| 서비스당 최대 정보 베이스 | 3 | 5 또는 15 1 | 50 | 200 | 200 | 파티션당 1000 또는 서비스 2당 3000 | 10 | 10 | 30 |
| 지식 베이스당 최대 지식 소스 수 | 3 | 5 또는 10 1 | 10 | 10 | 10 | 10 2 | 10 | 10 | 10 |
1 2024년 4월 3일 이전에 생성된 기본 서비스는 지식원 및 지식 기반에 대해 낮은 제한(5)을 가지고 있습니다.
2 이러한 제한은 지식 기반 및 지식 소스를 지원하는 S3 HD 서비스에 적용됩니다. 일부 이전 S3 HD 서비스는 이러한 리소스를 지원하지 않습니다.
검색하는 동안 지식 원본 선택
기술 자료는 API 버전 또는 검색 추론 작업에 관계없이 위에 표시된 계층별 최대값까지 포함할 수 있습니다. 대신 API 버전 및 추론 작업은 검색 중에 선택할 수 있는 지식 원본 수에 영향을 줍니다.
| API 버전 | 검색 추론 작업 | 무료 | 기본 | S1 | S2 | S3 | S3 HD | 레벨 1 | L2 |
|---|---|---|---|---|---|---|---|---|---|
2026-05-01-preview 및 이후 |
minimal, low, medium |
3 | 5 또는 10 1 | 10 | 10 | 10 | 10 | 10 | 10 |
2026-04-01, 2025-11-01-preview |
minimal
2 |
3 | 5 또는 10 1 | 10 | 10 | 10 | 10 | 10 | 10 |
2025-11-01-preview |
low |
3 | 3 | 3 | 3 | 3 | 3 | 3 | 3 |
2025-11-01-preview |
medium |
3 | 5 | 5 | 5 | 5 | 5 | 5 | 5 |
2025-08-01-preview는 레거시 지식 에이전트 계약을 사용하며, retrievalReasoningEffort를 지원하지 않습니다.
2minimal추론 노력은 LLM 기반 쿼리 계획을 우회하므로 기술 자료의 모든 지식 소스를 사용합니다.
요청 런타임 검색
maxRuntimeInSeconds 한도는 지원되는 계층에서 동일합니다.
| 최소 | 기본값 | 최대 |
|---|---|---|
| 10초 | 90초 | 600초(10분) |
최대값은 Azure AI 검색 검색 요청에만 적용됩니다. 구성 예제는 기본 추론 작업 재정의 및 요청 제한 설정을 참조하세요.
데이터 제한(AI 보강)
데이터 제한은 Foundry 도구에서 Azure Language를 호출하는 AI 보강 파이프라인에 적용됩니다.
엔터티 인식 기술, 엔터티 연결 기술, 핵심 구 추출 기술, 언어 감지 기술 및 PII 감지 기술의 최대 입력 길이는 String.Length 기준으로 측정했을 때 50,000자입니다.
감정 분석 기술의 최대 입력 길이는 5,000자입니다.
다운스트림 처리 전에 더 큰 텍스트를 나누어야 하는 경우 텍스트 분할 기술을 사용합니다.
이러한 제한은 전용 및 서버리스 가격 책정 모델에 모두 적용됩니다.
스로틀 제한
제한 제한은 API 요청 속도를 제어하여 서비스 안정성을 보장하는 데 도움이 됩니다.
전용 가격 책정 모델에서는 스로틀링이 검색 단위(복제본 × 파티션)를 기준으로 이루어집니다.
서버리스 가격 책정 모델에서는 스로틀링이 검색 단위를 기준으로 하지 않습니다. 대신 서비스 수준 작업 제한 및 전체 소비 동작이 처리량을 제어합니다. 사용량 및 서비스 제한은 복제본 및 파티션의 구성이 아니라 용량을 관리합니다.
| Operation | 전용(검색 단위당) | 서버리스(서비스당 또는 인덱스당) |
|---|---|---|
| 인덱스 목록 조회(GET /indexes) | 3개 요청/초/SU | 3개 요청/초 |
| 인덱스 가져오기(GET /indexes/{index}) | 10개 요청/초/SU | 10개 요청/초 |
| 인덱스 만들기(POST /indexes) | 12개 요청/분/SU | 12개 요청/분 |
| 인덱스 만들기 또는 업데이트(PUT /indexes/{index}) | 6개 요청/초/SU | 6개 요청/초 |
| 인덱스 삭제(DELETE /indexes/{index}) | 12개 요청/분/SU | 12개 요청/분 |
| 서비스 통계(GET /servicestats) | 4개 요청/초/SU | 4개 요청/초 |
| 검색 쿼리(POST /indexes/{index}/docs/search) | SU 수 및 쿼리 복잡성에 따라 다름 | 50개 쿼리/초(인덱스당 집계 읽기 제한) |
| 인덱스 문서(POST /indexes/{index}/docs/index) | SU 수 및 인덱싱 워크로드에 따라 다름 | 인덱스당 5개 요청/초 |
| 제안하기(POST /indexes/{index}/docs/suggest) | SU 수에 따라 다름 | 명시적으로 정의되지 않음 |
| 자동 완성(POST /indexes/{index}/docs/autocomplete) | SU 수에 따라 다름 | 명시적으로 정의되지 않음 |
의미 순위매기기 제한 한도
Semantic Ranker는 대기열 시스템을 사용하여 동시 요청을 관리합니다. 이 시스템을 사용하면 검색 서비스가 가능한 초당 가장 많은 쿼리 수를 가져올 수 있습니다. 동시 요청 제한에 도달하면 시스템에서 추가 요청을 큐에 배치합니다. 큐가 가득 차면 시스템에서 추가 요청을 거부하고 다시 시도해야 합니다.
초당 총 의미 체계 순위 쿼리는 다음 요인에 따라 달라집니다.
- 검색 서비스의 계층입니다. 큐 용량 및 동시 요청 제한은 계층에 따라 다릅니다.
- 검색 서비스의 검색 단위 수입니다. 동시 의미 체계 순위 쿼리 의 최대 수를 늘리는 가장 간단한 방법은 검색 서비스에 더 많은 검색 단위를 추가하는 것입니다.
- 해당 지역에서 사용 가능한 의미 순위매기기의 총 용량입니다.
- 의미 체계 순위자를 사용하여 쿼리를 제공하는 데 걸리는 시간입니다. 이 시간은 검색 서비스의 사용량에 따라 달라집니다.
다음 표에서는 지역에서 사용 가능한 용량에 따라 계층별 의미 체계 순위 조정 제한에 대해 설명합니다. Microsoft 지원에 문의하여 제한 증가를 요청할 수 있습니다.
| 리소스 | 기본 | S1 | S2 | S3 | S3 HD | 레벨 1 | L2 | 서버리스 개발자 |
|---|---|---|---|---|---|---|---|---|
| 최대 동시 요청(검색 단위당) | 2 | 3 | 4 | 4 | 4 | 4 | 4 | 4 (서비스당) |
| 최대 요청 큐 크기(검색 단위당) | 4 | 6 | 8 (여덟) | 8 (여덟) | 8 (여덟) | 8 (여덟) | 8 (여덟) | 8 (서비스당) |
API 요청 제한
바인딩되지 않은 쿼리가 검색 서비스를 불안정하게 만들 수 있으므로 쿼리에 대한 제한이 있습니다. 일반적으로 이러한 쿼리는 프로그래밍 방식으로 만들어집니다. 애플리케이션이 프로그래밍 방식으로 검색 쿼리를 생성하는 경우 바인딩되지 않은 크기의 쿼리를 생성하지 않도록 디자인합니다.
페이로드에 대한 제한은 유사한 이유로 존재하므로 검색 서비스의 안정성을 보장합니다. 제한은 모든 구성 요소를 포함하는 전체 요청에 적용됩니다. 예를 들어 요청이 여러 문서 또는 명령을 일괄 처리하는 경우 전체 요청이 지원되는 한도 내에 있어야 합니다.
지원되는 제한을 초과해야 하는 경우 예상되는 작업을 알 수 있도록 워크로드를 테스트합니다 .
언급된 경우를 제외하고 다음 API 요청은 Azure SDK를 비롯한 모든 프로그래밍 가능한 인터페이스에 적용됩니다.
일반:
- REST API 및 SDK를 통한 인덱싱 및 쿼리 요청에 지원되는 최대 페이로드 제한은 16MB입니다.
- 최대 8KB URL 길이(REST API에만 적용됨).
인덱싱 API:
- 인덱스 업로드, 병합 또는 삭제 일괄 처리당 최대 1,000개의 문서가 지원됩니다.
- 각 요청은 1~32,000개의 인덱싱 작업을 지원합니다.
쿼리 API:
- 벡터 쿼리의 최대 10개 필드
- $orderby 절에 최대 32개의 필드.
- 검색 절의 최대 100,000자.
- 검색의 최대 절 수는 3,000개입니다.
- Lucene에 의해 강제된 와일드카드 및 정규식 쿼리의 최대 제한입니다. 패턴, 변형 또는 일치 항목의 수를 1,000개의 인스턴스로 제한합니다. 이 제한은 엔진 오버로드를 방지하기 위해 적용됩니다.
검색어:
- 지원되는 최대 검색어 크기는 UTF-8로 인코딩된 텍스트의 32,766바이트(32KB ~ 2바이트)입니다. 키워드 검색 및 벡터 검색의 텍스트 속성에 적용됩니다.
- 지원되는 최대 검색어 크기는 접두사 검색 및 정규식 검색에 대해 1,000자입니다.
API 응답 제한
- 검색 결과의 각 페이지는 최대 1,000개의 문서를 반환합니다.
- 각 제안 API 요청은 최대 100개의 제안을 반환합니다.
검색 엔진은 기본적으로 50개의 결과를 반환하지만 이 매개 변수를 최대 제한까지 재정의할 수 있습니다.
API 키 제한
서비스 인증에 API 키를 사용합니다. 두 가지 유형의 API 키가 있습니다. 요청 헤더에 지정하는 관리 키는 서비스에 대한 전체 읽기-쓰기 액세스를 제공합니다. URL에 지정하는 쿼리 키는 읽기 전용이며 일반적으로 클라이언트 애플리케이션에 배포됩니다.
- 각 서비스는 최대 2개의 관리 키를 지원합니다.
- 각 서비스는 최대 50개의 쿼리 키를 지원합니다.