메모
Azure AI 검색 Azure 포털, REST API 및 Azure SDK 통해 사용할 수 있습니다. 또한 엔터프라이즈 콘텐츠를 Microsoft Foundry 포털의 에이전트에 대해 재사용 가능한 사용 권한 인식 기술 자료로 변환하는 관리되는 기술 계층인 Foundry IQ를 뒷받침합니다.
중요
기능, 기능 또는 표시된 속성(미리 보기)은 서비스 수준 계약에 포함되지 않으며 프로덕션 워크로드에는 권장되지 않으며 일반적으로 사용 가능해지기 전에 변경되거나 제한될 수 있습니다. Azure AI 검색 미리 보기 용어는 독립 실행형 기능이든 일반 공급 기능의 일부이든 관계없이 모든 미리 보기 기능에 적용됩니다.
보강 캐시(미리 보기)는 기술 세트 실행 중에 생성된 보강된 콘텐츠를 저장하는 선택적 기능입니다. 변경된 기술과 문서만 다시 처리해야 하므로 실행 간에 콘텐츠를 유지합니다. 기술 세트 출력, 인덱서 상태 또는 인덱싱된 문서의 백업이 아닙니다.
Azure Storage 보강 캐시를 만듭니다. 캐시에는 문서 크래킹의 출력과 모든 문서에 대한 각 기술의 출력이 포함됩니다. 캐싱은 청구 가능하지만(Azure Storage 사용) 스토리지 비용이 이미지 추출 및 AI 처리보다 적기 때문에 전체 보강 비용이 절감됩니다.
보강 캐시를 구성하는 경우 이 문서에서는 캐시된 보강에서 최대 유틸리티를 얻을 수 있도록 기술 및 데이터 원본 업데이트를 관리하는 방법을 설명합니다.
필수 구성 요소
제한
주의
SharePoint 인덱서(미리 보기)를 사용하는 경우 증분 보강을 피합니다. 특정 상황에서는 캐시가 유효하지 않습니다. 다시 로드하려면 인덱서 재설정 및 전체 다시 빌드를 수행합니다.
큰 데이터 원본에는 추가 캐시 제한이 있습니다.
주의
대규모 데이터 원본의 경우 장기 실행 기술, 반복된 중단 또는 잦은 기술 오류가 발생할 때 보강 캐시가 총 재처리를 늘릴 수 있습니다. 인덱서는 재처리 최소화보다 정확성을 우선하므로 반복되는 중단에서 캐시 백로그가 재시도 동작을 증폭합니다.
증가하는 캐시 백로그에서 복구하려면 데이터 원본을 더 작은 컨테이너 또는 가상 폴더로 분할합니다. 그런 다음 동일한 인덱서를 가리키는 병렬 인덱서를 사용합니다. 캐시를 연결 해제하려면 인덱서에서 cache 속성을 null로 설정합니다.
캐시 구성
실제로 캐시는 blob 컨테이너에 저장되고 Azure Storage 계정의 테이블은 인덱서당 하나씩 저장됩니다. 각 인덱서에는 사용 중인 컨테이너에 해당하는 고유하고 변경할 수 없는 캐시 식별자가 할당됩니다.
속성을 지정하고 인덱서 실행 cache 시 캐시가 만들어집니다. 보강된 콘텐츠만 캐시할 수 있습니다. 인덱서에 연결된 기술 세트가 없으면 캐싱이 적용되지 않습니다.
다음 예제에서는 캐싱을 사용하도록 설정된 인덱서에 대해 설명합니다. 전체 지침은 보강 캐싱 구성을 참조하세요.
POST https://[YOUR-SEARCH-SERVICE-NAME].search.windows.net/indexers?api-version=2026-08-01-preview
{
"name": "myIndexerName",
"targetIndexName": "myIndex",
"dataSourceName": "myDatasource",
"skillsetName": "mySkillset",
"cache" : {
"storageConnectionString" : "<Your storage account connection string>",
"enableReprocessing": true
},
"fieldMappings" : [],
"outputFieldMappings": [],
"parameters": []
}
캐시 관리
인덱서는 캐시 수명 주기를 관리합니다. 인덱서도 삭제하면 해당 캐시도 삭제됩니다. 인덱서의 cache 속성을 null로 설정하거나 연결 문자열 변경하면 다음 인덱서 실행 중에 기존 캐시가 삭제됩니다.
증분 보강은 사용자의 개입 없이 변경 내용을 감지하고 응답하도록 설계되어 있지만 특정 동작을 호출하도록 매개 변수를 설정할 수 있습니다.
새 문서의 우선 순위 지정
이 속성에는 cache 캐시된 콘텐츠가 다시 처리되는지 여부를 제어하는 매개 변수가 포함되어 enableReprocessing 있습니다. true(기본값)이면 기술 업데이트가 영향을 주는 경우 다시 실행할 때 인덱서가 캐시된 문서를 다시 처리합니다.
false이면 인덱서는 새 콘텐츠의 우선 순위를 지정하는 기존 문서를 다시 처리하지 않습니다. 일시적으로만 false로 설정합니다 enableReprocessing . 대부분의 시간을 true로 유지하면 새 문서와 기존 문서가 모두 현재 기술 세트 정의에 유효한 상태로 유지됩니다.
기술 평가 건너뛰기
일반적으로 기술을 수정하면 해당 기술을 다시 처리할 수 있습니다. 그러나 기술에 대한 일부 변경은 재처리를 트리거해서는 안 됩니다. 예를 들어 새 위치 또는 새 액세스 키를 사용하여 사용자 지정 기술을 배포합니다. 이러한 변경 내용은 일반적으로 기술 출력의 실체에 영향을 주지 않는 주변 장치 수정입니다.
스킬에 대한 변경이 피상적임을 알고 있다면 disableCacheReprocessingChangeDetection 매개 변수를 true로 설정하여 스킬 평가를 재정의할 수 있습니다.
- 업데이트 기술 세트를 호출하고 기술 세트 정의를 수정합니다.
- 요청에 매개 변수를 추가
disableCacheReprocessingChangeDetection=true합니다. - 변경 사항을 제출합니다.
이 매개 변수를 설정하면 기술 세트 정의에 대한 업데이트만 커밋됩니다. 변경 내용은 기존 캐시에 미치는 영향에 대해 평가되지 않습니다. 미리 보기 API 버전인 2020-06-30-Preview 이상을 사용합니다. 최신 미리 보기 API를 사용합니다.
PUT https://[servicename].search.windows.net/skillsets/[skillset name]?api-version=2026-08-01-preview&disableCacheReprocessingChangeDetection
데이터 원본 유효성 검사 무시
데이터 원본 정의에 대한 대부분의 변경 내용은 캐시를 무효화합니다. 그러나 연결 문자열 변경하거나 스토리지 계정에서 키를 회전하는 등 캐시를 무효화해서는 안 된다는 것을 알고 있는 시나리오의 경우 ignoreResetRequirement에 매개 변수를 추가합니다. 모든 개체가 다시 작성되고 처음부터 채워지는 초기화 조건을 트리거하지 않고 커밋을 통과할 수 있도록 이 매개 변수를 true로 설정합니다.
PUT https://[search service].search.windows.net/datasources/[data source name]?api-version=2026-08-01-preview&ignoreResetRequirement
기술 세트 평가 강제 적용
캐시의 목적은 불필요한 처리를 방지하는 것입니다. 그러나 인덱서가 검색하지 않는 기술을 변경한다고 가정합니다(예: 사용자 지정 기술과 같은 외부 코드에서 변경).
이 경우 기술 재설정 API를 사용하여 해당 기술의 출력에 종속된 다운스트림 기술을 포함하여 특정 기술을 강제로 다시 처리합니다. 이 API는 무효화되고 재처리용으로 표시되어야 하는 기술 목록이 포함된 POST 요청을 수락합니다. 기술을 재설정한 후 인덱서 실행 요청에 따라 파이프라인 처리를 호출합니다.
특정 문서 다시 캐시
인덱서를 다시 설정하면 검색 모음의 모든 문서가 다시 처리됩니다.
일부 문서만 다시 처리해야 하는 시나리오에서는 문서 다시 설정(미리 보기) 을 사용하여 특정 문서를 강제로 다시 처리합니다. 문서를 다시 설정하면 인덱서가 해당 문서의 캐시를 무효화합니다. 그런 다음 인덱서는 데이터 원본에서 문서를 읽어 문서를 다시 처리합니다. 자세한 내용은 인덱서, 기술 및 문서 실행 또는 재설정을 참조하세요.
특정 문서를 다시 설정하려면 요청의 검색 인덱스에서 읽은 문서 키 목록을 포함합니다. 키가 외부 데이터 원본의 필드에 매핑되는 경우 검색 인덱스에서 값을 사용합니다.
API를 호출하는 방법에 따라 요청 시 키 목록이 추가되거나, 덮어써지거나, 대기열에 추가됩니다.
다른 키를 사용하여 API를 여러 번 호출하면 다시 설정할 문서 키 목록에 새 키가 추가됩니다.
쿼리 문자열 매개변수
overwrite를true로 설정하여 API를 호출하면, 재설정할 문서 키의 현재 목록을 요청 페이로드로 덮어씁니다.API를 호출하면 인덱서가 수행하는 작업 큐에 문서 키가 추가됩니다. 인덱서가 예약된 대로 또는 요청 시 다음에 호출되면 데이터 원본에서 다른 변경 내용이 변경되기 전에 다시 설정 문서 키 처리의 우선 순위를 지정합니다.
다음 예제에서는 문서 다시 설정 요청을 보여 줍니다.
POST https://[search service name].search.windows.net/indexers/[indexer name]/resetdocs?api-version=2026-08-01-preview
{
"documentKeys" : [
"key1",
"key2",
"key3"
]
}
캐시를 무효화하는 변경 내용
캐시를 사용하도록 설정하면 인덱서는 파이프라인 컴퍼지션의 변경 내용을 확인하여 다시 사용할 수 있는 콘텐츠와 다시 처리해야 하는 콘텐츠를 결정합니다. 이 섹션에서는 캐시를 무효화하는 변경 내용과 증분 처리를 트리거하는 변경 내용을 나열합니다.
무효화 변경은 전체 캐시가 유효하지 않은 변경 내용입니다. 예를 들어 데이터 원본을 업데이트하면 변경 내용이 무효화됩니다. 다음은 캐시를 무효화하는 인덱서 파이프라인의 모든 부분에 대한 변경 내용의 전체 목록입니다.
- 데이터 원본 형식 변경
- 데이터 원본 컨테이너 변경
- 데이터 원본 자격 증명 변경
- 데이터 원본 변경 검색 정책 변경
- 데이터 원본 삭제 감지 정책 변경
- 인덱서 필드 매핑 변경
- 인덱서 매개 변수 변경:
- 구문 분석 모드
- 제외된 파일 이름 확장명
- 인덱싱된 파일 이름 확장명
- 대형 문서에 대해서만 스토리지 메타데이터 인덱싱
- 구분된 텍스트 머리글
- 구분 기호로 분리된 텍스트 구분 기호
- 문서 루트
- 이미지 작업(이미지 추출 방법 변경)
증분 처리를 트리거하는 변경 내용
증분 처리는 기술 세트 정의를 평가하고 다시 실행할 기술을 결정합니다. 문서 트리의 영향을 받는 부분을 선택적으로 업데이트합니다. 다음은 증분 보강을 초래하는 변경 내용의 전체 목록입니다.
- 기술 유형 변경(기술의 OData 형식 업데이트)
- URL, 기본값 또는 기타 매개 변수와 같은 기술별 매개 변수 업데이트
- 기술이 추가 또는 다른 출력을 반환하는 경우와 같은 기술 출력 변경
- 상위 구조 또는 기술 체인 변경을 초래하는 기술 입력 변경
- 이 기술에 대한 입력을 제공하는 기술을 업데이트하는 경우 업스트림 기술 무효화
- 지식 저장소 프로젝션 위치를 업데이트하면 문서가 다시 프로젝션됩니다.
- 지식 저장소 프로젝션을 변경하여 문서를 다시 프로젝션합니다.
- 인덱서에서 출력 필드 매핑을 변경하여 문서를 인덱스에 다시 프로젝팅합니다.
캐싱에 사용되는 API
미리 보기 API는 인덱서에 추가 속성을 제공합니다. 최신 미리 보기 API를 사용합니다.
기술 세트 및 데이터 원본에 일반적으로 사용 가능한 버전을 사용합니다. 참조 설명서 외에도 작업 순서 에 대한 자세한 내용은 증분 보강에 대한 캐싱 구성 을 참조하세요.
기술 세트 만들기 또는 업데이트(api-version=2026-08-01-preview) (요청에 대한 새 URI 매개 변수)
데이터 원본 만들기 또는 업데이트(api-version=2026-08-01-preview) 미리 보기 API 버전으로 이 API를 호출하면 이름이 새
ignoreResetRequirement매개 변수를 제공합니다. 이 매개 변수를true업데이트 작업에서 캐시를 무효화하지 않아야 하는 시점으로 설정합니다. 데이터에서 쉽게 감지되지 않는 의도치 않은 불일치를 초래할 수 있으므로ignoreResetRequirement는 가급적 적게 사용하세요.