Skillsets - Create
검색 서비스에서 새 기술 세트를 만듭니다.
POST {endpoint}/skillsets?api-version=2025-11-01-preview
URI 매개 변수
| Name | In(다음 안에) | 필수 | 형식 | Description |
|---|---|---|---|---|
|
endpoint
|
path | True |
string (uri) |
검색 서비스의 엔드포인트 URL입니다. |
|
api-version
|
query | True |
string minLength: 1 |
이 작업에 사용할 API 버전입니다. |
요청 헤더
| Name | 필수 | 형식 | Description |
|---|---|---|---|
| Accept |
Accept 헤더입니다. |
||
| x-ms-client-request-id |
string (uuid) |
요청에 대한 불투명하고 전역적으로 고유한 클라이언트 생성 문자열 식별자입니다. |
요청 본문
| Name | 필수 | 형식 | Description |
|---|---|---|---|
| name | True |
string |
기술 세트의 이름입니다. |
| skills | True |
SearchIndexerSkill[]:
|
기술 세트의 기술 목록입니다. |
| @odata.etag |
string |
기술 세트의 ETag입니다. |
|
| cognitiveServices | CognitiveServicesAccount: |
스킬 실행 시 사용할 Azure AI 서비스에 대한 자세한 내용입니다. |
|
| description |
string |
기술 세트에 대한 설명입니다. |
|
| encryptionKey |
Azure Key Vault에서 생성하는 암호화 키에 대한 설명입니다. 이 키는 Microsoft조차도 당신의 스킬셋 정의를 복호화할 수 없다는 완전한 확신을 원할 때 기술 정의에 대해 추가적인 암호화 상태를 제공하는 데 사용됩니다. 기술 세트 정의를 암호화한 후에는 항상 암호화된 상태로 유지됩니다. 검색 서비스는 이 속성을 null로 설정하려는 시도를 무시합니다. 암호화 키를 회전하려는 경우 필요에 따라 이 속성을 변경할 수 있습니다. 기술 세트 정의는 영향을 받지 않습니다. 고객 관리형 키를 사용한 암호화는 무료 검색 서비스에 사용할 수 없으며 2019년 1월 1일 이후 생성된 유료 서비스에만 사용할 수 있습니다. |
||
| indexProjections |
보조 검색 인덱스에 대한 추가 프로젝션 정의입니다. |
||
| knowledgeStore |
Azure 블롭, 테이블 또는 풍부 데이터의 파일에 대한 추가 투영 정의. |
응답
| Name | 형식 | Description |
|---|---|---|
| 201 Created |
요청이 성공했고 결과적으로 새 리소스가 생성되었습니다. |
|
| Other Status Codes |
예기치 않은 오류 응답입니다. |
보안
api-key
형식:
apiKey
In(다음 안에):
header
OAuth2Auth
형식:
oauth2
Flow:
implicit
권한 부여 URL:
https://login.microsoftonline.com/common/oauth2/v2.0/authorize
범위
| Name | Description |
|---|---|
| https://search.azure.com/.default |
예제
SearchServiceCreateSkillset
샘플 요청
POST https://previewexampleservice.search.windows.net/skillsets?api-version=2025-11-01-preview
{
"name": "tempskillset",
"description": "Skillset for extracting entities and more",
"skills": [
{
"@odata.type": "#Microsoft.Skills.Text.LanguageDetectionSkill",
"name": "skill2",
"inputs": [
{
"name": "text",
"source": "/document/content"
},
{
"name": "countryHint",
"source": "/document/countryHint"
}
],
"outputs": [
{
"name": "languageCode",
"targetName": "languageCode"
}
]
},
{
"textSplitMode": "pages",
"maximumPageLength": 4000,
"unit": "azureOpenAITokens",
"azureOpenAITokenizerParameters": {
"encoderModelName": "cl100k_base",
"allowedSpecialTokens": [
"[START]",
"[END]"
]
},
"@odata.type": "#Microsoft.Skills.Text.SplitSkill",
"name": "skill3",
"inputs": [
{
"name": "text",
"source": "/document/content"
},
{
"name": "languageCode",
"source": "/document/languageCode"
}
],
"outputs": [
{
"name": "textItems",
"targetName": "pages"
}
]
},
{
"@odata.type": "#Microsoft.Skills.Text.KeyPhraseExtractionSkill",
"name": "skill4",
"context": "/document/pages/*",
"inputs": [
{
"name": "text",
"source": "/document/content"
},
{
"name": "languageCode",
"source": "/document/languageCode"
}
],
"outputs": [
{
"name": "keyPhrases",
"targetName": "keyPhrases"
}
]
},
{
"uri": "https://contoso.example.org/",
"httpMethod": "POST",
"timeout": "PT5S",
"@odata.type": "#Microsoft.Skills.Custom.WebApiSkill",
"name": "skill5",
"inputs": [
{
"name": "text",
"source": "/document/content"
},
{
"name": "languageCode",
"source": "/document/languageCode"
}
],
"outputs": [
{
"name": "customresult",
"targetName": "result"
}
]
},
{
"outputMode": "oneToMany",
"markdownHeaderDepth": "h3",
"@odata.type": "#Microsoft.Skills.Util.DocumentIntelligenceLayoutSkill",
"name": "docIntelligenceLayoutSkill",
"context": "/document",
"inputs": [
{
"name": "file_data",
"source": "/document/content"
}
],
"outputs": [
{
"name": "markdown_document",
"targetName": "markdown_document"
}
]
},
{
"outputFormat": "text",
"outputMode": "oneToMany",
"extractionOptions": [
"images",
"locationMetadata"
],
"chunkingProperties": {
"unit": "characters",
"maximumLength": 500,
"overlapLength": 50
},
"@odata.type": "#Microsoft.Skills.Util.DocumentIntelligenceLayoutSkill",
"name": "docIntelligenceLayoutSkill#2",
"context": "/document",
"inputs": [
{
"name": "file_data",
"source": "/document/content"
}
],
"outputs": [
{
"name": "text_sections",
"targetName": "text_sections"
},
{
"name": "normalized_images",
"targetName": "normalized_images"
}
]
},
{
"apiKey": "<api-key>",
"commonModelParameters": {
"model": "gpt-4o",
"frequencyPenalty": 0,
"presencePenalty": 0,
"maxTokens": 0,
"temperature": 0,
"seed": 0,
"stop": []
},
"extraParameters": {
"safe_mode": true
},
"extraParametersBehavior": "error",
"responseFormat": {
"type": "jsonSchema",
"jsonSchemaProperties": {
"name": "Some Name",
"description": "Some Description",
"strict": true,
"schema": {
"type": "object",
"properties": "{\"steps\": {\"type\": \"array\", \"description\": \"A list of reasoning steps.\", \"items\": {\"type\": \"string\"}}, \"answer\": {\"type\": \"string\", \"description\": \"The final answer.\"}}",
"required": [
"steps",
"answer"
],
"additionalProperties": false
}
}
},
"uri": "https://azs-grok-aoai.openai.azure.com/openai/deployments/azs-grok-gpt-4o/chat/completions",
"timeout": "PT30S",
"degreeOfParallelism": 5,
"@odata.type": "#Microsoft.Skills.Custom.ChatCompletionSkill",
"name": "chatCompletionSkill",
"context": "/document/normalized_images/*",
"inputs": [
{
"name": "text",
"source": "/document/content"
},
{
"name": "systemMessage",
"source": "/document/system_message"
},
{
"name": "userMessage",
"source": "/document/user_message"
},
{
"name": "image",
"source": "/document/normalized_images/*"
},
{
"name": "imageDetail",
"source": "/document/detail"
}
],
"outputs": [
{
"name": "response",
"targetName": "response"
}
]
},
{
"extractionOptions": [
"images",
"locationMetadata"
],
"chunkingProperties": {
"unit": "characters",
"maximumLength": 500,
"overlapLength": 50
},
"@odata.type": "#Microsoft.Skills.Util.ContentUnderstandingSkill",
"name": "contentUnderstandingSKill",
"context": "/document",
"inputs": [
{
"name": "file_data",
"source": "/document/content"
}
],
"outputs": [
{
"name": "text_sections",
"targetName": "text_sections2"
},
{
"name": "normalized_images",
"targetName": "normalized_images2"
}
]
}
],
"cognitiveServices": {
"key": "myKey",
"subdomainUrl": "https://mySubdomainName.cognitiveservices.azure.com",
"@odata.type": "#Microsoft.Azure.Search.AIServicesByKey",
"description": "Description of the Azure AI service resource attached to a skillset"
},
"@odata.etag": "0x1234568AE7E58A1"
}
샘플 응답
{
"@odata.etag": "0x1234568AE7E58A1",
"name": "tempskillset",
"description": "Skillset for extracting entities and more",
"skills": [
{
"@odata.type": "#Microsoft.Skills.Text.LanguageDetectionSkill",
"name": "skill2",
"inputs": [
{
"name": "text",
"source": "/document/content",
"inputs": []
},
{
"name": "countryHint",
"source": "/document/countryHint",
"inputs": []
}
],
"outputs": [
{
"name": "languageCode",
"targetName": "languageCode"
}
]
},
{
"@odata.type": "#Microsoft.Skills.Text.SplitSkill",
"name": "skill3",
"textSplitMode": "pages",
"maximumPageLength": 4000,
"unit": "azureOpenAITokens",
"inputs": [
{
"name": "text",
"source": "/document/content",
"inputs": []
},
{
"name": "languageCode",
"source": "/document/languageCode",
"inputs": []
}
],
"outputs": [
{
"name": "textItems",
"targetName": "pages"
}
],
"azureOpenAITokenizerParameters": {
"encoderModelName": "cl100k_base",
"allowedSpecialTokens": [
"[START]",
"[END]"
]
}
},
{
"@odata.type": "#Microsoft.Skills.Text.KeyPhraseExtractionSkill",
"name": "skill4",
"context": "/document/pages/*",
"inputs": [
{
"name": "text",
"source": "/document/content",
"inputs": []
},
{
"name": "languageCode",
"source": "/document/languageCode",
"inputs": []
}
],
"outputs": [
{
"name": "keyPhrases",
"targetName": "keyPhrases"
}
]
},
{
"@odata.type": "#Microsoft.Skills.Custom.WebApiSkill",
"name": "skill5",
"uri": "https://contoso.example.org/",
"httpMethod": "POST",
"timeout": "PT5S",
"inputs": [
{
"name": "text",
"source": "/document/content",
"inputs": []
},
{
"name": "languageCode",
"source": "/document/languageCode",
"inputs": []
}
],
"outputs": [
{
"name": "customresult",
"targetName": "result"
}
]
},
{
"@odata.type": "#Microsoft.Skills.Util.DocumentIntelligenceLayoutSkill",
"name": "docIntelligenceLayoutSkill",
"context": "/document",
"outputMode": "oneToMany",
"markdownHeaderDepth": "h3",
"extractionOptions": [],
"inputs": [
{
"name": "file_data",
"source": "/document/content",
"inputs": []
}
],
"outputs": [
{
"name": "markdown_document",
"targetName": "markdown_document"
}
]
},
{
"@odata.type": "#Microsoft.Skills.Util.DocumentIntelligenceLayoutSkill",
"name": "docIntelligenceLayoutSkill#2",
"context": "/document",
"outputMode": "oneToMany",
"outputFormat": "text",
"extractionOptions": [
"images",
"locationMetadata"
],
"inputs": [
{
"name": "file_data",
"source": "/document/content",
"inputs": []
}
],
"outputs": [
{
"name": "text_sections",
"targetName": "text_sections"
},
{
"name": "normalized_images",
"targetName": "normalized_images"
}
],
"chunkingProperties": {
"unit": "characters",
"maximumLength": 500,
"overlapLength": 50
}
},
{
"@odata.type": "#Microsoft.Skills.Custom.ChatCompletionSkill",
"name": "chatCompletionSkill",
"context": "/document/normalized_images/*",
"uri": "https://azs-grok-aoai.openai.azure.com/openai/deployments/azs-grok-gpt-4o/chat/completions",
"timeout": "PT30S",
"degreeOfParallelism": 5,
"apiKey": "<api-key>",
"extraParametersBehavior": "error",
"inputs": [
{
"name": "text",
"source": "/document/content",
"inputs": []
},
{
"name": "systemMessage",
"source": "/document/system_message",
"inputs": []
},
{
"name": "userMessage",
"source": "/document/user_message",
"inputs": []
},
{
"name": "image",
"source": "/document/normalized_images/*",
"inputs": []
},
{
"name": "imageDetail",
"source": "/document/detail",
"inputs": []
}
],
"outputs": [
{
"name": "response",
"targetName": "response"
}
],
"commonModelParameters": {
"model": "gpt-4o",
"frequencyPenalty": 0,
"presencePenalty": 0,
"maxTokens": 0,
"temperature": 0,
"seed": 0,
"stop": []
},
"extraParameters": {
"safe_mode": true
},
"responseFormat": {
"type": "jsonSchema",
"jsonSchemaProperties": {
"name": "Some Name",
"description": "Some Description",
"strict": true,
"schema": {
"type": "object",
"additionalProperties": false,
"required": [
"steps",
"answer"
],
"properties": "{\"steps\": {\"type\": \"array\", \"description\": \"A list of reasoning steps.\", \"items\": {\"type\": \"string\"}}, \"answer\": {\"type\": \"string\", \"description\": \"The final answer.\"}}"
}
}
}
},
{
"@odata.type": "#Microsoft.Skills.Util.ContentUnderstandingSkill",
"name": "contentUnderstandingSKill",
"context": "/document",
"extractionOptions": [
"images",
"locationMetadata"
],
"inputs": [
{
"name": "file_data",
"source": "/document/content",
"inputs": []
}
],
"outputs": [
{
"name": "text_sections",
"targetName": "text_sections2"
},
{
"name": "normalized_images",
"targetName": "normalized_images2"
}
],
"chunkingProperties": {
"unit": "characters",
"maximumLength": 500,
"overlapLength": 50
}
}
],
"cognitiveServices": {
"@odata.type": "#Microsoft.Azure.Search.AIServicesByKey",
"description": "Description of the Azure AI service resource attached to a skillset",
"key": "myKey",
"subdomainUrl": "https://mySubdomainName.cognitiveservices.azure.com"
}
}
정의
| Name | Description |
|---|---|
| Accept |
Accept 헤더입니다. |
|
AIServices |
스킬셋에 연결된 Azure AI 서비스 자원의 다중 지역 계정입니다. |
|
AIServices |
스킬셋에 연결된 Azure AI 서비스 리소스의 계정 키로, 리소스의 하위 도메인과 함께 사용됩니다. |
|
Azure |
AML 스킬은 맞춤형 Azure Machine Learning(AML) 모델로 AI 강화를 확장할 수 있게 해줍니다. AML 모델을 학습하고 배포하면 AML 기술이 이를 AI 보강에 통합합니다. |
|
Azure |
Azure OpenAI 리소스를 사용해 주어진 텍스트 입력에 대해 벡터 임베딩을 생성할 수 있습니다. |
|
Azure |
호출될 Azure Open AI 모델 이름입니다. |
|
Azure |
Azure OpenAI Tokenizer parameters. |
|
Chat |
채팅 완료에 대한 공통 언어 모델 매개 변수입니다. 생략하면 기본값이 사용됩니다. |
|
Chat |
Azure AI Foundry가 'extraParameters'를 어떻게 처리해야 하는지 명시합니다. 기본값은 'error'입니다. |
|
Chat |
언어 모델의 응답을 직렬화하는 방법을 결정합니다. 기본값은 'text'입니다. |
|
Chat |
LLM이 응답의 형식을 지정하는 방법을 지정합니다. |
|
Chat |
모델이 출력을 구조화하는 데 사용할 사용자 지정 스키마를 정의하는 개체입니다. |
|
Chat |
JSON 스키마 응답 형식의 속성. |
|
Chat |
Azure AI Foundry의 Chat Completions 엔드포인트를 통해 언어 모델을 호출하는 스킬입니다. |
|
Cognitive |
Azure AI 서비스 리소스의 다중 지역 계정 키가 스킬셋에 연결되어 있습니다. |
|
Conditional |
부울 작업이 필요한 시나리오에서 출력에 할당할 데이터를 결정할 수 있도록 하는 기술입니다. |
|
Content |
Azure AI 콘텐츠 이해를 활용해 문서에서 구조화된 인사이트를 처리하고 추출하여, 향상된 문서 색인화 및 검색을 위한 풍부한 검색 콘텐츠를 가능하게 하는 기술입니다. |
|
Content |
콘텐츠를 청크하기 위한 카디널리티를 제어합니다. |
|
Content |
스킬에 의해 문서에서 추출된 콘텐츠의 카디널리티를 제어합니다. |
|
Custom |
찾은 일치 항목 및 관련 메타데이터에 대한 정보가 들어 있는 개체입니다. |
|
Custom |
루트 엔터티 이름에 대한 대체 맞춤법 또는 동의어를 지정하는 데 사용할 수 있는 복합 개체입니다. |
|
Custom |
기술은 사용자 정의 단어 및 구의 사용자 정의 목록에서 텍스트를 찾습니다. |
|
Custom |
CustomEntityLookupSkill에서 입력 텍스트에 대해 지원하는 언어 코드입니다. |
|
Default |
기본 Azure AI 서비스 자원을 나타내는 빈 객체입니다. |
|
Document |
보강 파이프라인 내의 파일에서 콘텐츠를 추출하는 기술입니다. |
|
Document |
Azure AI Services를 통해 풍부화 파이프라인 내 파일에서 콘텐츠와 레이아웃 정보를 추출하는 기술입니다. |
|
Document |
콘텐츠를 청크하기 위한 카디널리티를 제어합니다. |
|
Document |
스킬에 의해 문서에서 추출된 콘텐츠의 카디널리티를 제어합니다. |
|
Entity |
반환할 엔터티 범주를 나타내는 문자열입니다. |
|
Entity |
Text Analytics API를 사용하면 텍스트에서 연결된 엔터티를 추출합니다. |
|
Entity |
EntityRecognitionSkill에서 입력 텍스트에 대해 지원하는 언어 코드입니다. |
|
Entity |
Text Analytics API를 사용하면 텍스트에서 다양한 유형의 엔터티를 추출합니다. |
|
Error |
리소스 관리 오류 추가 정보입니다. |
|
Error |
오류 세부 정보입니다. |
|
Error |
모든 Azure Resource Manager API에서 실패한 작업에 대한 오류 세부 정보를 반환하는 공통 오류 응답입니다. 또한 OData 오류 응답 형식을 따릅니다. |
|
Image |
이미지 파일을 분석하는 기술입니다. 이미지 콘텐츠에 따라 다양한 시각적 기능 집합을 추출합니다. |
|
Image |
ImageAnalysisSkill에서 입력할 수 있도록 지원되는 언어 코드입니다. |
|
Image |
반환할 도메인별 세부 정보를 나타내는 문자열입니다. |
|
Index |
인덱서의 나머지 부분과 관련된 인덱스 프로젝션의 동작을 정의합니다. |
|
Input |
기술에 대한 입력 필드 매핑입니다. |
|
Key |
핵심 구 추출에 텍스트 분석을 사용하는 기술입니다. |
|
Key |
KeyPhraseExtractionSkill에서 입력 텍스트에 대해 지원하는 언어 코드입니다. |
|
Language |
입력 텍스트의 언어를 감지하고 요청에 제출된 모든 문서에 대해 단일 언어 코드를 보고하는 기술입니다. 언어 코드는 분석의 신뢰도를 나타내는 점수와 쌍을 이깁니다. |
|
Merge |
두 개 이상의 문자열을 단일 통합 문자열로 병합하는 기술로, 선택적 사용자 정의 구분 기호가 각 구성 요소 부분을 구분합니다. |
|
Ocr |
OCR 기술에서 인식하는 텍스트 줄 사이에 사용할 문자 시퀀스를 정의합니다. 기본값은 "space"입니다. |
|
Ocr |
이미지 파일에서 텍스트를 추출하는 기술입니다. |
|
Ocr |
OcrSkill에서 입력할 수 있도록 지원되는 언어 코드입니다. |
|
Output |
기술에 대한 출력 필드 매핑입니다. |
|
PIIDetection |
Text Analytics API를 사용하면 입력된 텍스트에서 개인 정보를 추출하고 이를 가릴 수 있는 옵션을 제공합니다. |
|
PIIDetection |
입력 텍스트에서 검색된 개인 정보를 마스킹하는 데 사용할 maskingMode를 나타내는 문자열입니다. |
|
Search |
데이터 원본의 ID 속성을 지웁니다. |
|
Search |
사용할 데이터 원본의 ID를 지정합니다. |
|
Search |
보조 검색 인덱스에 대한 추가 프로젝션 정의입니다. |
|
Search |
지정된 검색 인덱스로 저장할 데이터에 대한 설명입니다. |
|
Search |
인덱스 프로젝션 관련 구성 속성의 사전입니다. 각 이름은 특정 속성의 이름입니다. 각 값은 기본 형식이어야 합니다. |
|
Search |
보강된 데이터의 Azure Blob, 테이블 또는 파일에 대한 추가 프로젝션 정의입니다. |
|
Search |
Azure Files에 저장할 데이터를 위한 프로젝션 정의. |
|
Search |
Azure Blob에 저장할 데이터를 위한 프로젝션 정의. |
|
Search |
지식 저장소별 구성 속성의 사전입니다. 각 이름은 특정 속성의 이름입니다. 각 값은 기본 형식이어야 합니다. |
|
Search |
다양한 프로젝션 선택기에 대한 컨테이너 개체입니다. |
|
Search |
Azure Tables에 저장할 데이터 설명. |
|
Search |
기술 목록입니다. |
|
Search |
Azure Key Vault in customer-managed encryption key. 만들고 관리하는 키를 사용하여 인덱스 및 동의어 맵과 같은 미사용 데이터를 암호화하거나 복호화할 수 있습니다. |
|
Sentiment |
SentimentSkill에서 입력 텍스트에 대해 지원하는 언어 코드입니다. |
|
Sentiment |
Text Analytics API를 사용하여 비구조화된 텍스트를 평가하고, 각 레코드에 대해 문장 및 문서 수준에서 서비스가 찾은 가장 높은 신뢰도에 따라 '부정적', '중립적', '긍정적' 같은 감정 라벨을 제공합니다. |
|
Shaper |
출력을 재구성하기 위한 기술입니다. 복합 필드(다중 파트 필드라고도 함)를 지원하는 복합 형식을 만듭니다. |
|
Split |
문자열을 텍스트 청크로 분할하는 기술입니다. |
|
Split |
어떤 토큰라이저를 사용해야 할지를 나타내는 값입니다. |
|
Split |
SplitSkill에서 입력 텍스트에 대해 지원하는 언어 코드입니다. |
|
Split |
사용할 단위를 나타내는 값입니다. |
|
Text |
수행할 분할 모드를 나타내는 값입니다. |
|
Text |
텍스트를 한 언어에서 다른 언어로 번역하는 기술입니다. |
|
Text |
TextTranslationSkill에서 입력 텍스트에 대해 지원하는 언어 코드입니다. |
|
Vision |
Azure AI Services Vision Vectorize API를 사용해 주어진 이미지나 텍스트 입력에 대해 벡터 임베딩을 생성할 수 있습니다. |
|
Visual |
반환할 시각적 기능 유형을 나타내는 문자열입니다. |
|
Web |
Web API 엔드포인트를 호출할 수 있는 기술로, 사용자 지정 코드를 호출하여 기술 세트를 확장할 수 있습니다. |
Accept
Accept 헤더입니다.
| 값 | Description |
|---|---|
| application/json;odata.metadata=minimal |
AIServicesAccountIdentity
스킬셋에 연결된 Azure AI 서비스 자원의 다중 지역 계정입니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
| description |
string |
스킬셋에 첨부된 Azure AI 서비스 리소스 설명. |
| identity | SearchIndexerDataIdentity: |
AI 서비스에 대한 연결에 사용되는 사용자 할당 관리 ID입니다. 지정하지 않으면 시스템 할당 관리 ID가 사용됩니다. 기술 세트 업데이트 시 ID가 지정되지 않은 경우 값은 변경되지 않은 상태로 유지됩니다. "none"으로 설정하면 이 속성의 값이 지워집니다. |
| subdomainUrl |
string |
해당 AI 서비스의 하위 도메인/Azure AI 서비스 엔드포인트 URL. |
AIServicesAccountKey
스킬셋에 연결된 Azure AI 서비스 리소스의 계정 키로, 리소스의 하위 도메인과 함께 사용됩니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
| description |
string |
스킬셋에 첨부된 Azure AI 서비스 리소스 설명. |
| key |
string |
Azure AI 서비스 리소스를 스킬셋에 연결하는 데 사용된 키입니다. |
| subdomainUrl |
string |
해당 AI 서비스의 하위 도메인/Azure AI 서비스 엔드포인트 URL. |
AzureMachineLearningSkill
AML 스킬은 맞춤형 Azure Machine Learning(AML) 모델로 AI 강화를 확장할 수 있게 해줍니다. AML 모델을 학습하고 배포하면 AML 기술이 이를 AI 보강에 통합합니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
| context |
string |
문서 루트 또는 문서 콘텐츠(예: /document 또는 /document/content)와 같은 작업이 수행되는 수준을 나타냅니다. 기본값은 /document입니다. |
| degreeOfParallelism |
integer (int32) |
(선택 사항) 지정된 경우 인덱서가 제공한 엔드포인트와 병렬로 수행할 호출 수를 나타냅니다. 엔드포인트가 너무 높은 요청 로드에서 실패하는 경우 이 값을 줄이거나, 엔드포인트가 더 많은 요청을 수락할 수 있고 인덱서의 성능을 향상시키려면 이 값을 올릴 수 있습니다. 설정하지 않으면 기본값으로 5초가 사용됩니다. degreeOfParallelism은 최대 10 및 최소 1로 설정할 수 있습니다. |
| description |
string |
기술의 입력, 출력 및 사용을 설명하는 기술에 대한 설명입니다. |
| inputs |
기술 입력은 원본 데이터 집합의 열 또는 업스트림 기술의 출력일 수 있습니다. |
|
| key |
string |
(키 인증에 필요) AML 서비스의 키입니다. |
| name |
string |
기술 세트 내에서 고유하게 식별하는 기술의 이름입니다. 이름이 정의되지 않은 기술에는 '#' 문자 앞에 접두사로 지정된 기술 배열에서 1부터 시작하는 인덱스의 기본 이름이 지정됩니다. |
| outputs |
기술의 출력은 검색 인덱스의 필드이거나 다른 기술의 입력으로 사용할 수 있는 값입니다. |
|
| region |
string |
(토큰 인증의 경우 선택 사항). AML 서비스가 배포된 지역입니다. |
| resourceId |
string |
(토큰 인증에 필요). AML 서비스의 Azure Resource Manager 리소스 ID. 이 문서는 subscriptions/{guid}/resourceGroups/{resource-group-name}/Microsoft 형식으로 해야 합니다. MachineLearningServices/workspaces/{workspace-name}/services/{service_name}. |
| timeout |
string (duration) |
(선택 사항) 지정할 경우 API 호출을 수행하는 http 클라이언트에 대한 시간 제한을 나타냅니다. |
| uri |
string (uri) |
(인증 또는 키 인증을 사용하지 않는 데 필요) JSON 페이로드를 보낼 AML 서비스의 점수 매기기 URI입니다. https URI 스키마만 허용됩니다. |
AzureOpenAIEmbeddingSkill
Azure OpenAI 리소스를 사용해 주어진 텍스트 입력에 대해 벡터 임베딩을 생성할 수 있습니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
| apiKey |
string |
지정된 Azure OpenAI 리소스의 API 키. |
| authIdentity | SearchIndexerDataIdentity: |
아웃바운드 연결에 사용되는 사용자 할당 관리 ID입니다. |
| context |
string |
문서 루트 또는 문서 콘텐츠(예: /document 또는 /document/content)와 같은 작업이 수행되는 수준을 나타냅니다. 기본값은 /document입니다. |
| deploymentId |
string |
지정된 리소스에 대한 Azure OpenAI 모델 배포의 ID입니다. |
| description |
string |
기술의 입력, 출력 및 사용을 설명하는 기술에 대한 설명입니다. |
| dimensions |
integer (int32) |
결과 출력 포함에 있어야 하는 차원의 수입니다. text-embedding-3 이상 모델에서만 지원됩니다. |
| inputs |
기술 입력은 원본 데이터 집합의 열 또는 업스트림 기술의 출력일 수 있습니다. |
|
| modelName |
제공된 deploymentId 경로에 배포되는 포함 모델의 이름입니다. |
|
| name |
string |
기술 세트 내에서 고유하게 식별하는 기술의 이름입니다. 이름이 정의되지 않은 기술에는 '#' 문자 앞에 접두사로 지정된 기술 배열에서 1부터 시작하는 인덱스의 기본 이름이 지정됩니다. |
| outputs |
기술의 출력은 검색 인덱스의 필드이거나 다른 기술의 입력으로 사용할 수 있는 값입니다. |
|
| resourceUri |
string (uri) |
Azure OpenAI 리소스의 URI 리소스입니다. |
AzureOpenAIModelName
호출될 Azure Open AI 모델 이름입니다.
| 값 | Description |
|---|---|
| text-embedding-ada-002 |
TextEmbeddingAda002 모델. |
| text-embedding-3-large |
TextEmbedding3Large 모델. |
| text-embedding-3-small |
TextEmbedding3Small 모델. |
| gpt-4o |
GPT4o 모델입니다. |
| gpt-4o-mini |
GPT4oMini 모델입니다. |
| gpt-4.1 |
GPT41 모델입니다. |
| gpt-4.1-mini |
GPT41Mini 모델입니다. |
| gpt-4.1-nano |
GPT41Nano 모델입니다. |
| gpt-5 |
GPT5 모델입니다. |
| gpt-5-mini |
GPT5미니 모델입니다. |
| gpt-5-nano |
Gpt5Nano 모델입니다. |
AzureOpenAITokenizerParameters
Azure OpenAI Tokenizer parameters.
| Name | 형식 | Description |
|---|---|---|
| allowedSpecialTokens |
string[] |
(선택 사항) 단위가 azureOpenAITokens로 설정된 경우에만 적용됩니다. 이 매개변수는 토큰화 프로세스 내에서 허용되는 특수 토큰의 콜렉션을 정의합니다. |
| encoderModelName |
단위가 azureOpenAITokens로 설정된 경우에만 적용됩니다. 옵션에는 'R50k_base', 'P50k_base', 'P50k_edit' 및 'CL100k_base'이 포함됩니다. 기본값은 'CL100k_base'입니다. |
ChatCompletionCommonModelParameters
채팅 완료에 대한 공통 언어 모델 매개 변수입니다. 생략하면 기본값이 사용됩니다.
| Name | 형식 | Default value | Description |
|---|---|---|---|
| frequencyPenalty |
number (double) |
0 |
토큰이 반복될 가능성을 줄이거나 늘리는 [-2,2] 범위의 부동 소수점입니다. 기본값은 0입니다. |
| maxTokens |
integer (int32) |
생성할 최대 토큰 수. |
|
| model |
string |
사용할 모델의 이름(예: 'gpt-4o' 등). 지정하지 않으면 기본값은 null입니다. |
|
| presencePenalty |
number (double) |
0 |
[-2,2] 범위의 부동 소수점은 기존 존재에 따라 새 토큰에 불이익을 줍니다. 기본값은 0입니다. |
| seed |
integer (int32) |
결정론적 출력을 제어하기 위한 랜덤 시드. 생략하면 무작위화가 사용됩니다. |
|
| stop |
string[] |
텍스트 생성을 차단하는 중지 시퀀스 목록입니다. 기본값은 없음입니다. |
|
| temperature |
number (double) |
0.7 |
샘플링 온도. 기본값은 0.7입니다. |
ChatCompletionExtraParametersBehavior
Azure AI Foundry가 'extraParameters'를 어떻게 처리해야 하는지 명시합니다. 기본값은 'error'입니다.
| 값 | Description |
|---|---|
| passThrough |
추가 매개변수를 모델에 직접 전달합니다. |
| drop |
모든 추가 매개변수를 삭제합니다. |
| error |
추가 매개 변수가 있는 경우 오류가 발생합니다. |
ChatCompletionResponseFormat
언어 모델의 응답을 직렬화하는 방법을 결정합니다. 기본값은 'text'입니다.
| Name | 형식 | Default value | Description |
|---|---|---|---|
| jsonSchemaProperties |
확장 속성에 대한 개방형 사전입니다. 'type'== 'json_schema'인 경우 필수 |
||
| type | text |
LLM이 응답의 형식을 지정하는 방법을 지정합니다. |
ChatCompletionResponseFormatType
LLM이 응답의 형식을 지정하는 방법을 지정합니다.
| 값 | Description |
|---|---|
| text |
평문 응답 형식입니다. |
| jsonObject |
임의의 JSON 객체 응답 형식. |
| jsonSchema |
JSON 스키마 준수 응답 형식. |
ChatCompletionSchema
모델이 출력을 구조화하는 데 사용할 사용자 지정 스키마를 정의하는 개체입니다.
| Name | 형식 | Default value | Description |
|---|---|---|---|
| additionalProperties |
boolean |
False |
개체에 JSON 스키마에 정의되지 않은 추가 키/값을 포함할 수 있는지 여부를 제어합니다. 기본값은 false입니다. |
| properties |
string |
모델에 대한 출력 스키마의 속성 및 제약 조건을 정의하는 JSON 형식의 문자열입니다. |
|
| required |
string[] |
모델 응답의 일부가 되어야 하는 속성 이름의 배열입니다. 구조화된 출력에는 모든 속성이 포함되어야 합니다. |
|
| type |
string |
object |
스키마 표현의 유형입니다. 일반적으로 'object'입니다. 기본값은 'object'입니다. |
ChatCompletionSchemaProperties
JSON 스키마 응답 형식의 속성.
| Name | 형식 | Default value | Description |
|---|---|---|---|
| description |
string |
모델이 준수할 json 스키마에 대한 설명입니다. |
|
| name |
string |
모델이 따르는 json 스키마의 이름입니다. |
|
| schema |
스키마 정의. |
||
| strict |
boolean |
True |
모델의 응답이 구조화된 출력을 사용해야 하는지 여부입니다. 기본값은 true입니다. |
ChatCompletionSkill
Azure AI Foundry의 Chat Completions 엔드포인트를 통해 언어 모델을 호출하는 스킬입니다.
| Name | 형식 | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
|
| apiKey |
string |
모델에 인증하기 위한 API 키입니다. apiKey와 authIdentity는 동시에 지정할 수 없습니다. |
|
| authIdentity | SearchIndexerDataIdentity: |
아웃바운드 연결에 사용되는 사용자 할당 관리 ID입니다. authResourceId가 제공되고 지정되지 않은 경우 시스템 할당 관리 ID가 사용됩니다. 인덱서 업데이트 시 ID가 지정되지 않은 경우 값은 변경되지 않은 상태로 유지됩니다. "none"으로 설정하면 이 속성의 값이 지워집니다. |
|
| authResourceId |
string |
Azure 함수나 변환을 제공하는 다른 애플리케이션에서 외부 코드와 연결하는 맞춤형 스킬에 적용됩니다. 이 값은 Azure Active Directory에 등록된 기능이나 앱에 대해 생성된 애플리케이션 ID여야 합니다. 지정된 경우 사용자 지정 기술은 검색 서비스의 관리 ID(시스템 또는 사용자 할당)와 함수 또는 앱의 액세스 토큰을 사용하여 함수 또는 앱에 연결합니다. 이 값을 액세스 토큰의 범위를 만들기 위한 리소스 ID로 사용합니다. |
|
| batchSize |
integer (int32) |
문서 수를 나타내는 원하는 일괄 처리 크기입니다. |
|
| commonModelParameters |
고객이 조정할 수 있는 공통 언어 모델 매개 변수입니다. 생략하면 합리적인 기본값이 적용됩니다. |
||
| context |
string |
문서 루트 또는 문서 콘텐츠(예: /document 또는 /document/content)와 같은 작업이 수행되는 수준을 나타냅니다. 기본값은 /document입니다. |
|
| degreeOfParallelism |
integer (int32) |
설정된 경우 Web API에 대해 수행할 수 있는 병렬 호출 수입니다. |
|
| description |
string |
기술의 입력, 출력 및 사용을 설명하는 기술에 대한 설명입니다. |
|
| extraParameters |
채팅 완료 호출에 추가해야 하는 모델별 매개 변수에 대한 개방형 사전입니다. Azure AI Foundry의 확장 패턴을 따릅니다. |
||
| extraParametersBehavior | error |
Azure AI Foundry가 추가 매개변수를 어떻게 처리하는지에 대해 알아보세요. 기본값은 'error'입니다. |
|
| httpHeaders |
object |
http 요청을 만드는 데 필요한 헤더입니다. |
|
| httpMethod |
string |
http 요청에 대한 메서드입니다. |
|
| inputs |
기술 입력은 원본 데이터 집합의 열 또는 업스트림 기술의 출력일 수 있습니다. |
||
| name |
string |
기술 세트 내에서 고유하게 식별하는 기술의 이름입니다. 이름이 정의되지 않은 기술에는 '#' 문자 앞에 접두사로 지정된 기술 배열에서 1부터 시작하는 인덱스의 기본 이름이 지정됩니다. |
|
| outputs |
기술의 출력은 검색 인덱스의 필드이거나 다른 기술의 입력으로 사용할 수 있는 값입니다. |
||
| responseFormat |
LLM이 응답의 형식을 지정하는 방법을 결정합니다. 기본값은 'text' 응답 유형입니다. |
||
| timeout |
string (duration) |
요청에 대해 원하는 시간 제한입니다. 기본값은 30초입니다. |
|
| uri |
string |
Web API의 URL입니다. |
CognitiveServicesAccountKey
Azure AI 서비스 리소스의 다중 지역 계정 키가 스킬셋에 연결되어 있습니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
| description |
string |
스킬셋에 첨부된 Azure AI 서비스 리소스 설명. |
| key |
string |
Azure AI 서비스 리소스를 스킬셋에 연결하는 데 사용된 키입니다. |
ConditionalSkill
부울 작업이 필요한 시나리오에서 출력에 할당할 데이터를 결정할 수 있도록 하는 기술입니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
| context |
string |
문서 루트 또는 문서 콘텐츠(예: /document 또는 /document/content)와 같은 작업이 수행되는 수준을 나타냅니다. 기본값은 /document입니다. |
| description |
string |
기술의 입력, 출력 및 사용을 설명하는 기술에 대한 설명입니다. |
| inputs |
기술 입력은 원본 데이터 집합의 열 또는 업스트림 기술의 출력일 수 있습니다. |
|
| name |
string |
기술 세트 내에서 고유하게 식별하는 기술의 이름입니다. 이름이 정의되지 않은 기술에는 '#' 문자 앞에 접두사로 지정된 기술 배열에서 1부터 시작하는 인덱스의 기본 이름이 지정됩니다. |
| outputs |
기술의 출력은 검색 인덱스의 필드이거나 다른 기술의 입력으로 사용할 수 있는 값입니다. |
ContentUnderstandingSkill
Azure AI 콘텐츠 이해를 활용해 문서에서 구조화된 인사이트를 처리하고 추출하여, 향상된 문서 색인화 및 검색을 위한 풍부한 검색 콘텐츠를 가능하게 하는 기술입니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
| chunkingProperties |
콘텐츠를 청크하기 위한 카디널리티를 제어합니다. |
|
| context |
string |
문서 루트 또는 문서 콘텐츠(예: /document 또는 /document/content)와 같은 작업이 수행되는 수준을 나타냅니다. 기본값은 /document입니다. |
| description |
string |
기술의 입력, 출력 및 사용을 설명하는 기술에 대한 설명입니다. |
| extractionOptions |
스킬에 의해 문서에서 추출된 콘텐츠의 카디널리티를 제어합니다. |
|
| inputs |
기술 입력은 원본 데이터 집합의 열 또는 업스트림 기술의 출력일 수 있습니다. |
|
| name |
string |
기술 세트 내에서 고유하게 식별하는 기술의 이름입니다. 이름이 정의되지 않은 기술에는 '#' 문자 앞에 접두사로 지정된 기술 배열에서 1부터 시작하는 인덱스의 기본 이름이 지정됩니다. |
| outputs |
기술의 출력은 검색 인덱스의 필드이거나 다른 기술의 입력으로 사용할 수 있는 값입니다. |
ContentUnderstandingSkillChunkingProperties
콘텐츠를 청크하기 위한 카디널리티를 제어합니다.
| Name | 형식 | Default value | Description |
|---|---|---|---|
| maximumLength |
integer (int32) |
최대 청크 길이(문자)입니다. 기본값은 500입니다. |
|
| overlapLength |
integer (int32) |
두 텍스트 청크 사이에 제공되는 겹침의 길이입니다. 기본값은 0입니다. |
|
| unit |
enum:
characters |
characters |
청크의 단위입니다. |
ContentUnderstandingSkillExtractionOptions
스킬에 의해 문서에서 추출된 콘텐츠의 카디널리티를 제어합니다.
| 값 | Description |
|---|---|
| images |
문서에서 이미지 콘텐츠를 추출하도록 지정합니다. |
| locationMetadata |
문서에서 위치 메타데이터를 추출하도록 지정합니다. |
CustomEntity
찾은 일치 항목 및 관련 메타데이터에 대한 정보가 들어 있는 개체입니다.
| Name | 형식 | Description |
|---|---|---|
| accentSensitive |
boolean |
기본값은 false입니다. 엔터티 이름과의 비교가 악센트에 민감해야 하는지 여부를 나타내는 부울 값입니다. |
| aliases |
루트 엔터티 이름에 대한 대체 맞춤법 또는 동의어를 지정하는 데 사용할 수 있는 복잡한 개체의 배열입니다. |
|
| caseSensitive |
boolean |
기본값은 false입니다. 엔터티 이름과의 비교가 문자 대/소문자에 민감해야 하는지 여부를 나타내는 부울 값입니다. "Microsoft"의 대소문자 구별 예시 매칭은 microsoft, microSoft, MICROSOFT 등이 있을 수 있습니다. |
| defaultAccentSensitive |
boolean |
이 엔터티에 대한 기본 악센트 민감도 값을 변경합니다. 모든 별칭 accentSensitive 값의 기본값을 변경하는 데 사용됩니다. |
| defaultCaseSensitive |
boolean |
이 엔터티의 기본 대/소문자 구분 값을 변경합니다. 모든 별칭의 기본값을 변경하는 데 사용됩니다. |
| defaultFuzzyEditDistance |
integer (int32) |
이 엔티티에 대한 기본 퍼지 편집 거리 값을 변경합니다. 모든 별칭 fuzzyEditDistance 값의 기본값을 변경하는 데 사용할 수 있습니다. |
| description |
string |
이 필드는 일치하는 텍스트에 대한 사용자 지정 메타데이터에 대한 패스스루로 사용할 수 있습니다. 이 필드의 값은 스킬 출력에서 해당 엔티티의 모든 일치와 함께 나타납니다. |
| fuzzyEditDistance |
integer (int32) |
기본값은 0입니다. 최대값은 5입니다. 엔터티 이름과 일치하는 것으로 간주되는 허용되는 발산 문자 수를 나타냅니다. 지정된 일치 항목에 대해 가능한 가장 작은 퍼지가 반환됩니다. 예를 들어, 편집 거리를 3으로 설정해도 "Windows10"은 여전히 "Windows", "Windows10", "Windows 7"과 일치합니다. 대소문자 구분이 false로 설정되면 대소문자 차이는 퍼지 허용 오차에 포함되지 않지만 그렇지 않으면 계산됩니다. |
| id |
string |
이 필드는 일치하는 텍스트에 대한 사용자 지정 메타데이터에 대한 패스스루로 사용할 수 있습니다. 이 필드의 값은 스킬 출력에서 해당 엔티티의 모든 일치와 함께 나타납니다. |
| name |
string |
최상위 엔터티 설명자입니다. 스킬 출력의 일치 항목은 이 이름으로 그룹화되며 발견되는 텍스트의 "정규화된" 형식을 나타내야 합니다. |
| subtype |
string |
이 필드는 일치하는 텍스트에 대한 사용자 지정 메타데이터에 대한 패스스루로 사용할 수 있습니다. 이 필드의 값은 스킬 출력에서 해당 엔티티의 모든 일치와 함께 나타납니다. |
| type |
string |
이 필드는 일치하는 텍스트에 대한 사용자 지정 메타데이터에 대한 패스스루로 사용할 수 있습니다. 이 필드의 값은 스킬 출력에서 해당 엔티티의 모든 일치와 함께 나타납니다. |
CustomEntityAlias
루트 엔터티 이름에 대한 대체 맞춤법 또는 동의어를 지정하는 데 사용할 수 있는 복합 개체입니다.
| Name | 형식 | Description |
|---|---|---|
| accentSensitive |
boolean |
별칭이 악센트를 구분하는지 확인합니다. |
| caseSensitive |
boolean |
별칭이 대/소문자를 구분하는지 확인합니다. |
| fuzzyEditDistance |
integer (int32) |
별칭의 퍼지 편집 거리를 결정합니다. |
| text |
string |
별칭의 텍스트입니다. |
CustomEntityLookupSkill
기술은 사용자 정의 단어 및 구의 사용자 정의 목록에서 텍스트를 찾습니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
| context |
string |
문서 루트 또는 문서 콘텐츠(예: /document 또는 /document/content)와 같은 작업이 수행되는 수준을 나타냅니다. 기본값은 /document입니다. |
| defaultLanguageCode |
사용할 언어 코드를 나타내는 값입니다. 기본값은 |
|
| description |
string |
기술의 입력, 출력 및 사용을 설명하는 기술에 대한 설명입니다. |
| entitiesDefinitionUri |
string |
일치시킬 모든 대상 텍스트가 포함된 JSON 또는 CSV 파일의 경로입니다. 이 엔터티 정의는 인덱서 실행의 시작 부분에서 읽습니다. 인덱서 실행 중에 이 파일에 대한 업데이트는 후속 실행까지 적용되지 않습니다. 이 구성은 HTTPS를 통해 액세스할 수 있어야 합니다. |
| globalDefaultAccentSensitive |
boolean |
AccentSensitive의 전역 플래그입니다. CustomEntity에서 AccentSensitive가 설정되지 않은 경우 이 값이 기본값이 됩니다. |
| globalDefaultCaseSensitive |
boolean |
CaseSensitive의 전역 플래그입니다. CustomEntity에서 CaseSensitive가 설정되지 않은 경우 이 값이 기본값이 됩니다. |
| globalDefaultFuzzyEditDistance |
integer (int32) |
FuzzyEditDistance의 전역 플래그입니다. CustomEntity에서 FuzzyEditDistance가 설정되지 않은 경우 이 값이 기본값이 됩니다. |
| inlineEntitiesDefinition |
인라인 CustomEntity 정의입니다. |
|
| inputs |
기술 입력은 원본 데이터 집합의 열 또는 업스트림 기술의 출력일 수 있습니다. |
|
| name |
string |
기술 세트 내에서 고유하게 식별하는 기술의 이름입니다. 이름이 정의되지 않은 기술에는 '#' 문자 앞에 접두사로 지정된 기술 배열에서 1부터 시작하는 인덱스의 기본 이름이 지정됩니다. |
| outputs |
기술의 출력은 검색 인덱스의 필드이거나 다른 기술의 입력으로 사용할 수 있는 값입니다. |
CustomEntityLookupSkillLanguage
CustomEntityLookupSkill에서 입력 텍스트에 대해 지원하는 언어 코드입니다.
| 값 | Description |
|---|---|
| da |
덴마크어 |
| de |
German |
| en |
English |
| es |
Spanish |
| fi |
핀란드어 |
| fr |
프랑스어 |
| it |
Italian |
| ko |
한국어 |
| pt |
포르투갈어 |
DefaultCognitiveServicesAccount
기본 Azure AI 서비스 자원을 나타내는 빈 객체입니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
| description |
string |
스킬셋에 첨부된 Azure AI 서비스 리소스 설명. |
DocumentExtractionSkill
보강 파이프라인 내의 파일에서 콘텐츠를 추출하는 기술입니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
| configuration |
기술에 대한 구성 사전입니다. |
|
| context |
string |
문서 루트 또는 문서 콘텐츠(예: /document 또는 /document/content)와 같은 작업이 수행되는 수준을 나타냅니다. 기본값은 /document입니다. |
| dataToExtract |
string |
기술에 대해 추출할 데이터의 형식입니다. 정의되지 않은 경우 'contentAndMetadata'로 설정됩니다. |
| description |
string |
기술의 입력, 출력 및 사용을 설명하는 기술에 대한 설명입니다. |
| inputs |
기술 입력은 원본 데이터 집합의 열 또는 업스트림 기술의 출력일 수 있습니다. |
|
| name |
string |
기술 세트 내에서 고유하게 식별하는 기술의 이름입니다. 이름이 정의되지 않은 기술에는 '#' 문자 앞에 접두사로 지정된 기술 배열에서 1부터 시작하는 인덱스의 기본 이름이 지정됩니다. |
| outputs |
기술의 출력은 검색 인덱스의 필드이거나 다른 기술의 입력으로 사용할 수 있는 값입니다. |
|
| parsingMode |
string |
기술에 대한 parsingMode입니다. 정의되지 않은 경우 '기본값'으로 설정됩니다. |
DocumentIntelligenceLayoutSkill
Azure AI Services를 통해 풍부화 파이프라인 내 파일에서 콘텐츠와 레이아웃 정보를 추출하는 기술입니다.
| Name | 형식 | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
|
| chunkingProperties |
콘텐츠를 청크하기 위한 카디널리티를 제어합니다. |
||
| context |
string |
문서 루트 또는 문서 콘텐츠(예: /document 또는 /document/content)와 같은 작업이 수행되는 수준을 나타냅니다. 기본값은 /document입니다. |
|
| description |
string |
기술의 입력, 출력 및 사용을 설명하는 기술에 대한 설명입니다. |
|
| extractionOptions |
스킬에 의해 문서에서 추출된 콘텐츠의 카디널리티를 제어합니다. |
||
| inputs |
기술 입력은 원본 데이터 집합의 열 또는 업스트림 기술의 출력일 수 있습니다. |
||
| markdownHeaderDepth |
enum:
|
h6 |
마크다운 출력의 헤더 깊이입니다. 기본값은 h6입니다. |
| name |
string |
기술 세트 내에서 고유하게 식별하는 기술의 이름입니다. 이름이 정의되지 않은 기술에는 '#' 문자 앞에 접두사로 지정된 기술 배열에서 1부터 시작하는 인덱스의 기본 이름이 지정됩니다. |
|
| outputFormat |
enum:
|
markdown |
출력 형식을 제어합니다. 기본값은 'markdown'입니다. |
| outputMode |
enum:
one |
oneToMany |
기술에 의해 생성된 출력의 카디널리티를 제어합니다. 기본값은 'oneToMany'입니다. |
| outputs |
기술의 출력은 검색 인덱스의 필드이거나 다른 기술의 입력으로 사용할 수 있는 값입니다. |
DocumentIntelligenceLayoutSkillChunkingProperties
콘텐츠를 청크하기 위한 카디널리티를 제어합니다.
| Name | 형식 | Default value | Description |
|---|---|---|---|
| maximumLength |
integer (int32) |
최대 청크 길이(문자)입니다. 기본값은 500입니다. |
|
| overlapLength |
integer (int32) |
두 텍스트 청크 사이에 제공되는 겹침의 길이입니다. 기본값은 0입니다. |
|
| unit |
enum:
characters |
characters |
청크의 단위입니다. |
DocumentIntelligenceLayoutSkillExtractionOptions
스킬에 의해 문서에서 추출된 콘텐츠의 카디널리티를 제어합니다.
| 값 | Description |
|---|---|
| images |
문서에서 이미지 콘텐츠를 추출하도록 지정합니다. |
| locationMetadata |
문서에서 위치 메타데이터를 추출하도록 지정합니다. |
EntityCategory
반환할 엔터티 범주를 나타내는 문자열입니다.
| 값 | Description |
|---|---|
| location |
물리적 위치를 설명하는 엔터티입니다. |
| organization |
조직을 설명하는 엔터티입니다. |
| person |
사람을 설명하는 엔터티입니다. |
| quantity |
수량을 설명하는 엔터티입니다. |
| datetime |
날짜와 시간을 설명하는 엔터티입니다. |
| url |
URL을 설명하는 엔터티입니다. |
|
이메일 주소를 설명하는 엔터티입니다. |
EntityLinkingSkill
Text Analytics API를 사용하면 텍스트에서 연결된 엔터티를 추출합니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
| context |
string |
문서 루트 또는 문서 콘텐츠(예: /document 또는 /document/content)와 같은 작업이 수행되는 수준을 나타냅니다. 기본값은 /document입니다. |
| defaultLanguageCode |
string |
사용할 언어 코드를 나타내는 값입니다. 기본값은 |
| description |
string |
기술의 입력, 출력 및 사용을 설명하는 기술에 대한 설명입니다. |
| inputs |
기술 입력은 원본 데이터 집합의 열 또는 업스트림 기술의 출력일 수 있습니다. |
|
| minimumPrecision |
number (double) minimum: 0maximum: 1 |
신뢰도 점수가 지정된 값보다 큰 엔터티만 포함하는 데 사용되는 0에서 1 사이의 값입니다. 설정하지 않거나(기본값) 명시적으로 null로 설정하면 모든 엔터티가 포함됩니다. |
| modelVersion |
string |
Text Analytics 서비스를 호출할 때 사용할 모델의 버전입니다. 지정하지 않으면 기본적으로 사용 가능한 최신 버전으로 설정됩니다. 반드시 필요한 경우가 아니면 이 값을 지정하지 않는 것이 좋습니다. |
| name |
string |
기술 세트 내에서 고유하게 식별하는 기술의 이름입니다. 이름이 정의되지 않은 기술에는 '#' 문자 앞에 접두사로 지정된 기술 배열에서 1부터 시작하는 인덱스의 기본 이름이 지정됩니다. |
| outputs |
기술의 출력은 검색 인덱스의 필드이거나 다른 기술의 입력으로 사용할 수 있는 값입니다. |
EntityRecognitionSkillLanguage
EntityRecognitionSkill에서 입력 텍스트에 대해 지원하는 언어 코드입니다.
| 값 | Description |
|---|---|
| ar |
Arabic |
| cs |
체코어 |
| zh-Hans |
중국어 - 간체 |
| zh-Hant |
중국어-번체 |
| da |
덴마크어 |
| nl |
네덜란드어 |
| en |
English |
| fi |
핀란드어 |
| fr |
프랑스어 |
| de |
German |
| el |
그리스어 |
| hu |
Hungarian |
| it |
Italian |
| ja |
Japanese |
| ko |
한국어 |
| no |
노르웨이어(복말) |
| pl |
Polish |
| pt-PT |
포르투갈어(포르투갈) |
| pt-BR |
포르투갈어 (브라질) |
| ru |
Russian |
| es |
Spanish |
| sv |
스웨덴어 |
| tr |
터키어 |
EntityRecognitionSkillV3
Text Analytics API를 사용하면 텍스트에서 다양한 유형의 엔터티를 추출합니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
| categories |
추출해야 하는 엔터티 범주 목록입니다. |
|
| context |
string |
문서 루트 또는 문서 콘텐츠(예: /document 또는 /document/content)와 같은 작업이 수행되는 수준을 나타냅니다. 기본값은 /document입니다. |
| defaultLanguageCode |
사용할 언어 코드를 나타내는 값입니다. 기본값은 |
|
| description |
string |
기술의 입력, 출력 및 사용을 설명하는 기술에 대한 설명입니다. |
| inputs |
기술 입력은 원본 데이터 집합의 열 또는 업스트림 기술의 출력일 수 있습니다. |
|
| minimumPrecision |
number (double) minimum: 0maximum: 1 |
신뢰도 점수가 지정된 값보다 큰 엔터티만 포함하는 데 사용되는 0에서 1 사이의 값입니다. 설정하지 않거나(기본값) 명시적으로 null로 설정하면 모든 엔터티가 포함됩니다. |
| modelVersion |
string |
Text Analytics API를 호출할 때 사용하는 모델 버전입니다. 지정하지 않으면 기본적으로 사용 가능한 최신 버전으로 설정됩니다. 반드시 필요한 경우가 아니면 이 값을 지정하지 않는 것이 좋습니다. |
| name |
string |
기술 세트 내에서 고유하게 식별하는 기술의 이름입니다. 이름이 정의되지 않은 기술에는 '#' 문자 앞에 접두사로 지정된 기술 배열에서 1부터 시작하는 인덱스의 기본 이름이 지정됩니다. |
| outputs |
기술의 출력은 검색 인덱스의 필드이거나 다른 기술의 입력으로 사용할 수 있는 값입니다. |
ErrorAdditionalInfo
리소스 관리 오류 추가 정보입니다.
| Name | 형식 | Description |
|---|---|---|
| info |
추가 정보입니다. |
|
| type |
string |
추가 정보 유형입니다. |
ErrorDetail
오류 세부 정보입니다.
| Name | 형식 | Description |
|---|---|---|
| additionalInfo |
오류 추가 정보입니다. |
|
| code |
string |
오류 코드입니다. |
| details |
오류 세부 정보입니다. |
|
| message |
string |
오류 메시지입니다. |
| target |
string |
오류 대상입니다. |
ErrorResponse
모든 Azure Resource Manager API에서 실패한 작업에 대한 오류 세부 정보를 반환하는 공통 오류 응답입니다. 또한 OData 오류 응답 형식을 따릅니다.
| Name | 형식 | Description |
|---|---|---|
| error |
오류 개체입니다. |
ImageAnalysisSkill
이미지 파일을 분석하는 기술입니다. 이미지 콘텐츠에 따라 다양한 시각적 기능 집합을 추출합니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
| context |
string |
문서 루트 또는 문서 콘텐츠(예: /document 또는 /document/content)와 같은 작업이 수행되는 수준을 나타냅니다. 기본값은 /document입니다. |
| defaultLanguageCode |
사용할 언어 코드를 나타내는 값입니다. 기본값은 |
|
| description |
string |
기술의 입력, 출력 및 사용을 설명하는 기술에 대한 설명입니다. |
| details |
반환할 도메인별 세부 정보를 나타내는 문자열입니다. |
|
| inputs |
기술 입력은 원본 데이터 집합의 열 또는 업스트림 기술의 출력일 수 있습니다. |
|
| name |
string |
기술 세트 내에서 고유하게 식별하는 기술의 이름입니다. 이름이 정의되지 않은 기술에는 '#' 문자 앞에 접두사로 지정된 기술 배열에서 1부터 시작하는 인덱스의 기본 이름이 지정됩니다. |
| outputs |
기술의 출력은 검색 인덱스의 필드이거나 다른 기술의 입력으로 사용할 수 있는 값입니다. |
|
| visualFeatures |
시각적 기능 목록입니다. |
ImageAnalysisSkillLanguage
ImageAnalysisSkill에서 입력할 수 있도록 지원되는 언어 코드입니다.
| 값 | Description |
|---|---|
| ar |
Arabic |
| az |
아제르바이잔어 |
| bg |
불가리아어 |
| bs |
보스니아어(라틴 문자) |
| ca |
카탈로니아어 |
| cs |
체코어 |
| cy |
웨일스어 |
| da |
덴마크어 |
| de |
German |
| el |
그리스어 |
| en |
English |
| es |
Spanish |
| et |
Estonian |
| eu |
바스크어 |
| fi |
핀란드어 |
| fr |
프랑스어 |
| ga |
아일랜드어 |
| gl |
갈리시아어 |
| he |
히브리어 |
| hi |
힌디어 |
| hr |
크로아티아어 |
| hu |
Hungarian |
| id |
Indonesian |
| it |
Italian |
| ja |
Japanese |
| kk |
카자흐어 |
| ko |
한국어 |
| lt |
리투아니아어 |
| lv |
Latvian |
| mk |
마케도니아어 |
| ms |
말레이어(말레이시아) |
| nb |
노르웨이어(복말) |
| nl |
네덜란드어 |
| pl |
Polish |
| prs |
Dari |
| pt-BR |
포르투갈어(브라질) |
| pt |
포르투갈어(포르투갈) |
| pt-PT |
포르투갈어(포르투갈) |
| ro |
루마니아어 |
| ru |
Russian |
| sk |
슬로바키아어 |
| sl |
슬로베니아어 |
| sr-Cyrl |
세르비아어(키릴 문자) |
| sr-Latn |
세르비아어(라틴 문자) |
| sv |
스웨덴어 |
| th |
태국어 |
| tr |
터키어 |
| uk |
우크라이나어 |
| vi |
베트남어 |
| zh |
중국어 간체 |
| zh-Hans |
중국어 간체 |
| zh-Hant |
중국어 번체 |
ImageDetail
반환할 도메인별 세부 정보를 나타내는 문자열입니다.
| 값 | Description |
|---|---|
| celebrities |
연예인으로 인정되는 디테일. |
| landmarks |
세부 사항은 랜드마크로 인식됩니다. |
IndexProjectionMode
인덱서의 나머지 부분과 관련된 인덱스 프로젝션의 동작을 정의합니다.
| 값 | Description |
|---|---|
| skipIndexingParentDocuments |
원본 문서는 인덱서의 대상 인덱스에 쓰는 것을 건너뜁니다. |
| includeIndexingParentDocuments |
원본 문서는 인덱서의 대상 인덱스에 기록됩니다. 이것이 기본 패턴입니다. |
InputFieldMappingEntry
기술에 대한 입력 필드 매핑입니다.
| Name | 형식 | Description |
|---|---|---|
| inputs |
복합 형식을 만들 때 사용되는 재귀 입력입니다. |
|
| name |
string |
입력의 이름입니다. |
| source |
string |
입력의 소스입니다. |
| sourceContext |
string |
재귀 입력을 선택하는 데 사용되는 소스 컨텍스트입니다. |
KeyPhraseExtractionSkill
핵심 구 추출에 텍스트 분석을 사용하는 기술입니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
| context |
string |
문서 루트 또는 문서 콘텐츠(예: /document 또는 /document/content)와 같은 작업이 수행되는 수준을 나타냅니다. 기본값은 /document입니다. |
| defaultLanguageCode |
사용할 언어 코드를 나타내는 값입니다. 기본값은 |
|
| description |
string |
기술의 입력, 출력 및 사용을 설명하는 기술에 대한 설명입니다. |
| inputs |
기술 입력은 원본 데이터 집합의 열 또는 업스트림 기술의 출력일 수 있습니다. |
|
| maxKeyPhraseCount |
integer (int32) |
반환할 핵심 구 수를 나타내는 숫자입니다. 없는 경우 식별된 모든 핵심 구가 반환됩니다. |
| modelVersion |
string |
Text Analytics 서비스를 호출할 때 사용할 모델의 버전입니다. 지정하지 않으면 기본적으로 사용 가능한 최신 버전으로 설정됩니다. 반드시 필요한 경우가 아니면 이 값을 지정하지 않는 것이 좋습니다. |
| name |
string |
기술 세트 내에서 고유하게 식별하는 기술의 이름입니다. 이름이 정의되지 않은 기술에는 '#' 문자 앞에 접두사로 지정된 기술 배열에서 1부터 시작하는 인덱스의 기본 이름이 지정됩니다. |
| outputs |
기술의 출력은 검색 인덱스의 필드이거나 다른 기술의 입력으로 사용할 수 있는 값입니다. |
KeyPhraseExtractionSkillLanguage
KeyPhraseExtractionSkill에서 입력 텍스트에 대해 지원하는 언어 코드입니다.
| 값 | Description |
|---|---|
| da |
덴마크어 |
| nl |
네덜란드어 |
| en |
English |
| fi |
핀란드어 |
| fr |
프랑스어 |
| de |
German |
| it |
Italian |
| ja |
Japanese |
| ko |
한국어 |
| no |
노르웨이어(복말) |
| pl |
Polish |
| pt-PT |
포르투갈어(포르투갈) |
| pt-BR |
포르투갈어 (브라질) |
| ru |
Russian |
| es |
Spanish |
| sv |
스웨덴어 |
LanguageDetectionSkill
입력 텍스트의 언어를 감지하고 요청에 제출된 모든 문서에 대해 단일 언어 코드를 보고하는 기술입니다. 언어 코드는 분석의 신뢰도를 나타내는 점수와 쌍을 이깁니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
| context |
string |
문서 루트 또는 문서 콘텐츠(예: /document 또는 /document/content)와 같은 작업이 수행되는 수준을 나타냅니다. 기본값은 /document입니다. |
| defaultCountryHint |
string |
언어를 구분할 수 없는 경우 언어 감지 모델에 대한 힌트로 사용할 국가 코드입니다. |
| description |
string |
기술의 입력, 출력 및 사용을 설명하는 기술에 대한 설명입니다. |
| inputs |
기술 입력은 원본 데이터 집합의 열 또는 업스트림 기술의 출력일 수 있습니다. |
|
| modelVersion |
string |
Text Analytics 서비스를 호출할 때 사용할 모델의 버전입니다. 지정하지 않으면 기본적으로 사용 가능한 최신 버전으로 설정됩니다. 반드시 필요한 경우가 아니면 이 값을 지정하지 않는 것이 좋습니다. |
| name |
string |
기술 세트 내에서 고유하게 식별하는 기술의 이름입니다. 이름이 정의되지 않은 기술에는 '#' 문자 앞에 접두사로 지정된 기술 배열에서 1부터 시작하는 인덱스의 기본 이름이 지정됩니다. |
| outputs |
기술의 출력은 검색 인덱스의 필드이거나 다른 기술의 입력으로 사용할 수 있는 값입니다. |
MergeSkill
두 개 이상의 문자열을 단일 통합 문자열로 병합하는 기술로, 선택적 사용자 정의 구분 기호가 각 구성 요소 부분을 구분합니다.
| Name | 형식 | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
|
| context |
string |
문서 루트 또는 문서 콘텐츠(예: /document 또는 /document/content)와 같은 작업이 수행되는 수준을 나타냅니다. 기본값은 /document입니다. |
|
| description |
string |
기술의 입력, 출력 및 사용을 설명하는 기술에 대한 설명입니다. |
|
| inputs |
기술 입력은 원본 데이터 집합의 열 또는 업스트림 기술의 출력일 수 있습니다. |
||
| insertPostTag |
string |
태그는 병합된 텍스트의 끝을 나타냅니다. 기본적으로 태그는 빈 공간입니다. |
|
| insertPreTag |
string |
태그는 병합된 텍스트의 시작을 나타냅니다. 기본적으로 태그는 빈 공간입니다. |
|
| name |
string |
기술 세트 내에서 고유하게 식별하는 기술의 이름입니다. 이름이 정의되지 않은 기술에는 '#' 문자 앞에 접두사로 지정된 기술 배열에서 1부터 시작하는 인덱스의 기본 이름이 지정됩니다. |
|
| outputs |
기술의 출력은 검색 인덱스의 필드이거나 다른 기술의 입력으로 사용할 수 있는 값입니다. |
OcrLineEnding
OCR 기술에서 인식하는 텍스트 줄 사이에 사용할 문자 시퀀스를 정의합니다. 기본값은 "space"입니다.
| 값 | Description |
|---|---|
| space |
줄은 단일 공백 문자로 구분됩니다. |
| carriageReturn |
행은 캐리지 리턴('\r') 문자로 구분됩니다. |
| lineFeed |
줄은 단일 줄 바꿈('\n') 문자로 구분됩니다. |
| carriageReturnLineFeed |
줄은 캐리지 리턴과 줄 바꿈('\r\n') 문자로 구분됩니다. |
OcrSkill
이미지 파일에서 텍스트를 추출하는 기술입니다.
| Name | 형식 | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
|
| context |
string |
문서 루트 또는 문서 콘텐츠(예: /document 또는 /document/content)와 같은 작업이 수행되는 수준을 나타냅니다. 기본값은 /document입니다. |
|
| defaultLanguageCode |
사용할 언어 코드를 나타내는 값입니다. 기본값은 |
||
| description |
string |
기술의 입력, 출력 및 사용을 설명하는 기술에 대한 설명입니다. |
|
| detectOrientation |
boolean |
False |
방향 검색을 켜거나 설정하지 않음을 나타내는 값입니다. 기본값은 false입니다. |
| inputs |
기술 입력은 원본 데이터 집합의 열 또는 업스트림 기술의 출력일 수 있습니다. |
||
| lineEnding |
OCR 기술에서 인식하는 텍스트 줄 사이에 사용할 문자 시퀀스를 정의합니다. 기본값은 "space"입니다. |
||
| name |
string |
기술 세트 내에서 고유하게 식별하는 기술의 이름입니다. 이름이 정의되지 않은 기술에는 '#' 문자 앞에 접두사로 지정된 기술 배열에서 1부터 시작하는 인덱스의 기본 이름이 지정됩니다. |
|
| outputs |
기술의 출력은 검색 인덱스의 필드이거나 다른 기술의 입력으로 사용할 수 있는 값입니다. |
OcrSkillLanguage
OcrSkill에서 입력할 수 있도록 지원되는 언어 코드입니다.
| 값 | Description |
|---|---|
| af |
아프리칸스어 |
| sq |
알바니아어 |
| anp |
앙기카어(데바나기리어) |
| ar |
Arabic |
| ast |
아스투리아스어 |
| awa |
Awadhi-Hindi(데바나기리어) |
| az |
아제르바이잔어(라틴어) |
| bfy |
Bagheli |
| eu |
바스크어 |
| be |
벨로루시어(키릴 자모 및 라틴어) |
| be-cyrl |
벨로루시어(키릴 자모) |
| be-latn |
벨로루시어(라틴어) |
| bho |
Bhojpuri-Hindi(데바나기리어) |
| bi |
비슬라마어 |
| brx |
Bodo(데바나기리어) |
| bs |
보스니아어(라틴 문자) |
| bra |
Brajbha |
| br |
브르타뉴어 |
| bg |
불가리아어 |
| bns |
Bundeli |
| bua |
부랴트어(키릴 자모) |
| ca |
카탈로니아어 |
| ceb |
세부아노어 |
| rab |
Chamling |
| ch |
차모로어 |
| hne |
Chhattisgarhi(데바나기리어) |
| zh-Hans |
중국어 간체 |
| zh-Hant |
중국어 번체 |
| kw |
콘월어 |
| co |
코르시카어 |
| crh |
크림 타타르어(라틴어) |
| hr |
크로아티아어 |
| cs |
체코어 |
| da |
덴마크어 |
| prs |
Dari |
| dhi |
Dhimal(데바나기리어) |
| doi |
Dogri(데바나기리어) |
| nl |
네덜란드어 |
| en |
English |
| myv |
에르자어(키릴 자모) |
| et |
Estonian |
| fo |
페로어 |
| fj |
피지어 |
| fil |
필리핀어 |
| fi |
핀란드어 |
| fr |
프랑스어 |
| fur |
프룰리안 |
| gag |
가가우즈어(라틴어) |
| gl |
갈리시아어 |
| de |
German |
| gil |
길버트어 |
| gon |
Gondi(데바나기리어) |
| el |
그리스어 |
| kl |
그린란드어 |
| gvr |
Gurung(데바나기리어) |
| ht |
아이티 크리올 |
| hlb |
Halbi(데바나기리어) |
| hni |
하니어 |
| bgc |
Haryanvi |
| haw |
하와이어 |
| hi |
힌디어 |
| mww |
몽 다오어(라틴어) |
| hoc |
호(데바나기리) |
| hu |
Hungarian |
| is |
아이슬란드어 |
| smn |
이나리 사미어 |
| id |
Indonesian |
| ia |
국제어 |
| iu |
이누크티투트어 (라틴어) |
| ga |
아일랜드어 |
| it |
Italian |
| ja |
Japanese |
| Jns |
Jaunsari(데바나기리어) |
| jv |
자바어 |
| kea |
카보베르디아누 |
| kac |
카친어(라틴어) |
| xnr |
Kangri(데바나기리어) |
| krc |
카라차이발카르어 |
| kaa-cyrl |
카라칼파크어(키릴 자모) |
| kaa |
카라칼파크어(라틴어) |
| csb |
카슈비아어 |
| kk-cyrl |
카자흐어(키릴 자모) |
| kk-latn |
카자흐어(라틴어) |
| klr |
칼링 |
| kha |
카시어 |
| quc |
키체어 |
| ko |
한국어 |
| kfq |
Korku |
| kpy |
코랴크어 |
| kos |
코스라에어 |
| kum |
쿠믹어(키릴 자모) |
| ku-arab |
쿠르드어(아랍어) |
| ku-latn |
쿠르드어(라틴 문자) |
| kru |
쿠루흐어(데바나기리어) |
| ky |
키르기스어(키릴 자모) |
| lkt |
라코타어 |
| la |
라틴어 |
| lt |
리투아니아어 |
| dsb |
저지 소르브어 |
| smj |
룰레 사미어 |
| lb |
룩셈부르크어 |
| bfz |
Mahasu Pahari(데바나기리어) |
| ms |
말레이어(라틴 문자) |
| mt |
몰타어 |
| kmj |
Malto(데바나기리어) |
| gv |
맹크스어 |
| mi |
마오리어 |
| mr |
마라티어 |
| mn |
몽골어(키릴 자모) |
| cnr-cyrl |
몬테네그린어(키릴 자모) |
| cnr-latn |
몬테네그린어(라틴어) |
| nap |
나폴리어 |
| ne |
네팔어 |
| niu |
니우에안어 |
| nog |
노가이어 |
| sme |
북부 사미어(라틴어) |
| nb |
노르웨이어 |
| no |
노르웨이어 |
| oc |
오크어 |
| os |
오세트어 |
| ps |
파슈토어 |
| fa |
Persian |
| pl |
Polish |
| pt |
포르투갈어 |
| pa |
펀잡어(아랍어) |
| ksh |
리프아리안어 |
| ro |
루마니아어 |
| rm |
로망슈어 |
| ru |
Russian |
| sck |
Sadri(데바나기리어) |
| sm |
사모아어(라틴어) |
| sa |
산스크리트어(데바나기리) |
| sat |
산탈리(데바나기리) |
| sco |
스코틀랜드어 |
| gd |
스코틀랜드 게일어 |
| sr |
세르비아어(라틴 문자) |
| sr-Cyrl |
세르비아어(키릴 문자) |
| sr-Latn |
세르비아어(라틴 문자) |
| xsr |
Sherpa(데바나기리어) |
| srx |
Sirmauri(데바나기리어) |
| sms |
스콜트 사미어 |
| sk |
슬로바키아어 |
| sl |
슬로베니아어 |
| so |
소말리어(아랍어) |
| sma |
남부 사미어 |
| es |
Spanish |
| sw |
스와힐리어(라틴어) |
| sv |
스웨덴어 |
| tg |
타지크어(키릴 자모) |
| tt |
타타르어 (라틴어) |
| tet |
테툼어 |
| thf |
탕미 |
| to |
통가어 |
| tr |
터키어 |
| tk |
투르크멘어(라틴어) |
| tyv |
투반어 |
| hsb |
고지대 슬라브어 |
| ur |
우르두어 |
| ug |
위구르어(아랍어) |
| uz-arab |
우즈베키스탄어(아랍어) |
| uz-cyrl |
우즈베크어(키릴 자모) |
| uz |
우즈베크어(라틴 문자) |
| vo |
볼라퓌크어 |
| wae |
Walser |
| cy |
웨일스어 |
| fy |
서 프리지아어 |
| yua |
유카텍 마야어 |
| za |
장족어 |
| zu |
줄루어 |
| unk |
알 수 없음(모두) |
OutputFieldMappingEntry
기술에 대한 출력 필드 매핑입니다.
| Name | 형식 | Description |
|---|---|---|
| name |
string |
스킬에 의해 정의된 출력의 이름입니다. |
| targetName |
string |
출력의 대상 이름입니다. 선택 사항이며 기본값은 name입니다. |
PIIDetectionSkill
Text Analytics API를 사용하면 입력된 텍스트에서 개인 정보를 추출하고 이를 가릴 수 있는 옵션을 제공합니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
| context |
string |
문서 루트 또는 문서 콘텐츠(예: /document 또는 /document/content)와 같은 작업이 수행되는 수준을 나타냅니다. 기본값은 /document입니다. |
| defaultLanguageCode |
string |
사용할 언어 코드를 나타내는 값입니다. 기본값은 |
| description |
string |
기술의 입력, 출력 및 사용을 설명하는 기술에 대한 설명입니다. |
| domain |
string |
지정된 경우 엔터티 범주의 하위 집합만 포함하도록 PII 도메인을 설정합니다. 가능한 값은 'phi', 'none'입니다. 기본값은 'none'입니다. |
| inputs |
기술 입력은 원본 데이터 집합의 열 또는 업스트림 기술의 출력일 수 있습니다. |
|
| maskingCharacter |
string maxLength: 1 |
maskingMode 매개 변수가 대체되도록 설정된 경우 텍스트를 마스킹하는 데 사용되는 문자입니다. 기본값은 '*'입니다. |
| maskingMode |
입력 텍스트에서 검색된 개인 정보를 마스킹하는 다양한 방법을 제공하는 매개 변수입니다. 기본값은 'none'입니다. |
|
| minimumPrecision |
number (double) minimum: 0maximum: 1 |
신뢰도 점수가 지정된 값보다 큰 엔터티만 포함하는 데 사용되는 0에서 1 사이의 값입니다. 설정하지 않거나(기본값) 명시적으로 null로 설정하면 모든 엔터티가 포함됩니다. |
| modelVersion |
string |
Text Analytics 서비스를 호출할 때 사용할 모델의 버전입니다. 지정하지 않으면 기본적으로 사용 가능한 최신 버전으로 설정됩니다. 반드시 필요한 경우가 아니면 이 값을 지정하지 않는 것이 좋습니다. |
| name |
string |
기술 세트 내에서 고유하게 식별하는 기술의 이름입니다. 이름이 정의되지 않은 기술에는 '#' 문자 앞에 접두사로 지정된 기술 배열에서 1부터 시작하는 인덱스의 기본 이름이 지정됩니다. |
| outputs |
기술의 출력은 검색 인덱스의 필드이거나 다른 기술의 입력으로 사용할 수 있는 값입니다. |
|
| piiCategories |
string[] |
추출하고 마스킹해야 하는 PII 엔터티 범주 목록입니다. |
PIIDetectionSkillMaskingMode
입력 텍스트에서 검색된 개인 정보를 마스킹하는 데 사용할 maskingMode를 나타내는 문자열입니다.
| 값 | Description |
|---|---|
| none |
마스킹이 발생하지 않으며 maskedText 출력이 반환되지 않습니다. |
| replace |
감지된 엔터티를 maskingCharacter 매개변수에 지정된 문자로 바꿉니다. 오프셋이 입력 텍스트와 출력 maskedText 모두에 올바르게 해당하도록 문자는 감지된 엔터티의 길이까지 반복됩니다. |
SearchIndexerDataNoneIdentity
데이터 원본의 ID 속성을 지웁니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
ID 유형을 지정하는 URI 조각입니다. |
SearchIndexerDataUserAssignedIdentity
사용할 데이터 원본의 ID를 지정합니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
ID 유형을 지정하는 URI 조각입니다. |
| userAssignedIdentity |
string |
사용자 할당 관리 식별의 완전 자격화된 Azure 자원 ID는 일반적으로 "/subscriptions/12345678-1234-1234-1234567890ab/resourceGroups/rg/providers/Microsoft. ManagedIdentity/userAssignedIdentities/myId"라는 이름이 검색 서비스에 할당되었어야 했습니다. |
SearchIndexerIndexProjection
보조 검색 인덱스에 대한 추가 프로젝션 정의입니다.
| Name | 형식 | Description |
|---|---|---|
| parameters |
인덱스 프로젝션 관련 구성 속성의 사전입니다. 각 이름은 특정 속성의 이름입니다. 각 값은 기본 형식이어야 합니다. |
|
| selectors |
보조 검색 인덱스에 대해 수행할 프로젝션 목록입니다. |
SearchIndexerIndexProjectionSelector
지정된 검색 인덱스로 저장할 데이터에 대한 설명입니다.
| Name | 형식 | Description |
|---|---|---|
| mappings |
프로젝션에 대한 매핑 또는 대상 인덱스의 필드에 매핑해야 하는 원본입니다. |
|
| parentKeyFieldName |
string |
상위 문서의 키 값을 매핑할 검색 인덱스의 필드 이름입니다. 키 필드가 아닌 필터링 가능한 문자열 필드여야 합니다. |
| sourceContext |
string |
프로젝션의 원본 컨텍스트입니다. 문서가 여러 하위 문서로 분할되는 카디널리티를 나타냅니다. |
| targetIndexName |
string |
프로젝션할 검색 인덱스의 이름입니다. '키워드' 분석기가 설정된 키 필드가 있어야 합니다. |
SearchIndexerIndexProjectionsParameters
인덱스 프로젝션 관련 구성 속성의 사전입니다. 각 이름은 특정 속성의 이름입니다. 각 값은 기본 형식이어야 합니다.
| Name | 형식 | Description |
|---|---|---|
| projectionMode |
인덱서의 나머지 부분과 관련된 인덱스 프로젝션의 동작을 정의합니다. |
SearchIndexerKnowledgeStore
보강된 데이터의 Azure Blob, 테이블 또는 파일에 대한 추가 프로젝션 정의입니다.
| Name | 형식 | Description |
|---|---|---|
| identity | SearchIndexerDataIdentity: |
지식 저장소 예측을 작성할 때 Azure Storage와의 연결에 사용되는 사용자 지정 관리 신원입니다. 만약 연결 문자열이 신원(ResourceId)을 나타내고 명시되어 있지 않으면, 시스템이 할당한 관리 신원이 사용됩니다. 인덱서 업데이트 시 ID가 지정되지 않은 경우 값은 변경되지 않은 상태로 유지됩니다. "none"으로 설정하면 이 속성의 값이 지워집니다. |
| parameters |
지식 저장소별 구성 속성의 사전입니다. 각 이름은 특정 속성의 이름입니다. 각 값은 기본 형식이어야 합니다. |
|
| projections |
인덱싱 중에 수행할 추가 프로젝션 목록입니다. |
|
| storageConnectionString |
string |
스토리지 계정 투영에 연결되는 연결 문자열은 저장됩니다. |
SearchIndexerKnowledgeStoreFileProjectionSelector
Azure Files에 저장할 데이터를 위한 프로젝션 정의.
| Name | 형식 | Description |
|---|---|---|
| generatedKeyName |
string |
프로젝션을 저장할 생성된 키의 이름입니다. |
| inputs |
복잡한 투영을 위한 중첩된 입력. |
|
| referenceKeyName |
string |
다른 투영에 대한 참조 키의 이름입니다. |
| source |
string |
프로젝트에 대한 소스 데이터. |
| sourceContext |
string |
복잡한 프로젝션에 대한 소스 컨텍스트입니다. |
| storageContainer |
string |
프로젝션을 저장할 Blob 컨테이너입니다. |
SearchIndexerKnowledgeStoreObjectProjectionSelector
Azure Blob에 저장할 데이터를 위한 프로젝션 정의.
| Name | 형식 | Description |
|---|---|---|
| generatedKeyName |
string |
프로젝션을 저장할 생성된 키의 이름입니다. |
| inputs |
복잡한 투영을 위한 중첩된 입력. |
|
| referenceKeyName |
string |
다른 투영에 대한 참조 키의 이름입니다. |
| source |
string |
프로젝트에 대한 소스 데이터. |
| sourceContext |
string |
복잡한 프로젝션에 대한 소스 컨텍스트입니다. |
| storageContainer |
string |
프로젝션을 저장할 Blob 컨테이너입니다. |
SearchIndexerKnowledgeStoreParameters
지식 저장소별 구성 속성의 사전입니다. 각 이름은 특정 속성의 이름입니다. 각 값은 기본 형식이어야 합니다.
| Name | 형식 | Default value | Description |
|---|---|---|---|
| synthesizeGeneratedKeyName |
boolean |
False |
프로젝션이 생성된 키 이름이 아직 없는 경우 합성해야 하는지 여부입니다. |
SearchIndexerKnowledgeStoreProjection
다양한 프로젝션 선택기에 대한 컨테이너 개체입니다.
| Name | 형식 | Description |
|---|---|---|
| files |
Azure 파일 저장소로의 프로젝션. |
|
| objects |
Azure Blob 저장소로의 투영. |
|
| tables |
Azure 테이블 저장소로의 프로젝션. |
SearchIndexerKnowledgeStoreTableProjectionSelector
Azure Tables에 저장할 데이터 설명.
| Name | 형식 | Description |
|---|---|---|
| generatedKeyName |
string |
프로젝션을 저장할 생성된 키의 이름입니다. |
| inputs |
복잡한 투영을 위한 중첩된 입력. |
|
| referenceKeyName |
string |
다른 투영에 대한 참조 키의 이름입니다. |
| source |
string |
프로젝트에 대한 소스 데이터. |
| sourceContext |
string |
복잡한 프로젝션에 대한 소스 컨텍스트입니다. |
| tableName |
string |
projected data를 저장할 Azure 테이블의 이름. |
SearchIndexerSkillset
기술 목록입니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.etag |
string |
기술 세트의 ETag입니다. |
| cognitiveServices | CognitiveServicesAccount: |
스킬 실행 시 사용할 Azure AI 서비스에 대한 자세한 내용입니다. |
| description |
string |
기술 세트에 대한 설명입니다. |
| encryptionKey |
Azure Key Vault에서 생성하는 암호화 키에 대한 설명입니다. 이 키는 Microsoft조차도 당신의 스킬셋 정의를 복호화할 수 없다는 완전한 확신을 원할 때 기술 정의에 대해 추가적인 암호화 상태를 제공하는 데 사용됩니다. 기술 세트 정의를 암호화한 후에는 항상 암호화된 상태로 유지됩니다. 검색 서비스는 이 속성을 null로 설정하려는 시도를 무시합니다. 암호화 키를 회전하려는 경우 필요에 따라 이 속성을 변경할 수 있습니다. 기술 세트 정의는 영향을 받지 않습니다. 고객 관리형 키를 사용한 암호화는 무료 검색 서비스에 사용할 수 없으며 2019년 1월 1일 이후 생성된 유료 서비스에만 사용할 수 있습니다. |
|
| indexProjections |
보조 검색 인덱스에 대한 추가 프로젝션 정의입니다. |
|
| knowledgeStore |
Azure 블롭, 테이블 또는 풍부 데이터의 파일에 대한 추가 투영 정의. |
|
| name |
string |
기술 세트의 이름입니다. |
| skills |
SearchIndexerSkill[]:
|
기술 세트의 기술 목록입니다. |
SearchResourceEncryptionKey
Azure Key Vault in customer-managed encryption key. 만들고 관리하는 키를 사용하여 인덱스 및 동의어 맵과 같은 미사용 데이터를 암호화하거나 복호화할 수 있습니다.
| Name | 형식 | Description |
|---|---|---|
| accessCredentials.applicationId |
string |
데이터 암호화 시 사용할 Azure Key Vault에 대한 필요한 접근 권한을 부여받은 AAD Application ID입니다. 애플리케이션 ID를 AAD 애플리케이션의 개체 ID와 혼동해서는 안 됩니다. |
| accessCredentials.applicationSecret |
string |
지정된 AAD 애플리케이션의 인증 키입니다. |
| identity | SearchIndexerDataIdentity: |
이 암호화 키에 사용할 명시적 관리 ID입니다. 지정하지 않고 액세스 자격 증명 속성이 null인 경우 시스템 할당 관리 ID가 사용됩니다. 리소스를 업데이트할 때 명시적 ID가 지정되지 않은 경우 변경되지 않은 상태로 유지됩니다. "none"을 지정하면 이 속성의 값이 지워집니다. |
| keyVaultKeyName |
string |
데이터를 정지할 때 암호화하는 데 사용할 Azure Key Vault 키의 이름입니다. |
| keyVaultKeyVersion |
string |
Azure Key Vault 키의 저장 시 데이터를 암호화하는 데 사용할 버전입니다. |
| keyVaultUri |
string |
Azure Key Vault의 URI, 즉 DNS 이름으로, 데이터를 정지 상태에서 암호화하는 데 사용할 키를 포함합니다. URI |
SentimentSkillLanguage
SentimentSkill에서 입력 텍스트에 대해 지원하는 언어 코드입니다.
| 값 | Description |
|---|---|
| da |
덴마크어 |
| nl |
네덜란드어 |
| en |
English |
| fi |
핀란드어 |
| fr |
프랑스어 |
| de |
German |
| el |
그리스어 |
| it |
Italian |
| no |
노르웨이어(복말) |
| pl |
Polish |
| pt-PT |
포르투갈어(포르투갈) |
| ru |
Russian |
| es |
Spanish |
| sv |
스웨덴어 |
| tr |
터키어 |
SentimentSkillV3
Text Analytics API를 사용하여 비구조화된 텍스트를 평가하고, 각 레코드에 대해 문장 및 문서 수준에서 서비스가 찾은 가장 높은 신뢰도에 따라 '부정적', '중립적', '긍정적' 같은 감정 라벨을 제공합니다.
| Name | 형식 | Default value | Description |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
|
| context |
string |
문서 루트 또는 문서 콘텐츠(예: /document 또는 /document/content)와 같은 작업이 수행되는 수준을 나타냅니다. 기본값은 /document입니다. |
|
| defaultLanguageCode |
사용할 언어 코드를 나타내는 값입니다. 기본값은 |
||
| description |
string |
기술의 입력, 출력 및 사용을 설명하는 기술에 대한 설명입니다. |
|
| includeOpinionMining |
boolean |
False |
참으로 설정하면, 스킬 출력에는 의견 마이닝을 위한 Text Analytics의 정보, 즉 텍스트 내 목표(명사 또는 동사)와 그에 따른 평가(형용사)가 포함됩니다. 기본값은 false입니다. |
| inputs |
기술 입력은 원본 데이터 집합의 열 또는 업스트림 기술의 출력일 수 있습니다. |
||
| modelVersion |
string |
Text Analytics 서비스를 호출할 때 사용할 모델의 버전입니다. 지정하지 않으면 기본적으로 사용 가능한 최신 버전으로 설정됩니다. 반드시 필요한 경우가 아니면 이 값을 지정하지 않는 것이 좋습니다. |
|
| name |
string |
기술 세트 내에서 고유하게 식별하는 기술의 이름입니다. 이름이 정의되지 않은 기술에는 '#' 문자 앞에 접두사로 지정된 기술 배열에서 1부터 시작하는 인덱스의 기본 이름이 지정됩니다. |
|
| outputs |
기술의 출력은 검색 인덱스의 필드이거나 다른 기술의 입력으로 사용할 수 있는 값입니다. |
ShaperSkill
출력을 재구성하기 위한 기술입니다. 복합 필드(다중 파트 필드라고도 함)를 지원하는 복합 형식을 만듭니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
| context |
string |
문서 루트 또는 문서 콘텐츠(예: /document 또는 /document/content)와 같은 작업이 수행되는 수준을 나타냅니다. 기본값은 /document입니다. |
| description |
string |
기술의 입력, 출력 및 사용을 설명하는 기술에 대한 설명입니다. |
| inputs |
기술 입력은 원본 데이터 집합의 열 또는 업스트림 기술의 출력일 수 있습니다. |
|
| name |
string |
기술 세트 내에서 고유하게 식별하는 기술의 이름입니다. 이름이 정의되지 않은 기술에는 '#' 문자 앞에 접두사로 지정된 기술 배열에서 1부터 시작하는 인덱스의 기본 이름이 지정됩니다. |
| outputs |
기술의 출력은 검색 인덱스의 필드이거나 다른 기술의 입력으로 사용할 수 있는 값입니다. |
SplitSkill
문자열을 텍스트 청크로 분할하는 기술입니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
| azureOpenAITokenizerParameters |
단위가 azureOpenAITokens로 설정된 경우에만 적용됩니다. 지정된 경우 splitSkill은 토큰화를 수행할 때 이러한 매개변수를 사용합니다. 매개 변수는 유효한 'encoderModelName' 및 선택적 'allowedSpecialTokens' 속성입니다. |
|
| context |
string |
문서 루트 또는 문서 콘텐츠(예: /document 또는 /document/content)와 같은 작업이 수행되는 수준을 나타냅니다. 기본값은 /document입니다. |
| defaultLanguageCode |
사용할 언어 코드를 나타내는 값입니다. 기본값은 |
|
| description |
string |
기술의 입력, 출력 및 사용을 설명하는 기술에 대한 설명입니다. |
| inputs |
기술 입력은 원본 데이터 집합의 열 또는 업스트림 기술의 출력일 수 있습니다. |
|
| maximumPageLength |
integer (int32) |
원하는 최대 페이지 길이입니다. 기본값은 10000입니다. |
| maximumPagesToTake |
integer (int32) |
textSplitMode가 'pages'로 설정된 경우에만 적용됩니다. 지정된 경우 SplitSkill은 각 문서에서 몇 개의 초기 페이지만 필요할 때 성능을 향상시키기 위해 첫 번째 'maximumPagesToTake' 페이지를 처리한 후 분할을 중단합니다. |
| name |
string |
기술 세트 내에서 고유하게 식별하는 기술의 이름입니다. 이름이 정의되지 않은 기술에는 '#' 문자 앞에 접두사로 지정된 기술 배열에서 1부터 시작하는 인덱스의 기본 이름이 지정됩니다. |
| outputs |
기술의 출력은 검색 인덱스의 필드이거나 다른 기술의 입력으로 사용할 수 있는 값입니다. |
|
| pageOverlapLength |
integer (int32) |
textSplitMode가 'pages'로 설정된 경우에만 적용됩니다. 지정된 경우 n+1번째 청크는 n번째 청크 끝에서 이 수의 문자/토큰으로 시작합니다. |
| textSplitMode |
수행할 분할 모드를 나타내는 값입니다. |
|
| unit |
textSplitMode가 pages로 설정된 경우에만 적용됩니다. 두 가지 가능한 값이 있습니다. 값을 선택하면 길이(maximumPageLength 및 pageOverlapLength) 측정값이 결정됩니다. 기본값은 'characters'이며, 이는 길이가 문자별로 측정됨을 의미합니다. |
SplitSkillEncoderModelName
어떤 토큰라이저를 사용해야 할지를 나타내는 값입니다.
| 값 | Description |
|---|---|
| r50k_base |
일반적인 자연어 처리 작업에 자주 사용되는 50,000개의 토큰 어휘로 학습된 기본 모델을 나타냅니다. |
| p50k_base |
프롬프트 기반 작업에 최적화된 50,000개의 토큰 어휘가 있는 기본 모델입니다. |
| p50k_edit |
p50k_base와 유사하지만 50,000개의 토큰 어휘로 작업을 편집하거나 바꾸기 위해 미세 조정되었습니다. |
| cl100k_base |
100,000개의 토큰 어휘가 있는 기본 모델입니다. |
SplitSkillLanguage
SplitSkill에서 입력 텍스트에 대해 지원하는 언어 코드입니다.
| 값 | Description |
|---|---|
| am |
암하라어 |
| bs |
Bosnian |
| cs |
체코어 |
| da |
덴마크어 |
| de |
German |
| en |
English |
| es |
Spanish |
| et |
Estonian |
| fi |
핀란드어 |
| fr |
프랑스어 |
| he |
히브리어 |
| hi |
힌디어 |
| hr |
크로아티아어 |
| hu |
Hungarian |
| id |
Indonesian |
| is |
아이슬란드어 |
| it |
Italian |
| ja |
Japanese |
| ko |
한국어 |
| lv |
Latvian |
| nb |
노르웨이어 |
| nl |
네덜란드어 |
| pl |
Polish |
| pt |
포르투갈어(포르투갈) |
| pt-br |
포르투갈어 (브라질) |
| ru |
Russian |
| sk |
슬로바키아어 |
| sl |
슬로베니아어 |
| sr |
세르비아어 |
| sv |
스웨덴어 |
| tr |
터키어 |
| ur |
우르두어 |
| zh |
중국어 (간체) |
SplitSkillUnit
사용할 단위를 나타내는 값입니다.
| 값 | Description |
|---|---|
| characters |
길이는 문자별로 측정됩니다. |
| azureOpenAITokens |
길이는 tiktoken 라이브러리의 AzureOpenAI 토크나이저로 측정됩니다. |
TextSplitMode
수행할 분할 모드를 나타내는 값입니다.
| 값 | Description |
|---|---|
| pages |
텍스트를 개별 페이지로 분할합니다. |
| sentences |
텍스트를 개별 문장으로 분할합니다. |
TextTranslationSkill
텍스트를 한 언어에서 다른 언어로 번역하는 기술입니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
| context |
string |
문서 루트 또는 문서 콘텐츠(예: /document 또는 /document/content)와 같은 작업이 수행되는 수준을 나타냅니다. 기본값은 /document입니다. |
| defaultFromLanguageCode |
원본 언어를 명시적으로 지정하지 않는 문서의 문서를 번역할 언어 코드입니다. |
|
| defaultToLanguageCode |
to 언어를 명시적으로 지정하지 않는 문서에 대해 문서를 번역할 언어 코드입니다. |
|
| description |
string |
기술의 입력, 출력 및 사용을 설명하는 기술에 대한 설명입니다. |
| inputs |
기술 입력은 원본 데이터 집합의 열 또는 업스트림 기술의 출력일 수 있습니다. |
|
| name |
string |
기술 세트 내에서 고유하게 식별하는 기술의 이름입니다. 이름이 정의되지 않은 기술에는 '#' 문자 앞에 접두사로 지정된 기술 배열에서 1부터 시작하는 인덱스의 기본 이름이 지정됩니다. |
| outputs |
기술의 출력은 검색 인덱스의 필드이거나 다른 기술의 입력으로 사용할 수 있는 값입니다. |
|
| suggestedFrom |
fromLanguageCode 입력이나 defaultFromLanguageCode 매개 변수가 제공되지 않고 자동 언어 검색에 실패한 경우 문서를 번역할 언어 코드입니다. 기본값은 |
TextTranslationSkillLanguage
TextTranslationSkill에서 입력 텍스트에 대해 지원하는 언어 코드입니다.
| 값 | Description |
|---|---|
| af |
아프리칸스어 |
| ar |
Arabic |
| bn |
벵골어 |
| bs |
보스니아어(라틴 문자) |
| bg |
불가리아어 |
| yue |
광둥어(번체) |
| ca |
카탈로니아어 |
| zh-Hans |
중국어 간체 |
| zh-Hant |
중국어 번체 |
| hr |
크로아티아어 |
| cs |
체코어 |
| da |
덴마크어 |
| nl |
네덜란드어 |
| en |
English |
| et |
Estonian |
| fj |
피지어 |
| fil |
필리핀어 |
| fi |
핀란드어 |
| fr |
프랑스어 |
| de |
German |
| el |
그리스어 |
| ht |
아이티 크리올 |
| he |
히브리어 |
| hi |
힌디어 |
| mww |
몽 다오어 |
| hu |
Hungarian |
| is |
아이슬란드어 |
| id |
Indonesian |
| it |
Italian |
| ja |
Japanese |
| sw |
Kiswahili |
| tlh |
클링곤어 |
| tlh-Latn |
클링온어(라틴 스크립트) |
| tlh-Piqd |
클링온어(클링온 문자) |
| ko |
한국어 |
| lv |
Latvian |
| lt |
리투아니아어 |
| mg |
말라가시어 |
| ms |
말레이어 |
| mt |
몰타어 |
| nb |
노르웨이어 |
| fa |
Persian |
| pl |
Polish |
| pt |
포르투갈어 |
| pt-br |
포르투갈어 (브라질) |
| pt-PT |
포르투갈어(포르투갈) |
| otq |
케레타로 오토미어 |
| ro |
루마니아어 |
| ru |
Russian |
| sm |
사모아어 |
| sr-Cyrl |
세르비아어(키릴 문자) |
| sr-Latn |
세르비아어(라틴 문자) |
| sk |
슬로바키아어 |
| sl |
슬로베니아어 |
| es |
Spanish |
| sv |
스웨덴어 |
| ty |
타히티어 |
| ta |
타밀어 |
| te |
텔루구어 |
| th |
태국어 |
| to |
통가어 |
| tr |
터키어 |
| uk |
우크라이나어 |
| ur |
우르두어 |
| vi |
베트남어 |
| cy |
웨일스어 |
| yua |
유카텍 마야어 |
| ga |
아일랜드어 |
| kn |
Kannada |
| mi |
마오리어 |
| ml |
말라얄람어 |
| pa |
펀잡어 |
VisionVectorizeSkill
Azure AI Services Vision Vectorize API를 사용해 주어진 이미지나 텍스트 입력에 대해 벡터 임베딩을 생성할 수 있습니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
| context |
string |
문서 루트 또는 문서 콘텐츠(예: /document 또는 /document/content)와 같은 작업이 수행되는 수준을 나타냅니다. 기본값은 /document입니다. |
| description |
string |
기술의 입력, 출력 및 사용을 설명하는 기술에 대한 설명입니다. |
| inputs |
기술 입력은 원본 데이터 집합의 열 또는 업스트림 기술의 출력일 수 있습니다. |
|
| modelVersion |
string |
AI Services Vision 서비스를 호출할 때 사용할 모델의 버전입니다. 지정하지 않으면 기본적으로 사용 가능한 최신 버전으로 설정됩니다. |
| name |
string |
기술 세트 내에서 고유하게 식별하는 기술의 이름입니다. 이름이 정의되지 않은 기술에는 '#' 문자 앞에 접두사로 지정된 기술 배열에서 1부터 시작하는 인덱스의 기본 이름이 지정됩니다. |
| outputs |
기술의 출력은 검색 인덱스의 필드이거나 다른 기술의 입력으로 사용할 수 있는 값입니다. |
VisualFeature
반환할 시각적 기능 유형을 나타내는 문자열입니다.
| 값 | Description |
|---|---|
| adult |
성인으로 인식되는 시각적 특징. |
| brands |
상업 브랜드로 인정받는 시각적 특징. |
| categories |
카테고리. |
| description |
Description. |
| faces |
사람의 얼굴로 인식되는 시각적 특징. |
| objects |
객체로 인식되는 시각적 특징. |
| tags |
태그. |
WebApiSkill
Web API 엔드포인트를 호출할 수 있는 기술로, 사용자 지정 코드를 호출하여 기술 세트를 확장할 수 있습니다.
| Name | 형식 | Description |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
파생 형식에 대한 판별자입니다. |
| authIdentity | SearchIndexerDataIdentity: |
아웃바운드 연결에 사용되는 사용자 할당 관리 ID입니다. authResourceId가 제공되고 지정되지 않은 경우 시스템 할당 관리 ID가 사용됩니다. 인덱서 업데이트 시 ID가 지정되지 않은 경우 값은 변경되지 않은 상태로 유지됩니다. "none"으로 설정하면 이 속성의 값이 지워집니다. |
| authResourceId |
string |
Azure 함수나 변환을 제공하는 다른 애플리케이션에서 외부 코드와 연결하는 맞춤형 스킬에 적용됩니다. 이 값은 Azure Active Directory에 등록된 기능이나 앱에 대해 생성된 애플리케이션 ID여야 합니다. 지정된 경우 사용자 지정 기술은 검색 서비스의 관리 ID(시스템 또는 사용자 할당)와 함수 또는 앱의 액세스 토큰을 사용하여 함수 또는 앱에 연결합니다. 이 값을 액세스 토큰의 범위를 만들기 위한 리소스 ID로 사용합니다. |
| batchSize |
integer (int32) |
문서 수를 나타내는 원하는 일괄 처리 크기입니다. |
| context |
string |
문서 루트 또는 문서 콘텐츠(예: /document 또는 /document/content)와 같은 작업이 수행되는 수준을 나타냅니다. 기본값은 /document입니다. |
| degreeOfParallelism |
integer (int32) |
설정된 경우 Web API에 대해 수행할 수 있는 병렬 호출 수입니다. |
| description |
string |
기술의 입력, 출력 및 사용을 설명하는 기술에 대한 설명입니다. |
| httpHeaders |
object |
http 요청을 만드는 데 필요한 헤더입니다. |
| httpMethod |
string |
http 요청에 대한 메서드입니다. |
| inputs |
기술 입력은 원본 데이터 집합의 열 또는 업스트림 기술의 출력일 수 있습니다. |
|
| name |
string |
기술 세트 내에서 고유하게 식별하는 기술의 이름입니다. 이름이 정의되지 않은 기술에는 '#' 문자 앞에 접두사로 지정된 기술 배열에서 1부터 시작하는 인덱스의 기본 이름이 지정됩니다. |
| outputs |
기술의 출력은 검색 인덱스의 필드이거나 다른 기술의 입력으로 사용할 수 있는 값입니다. |
|
| timeout |
string (duration) |
요청에 대해 원하는 시간 제한입니다. 기본값은 30초입니다. |
| uri |
string |
Web API의 URL입니다. |