Indeksator dostępu do zawartości chronionej przez zabezpieczenia sieci platformy Azure

Uwaga

Wyszukiwanie AI platformy Azure jest dostępna za pośrednictwem portalu Azure, interfejsów API REST i Azure SDKs. Jest także podstawą Foundry IQ — zarządzanej warstwy wiedzy, która przekształca treści przedsiębiorstwa w bazy wiedzy wielokrotnego użytku z uwzględnieniem uprawnień dla agentów w portalu Microsoft Foundry.

Jeśli zasoby platformy Azure są wdrażane w sieci wirtualnej platformy Azure, w tym artykule wyjaśniono, w jaki sposób indeksator wyszukiwania może uzyskać dostęp do zawartości chronionej przez zabezpieczenia sieciowe. Opisuje on wzorce ruchu wychodzącego i środowiska wykonywania indeksatora. Obejmuje również zabezpieczenia sieci obsługiwane przez usługę Wyszukiwanie AI platformy Azure i czynniki, które mogą mieć wpływ na strategię zabezpieczeń. Podsumowując, ponieważ usługa Azure Storage jest używana zarówno na potrzeby dostępu do danych, jak i magazynu trwałego, w tym artykule opisano również aspekty sieciowe związane z konektorami wyszukiwania i magazynu.

Szukasz instrukcji krok po kroku? Zobacz Jak skonfigurować reguły zapory, aby umożliwić dostęp indeksatora lub Jak nawiązywać połączenia wychodzące przez prywatny punkt końcowy.

Zasoby dostępne przez indeksatory

Indeksatory usługi Wyszukiwanie AI platformy Azure mogą wykonywać wywołania wychodzące do różnych zasobów platformy Azure w trzech sytuacjach:

  • Połączenia z zewnętrznymi źródłami danych podczas indeksowania
  • Połączenia z zewnętrznym, hermetyzowanym kodem za pomocą zestawu umiejętności obejmującego umiejętności dostosowane do potrzeb.
  • Połączenia z usługą Azure Storage podczas wykonywania zestawu umiejętności, których celem jest buforowanie wzbogaconych danych, zapisywanie stanu sesji debugowania lub zapis do magazynu wiedzy.

Lista wszystkich możliwych typów zasobów platformy Azure, do których indeksator może uzyskać dostęp w typowym przebiegu, znajduje się w poniższej tabeli.

Zasób Cel w procesie indeksowania
Azure Storage (obiekty blob, ADLS Gen2, pliki, tabele) Źródło danych
Azure Storage (Blob, tabela) Zestawy umiejętności (buforowanie procesów wzbogacających, sesje debugowania, projekcje repozytorium wiedzy)
Azure Cosmos DB (różne interfejsy API) Źródło danych
Azure SQL Database Źródło danych
Microsoft OneLake Źródło danych
Program SQL Server na maszynach wirtualnych platformy Azure Źródło danych
SQL Managed Instance Źródło danych
Azure Functions Dołączone do zestawu umiejętności API i używane do hostowania niestandardowych umiejętności API
Azure OpenAI Osadzanie i wykonywanie umiejętności modelu
Microsoft Foundry Wykonywanie umiejętności przez model i rozliczanie bez użycia klucza dla wbudowanych umiejętności

Uwaga

Wyszukiwanie AI platformy Azure wewnętrznie obsługuje przetwarzanie większości wbudowanych umiejętności rozliczanych za pośrednictwem narzędzi Foundry. W przypadku rozliczania bez użycia klucza zestaw umiejętności nawiązuje oddzielne połączenie wychodzące do dołączonego zasobu Foundry. Jeśli dostęp do sieci publicznej jest wyłączony w zasobie Foundry, skonfiguruj udostępniony link prywatny dla połączenia rozliczeniowego. Aby uzyskać szczegółowe informacje o konfiguracji, zobacz Obsługiwane typy zasobów.

Indeksatory łączą się z zasobami przy użyciu następujących metod:

  • Ogólnodostępny punkt końcowy z poświadczeniami
  • Prywatny punkt końcowy korzystający z usługi Azure Private Link
  • Łączenie jako zaufana usługa
  • Nawiązywanie połączenia za pośrednictwem adresowania IP

Jeśli zasób platformy Azure znajduje się w sieci wirtualnej, należy użyć prywatnego punktu końcowego lub adresowania IP, aby umożliwić indeksatorowi połączenia z danymi.

Obsługiwane zabezpieczenia sieci

Zasoby platformy Azure mogą być chronione przy użyciu dowolnej liczby mechanizmów izolacji sieci oferowanych przez platformę Azure. W zależności od zasobu i regionu indeksatory usługi Wyszukiwanie AI platformy Azure mogą wykonywać połączenia wychodzące za pośrednictwem zapór ip i prywatnych punktów końcowych, z zastrzeżeniem ograniczeń wskazanych w poniższej tabeli.

Zasób Ograniczenie adresów IP Prywatny punkt końcowy
Azure Storage na potrzeby indeksowania opartego na tekście (obiektów blob, usługi ADLS Gen2, plików, tabel) Obsługiwane jest tylko wtedy, gdy konto magazynu i usługa wyszukiwania znajdują się w różnych regionach. Obsługiwane
Wzbogacanie sztucznej inteligencji w usłudze Azure Storage (buforowanie, sesje debugowania, magazyn wiedzy) Obsługiwane jest tylko wtedy, gdy konto magazynu i usługa wyszukiwania znajdują się w różnych regionach. Obsługiwane
Azure Cosmos DB for NoSQL Obsługiwane Obsługiwane
Azure Cosmos DB for MongoDB Obsługiwane Nieobsługiwane
Azure Cosmos DB for Apache Gremlin Obsługiwane Nieobsługiwane
Azure SQL Database Obsługiwane Obsługiwane
Program SQL Server na maszynach wirtualnych platformy Azure Obsługiwane Nie dotyczy
SQL Managed Instance Obsługiwane Nie dotyczy
Azure Functions Obsługiwane Obsługiwane tylko w przypadku niektórych warstw Azure Functions.
Azure OpenAI lub Microsoft Foundry Obsługiwane Obsługiwane, ale z ograniczeniami. Zobacz Obsługiwane typy zasobów.

Środowiska wykonywania dostępu do sieci i indeksatora

Usługa Wyszukiwanie AI platformy Azure posiada koncepcję środowiska wykonywania indeksatora, które optymalizuje przetwarzanie na podstawie cech zadania. Istnieją dwa środowiska. Jeśli używasz zapory ip do kontrolowania dostępu do Azure zasobów, wiedza na temat środowisk wykonywania pomaga skonfigurować zakres adresów IP, który obejmuje oba środowiska.

W przypadku dowolnego przebiegu indeksatora usługa Wyszukiwanie AI platformy Azure określa najlepsze środowisko, w którym ma zostać uruchomiony indeksator. W zależności od liczby i typów przydzielonych zadań indeksator jest uruchamiany w jednym z dwóch środowisk:

Środowisko wykonywania opis
Prywatny 1 Wewnętrzny dla usługi wyszukiwania. Indeksatory działające w środowisku prywatnym współdzielą zasoby obliczeniowe z innymi obciążeniami indeksowania i wykonywania zapytań w tej samej usłudze wyszukiwania. Tylko prywatne środowisko wykonywania może używać udostępnionego łącza prywatnego. Aby użyć tego połączenia, jawnie ustaw parametr executionEnvironment na private w indeksatorze. Wybór automatyczny nie jest gwarantowany. Aby uzyskać więcej informacji, zobacz Zagadnienia dotyczące korzystania z prywatnego punktu końcowego.
Multitenant Zarządzane i zabezpieczone przez firmę Microsoft bez dodatkowych kosztów. Nie podlega żadnym przepisom dotyczącym sieci pod kontrolą użytkownika. To środowisko służy do odciążania przetwarzania intensywnie korzystającego z obliczeń, pozostawiając zasoby specyficzne dla usługi dostępne dla rutynowych operacji. Przykłady zadań indeksatora intensywnie korzystających z zasobów obejmują zestawy umiejętności, przetwarzanie dużych dokumentów lub przetwarzanie dużej liczby dokumentów.

1 Aby zapobiec dużemu obciążeniu w prywatnym środowisku wykonywania, indeksatory z więcej niż dwiema umiejętnościami Azure OpenAI Embedding lub Azure Vision multimodal embeddings nie mogą być uruchamiane w tym środowisku.

Konfigurowanie zakresów adresów IP na potrzeby wykonywania indeksatora

W tej sekcji opisano konfigurację zapory ip na potrzeby przyjmowania żądań z obu środowisk wykonywania.

Jeśli zasób platformy Azure znajduje się za zaporą, skonfiguruj reguły ruchu przychodzącego, które przyznają połączenia indeksatora dla wszystkich adresów IP, z których może pochodzić żądanie indeksatora. Obejmuje to adres IP używany przez usługę wyszukiwania oraz adresy IP używane przez środowisko wielodostępne.

  • Aby uzyskać adres IP usługi wyszukiwania (oraz prywatne środowisko wykonawcze), użyj nslookup (lub ping), aby znaleźć w pełni kwalifikowaną nazwę domeny (FQDN) swojej usługi wyszukiwania. Nazwa FQDN usługi wyszukiwania w chmurze publicznej to <service-name>.search.windows.net.

  • Aby uzyskać adresy IP środowisk wielodostępnych, w których może działać indeksator, użyj tagu AzureCognitiveSearch usługi.

    Tagi usług platformy Azure mają opublikowany zakres adresów IP środowisk wielodostępnych dla każdego regionu. Te adresy IP można znaleźć przy użyciu interfejsu API odnajdywania lub pliku JSON do pobrania. Zakresy adresów IP są przydzielane według regionów, dlatego przed rozpoczęciem sprawdź region usługi wyszukiwania.

Konfigurowanie reguł adresów IP dla usługi Azure SQL

Podczas ustawiania reguły adresów IP dla środowiska wielodostępnego niektóre źródła danych SQL obsługują proste podejście do specyfikacji adresów IP. Zamiast wyliczać wszystkie adresy IP w regule, można utworzyć regułę sieciowej grupy zabezpieczeń, która określa AzureCognitiveSearch tag usługi.

Możesz określić tag usługi, jeśli źródło danych to:

Zwróć uwagę, że nawet jeśli określono tag usługi dla reguły IP środowiska wielodostępnego, nadal trzeba jawnie określić regułę ruchu przychodzącego dla środowiska wykonywania prywatnego (czyli sama usługa wyszukiwania), uzyskana za pomocą nslookup metody.

Wybieranie podejścia do łączności

Nie można aprowizować usługi wyszukiwania w określonej sieci wirtualnej, ponieważ nie jest ona uruchamiana natywnie na maszynie wirtualnej. Chociaż niektóre zasoby Azure oferują punkty końcowe usługi sieci wirtualnej, Wyszukiwanie AI platformy Azure nie oferuje tej funkcji. Zaplanuj wdrożenie jednego z następujących podejść.

Metoda Szczegóły
Zabezpiecz połączenie przychodzące do zasobu Azure Skonfiguruj regułę zapory dla ruchu przychodzącego w zasobie platformy Azure, która przyznaje żądania indeksatora dla danych. Konfiguracja zapory powinna zawierać tag usługi wykonywania w środowisku wielodostępnym oraz adres IP usługi wyszukiwania. Zobacz Konfigurowanie reguł zapory, aby zezwolić na dostęp indeksatora.
Połączenie prywatne między usługą Wyszukiwanie AI platformy Azure i zasobem platformy Azure Skonfiguruj udostępniony link prywatny używany wyłącznie przez usługę wyszukiwania pod kątem połączeń z zasobem. Połączenia są przesyłane przez sieć wewnętrzną i pomijają publiczny Internet. Jeśli zasoby są w pełni zablokowane (uruchomione w chronionej sieci wirtualnej lub w inny sposób niedostępne za pośrednictwem połączenia publicznego), prywatny punkt końcowy jest jedynym wyborem. Zobacz Nawiązywanie połączeń wychodzących za pośrednictwem prywatnego punktu końcowego.

Połączenia za pośrednictwem prywatnego punktu końcowego muszą pochodzić ze środowiska wykonywania prywatnego usługi wyszukiwania.

Konfigurowanie zapory ip jest bezpłatne. Prywatny punkt końcowy oparty na usłudze Azure Private Link ma wpływ na rozliczenia. Aby uzyskać szczegółowe informacje, zobacz Cennik usługi Azure Private Link.

Po skonfigurowaniu zabezpieczeń sieci postępuj zgodnie z przypisaniami ról, które określają, którzy użytkownicy i grupy mają dostęp do odczytu i zapisu danych i operacji.

Zagadnienia dotyczące korzystania z prywatnego punktu końcowego

Ta sekcja zawęża opcję połączenia prywatnego.

  • Udostępniony link prywatny wymaga rozliczanej usługi wyszukiwania, gdzie minimalna warstwa to Podstawowa dla indeksowania opartego na tekście lub Standardowa 2 (S2) na potrzeby indeksowania opartego na umiejętnościach. Aby uzyskać szczegółowe informacje, zobacz limity warstw dla liczby prywatnych punktów końcowych .
  • Po utworzeniu udostępnionego łącza prywatnego usługa wyszukiwania zawsze używa go dla każdego połączenia indeksatora z określonym zasobem platformy Azure. Połączenie prywatne jest zablokowane i narzucane wewnętrznie. Nie można pominąć połączenia prywatnego dla połączenia publicznego.

  • Wymaga rozliczanego zasobu usługi Azure Private Link.

  • Wymaga, aby właściciel subskrypcji zatwierdził połączenie prywatnego punktu końcowego.

  • Wymaga wyłączenia wielodostępnego środowiska wykonywania dla indeksatora.

    W tym celu należy ustawić indeksator executionEnvironment na "private". Ten krok gwarantuje, że całe wykonywanie indeksatora jest ograniczone do prywatnego środowiska przydzielonego w usłudze wyszukiwania. To ustawienie jest ograniczone do indeksatora, a nie do usługi wyszukiwania. Jeśli chcesz, aby wszystkie indeksatory łączyły się za pośrednictwem prywatnych punktów końcowych, każda z nich musi mieć następującą konfigurację:

        {
          "name" : "myindexer",
          ... other indexer properties
          "parameters" : {
              ... other parameters
              "configuration" : {
                ... other configuration properties
                "executionEnvironment": "private"
              }
            }
        }
    

Po zatwierdzeniu jednego z prywatnych punktów końcowych do zasobu, indeksatory, które są skonfigurowane jako prywatne, próbują uzyskać dostęp za pośrednictwem łącza prywatnego, które zostało utworzone i zatwierdzone dla zasobu na platformie Azure.

Wyszukiwanie AI platformy Azure weryfikuje, czy podmioty wywołujące prywatny punkt końcowy mają odpowiednio przypisane role. Jeśli na przykład zażądasz połączenia prywatnego punktu końcowego z kontem magazynu z uprawnieniami tylko do odczytu, to wywołanie zostanie odrzucone.

Jeśli prywatny punkt końcowy nie został zatwierdzony lub indeksator nie używał połączenia prywatnego punktu końcowego, w historii wykonywania indeksatora zostanie wyświetlony transientFailure komunikat o błędzie.

Uzupełnienie zabezpieczeń sieci przy użyciu uwierzytelniania tokenów

Zapory i zabezpieczenia sieci są pierwszym krokiem w zapobieganiu nieautoryzowanemu dostępowi do danych i operacji. Autoryzacja powinna być następnym krokiem.

Zalecamy dostęp oparty na rolach, w którym użytkownicy i grupy identyfikatora Entra firmy Microsoft są przypisywane do ról, które określają dostęp do odczytu i zapisu w usłudze. Aby uzyskać opis wbudowanych ról i instrukcji dotyczących tworzenia ról, zobacz Connect to Wyszukiwanie AI platformy Azure using role-based access controls (Nawiązywanie połączenia z usługą Wyszukiwanie AI platformy Azure przy użyciu kontroli dostępu opartej na rolach).

Jeśli nie potrzebujesz uwierzytelniania opartego na kluczach, zalecamy wyłączenie kluczy interfejsu API i używanie przypisań ról wyłącznie.

Dostęp do konta magazynu chronionego przez sieć

Usługa wyszukiwania przechowuje indeksy i listy synonimów. W przypadku innych funkcji wymagających magazynu usługa Wyszukiwanie AI platformy Azure jest zależna od usługi Azure Storage. Buforowanie danych wzbogacających, sesje debugowania i magazyny wiedzy należą do tej kategorii. Lokalizacja każdej usługi oraz wszelkie zabezpieczenia sieciowe zastosowane dla magazynu określają strategię dostępu do danych.

Usługi w tym samym regionie

W usłudze Azure Storage dostęp za pośrednictwem zapory wymaga, aby żądanie pochodziło z innego regionu. Jeśli usługi Azure Storage i Wyszukiwanie AI platformy Azure znajdują się w tym samym regionie, możesz pominąć ograniczenia adresów IP dla konta magazynu, uzyskując dostęp do danych w ramach tożsamości systemowej usługi wyszukiwania.

Istnieją dwie opcje obsługi dostępu do danych przy użyciu tożsamości systemowej:

  • Skonfiguruj wyszukiwanie do uruchomienia jako zaufana usługa i użyj wyjątku dla zaufanej usługi w usłudze Azure Storage.

  • Skonfiguruj regułę wystąpienia zasobu w usłudze Azure Storage, która dopuszcza przychodzące żądania z zasobu Azure.

Powyższe opcje zależą od identyfikatora Entra firmy Microsoft do uwierzytelniania, co oznacza, że połączenie musi zostać nawiązane przy użyciu identyfikatora logowania firmy Microsoft Entra. Obecnie tylko tożsamość zarządzana przypisana przez system usługi Wyszukiwanie AI platformy Azure jest obsługiwana w przypadku połączeń z tym samym regionem za pośrednictwem zapory.

Usługi w różnych regionach

Gdy wyszukiwanie i przechowywanie znajdują się w różnych regionach, możesz użyć wcześniej wymienionych opcji lub skonfigurować reguły adresów IP, które zezwalają na żądania z twojej usługi. W zależności od obciążenia może być konieczne skonfigurowanie reguł dla wielu środowisk wykonywania zgodnie z opisem w następnej sekcji.

Następne kroki

Teraz, gdy znasz opcje dostępu do danych indeksatora dla rozwiązań wdrożonych w sieci wirtualnej platformy Azure, zapoznaj się z jednym z następujących artykułów z instrukcjami w następnym kroku: