Vrácení oddělovačů slov ve službě Full-Text Search na předchozí verzi

platí pro:SQL Server

Tento článek popisuje starší postup pro přepínání dělení slov mezi aktualizovanými komponentami zavedených v SQL Server 2012 (11.x) a předchozími komponentami.

Informace o změně verze indexu Full-Text v SQL Server 2025 (17.x) viz Upgrade verze indexu Full-Text.

SQL Server nainstaluje a povolí verzi modulů pro dělení slov a stemmery pro všechny jazyky podporované funkcí Full-Text Search s výjimkou korejštiny. Tento článek popisuje, jak přepnout z této verze těchto komponent na předchozí verzi nebo přepnout zpět z předchozí verze na novou verzi.

Tento článek nepojednávat o následujících jazycích:

Jazyk Description
English Informace o vrácení nebo obnovení anglických komponent najdete v článku Změna děliče slov používaného pro americkou a britskou angličtinu.
Dánština, polština a turečtina Moduly pro dělení slov třetích stran pro dánštinu, polštinu a turečtinu, které byly součástí předchozích verzí SQL Serveru, jsou nahrazeny komponentami Microsoftu.
Čeština a řečtina Jsou k dispozici nové dělitele slov pro češtinu a řečtinu. Předchozí verze SQL Serveru Full-Text Search nezahrnují podporu těchto dvou jazyků.
Korejština V této verzi se neupgraduje word breaker a stemmer pro korejský jazyk.

Obecné informace o oddělovačích slov a algoritmech pro hledání kořenů slov naleznete v článku Konfigurace a správa oddělovačů slov a algoritmů pro hledání kořenů slov.

Přehled vrácení a obnovení rozdělovačů slov a stemmerů

Pokyny pro vrácení a obnovení dělení slov a stemmerů závisí na jazyce. Následující tabulka shrnuje tři sady akcí, které se můžou vyžadovat k návratu k předchozí verzi komponent.

Upozornění

Nesprávná úprava registru může vážně poškodit systém. Před provedením změn registru doporučujeme zálohovat všechna hodnotná data v počítači.

Aktuální soubor Předchozí soubor Počet ovlivněných jazyků Akce pro soubory Akce pro položky registru
NaturalLanguage6.dll NaturalLanguage6.dll 34 Získejte a nainstalujte předchozí verzi NaturalLanguage6.dllsouboru a přepíšete aktuální verzi souboru. Nevyžaduje se žádná akce.

Klíče a hodnoty registru se pro tuto verzi nezměnily.
(Jiný název souboru) NaturalLanguage6.dll 5 Získejte a nainstalujte předchozí verzi NaturalLanguage6.dllsouboru a přepíšete aktuální verzi souboru. Změňte sadu položek registru a určete předchozí verzi součástí.
(Jiný název souboru) (Jiný název souboru) 6 Nevyžaduje se žádná akce.

Instalační program SYSTÉMU SQL Server zkopíruje aktuální i předchozí verze součástí do Binn složky.
Změňte sadu položek registru a určete předchozí verzi součástí.

Varování

Pokud nahradíte aktuální verzi souboru NaturalLanguage6.dll jinou verzí, chování všech jazyků, které tento soubor používají, se změní.

Soubory popsané v tomto článku jsou soubory DLL, které jsou nainstalovány ve složce MSSQL\Binn instance SYSTÉMU SQL Server. Úplná cesta je obvykle následující:

C:\Program Files\Microsoft SQL Server\<instance>\MSSQL\Binn

Jazyky, pro které je název souboru systému pro dělení slov, a to jak aktuálního, tak předchozího, NaturalLanguage6.dll

Pro jazyky v následující tabulce je název souboru aktuálního i předchozího dělení slov NaturalLanguage6.dll. Pokud chcete tyto komponenty vrátit nebo obnovit, musíte je přepsat NaturalLanguage6.dll jinou verzí stejného souboru. Nemusíte měnit žádné položky registru, protože položky registru se pro tuto verzi nezměnily.

Varování

Pokud nahradíte aktuální verzi souboru NaturalLanguage6.dll jinou verzí, chování všech jazyků, které tento soubor používají, se změní.

Seznam ovlivněných jazyků

Jazyk Zkratka použitá v rejstříku Identifikátor místního nastavení (LCID)
Bengálština ben 1093
Bulharština bgr 1026
Katalánština cat 1027
Španělština esn 3082
Francouzština fra 1036
Gudžarátština guj 1095
Hebrejština heb 1037
Hindština hin 1081
Chorvatština hrv 1050
Indonéština ind 1057
Islandština isl 1039
Italština ita 1040
Kannadština kan 1099
Litevština lth 1063
Lotyština lvi 1062
Malajalámština mal 1100
Maráthština mar 1102
Malajština msl 1086
Neutrální Neutral 0000
Norština Bokmål nor 1044
Paňdžábština pan 1094
Portugalština (Brazílie) ptb 1046
Portugalština ptg 2070
Rumunština rom 1048
Slovenština sky 1051
Slovinština slv 1060
Srbština – cyrilice srb 3098
Srbština – latinka srl 2074
Švédština sve 1053
Tamilština tam 1097
Telugština tel 1098
Ukrajinština ukr 1058
Urdština urd 1056
Vietnamština vit 1066

Předchozí tabulka je seřazená abecedně podle sloupce Zkratka.

  1. Přejděte do Binn složky popsané výše.

  2. Zálohujte verzi NaturalLanguage6.dll SQL Serveru na jiné místo.

  3. Zkopírujte předchozí verzi NaturalLanguage6.dll ze Binn složky instance SYSTÉMU SQL Server 2008 R2 (10.50.x) nebo SQL Server 2008 (10.0.x) do Binn složky instance SQL Serveru.

    Varování

    Tato změna má vliv na všechny jazyky, které používají NaturalLanguage6.dll aktuální i předchozí verzi.

  4. Restartujte SQL Server.

Jazyky, pro které je název souboru předchozího oddělovače slov NaturalLanguage6.dll

Pro jazyky v následující tabulce se název souboru předchozího dělení slov liší od názvu souboru nové verze. Předchozí název souboru je NaturalLanguage6.dll. Pokud se chcete vrátit k předchozí verzi, musíte aktuální verzi NaturalLanguage6.dll přepsat starší verzí stejného souboru. Musíte také změnit sadu položek registru, aby bylo možné určit předchozí nebo aktuální verzi komponent.

Varování

Pokud nahradíte aktuální verzi souboru NaturalLanguage6.dll jinou verzí, chování všech jazyků, které tento soubor používají, se změní.

Seznam ovlivněných jazyků

Jazyk Zkratka
používané v
registr
LCID
Arabština ara 1025
Němčina deu 1031
Japonština jpn 1041
Holandština nld 1043
Ruština rus 1049

Předchozí tabulka je seřazená abecedně podle sloupce Zkratka.

Následující pokyny použijte společně se seznamem hodnot v části Názvy souborů a hodnoty registru pro reset a obnovení děličů slov a tvořičů tvarů.

  1. Přejděte do Binn složky popsané výše.

  2. Neodstraňujte soubory pro aktuální verzi komponent z Binn složky.

  3. Zálohujte verzi NaturalLanguage6.dll SQL Serveru na jiné místo.

  4. Zkopírujte předchozí verzi NaturalLanguage6.dll ze Binn složky instance SYSTÉMU SQL Server 2008 R2 (10.50.x) nebo SQL Server 2008 (10.0.x) do Binn složky nové instance SQL Serveru.

    Varování

    Tato změna má vliv na všechny jazyky, které používají NaturalLanguage6.dll aktuální i předchozí verzi.

  5. V registru přejděte na následující uzel: HKEY_LOCAL_MACHINE\SOFTWARE\Microsoft\Microsoft SQL Server\<InstanceRoot>\MSSearch\CLSID.

  6. Pomocí následujícího postupu přidejte nové klíče pro identifikátory COM ClassID pro předchozí dělení slov a rozhraní stemmeru pro vybraný jazyk:

    1. Přidejte nový klíč s hodnotou z tabulky pro předchozí modul pro dělení slov.

    2. Aktualizujte (výchozí) data této hodnoty klíče na název souboru předchozího dělení slov z tabulky.

    3. Pokud vybraný jazyk používá „stemmer“, přidejte nový klíč s hodnotou z tabulky pro předchozí „stemmer“.

    4. Pokud vybraný jazyk používá stemmer, aktualizujte výchozí data tohoto klíče na název souboru předchozího stemmeru z tabulky.

  7. V registru přejděte na následující uzel: HKEY_LOCAL_MACHINE\SOFTWARE\Microsoft\Microsoft SQL Server\<InstanceRoot>\MSSearch\Language\<language_key>. <language_key> představuje zkratku jazyka používaného v rejstříku; Například fra pro francouzštinu a esn španělštinu.

  8. WBreakerClass Aktualizujte hodnotu klíče na hodnotu z tabulky pro aktuální dělení slov.

  9. Pokud vybraný jazyk používá stemmer, aktualizujte StemmerClass hodnotu klíče na hodnotu z tabulky pro aktuální stemmer.

  10. Restartujte SQL Server.

Názvy souborů a hodnoty registru pro navrácení a obnovení děličů slov a stemmatizátorů

Použijte následující seznam názvů souborů a položek registru společně s pokyny v předchozí části. Pomocí předchozích hodnot se vraťte k předchozí verzi nebo použijte aktuální hodnoty k obnovení aktuální verze součástí.

Následující seznam je seřazen abecedně podle zkratky používané pro každý jazyk.

Arabština (ara) – LCID 1025

Komponenta Dělič slov Stemer
Předchozí CLSID 7efd3c7e-9e4b-4a93-9503-decd74c0ac6d 483b0283-25db-4c92-9c15-a65925cb95ce
Předchozí název souboru NaturalLanguage6.dll NaturalLanguage6.dll
Aktuální CLSID 04b37e30-c9a9-4a7d-8f20-792fc87ddf71 Žádný
Aktuální název souboru MSWB7.dll Žádný

Němčina (deu) – LCID 1031

Komponenta Dělič slov Stemer
Předchozí CLSID 45eaca36-dbe9-4e4a-a26d-5c201902346d 65170ae4-0ad2-4fa5-b3ba-7cd73e2da825
Předchozí název souboru NaturalLanguage6.dll NaturalLanguage6.dll
Aktuální CLSID dfa00c33-bf19-482e-a791-3c785b0149b4 8a474d89-6e2f-419c-8dd5-9b50edc8c787
Aktuální název souboru MsWb7.dll MsWb7.dll

Japonština (jpn) – LCID 1041

Komponenta Dělič slov Stemer
Předchozí CLSID e1e8f15e-8bec-45df-83bf-50ff84d0cab5 3d5df14f-649f-4cbc-853d-f18fede9cf5d
Předchozí název souboru NaturalLanguage6.dll NaturalLanguage6.dll
Aktuální CLSID 04096682-6ece-4e9e-90c1-52d81f0422ed Žádný
Aktuální název souboru MsWb70011.dll Žádný

Holandština (nld) – LCID 1043

Komponenta Dělič slov Stemer
Předchozí CLSID 2c9f6beb-c5b0-42b6-a5ee-84c24dc0d8ef f7a465ee-13fb-409a-b878-195b420433af
Předchozí název souboru NaturalLanguage6.dll NaturalLanguage6.dll
Aktuální CLSID 69483c30-a9af-4552-8f84-a0796ad5285b cf923cb5-1187-43ab-b053-3e44bed65ffa
Aktuální název souboru MsWb7.dll MsWb7.dll

Ruština (rus) – LCID 1049

Komponenta Dělič slov Stemer
Předchozí CLSID 2cb6cda4-1c14-4392-a8ec-81eef1f2e079 e06a0ddd-e81a-4e93-8a8d-f386c3a1b670
Předchozí název souboru NaturalLanguage6.dll NaturalLanguage6.dll
Aktuální CLSID aaa3d3bd-6de7-4317-91a0-d25e7d3babc3 d42c8b70-adeb-4b81-a52f-c09f24f77dfa
Aktuální název souboru MsWb7.dll MsWb7.dll

Jazyky, pro které předchozí a aktuální název souboru není NaturalLanguage6.dll

Pro jazyky v následující tabulce se názvy souborů předchozích tokenizátorů a stemmerů liší od názvů souborů nových verzí. Předchozí i aktuální název souboru není NaturalLanguage6.dll. Nemusíte nahrazovat žádné soubory, protože instalační program SQL Serveru zkopíruje do složky aktuální i předchozí verze komponent Binn . Je však nutné změnit sadu položek registru, aby bylo možné určit předchozí nebo aktuální verzi součástí.

Seznam ovlivněných jazyků

Jazyk Zkratka použitá v rejstříku LCID
Zjednodušená čínština chs 2052
Tradiční čínština cht 1028
Thajština tha 1054
Tradiční čínština zh-hk 3076
Tradiční čínština zh-mo 5124
Zjednodušená čínština zh-sg 4100

Předchozí tabulka je seřazená abecedně podle sloupce Zkratka.

Následující pokyny použijte společně se seznamem hodnot v části Názvy souborů a hodnoty registru pro reset a obnovení děličů slov a tvořičů tvarů.

  1. Neodstraňujte soubory pro aktuální verzi komponent z Binn složky.

  2. V registru přejděte na následující uzel: HKEY_LOCAL_MACHINE\SOFTWARE\Microsoft\Microsoft SQL Server\<InstanceRoot>\MSSearch\CLSID.

  3. Pomocí následujícího postupu přidejte nové klíče pro identifikátory COM ClassID pro předchozí dělení slov a rozhraní stemmeru pro vybraný jazyk:

    1. Přidejte nový klíč s hodnotou z tabulky pro předchozí modul pro dělení slov.

    2. Aktualizujte (výchozí) data této hodnoty klíče na název souboru předchozího dělení slov z tabulky.

    3. Pokud vybraný jazyk používá „stemmer“, přidejte nový klíč s hodnotou z tabulky pro předchozí „stemmer“.

    4. Pokud vybraný jazyk používá stemmer, aktualizujte výchozí data tohoto klíče na název souboru předchozího stemmeru z tabulky.

  4. V registru přejděte na následující uzel: HKEY_LOCAL_MACHINE\SOFTWARE\Microsoft\Microsoft SQL Server\<InstanceRoot>\MSSearch\Language\<language_key>. <language_key> představuje zkratku jazyka používaného v rejstříku; Například fra pro francouzštinu a esn španělštinu.

  5. WBreakerClass Aktualizujte hodnotu klíče na hodnotu z tabulky pro aktuální dělení slov.

  6. Pokud vybraný jazyk používá stemmer, aktualizujte StemmerClass hodnotu klíče na hodnotu z tabulky pro aktuální stemmer.

  7. Restartujte SQL Server.

Názvy souborů a hodnoty registru pro navrácení a obnovení děličů slov a stemmatizátorů

Použijte následující seznam názvů souborů a položek registru společně s pokyny v předchozí části. Pomocí předchozích hodnot se vraťte k předchozí verzi nebo použijte aktuální hodnoty k obnovení aktuální verze součástí.

Následující seznam je seřazen abecedně podle zkratky používané pro každý jazyk.

Zjednodušená čínština (chs) – LCID 2052

Komponenta Dělič slov
Předchozí CLSID 12ce94a0-defb-11d2-b31d-00600893a857
Předchozí název souboru chsbrkr.dll
Aktuální CLSID e0831c90-bab0-4ca5-b9bd-ea254b538dac
Aktuální název souboru MsWb70804.dll

Tradiční čínština (cht) – LCID 1028

Komponenta Dělič slov
Předchozí CLSID 1680e7c3-9430-4a51-9b82-1e7e7aee5258
Předchozí název souboru chtbrkr.dll
Aktuální CLSID e9b1df65-08f1-438b-8277-ef462b23a792
Aktuální název souboru MsWb70404.dll

Thajština (tha) – LCID 1054

Komponenta Dělič slov Stemer
Předchozí CLSID cca22cf4-59fe-11d1-bbff-00c04fb97fda cedc01c7-59fe-11d1-bbff-00c04fb97fda
Předchozí název souboru Thawbrkr.dll Thawbrkr.dll
Aktuální CLSID f70c0935-6e9f-4ef1-9f06-7876536db900 Žádný
Aktuální název souboru MsWb7001e.dll Žádný

Tradiční čínština (zh-hk) – LCID 3076

Komponenta Dělič slov
Předchozí CLSID 1680e7c3-9430-4a51-9b82-1e7e7aee5258
Předchozí název souboru chtbrkr.dll
Aktuální CLSID e9b1df65-08f1-438b-8277-ef462b23a792
Aktuální název souboru MsWb70404.dll

Tradiční čínština (zh-mo) – LCID 5124

Komponenta Dělič slov
Předchozí CLSID 1680e7c3-9430-4a51-9b82-1e7e7aee5258
Předchozí název souboru chtbrkr.dll
Aktuální CLSID e9b1df65-08f1-438b-8277-ef462b23a792
Aktuální název souboru MsWb70404.dll

Zjednodušená čínština (zh-sg) – LCID 4100

Komponenta Dělič slov
Předchozí CLSID 12ce94a0-defb-11d2-b31d-00600893a857
Předchozí název souboru chsbrkr.dll
Aktuální CLSID e0831c90-bab0-4ca5-b9bd-ea254b538dac
Aktuální název souboru MsWb70804.dll