Microsoft.ML.Transforms.Text Przestrzeń nazw
Ważne
Niektóre informacje odnoszą się do produktu w wersji wstępnej, który może zostać znacząco zmodyfikowany przed wydaniem. Firma Microsoft nie udziela żadnych gwarancji, jawnych lub domniemanych, w odniesieniu do informacji podanych w tym miejscu.
Przestrzeń nazw zawierająca składniki przekształcania danych tekstowych.
Klasy
| Nazwa | Opis |
|---|---|
| CustomStopWordsRemovingEstimator |
IEstimator<TTransformer> dla elementu CustomStopWordsRemovingTransformer. |
| CustomStopWordsRemovingEstimator.Options |
Użyj narzędzia do usuwania wyrazów zatrzymania, które może usuwać listę słów zatrzymania (najczęściej używanych słów) już zdefiniowanych w systemie. |
| CustomStopWordsRemovingTransformer |
ITransformer wynikające z dopasowania elementu CustomStopWordsRemovingEstimator. |
| LatentDirichletAllocationEstimator |
Transformacja LDA implementuje LightLDA, najnowocześniejsze wdrożenie utajnianej alokacji Dirichlet. |
| LatentDirichletAllocationTransformer |
ITransformer wynikające z dopasowania elementu LatentDirichletAllocationEstimator. |
| LatentDirichletAllocationTransformer.ModelParameters |
Podaj szczegółowe informacje o tematach odnalezionych przez lightLDA. |
| NgramExtractingEstimator |
Tworzy wektor liczby n-gramów (sekwencje kolejnych wyrazów) napotkanych w tekście wejściowym. |
| NgramExtractingTransformer |
ITransformer wynikające z dopasowania elementu NgramExtractingEstimator. |
| NgramHashingEstimator |
IEstimator<TTransformer> dla elementu NgramHashingTransformer. |
| NgramHashingTransformer |
Przestrzeń nazw zawierająca składniki przekształcania danych tekstowych. |
| StopWordsRemovingEstimator |
IEstimator<TTransformer> dla elementu CustomStopWordsRemovingTransformer. |
| StopWordsRemovingEstimator.Options |
Użyj narzędzia do usuwania wyrazów zatrzymania, które mogą usuwać listę słów zatrzymania (najczęściej używanych słów) zdefiniowanych już w systemie. |
| StopWordsRemovingTransformer |
ITransformer wynikające z dopasowania elementu StopWordsRemovingEstimator. |
| TextFeaturizingEstimator |
Narzędzie do szacowania, które zamienia kolekcję dokumentów tekstowych na wektory cech liczbowych. Wektory cech są znormalizowanymi liczbami wyrazów i/lub n-gramów znaków (na podstawie podanych opcji). |
| TextFeaturizingEstimator.Options |
Zaawansowane opcje dla elementu TextFeaturizingEstimator. |
| TextNormalizingEstimator |
IEstimator<TTransformer> dla elementu TextNormalizingTransformer. |
| TextNormalizingTransformer |
ITransformer wynikające z dopasowania elementu TextNormalizingEstimator. |
| TokenizingByCharactersEstimator |
IEstimator<TTransformer> dla elementu TokenizingByCharactersTransformer. |
| TokenizingByCharactersTransformer |
ITransformer wynikające z dopasowania elementu TokenizingByCharactersEstimator. |
| WordBagEstimator |
IEstimator<TTransformer> dla elementu ITransformer. |
| WordBagEstimator.Options |
Opcje sposobu wyodrębniania n-gramów. |
| WordEmbeddingEstimator |
Cecha tekstowa, która konwertuje wektory tokenów tekstowych na wektor liczbowy przy użyciu wstępnie wytrenowanego modelu osadzania. |
| WordEmbeddingTransformer |
ITransformer wynikające z dopasowania elementu WordEmbeddingEstimator. |
| WordHashBagEstimator |
IEstimator<TTransformer> dla elementu ITransformer. |
| WordTokenizingEstimator |
Tokenizuje tekst wejściowy przy użyciu określonych ograniczników. |
| WordTokenizingTransformer |
ITransformer wynikające z dopasowania elementu WordTokenizingEstimator. |
Struktury
| Nazwa | Opis |
|---|---|
| LatentDirichletAllocationTransformer.ModelParameters.ItemScore |
Przestrzeń nazw zawierająca składniki przekształcania danych tekstowych. |
| LatentDirichletAllocationTransformer.ModelParameters.WordItemScore |
Przestrzeń nazw zawierająca składniki przekształcania danych tekstowych. |
Interfejsy
| Nazwa | Opis |
|---|---|
| IStopWordsRemoverOptions |
Definiuje obsługiwany inny typ usuwania wyrazów zatrzymania. |
Wyliczenia
| Nazwa | Opis |
|---|---|
| NgramExtractingEstimator.WeightingCriteria |
Miara statystyczna używana do oceny, jak ważne jest słowo w dokumencie w korpusie. Ta wyliczenie jest serializowana. |
| StopWordsRemovingEstimator.Language |
Język Stopwords. Ta wyliczenie jest serializowana. |
| TextFeaturizingEstimator.Language |
Język tekstu. Ta wyliczenie jest serializowana. |
| TextFeaturizingEstimator.NormFunction |
Typ normalizatora wektorów tekstowych. |
| TextNormalizingEstimator.CaseMode |
Tryb normalizacji wielkości liter tekstu. Ta wyliczenie jest serializowana. |
| WordEmbeddingEstimator.PretrainedModelKind |
Określa, które wyrazy osadzania mają być używane. |