Język

EnglishRobertaTokenizer.Create Metoda

Definicja

Przeciążenia

Nazwa Opis
Create(Stream, Stream, Stream)

Utwórz obiekt modelu tokenizatora do użycia z angielskim modelem Roberta.

Create(String, String, String)

Utwórz obiekt modelu tokenizatora do użycia z angielskim modelem Roberta.

Create(Stream, Stream, Stream, PreTokenizer, Normalizer, Boolean)

Utwórz obiekt modelu tokenizatora do użycia z angielskim modelem Roberta.

Create(String, String, String, PreTokenizer, Normalizer, Boolean)

Utwórz obiekt modelu tokenizatora do użycia z angielskim modelem Roberta.

Create(Stream, Stream, Stream)

Źródło:
EnglishRobertaTokenizer.cs
Źródło:
EnglishRobertaTokenizer.cs
Źródło:
EnglishRobertaTokenizer.cs

Utwórz obiekt modelu tokenizatora do użycia z angielskim modelem Roberta.

public static Microsoft.ML.Tokenizers.EnglishRobertaTokenizer Create(System.IO.Stream vocabularyStream, System.IO.Stream mergeStream, System.IO.Stream highestOccurrenceMappingStream);
static member Create : System.IO.Stream * System.IO.Stream * System.IO.Stream -> Microsoft.ML.Tokenizers.EnglishRobertaTokenizer
Public Shared Function Create (vocabularyStream As Stream, mergeStream As Stream, highestOccurrenceMappingStream As Stream) As EnglishRobertaTokenizer

Parametry

vocabularyStream
Stream

Strumień pliku JSON zawierającego słownik kluczy ciągów i ich identyfikatory.

mergeStream
Stream

Strumień pliku zawierającego listę par tokenów.

highestOccurrenceMappingStream
Stream

Zamapuj ponownie oryginalne identyfikatory modelu GPT-2 na wysokie rangi i wartości wystąpienia.

Zwraca

Uwagi

Podczas tworzenia tokenizatora upewnij się, że strumień słownictwa jest pozyskiwany od zaufanego dostawcy.

Dotyczy

Create(String, String, String)

Źródło:
EnglishRobertaTokenizer.cs
Źródło:
EnglishRobertaTokenizer.cs
Źródło:
EnglishRobertaTokenizer.cs

Utwórz obiekt modelu tokenizatora do użycia z angielskim modelem Roberta.

public static Microsoft.ML.Tokenizers.EnglishRobertaTokenizer Create(string vocabularyPath, string mergePath, string highestOccurrenceMappingPath);
static member Create : string * string * string -> Microsoft.ML.Tokenizers.EnglishRobertaTokenizer
Public Shared Function Create (vocabularyPath As String, mergePath As String, highestOccurrenceMappingPath As String) As EnglishRobertaTokenizer

Parametry

vocabularyPath
String

Ścieżka pliku JSON zawierająca słownik kluczy ciągów i ich identyfikatory.

mergePath
String

Ścieżka pliku zawierająca listę par tokenów.

highestOccurrenceMappingPath
String

Zamapuj ponownie oryginalne identyfikatory modelu GPT-2 na wysokie rangi i wartości wystąpienia.

Zwraca

Uwagi

Podczas tworzenia tokenizatora upewnij się, że plik słownictwa pochodzi od zaufanego dostawcy.

Dotyczy

Create(Stream, Stream, Stream, PreTokenizer, Normalizer, Boolean)

Źródło:
EnglishRobertaTokenizer.cs
Źródło:
EnglishRobertaTokenizer.cs
Źródło:
EnglishRobertaTokenizer.cs

Utwórz obiekt modelu tokenizatora do użycia z angielskim modelem Roberta.

public static Microsoft.ML.Tokenizers.EnglishRobertaTokenizer Create(System.IO.Stream vocabularyStream, System.IO.Stream mergeStream, System.IO.Stream highestOccurrenceMappingStream, Microsoft.ML.Tokenizers.PreTokenizer? preTokenizer = default, Microsoft.ML.Tokenizers.Normalizer? normalizer = default, bool filterUnsupportedChars = true);
static member Create : System.IO.Stream * System.IO.Stream * System.IO.Stream * Microsoft.ML.Tokenizers.PreTokenizer * Microsoft.ML.Tokenizers.Normalizer * bool -> Microsoft.ML.Tokenizers.EnglishRobertaTokenizer
Public Shared Function Create (vocabularyStream As Stream, mergeStream As Stream, highestOccurrenceMappingStream As Stream, Optional preTokenizer As PreTokenizer = Nothing, Optional normalizer As Normalizer = Nothing, Optional filterUnsupportedChars As Boolean = true) As EnglishRobertaTokenizer

Parametry

vocabularyStream
Stream

Strumień pliku JSON zawierającego słownik kluczy ciągów i ich identyfikatory.

mergeStream
Stream

Strumień pliku zawierającego listę par tokenów.

highestOccurrenceMappingStream
Stream

Zamapuj ponownie oryginalne identyfikatory modelu GPT-2 na wysokie rangi i wartości wystąpienia.

preTokenizer
PreTokenizer

Pre-tokenizer do użycia.

normalizer
Normalizer

Normalizator do użycia.

filterUnsupportedChars
Boolean

Wskaż, czy chcesz filtrować nieobsługiwane znaki podczas dekodowania.

Zwraca

Uwagi

Podczas tworzenia tokenizatora upewnij się, że strumień słownictwa jest pozyskiwany od zaufanego dostawcy.

Dotyczy

Create(String, String, String, PreTokenizer, Normalizer, Boolean)

Źródło:
EnglishRobertaTokenizer.cs
Źródło:
EnglishRobertaTokenizer.cs
Źródło:
EnglishRobertaTokenizer.cs

Utwórz obiekt modelu tokenizatora do użycia z angielskim modelem Roberta.

public static Microsoft.ML.Tokenizers.EnglishRobertaTokenizer Create(string vocabularyPath, string mergePath, string highestOccurrenceMappingPath, Microsoft.ML.Tokenizers.PreTokenizer? preTokenizer = default, Microsoft.ML.Tokenizers.Normalizer? normalizer = default, bool filterUnsupportedChars = true);
static member Create : string * string * string * Microsoft.ML.Tokenizers.PreTokenizer * Microsoft.ML.Tokenizers.Normalizer * bool -> Microsoft.ML.Tokenizers.EnglishRobertaTokenizer
Public Shared Function Create (vocabularyPath As String, mergePath As String, highestOccurrenceMappingPath As String, Optional preTokenizer As PreTokenizer = Nothing, Optional normalizer As Normalizer = Nothing, Optional filterUnsupportedChars As Boolean = true) As EnglishRobertaTokenizer

Parametry

vocabularyPath
String

Ścieżka pliku JSON zawierająca słownik kluczy ciągów i ich identyfikatory.

mergePath
String

Ścieżka pliku zawierająca listę par tokenów.

highestOccurrenceMappingPath
String

Zamapuj ponownie oryginalne identyfikatory modelu GPT-2 na wysokie rangi i wartości wystąpienia.

preTokenizer
PreTokenizer

Pre-tokenizer do użycia.

normalizer
Normalizer

Normalizator do użycia.

filterUnsupportedChars
Boolean

Wskaż, czy chcesz filtrować nieobsługiwane znaki podczas dekodowania.

Zwraca

Uwagi

Podczas tworzenia tokenizatora upewnij się, że plik słownictwa pochodzi od zaufanego dostawcy.

Dotyczy