Język

Tokenizer.EncodeToTokens Metoda

Definicja

Przeciążenia

EncodeToTokens(String, ReadOnlySpan<Char>, EncodeSettings)

Źródło:
Tokenizer.cs
Źródło:
Tokenizer.cs
Źródło:
Tokenizer.cs

Koduje tekst wejściowy do listy EncodedTokens.

protected abstract Microsoft.ML.Tokenizers.EncodeResults<Microsoft.ML.Tokenizers.EncodedToken> EncodeToTokens(string? text, ReadOnlySpan<char> textSpan, Microsoft.ML.Tokenizers.EncodeSettings settings);
abstract member EncodeToTokens : string * ReadOnlySpan<char> * Microsoft.ML.Tokenizers.EncodeSettings -> Microsoft.ML.Tokenizers.EncodeResults<Microsoft.ML.Tokenizers.EncodedToken>
Protected MustOverride Function EncodeToTokens (text As String, textSpan As ReadOnlySpan(Of Char), settings As EncodeSettings) As EncodeResults(Of EncodedToken)

Parametry

text
String

Tekst do zakodowania.

textSpan
ReadOnlySpan<Char>

Zakres tekstu do zakodowania, który będzie używany, jeśli element text ma wartość null.

settings
EncodeSettings

Ustawienia używane do kodowania tekstu.

Zwraca

Dotyczy

EncodeToTokens(ReadOnlySpan<Char>, String, Boolean, Boolean)

Źródło:
Tokenizer.cs
Źródło:
Tokenizer.cs
Źródło:
Tokenizer.cs

Koduje tekst wejściowy do listy EncodedTokens.

public System.Collections.Generic.IReadOnlyList<Microsoft.ML.Tokenizers.EncodedToken> EncodeToTokens(ReadOnlySpan<char> text, out string? normalizedText, bool considerPreTokenization = true, bool considerNormalization = true);
member this.EncodeToTokens : ReadOnlySpan<char> * string * bool * bool -> System.Collections.Generic.IReadOnlyList<Microsoft.ML.Tokenizers.EncodedToken>
Public Function EncodeToTokens (text As ReadOnlySpan(Of Char), ByRef normalizedText As String, Optional considerPreTokenization As Boolean = true, Optional considerNormalization As Boolean = true) As IReadOnlyList(Of EncodedToken)

Parametry

text
ReadOnlySpan<Char>

Tekst do zakodowania.

normalizedText
String

Jeśli normalizacja tokenizatora jest włączona lub <paramRef name="considerNormalization"></paramRef> to false, zostanie ustawiona <wartość paramRef name="text"></paramRef> w znormalizowanej postaci; w przeciwnym razie ta wartość zostanie ustawiona na nullwartość .

considerPreTokenization
Boolean

Określ, czy należy rozważyć wstępne tokenizację przed tokenizacją.

considerNormalization
Boolean

Określ, czy należy rozważyć normalizację przed tokenizacją.

Zwraca

Lista zakodowanych EncodedTokens.

Dotyczy

EncodeToTokens(String, String, Boolean, Boolean)

Źródło:
Tokenizer.cs
Źródło:
Tokenizer.cs
Źródło:
Tokenizer.cs

Koduje tekst wejściowy do listy EncodedTokens.

public System.Collections.Generic.IReadOnlyList<Microsoft.ML.Tokenizers.EncodedToken> EncodeToTokens(string text, out string? normalizedText, bool considerPreTokenization = true, bool considerNormalization = true);
member this.EncodeToTokens : string * string * bool * bool -> System.Collections.Generic.IReadOnlyList<Microsoft.ML.Tokenizers.EncodedToken>
Public Function EncodeToTokens (text As String, ByRef normalizedText As String, Optional considerPreTokenization As Boolean = true, Optional considerNormalization As Boolean = true) As IReadOnlyList(Of EncodedToken)

Parametry

text
String

Tekst do zakodowania.

normalizedText
String

Jeśli normalizacja tokenizatora jest włączona lub <paramRef name="considerNormalization"></paramRef> to false, zostanie ustawiona <wartość paramRef name="text"></paramRef> w znormalizowanej postaci; w przeciwnym razie ta wartość zostanie ustawiona na nullwartość .

considerPreTokenization
Boolean

Określ, czy należy rozważyć wstępne tokenizację przed tokenizacją.

considerNormalization
Boolean

Określ, czy należy rozważyć normalizację przed tokenizacją.

Zwraca

Lista zakodowanych EncodedTokens.

Dotyczy