Tokenizer.CountTokens Methode

Definition

Überlädt

Name Beschreibung
CountTokens(ReadOnlySpan<Char>, Boolean, Boolean)

Rufen Sie die Anzahl der Token ab, für die der Eingabetext codiert wird.

CountTokens(String, Boolean, Boolean)

Rufen Sie die Anzahl der Token ab, für die der Eingabetext codiert wird.

CountTokens(String, ReadOnlySpan<Char>, EncodeSettings)

Rufen Sie die Anzahl der Token ab, für die der Eingabetext codiert wird.

CountTokens(ReadOnlySpan<Char>, Boolean, Boolean)

Quelle:
Tokenizer.cs
Quelle:
Tokenizer.cs
Quelle:
Tokenizer.cs

Rufen Sie die Anzahl der Token ab, für die der Eingabetext codiert wird.

public int CountTokens(ReadOnlySpan<char> text, bool considerPreTokenization = true, bool considerNormalization = true);
member this.CountTokens : ReadOnlySpan<char> * bool * bool -> int
Public Function CountTokens (text As ReadOnlySpan(Of Char), Optional considerPreTokenization As Boolean = true, Optional considerNormalization As Boolean = true) As Integer

Parameter

text
ReadOnlySpan<Char>

Der zu codierenden Text.

considerPreTokenization
Boolean

Geben Sie an, ob vor der Tokenisierung vor der Tokenisierung berücksichtigt werden soll.

considerNormalization
Boolean

Geben Sie an, ob die Normalisierung vor der Tokenisierung berücksichtigt werden soll.

Gibt zurück

Die Anzahl der Token-IDs, auf die der Eingabetext codiert wird.

Gilt für:

CountTokens(String, Boolean, Boolean)

Quelle:
Tokenizer.cs
Quelle:
Tokenizer.cs
Quelle:
Tokenizer.cs

Rufen Sie die Anzahl der Token ab, für die der Eingabetext codiert wird.

public int CountTokens(string text, bool considerPreTokenization = true, bool considerNormalization = true);
member this.CountTokens : string * bool * bool -> int
Public Function CountTokens (text As String, Optional considerPreTokenization As Boolean = true, Optional considerNormalization As Boolean = true) As Integer

Parameter

text
String

Der zu codierenden Text.

considerPreTokenization
Boolean

Geben Sie an, ob vor der Tokenisierung vor der Tokenisierung berücksichtigt werden soll.

considerNormalization
Boolean

Geben Sie an, ob die Normalisierung vor der Tokenisierung berücksichtigt werden soll.

Gibt zurück

Die Anzahl der Token-IDs, auf die der Eingabetext codiert wird.

Gilt für:

CountTokens(String, ReadOnlySpan<Char>, EncodeSettings)

Quelle:
Tokenizer.cs
Quelle:
Tokenizer.cs
Quelle:
Tokenizer.cs

Rufen Sie die Anzahl der Token ab, für die der Eingabetext codiert wird.

protected virtual int CountTokens(string? text, ReadOnlySpan<char> textSpan, Microsoft.ML.Tokenizers.EncodeSettings settings);
abstract member CountTokens : string * ReadOnlySpan<char> * Microsoft.ML.Tokenizers.EncodeSettings -> int
override this.CountTokens : string * ReadOnlySpan<char> * Microsoft.ML.Tokenizers.EncodeSettings -> int
Protected Overridable Function CountTokens (text As String, textSpan As ReadOnlySpan(Of Char), settings As EncodeSettings) As Integer

Parameter

text
String

Der zu codierenden Text.

textSpan
ReadOnlySpan<Char>

Der Bereich des zu codierenden Texts, der verwendet wird, wenn dies der text Grund ist null.

settings
EncodeSettings

Die Einstellungen, die zum Codieren des Texts verwendet werden.

Gibt zurück

Die Anzahl der Token-IDs, auf die der Eingabetext codiert wird.

Hinweise

Von dieser Implementierung abgeleitete Tokenizer Typen können außer Kraft setzen, um eine effizientere Implementierung bereitzustellen. Standardmäßig wird verwendet EncodeToTokens(String, ReadOnlySpan<Char>, EncodeSettings).

Gilt für: