Tokenizer.GetIndexByTokenCountFromEnd Método

Definición

Sobrecargas

Nombre Description
GetIndexByTokenCountFromEnd(ReadOnlySpan<Char>, Int32, String, Int32, Boolean, Boolean)

Busque el índice de la capacidad de codificación máxima sin superar el límite de tokens.

GetIndexByTokenCountFromEnd(String, Int32, String, Int32, Boolean, Boolean)

Busque el índice de la capacidad de codificación máxima sin superar el límite de tokens.

GetIndexByTokenCountFromEnd(ReadOnlySpan<Char>, Int32, String, Int32, Boolean, Boolean)

Source:
Tokenizer.cs
Source:
Tokenizer.cs
Source:
Tokenizer.cs

Busque el índice de la capacidad de codificación máxima sin superar el límite de tokens.

public int GetIndexByTokenCountFromEnd(ReadOnlySpan<char> text, int maxTokenCount, out string? normalizedText, out int tokenCount, bool considerPreTokenization = true, bool considerNormalization = true);
member this.GetIndexByTokenCountFromEnd : ReadOnlySpan<char> * int * string * int * bool * bool -> int
Public Function GetIndexByTokenCountFromEnd (text As ReadOnlySpan(Of Char), maxTokenCount As Integer, ByRef normalizedText As String, ByRef tokenCount As Integer, Optional considerPreTokenization As Boolean = true, Optional considerNormalization As Boolean = true) As Integer

Parámetros

text
ReadOnlySpan<Char>

Texto que se va a codificar.

maxTokenCount
Int32

Número máximo de tokens que se van a codificar.

normalizedText
String

Si la normalización del tokenizador está habilitada o <paramRef name="considerPreTokenization"></paramRef> es false, se establecerá <en paramRef name="text"></paramRef> en su forma normalizada; de lo contrario, este valor se establecerá nullen .

tokenCount
Int32

El recuento de tokens se puede generar que debe ser menor que el número máximo de tokens.

considerPreTokenization
Boolean

Indica si se debe tener en cuenta la tokenización previa antes de la tokenización.

considerNormalization
Boolean

Indica si se debe considerar la normalización antes de la tokenización.

Devoluciones

Índice de la capacidad de codificación máxima dentro del texto procesado sin superar el límite de tokens. Representa el índice del primer carácter que se va a incluir. En los casos en los que no caben tokens, el resultado será la longitud del texto; por el contrario, si todos los tokens encajan, el resultado será cero.

Se aplica a

GetIndexByTokenCountFromEnd(String, Int32, String, Int32, Boolean, Boolean)

Source:
Tokenizer.cs
Source:
Tokenizer.cs
Source:
Tokenizer.cs

Busque el índice de la capacidad de codificación máxima sin superar el límite de tokens.

public int GetIndexByTokenCountFromEnd(string text, int maxTokenCount, out string? normalizedText, out int tokenCount, bool considerPreTokenization = true, bool considerNormalization = true);
member this.GetIndexByTokenCountFromEnd : string * int * string * int * bool * bool -> int
Public Function GetIndexByTokenCountFromEnd (text As String, maxTokenCount As Integer, ByRef normalizedText As String, ByRef tokenCount As Integer, Optional considerPreTokenization As Boolean = true, Optional considerNormalization As Boolean = true) As Integer

Parámetros

text
String

Texto que se va a codificar.

maxTokenCount
Int32

Número máximo de tokens que se van a codificar.

normalizedText
String

Si la normalización del tokenizador está habilitada o <paramRef name="considerPreTokenization"></paramRef> es false, se establecerá <en paramRef name="text"></paramRef> en su forma normalizada; de lo contrario, este valor se establecerá nullen .

tokenCount
Int32

El recuento de tokens se puede generar que debe ser menor que el número máximo de tokens.

considerPreTokenization
Boolean

Indica si se debe tener en cuenta la tokenización previa antes de la tokenización.

considerNormalization
Boolean

Indica si se debe considerar la normalización antes de la tokenización.

Devoluciones

Índice de la capacidad de codificación máxima dentro del texto procesado sin superar el límite de tokens. Representa el índice del primer carácter que se va a incluir. En los casos en los que no caben tokens, el resultado será la longitud del texto; por el contrario, si todos los tokens encajan, el resultado será cero.

Se aplica a