Idioma

Tokenizer.GetIndexByTokenCountFromEnd Método

Definição

Sobrecargas

Nome Description
GetIndexByTokenCountFromEnd(ReadOnlySpan<Char>, Int32, String, Int32, Boolean, Boolean)

Localize o índice da capacidade máxima de codificação sem ultrapassar o limite de token.

GetIndexByTokenCountFromEnd(String, Int32, String, Int32, Boolean, Boolean)

Localize o índice da capacidade máxima de codificação sem ultrapassar o limite de token.

GetIndexByTokenCountFromEnd(ReadOnlySpan<Char>, Int32, String, Int32, Boolean, Boolean)

Origem:
Tokenizer.cs
Origem:
Tokenizer.cs
Origem:
Tokenizer.cs

Localize o índice da capacidade máxima de codificação sem ultrapassar o limite de token.

public int GetIndexByTokenCountFromEnd(ReadOnlySpan<char> text, int maxTokenCount, out string? normalizedText, out int tokenCount, bool considerPreTokenization = true, bool considerNormalization = true);
member this.GetIndexByTokenCountFromEnd : ReadOnlySpan<char> * int * string * int * bool * bool -> int
Public Function GetIndexByTokenCountFromEnd (text As ReadOnlySpan(Of Char), maxTokenCount As Integer, ByRef normalizedText As String, ByRef tokenCount As Integer, Optional considerPreTokenization As Boolean = true, Optional considerNormalization As Boolean = true) As Integer

Parâmetros

text
ReadOnlySpan<Char>

O texto a ser codificado.

maxTokenCount
Int32

O número máximo de tokens a serem codificados.

normalizedText
String

Se a normalização do tokenizer estiver habilitada ou <paramRef name="considerPreTokenization"></paramRef> for false, isso será definido como <paramRef name="text"></paramRef> em sua forma normalizada; caso contrário, esse valor será definido como null.

tokenCount
Int32

A contagem de tokens pode ser gerada, que deve ser menor que a contagem máxima de tokens.

considerPreTokenization
Boolean

Indique se deve considerar a pré-tokenização antes da tokenização.

considerNormalization
Boolean

Indique se deve considerar a normalização antes da tokenização.

Retornos

O índice da capacidade máxima de codificação dentro do texto processado sem ultrapassar o limite de token. Ele representa o índice do primeiro caractere a ser incluído. Nos casos em que nenhum token se ajustar, o resultado será o comprimento do texto; por outro lado, se todos os tokens se ajustarem, o resultado será zero.

Aplica-se a

GetIndexByTokenCountFromEnd(String, Int32, String, Int32, Boolean, Boolean)

Origem:
Tokenizer.cs
Origem:
Tokenizer.cs
Origem:
Tokenizer.cs

Localize o índice da capacidade máxima de codificação sem ultrapassar o limite de token.

public int GetIndexByTokenCountFromEnd(string text, int maxTokenCount, out string? normalizedText, out int tokenCount, bool considerPreTokenization = true, bool considerNormalization = true);
member this.GetIndexByTokenCountFromEnd : string * int * string * int * bool * bool -> int
Public Function GetIndexByTokenCountFromEnd (text As String, maxTokenCount As Integer, ByRef normalizedText As String, ByRef tokenCount As Integer, Optional considerPreTokenization As Boolean = true, Optional considerNormalization As Boolean = true) As Integer

Parâmetros

text
String

O texto a ser codificado.

maxTokenCount
Int32

O número máximo de tokens a serem codificados.

normalizedText
String

Se a normalização do tokenizer estiver habilitada ou <paramRef name="considerPreTokenization"></paramRef> for false, isso será definido como <paramRef name="text"></paramRef> em sua forma normalizada; caso contrário, esse valor será definido como null.

tokenCount
Int32

A contagem de tokens pode ser gerada, que deve ser menor que a contagem máxima de tokens.

considerPreTokenization
Boolean

Indique se deve considerar a pré-tokenização antes da tokenização.

considerNormalization
Boolean

Indique se deve considerar a normalização antes da tokenização.

Retornos

O índice da capacidade máxima de codificação dentro do texto processado sem ultrapassar o limite de token. Ele representa o índice do primeiro caractere a ser incluído. Nos casos em que nenhum token se ajustar, o resultado será o comprimento do texto; por outro lado, se todos os tokens se ajustarem, o resultado será zero.

Aplica-se a