Język

CodeGenTokenizer.GetIndexByTokenCountFromEnd Metoda

Definicja

Przeciążenia

Nazwa Opis
GetIndexByTokenCountFromEnd(ReadOnlySpan<Char>, Int32, Boolean, Boolean, Boolean, String, Int32, Boolean, Boolean)

Znajdź indeks maksymalnej pojemności kodowania z końca tekstu bez przekraczania limitu tokenu.

GetIndexByTokenCountFromEnd(String, Int32, Boolean, Boolean, Boolean, String, Int32, Boolean, Boolean)

Znajdź indeks maksymalnej pojemności kodowania z końca tekstu bez przekraczania limitu tokenu.

GetIndexByTokenCountFromEnd(ReadOnlySpan<Char>, Int32, Boolean, Boolean, Boolean, String, Int32, Boolean, Boolean)

Źródło:
CodeGenTokenizer.cs
Źródło:
CodeGenTokenizer.cs
Źródło:
CodeGenTokenizer.cs

Znajdź indeks maksymalnej pojemności kodowania z końca tekstu bez przekraczania limitu tokenu.

public int GetIndexByTokenCountFromEnd(ReadOnlySpan<char> text, int maxTokenCount, bool addPrefixSpace, bool addBeginningOfSentence, bool addEndOfSentence, out string? normalizedText, out int tokenCount, bool considerPreTokenization = true, bool considerNormalization = true);
override this.GetIndexByTokenCountFromEnd : ReadOnlySpan<char> * int * bool * bool * bool * string * int * bool * bool -> int
Public Function GetIndexByTokenCountFromEnd (text As ReadOnlySpan(Of Char), maxTokenCount As Integer, addPrefixSpace As Boolean, addBeginningOfSentence As Boolean, addEndOfSentence As Boolean, ByRef normalizedText As String, ByRef tokenCount As Integer, Optional considerPreTokenization As Boolean = true, Optional considerNormalization As Boolean = true) As Integer

Parametry

text
ReadOnlySpan<Char>

Tekst do zakodowania.

maxTokenCount
Int32

Maksymalna liczba tokenów w celu ograniczenia pojemności kodowania.

addPrefixSpace
Boolean

Określ, czy przed kodowaniem tekstu należy uwzględnić spację wiodącą.

addBeginningOfSentence
Boolean

Określ, czy należy uwzględnić początek tokenu zdania w kodowaniu.

addEndOfSentence
Boolean

Określ, czy należy uwzględnić koniec tokenu zdania w kodowaniu.

normalizedText
String

Jeśli normalizacja tokenizatora jest włączona, tekst wejściowy będzie reprezentowany w postaci normalizacji; w przeciwnym razie będzie mieć wartość null.

tokenCount
Int32

Liczbę tokenów można wygenerować, która powinna być mniejsza niż maksymalna liczba tokenów.

considerPreTokenization
Boolean

Określ, czy należy rozważyć wstępne tokenizację przed tokenizacją.

considerNormalization
Boolean

Określ, czy należy rozważyć normalizację przed tokenizacją.

Zwraca

Indeks początkowy maksymalnej pojemności kodowania w przetworzonym tekście bez przekraczania limitu tokenu. Reprezentuje indeks w pierwszym znaku, który ma zostać uwzględniony. W przypadkach, gdy żadne tokeny nie pasują, wynik będzie mieć długość normalizedText, natomiast jeśli wszystkie tokeny pasują, wynik będzie wynosić 0.

Uwagi

Jeśli cały tekst może być zakodowany w limicie tokenu, zwrócony indeks będzie wynosić 0.

Dotyczy

GetIndexByTokenCountFromEnd(String, Int32, Boolean, Boolean, Boolean, String, Int32, Boolean, Boolean)

Źródło:
CodeGenTokenizer.cs
Źródło:
CodeGenTokenizer.cs
Źródło:
CodeGenTokenizer.cs

Znajdź indeks maksymalnej pojemności kodowania z końca tekstu bez przekraczania limitu tokenu.

public int GetIndexByTokenCountFromEnd(string text, int maxTokenCount, bool addPrefixSpace, bool addBeginningOfSentence, bool addEndOfSentence, out string? normalizedText, out int tokenCount, bool considerPreTokenization = true, bool considerNormalization = true);
override this.GetIndexByTokenCountFromEnd : string * int * bool * bool * bool * string * int * bool * bool -> int
Public Function GetIndexByTokenCountFromEnd (text As String, maxTokenCount As Integer, addPrefixSpace As Boolean, addBeginningOfSentence As Boolean, addEndOfSentence As Boolean, ByRef normalizedText As String, ByRef tokenCount As Integer, Optional considerPreTokenization As Boolean = true, Optional considerNormalization As Boolean = true) As Integer

Parametry

text
String

Tekst do zakodowania.

maxTokenCount
Int32

Maksymalna liczba tokenów w celu ograniczenia pojemności kodowania.

addPrefixSpace
Boolean

Określ, czy przed kodowaniem tekstu należy uwzględnić spację wiodącą.

addBeginningOfSentence
Boolean

Określ, czy należy uwzględnić początek tokenu zdania w kodowaniu.

addEndOfSentence
Boolean

Określ, czy należy uwzględnić koniec tokenu zdania w kodowaniu.

normalizedText
String

Jeśli normalizacja tokenizatora jest włączona, tekst wejściowy będzie reprezentowany w postaci normalizacji; w przeciwnym razie będzie mieć wartość null.

tokenCount
Int32

Liczbę tokenów można wygenerować, która powinna być mniejsza niż maksymalna liczba tokenów.

considerPreTokenization
Boolean

Określ, czy należy rozważyć wstępne tokenizację przed tokenizacją.

considerNormalization
Boolean

Określ, czy należy rozważyć normalizację przed tokenizacją.

Zwraca

Indeks początkowy maksymalnej pojemności kodowania w przetworzonym tekście bez przekraczania limitu tokenu. Reprezentuje indeks w pierwszym znaku, który ma zostać uwzględniony. W przypadkach, gdy tokeny nie pasują, wynik będzie mieć długość tekstu lub normalizedText jeśli normalizacja jest włączona; z drugiej strony, jeśli wszystkie tokeny pasują, wynik będzie wynosić 0.

Uwagi

Jeśli cały tekst może być zakodowany w limicie tokenu, zwrócony indeks będzie wynosić 0.

Dotyczy