Tokenizer.EncodeToTokens メソッド

定義

オーバーロード

名前 説明
EncodeToTokens(String, ReadOnlySpan<Char>, EncodeSettings)

入力テキストを EncodedTokenの一覧にエンコードします。

EncodeToTokens(ReadOnlySpan<Char>, String, Boolean, Boolean)

入力テキストを EncodedTokenの一覧にエンコードします。

EncodeToTokens(String, String, Boolean, Boolean)

入力テキストを EncodedTokenの一覧にエンコードします。

EncodeToTokens(String, ReadOnlySpan<Char>, EncodeSettings)

ソース:
Tokenizer.cs
ソース:
Tokenizer.cs
ソース:
Tokenizer.cs

入力テキストを EncodedTokenの一覧にエンコードします。

protected abstract Microsoft.ML.Tokenizers.EncodeResults<Microsoft.ML.Tokenizers.EncodedToken> EncodeToTokens(string? text, ReadOnlySpan<char> textSpan, Microsoft.ML.Tokenizers.EncodeSettings settings);
abstract member EncodeToTokens : string * ReadOnlySpan<char> * Microsoft.ML.Tokenizers.EncodeSettings -> Microsoft.ML.Tokenizers.EncodeResults<Microsoft.ML.Tokenizers.EncodedToken>
Protected MustOverride Function EncodeToTokens (text As String, textSpan As ReadOnlySpan(Of Char), settings As EncodeSettings) As EncodeResults(Of EncodedToken)

パラメーター

text
String

エンコードするテキスト。

textSpan
ReadOnlySpan<Char>

textnullされている場合に使用されるエンコードするテキストのスパン。

settings
EncodeSettings

テキストのエンコードに使用する設定。

返品

適用対象

EncodeToTokens(ReadOnlySpan<Char>, String, Boolean, Boolean)

ソース:
Tokenizer.cs
ソース:
Tokenizer.cs
ソース:
Tokenizer.cs

入力テキストを EncodedTokenの一覧にエンコードします。

public System.Collections.Generic.IReadOnlyList<Microsoft.ML.Tokenizers.EncodedToken> EncodeToTokens(ReadOnlySpan<char> text, out string? normalizedText, bool considerPreTokenization = true, bool considerNormalization = true);
member this.EncodeToTokens : ReadOnlySpan<char> * string * bool * bool -> System.Collections.Generic.IReadOnlyList<Microsoft.ML.Tokenizers.EncodedToken>
Public Function EncodeToTokens (text As ReadOnlySpan(Of Char), ByRef normalizedText As String, Optional considerPreTokenization As Boolean = true, Optional considerNormalization As Boolean = true) As IReadOnlyList(Of EncodedToken)

パラメーター

text
ReadOnlySpan<Char>

エンコードするテキスト。

normalizedText
String

トークナイザーの正規化が有効になっているか、 <paramRef name="considerNormalization"></paramRef> が false場合、これは正規化された形式で <paramRef name="text"></paramRef> に設定されます。それ以外の場合、この値は nullに設定されます。

considerPreTokenization
Boolean

トークン化の前に事前トークン化を検討するかどうかを示します。

considerNormalization
Boolean

トークン化の前に正規化を検討するかどうかを示します。

返品

エンコードされた EncodedTokenの一覧。

適用対象

EncodeToTokens(String, String, Boolean, Boolean)

ソース:
Tokenizer.cs
ソース:
Tokenizer.cs
ソース:
Tokenizer.cs

入力テキストを EncodedTokenの一覧にエンコードします。

public System.Collections.Generic.IReadOnlyList<Microsoft.ML.Tokenizers.EncodedToken> EncodeToTokens(string text, out string? normalizedText, bool considerPreTokenization = true, bool considerNormalization = true);
member this.EncodeToTokens : string * string * bool * bool -> System.Collections.Generic.IReadOnlyList<Microsoft.ML.Tokenizers.EncodedToken>
Public Function EncodeToTokens (text As String, ByRef normalizedText As String, Optional considerPreTokenization As Boolean = true, Optional considerNormalization As Boolean = true) As IReadOnlyList(Of EncodedToken)

パラメーター

text
String

エンコードするテキスト。

normalizedText
String

トークナイザーの正規化が有効になっているか、 <paramRef name="considerNormalization"></paramRef> が false場合、これは正規化された形式で <paramRef name="text"></paramRef> に設定されます。それ以外の場合、この値は nullに設定されます。

considerPreTokenization
Boolean

トークン化の前に事前トークン化を検討するかどうかを示します。

considerNormalization
Boolean

トークン化の前に正規化を検討するかどうかを示します。

返品

エンコードされた EncodedTokenの一覧。

適用対象