TextCatalog.ProduceHashedWordBags メソッド

定義

オーバーロード

名前 説明
ProduceHashedWordBags(TransformsCatalog+TextTransforms, String, String[], Int32, Int32, Int32, Boolean, UInt32, Boolean, Int32)

WordHashBagEstimatorを作成します。これは、inputColumnNamesで指定された複数の列を、outputColumnNameという名前の新しい列のハッシュ n グラムの数のベクトルにマップします。

ProduceHashedWordBags(TransformsCatalog+TextTransforms, String, String, Int32, Int32, Int32, Boolean, UInt32, Boolean, Int32)

WordHashBagEstimatorを作成します。inputColumnNameで指定された列を、outputColumnNameという名前の新しい列のハッシュ n グラムの数のベクトルにマップします。

ProduceHashedWordBags(TransformsCatalog+TextTransforms, String, String[], Int32, Int32, Int32, Boolean, UInt32, Boolean, Int32)

ソース:
TextCatalog.cs
ソース:
TextCatalog.cs
ソース:
TextCatalog.cs

WordHashBagEstimatorを作成します。これは、inputColumnNamesで指定された複数の列を、outputColumnNameという名前の新しい列のハッシュ n グラムの数のベクトルにマップします。

public static Microsoft.ML.Transforms.Text.WordHashBagEstimator ProduceHashedWordBags(this Microsoft.ML.TransformsCatalog.TextTransforms catalog, string outputColumnName, string[] inputColumnNames, int numberOfBits = 16, int ngramLength = 1, int skipLength = 0, bool useAllLengths = true, uint seed = 314489979, bool useOrderedHashing = true, int maximumNumberOfInverts = 0);
static member ProduceHashedWordBags : Microsoft.ML.TransformsCatalog.TextTransforms * string * string[] * int * int * int * bool * uint32 * bool * int -> Microsoft.ML.Transforms.Text.WordHashBagEstimator
<Extension()>
Public Function ProduceHashedWordBags (catalog As TransformsCatalog.TextTransforms, outputColumnName As String, inputColumnNames As String(), Optional numberOfBits As Integer = 16, Optional ngramLength As Integer = 1, Optional skipLength As Integer = 0, Optional useAllLengths As Boolean = true, Optional seed As UInteger = 314489979, Optional useOrderedHashing As Boolean = true, Optional maximumNumberOfInverts As Integer = 0) As WordHashBagEstimator

パラメーター

catalog
TransformsCatalog.TextTransforms

変換のカタログ。

outputColumnName
String

inputColumnNamesの変換に起因する列の名前。 この列のデータ型は、 Singleの既知のサイズ ベクトルになります。

inputColumnNames
String[]

データを取得する複数の列の名前。 この推定器は、テキストのベクトルに対して動作します。

numberOfBits
Int32

ハッシュするビット数。 1 ~ 30 の範囲で指定する必要があります。

ngramLength
Int32

Ngram の長さ。

skipLength
Int32

n グラムを構築するときにスキップするトークンの最大数。

useAllLengths
Boolean

すべての n グラムの長さを最大 ngramLength 含めるか、 ngramLengthのみを含めるか。

seed
UInt32

ハッシュ シード。

useOrderedHashing
Boolean

各ソース列の位置をハッシュに含めるかどうか (複数のソース列がある場合)。

maximumNumberOfInverts
Int32

ハッシュ中に、元の値と生成されたハッシュ値の間のマッピングを構築します。 元の値のテキスト表現は、新しい列の注釈のスロット名に格納されます。そのため、ハッシュは多くの初期値を 1 つにマップできます。 maximumNumberOfInverts は、保持する必要があるハッシュに対応する個別の入力値の数の上限を指定します。 <returns>0</returns> は入力値を保持しません。 <returns>-1</returns> は各ハッシュにマッピングされているすべての入力値を保持します。

返品

注釈

WordHashBagEstimator は、前者が内部的にテキストをトークン化し、後者がトークン化されたテキストを入力として受け取るという点で、 NgramHashingEstimator とは異なります。

適用対象

ProduceHashedWordBags(TransformsCatalog+TextTransforms, String, String, Int32, Int32, Int32, Boolean, UInt32, Boolean, Int32)

ソース:
TextCatalog.cs
ソース:
TextCatalog.cs
ソース:
TextCatalog.cs

WordHashBagEstimatorを作成します。inputColumnNameで指定された列を、outputColumnNameという名前の新しい列のハッシュ n グラムの数のベクトルにマップします。

public static Microsoft.ML.Transforms.Text.WordHashBagEstimator ProduceHashedWordBags(this Microsoft.ML.TransformsCatalog.TextTransforms catalog, string outputColumnName, string inputColumnName = default, int numberOfBits = 16, int ngramLength = 1, int skipLength = 0, bool useAllLengths = true, uint seed = 314489979, bool useOrderedHashing = true, int maximumNumberOfInverts = 0);
static member ProduceHashedWordBags : Microsoft.ML.TransformsCatalog.TextTransforms * string * string * int * int * int * bool * uint32 * bool * int -> Microsoft.ML.Transforms.Text.WordHashBagEstimator
<Extension()>
Public Function ProduceHashedWordBags (catalog As TransformsCatalog.TextTransforms, outputColumnName As String, Optional inputColumnName As String = Nothing, Optional numberOfBits As Integer = 16, Optional ngramLength As Integer = 1, Optional skipLength As Integer = 0, Optional useAllLengths As Boolean = true, Optional seed As UInteger = 314489979, Optional useOrderedHashing As Boolean = true, Optional maximumNumberOfInverts As Integer = 0) As WordHashBagEstimator

パラメーター

catalog
TransformsCatalog.TextTransforms

変換のカタログ。

outputColumnName
String

inputColumnNameの変換に起因する列の名前。 この列のデータ型は、 Singleの既知のサイズ ベクトルになります。

inputColumnName
String

データを取得する列の名前。 この推定器は、テキストのベクトルに対して動作します。

numberOfBits
Int32

ハッシュするビット数。 1 ~ 30 の範囲で指定する必要があります。

ngramLength
Int32

Ngram の長さ。

skipLength
Int32

n グラムを構築するときにスキップするトークンの最大数。

useAllLengths
Boolean

すべての n グラムの長さを最大 ngramLength 含めるか、 ngramLengthのみを含めるか。

seed
UInt32

ハッシュ シード。

useOrderedHashing
Boolean

各ソース列の位置をハッシュに含めるかどうか (複数のソース列がある場合)。

maximumNumberOfInverts
Int32

ハッシュ中に、元の値と生成されたハッシュ値の間のマッピングを構築します。 元の値のテキスト表現は、新しい列の注釈のスロット名に格納されます。 そのため、ハッシュは多くの初期値を 1 つにマップできます。 maximumNumberOfInverts は、保持する必要があるハッシュに対応する個別の入力値の数の上限を指定します。 <returns>0</returns> は入力値を保持しません。 <returns>-1</returns> は各ハッシュにマッピングされているすべての入力値を保持します。

返品

注釈

WordHashBagEstimator は、前者が内部的にテキストをトークン化し、後者がトークン化されたテキストを入力として受け取るという点で、 NgramHashingEstimator とは異なります。

適用対象