語言

TorchSharpCatalog.SentenceSimilarity 方法

定義

多載

名稱 Description
SentenceSimilarity(RegressionCatalog+RegressionTrainers, SentenceSimilarityTrainer+SentenceSimilarityOptions)

微調NLP句子相似度的 NAS-BERT 模型。 任何句子的上限為512個代幣。 每個單字通常對應一個詞元,我們會自動加入兩個特殊詞元(起始詞和分隔詞),因此一般來說,這個限制是所有句子的 510 字。

SentenceSimilarity(RegressionCatalog+RegressionTrainers, String, String, String, String, Int32, Int32, BertArchitecture, IDataView)

微調NLP句子相似度的 NAS-BERT 模型。 任何句子的上限為512個代幣。 每個單字通常對應一個詞元,我們會自動加入兩個特殊詞元(起始詞和分隔詞),因此一般來說,這個限制是所有句子的 510 字。

SentenceSimilarity(RegressionCatalog+RegressionTrainers, SentenceSimilarityTrainer+SentenceSimilarityOptions)

來源:
TorchSharpCatalog.cs
來源:
TorchSharpCatalog.cs
來源:
TorchSharpCatalog.cs

微調NLP句子相似度的 NAS-BERT 模型。 任何句子的上限為512個代幣。 每個單字通常對應一個詞元,我們會自動加入兩個特殊詞元(起始詞和分隔詞),因此一般來說,這個限制是所有句子的 510 字。

public static Microsoft.ML.TorchSharp.NasBert.SentenceSimilarityTrainer SentenceSimilarity(this Microsoft.ML.RegressionCatalog.RegressionTrainers catalog, Microsoft.ML.TorchSharp.NasBert.SentenceSimilarityTrainer.SentenceSimilarityOptions options);
static member SentenceSimilarity : Microsoft.ML.RegressionCatalog.RegressionTrainers * Microsoft.ML.TorchSharp.NasBert.SentenceSimilarityTrainer.SentenceSimilarityOptions -> Microsoft.ML.TorchSharp.NasBert.SentenceSimilarityTrainer
<Extension()>
Public Function SentenceSimilarity (catalog As RegressionCatalog.RegressionTrainers, options As SentenceSimilarityTrainer.SentenceSimilarityOptions) As SentenceSimilarityTrainer

參數

catalog
RegressionCatalog.RegressionTrainers

變身者的目錄。

傳回

適用於

SentenceSimilarity(RegressionCatalog+RegressionTrainers, String, String, String, String, Int32, Int32, BertArchitecture, IDataView)

來源:
TorchSharpCatalog.cs
來源:
TorchSharpCatalog.cs
來源:
TorchSharpCatalog.cs

微調NLP句子相似度的 NAS-BERT 模型。 任何句子的上限為512個代幣。 每個單字通常對應一個詞元,我們會自動加入兩個特殊詞元(起始詞和分隔詞),因此一般來說,這個限制是所有句子的 510 字。

public static Microsoft.ML.TorchSharp.NasBert.SentenceSimilarityTrainer SentenceSimilarity(this Microsoft.ML.RegressionCatalog.RegressionTrainers catalog, string labelColumnName = "Label", string scoreColumnName = "Score", string sentence1ColumnName = "Sentence1", string sentence2ColumnName = "Sentence2", int batchSize = 32, int maxEpochs = 10, Microsoft.ML.TorchSharp.NasBert.BertArchitecture architecture = Microsoft.ML.TorchSharp.NasBert.BertArchitecture.Roberta, Microsoft.ML.IDataView validationSet = default);
static member SentenceSimilarity : Microsoft.ML.RegressionCatalog.RegressionTrainers * string * string * string * string * int * int * Microsoft.ML.TorchSharp.NasBert.BertArchitecture * Microsoft.ML.IDataView -> Microsoft.ML.TorchSharp.NasBert.SentenceSimilarityTrainer
<Extension()>
Public Function SentenceSimilarity (catalog As RegressionCatalog.RegressionTrainers, Optional labelColumnName As String = "Label", Optional scoreColumnName As String = "Score", Optional sentence1ColumnName As String = "Sentence1", Optional sentence2ColumnName As String = "Sentence2", Optional batchSize As Integer = 32, Optional maxEpochs As Integer = 10, Optional architecture As BertArchitecture = Microsoft.ML.TorchSharp.NasBert.BertArchitecture.Roberta, Optional validationSet As IDataView = Nothing) As SentenceSimilarityTrainer

參數

catalog
RegressionCatalog.RegressionTrainers

變身者的目錄。

labelColumnName
String

標籤欄位名稱。 欄位應該是浮點子類型。

scoreColumnName
String

分數欄名稱。

sentence1ColumnName
String

第一句話的專欄名稱。

sentence2ColumnName
String

第二句話的欄位名稱。 只有當你的NLP分類需要句子對時才需要。

batchSize
Int32

批次中的數據列數目。

maxEpochs
Int32

訓練集最多循環次數。

architecture
BertArchitecture

模型的架構。 預設是羅伯塔。

validationSet
IDataView

訓練時用於提升模型品質的驗證集。

傳回

適用於