TorchSharpCatalog.SentenceSimilarity 方法
定義
重要
部分資訊涉及發行前產品,在發行之前可能會有大幅修改。 Microsoft 對此處提供的資訊,不做任何明確或隱含的瑕疵擔保。
多載
| 名稱 | Description |
|---|---|
| SentenceSimilarity(RegressionCatalog+RegressionTrainers, SentenceSimilarityTrainer+SentenceSimilarityOptions) |
微調NLP句子相似度的 NAS-BERT 模型。 任何句子的上限為512個代幣。 每個單字通常對應一個詞元,我們會自動加入兩個特殊詞元(起始詞和分隔詞),因此一般來說,這個限制是所有句子的 510 字。 |
| SentenceSimilarity(RegressionCatalog+RegressionTrainers, String, String, String, String, Int32, Int32, BertArchitecture, IDataView) |
微調NLP句子相似度的 NAS-BERT 模型。 任何句子的上限為512個代幣。 每個單字通常對應一個詞元,我們會自動加入兩個特殊詞元(起始詞和分隔詞),因此一般來說,這個限制是所有句子的 510 字。 |
SentenceSimilarity(RegressionCatalog+RegressionTrainers, SentenceSimilarityTrainer+SentenceSimilarityOptions)
微調NLP句子相似度的 NAS-BERT 模型。 任何句子的上限為512個代幣。 每個單字通常對應一個詞元,我們會自動加入兩個特殊詞元(起始詞和分隔詞),因此一般來說,這個限制是所有句子的 510 字。
public static Microsoft.ML.TorchSharp.NasBert.SentenceSimilarityTrainer SentenceSimilarity(this Microsoft.ML.RegressionCatalog.RegressionTrainers catalog, Microsoft.ML.TorchSharp.NasBert.SentenceSimilarityTrainer.SentenceSimilarityOptions options);
static member SentenceSimilarity : Microsoft.ML.RegressionCatalog.RegressionTrainers * Microsoft.ML.TorchSharp.NasBert.SentenceSimilarityTrainer.SentenceSimilarityOptions -> Microsoft.ML.TorchSharp.NasBert.SentenceSimilarityTrainer
<Extension()>
Public Function SentenceSimilarity (catalog As RegressionCatalog.RegressionTrainers, options As SentenceSimilarityTrainer.SentenceSimilarityOptions) As SentenceSimilarityTrainer
參數
變身者的目錄。
進階選項
傳回
適用於
SentenceSimilarity(RegressionCatalog+RegressionTrainers, String, String, String, String, Int32, Int32, BertArchitecture, IDataView)
微調NLP句子相似度的 NAS-BERT 模型。 任何句子的上限為512個代幣。 每個單字通常對應一個詞元,我們會自動加入兩個特殊詞元(起始詞和分隔詞),因此一般來說,這個限制是所有句子的 510 字。
public static Microsoft.ML.TorchSharp.NasBert.SentenceSimilarityTrainer SentenceSimilarity(this Microsoft.ML.RegressionCatalog.RegressionTrainers catalog, string labelColumnName = "Label", string scoreColumnName = "Score", string sentence1ColumnName = "Sentence1", string sentence2ColumnName = "Sentence2", int batchSize = 32, int maxEpochs = 10, Microsoft.ML.TorchSharp.NasBert.BertArchitecture architecture = Microsoft.ML.TorchSharp.NasBert.BertArchitecture.Roberta, Microsoft.ML.IDataView validationSet = default);
static member SentenceSimilarity : Microsoft.ML.RegressionCatalog.RegressionTrainers * string * string * string * string * int * int * Microsoft.ML.TorchSharp.NasBert.BertArchitecture * Microsoft.ML.IDataView -> Microsoft.ML.TorchSharp.NasBert.SentenceSimilarityTrainer
<Extension()>
Public Function SentenceSimilarity (catalog As RegressionCatalog.RegressionTrainers, Optional labelColumnName As String = "Label", Optional scoreColumnName As String = "Score", Optional sentence1ColumnName As String = "Sentence1", Optional sentence2ColumnName As String = "Sentence2", Optional batchSize As Integer = 32, Optional maxEpochs As Integer = 10, Optional architecture As BertArchitecture = Microsoft.ML.TorchSharp.NasBert.BertArchitecture.Roberta, Optional validationSet As IDataView = Nothing) As SentenceSimilarityTrainer
參數
變身者的目錄。
- labelColumnName
- String
標籤欄位名稱。 欄位應該是浮點子類型。
- scoreColumnName
- String
分數欄名稱。
- sentence1ColumnName
- String
第一句話的專欄名稱。
- sentence2ColumnName
- String
第二句話的欄位名稱。 只有當你的NLP分類需要句子對時才需要。
- batchSize
- Int32
批次中的數據列數目。
- maxEpochs
- Int32
訓練集最多循環次數。
- architecture
- BertArchitecture
模型的架構。 預設是羅伯塔。
- validationSet
- IDataView
訓練時用於提升模型品質的驗證集。