PredictCaseLikelihood (DMX)

Dotyczy: usług SQL Server Analysis Services

Funkcja ta zwraca prawdopodobieństwo, że przypadek wejściowy zmieści się w istniejącym modelu. Używane tylko w modelach klastrowania.

Syntax

  
PredictCaseLikelihood([NORMALIZED|NONNORMALIZED])  

Arguments

ZNORMALIZOWANE
Wartość zwrotna zawiera prawdopodobieństwo przypadku w modelu podzielone przez prawdopodobieństwo przypadku bez modelu.

NIEZNORMALIZOWANE
Wartość zwrotu zawiera surowe prawdopodobieństwo przypadku, które jest iloczynem prawdopodobieństw atrybutów przypadku.

Ma zastosowanie do

Modele budowane przy użyciu algorytmów Microsoft Clustering i Microsoft Sequence Clustering.

Zwracany typ

Podwójna precyzja zmiennoprzecinkowa w zakresie od 0 do 1. Liczba bliższa 1 wskazuje, że przypadek ma większe prawdopodobieństwo wystąpienia w tym modelu. Liczba bliższa 0 wskazuje, że przypadek ten jest mniej prawdopodobny w tym modelu.

Remarks

Domyślnie wynik funkcji PredictCaseLikelihood jest znormalizowany. Wartości znormalizowane są zazwyczaj bardziej użyteczne, gdy liczba atrybutów w przypadku rośnie, a różnice między surowymi prawdopodobieństwami dowolnych dwóch przypadków stają się znacznie mniejsze.

Do obliczenia znormalizowanych wartości używa się następującego równania, dla danych x i y:

  • x = prawdopodobieństwo przypadku na podstawie modelu klastrowania

  • y = marginalne prawdopodobieństwo przypadku, obliczane jako log prawdopodobieństwa przypadku na podstawie liczenia przypadków treningowych

  • Z = Exp( log(x) - Log(Y))

Znormalizowane = (z/ (1+z))

Examples

Poniższy przykład zwraca prawdopodobieństwo, że dany przypadek wystąpi w modelu klastrowania, który opiera się na bazie danych Adventure Works DW.

SELECT  
  PredictCaseLikelihood() AS Default_Likelihood,  
  PredictCaseLikelihood(NORMALIZED) AS Normalized_Likelihood,  
  PredictCaseLikelihood(NONNORMALIZED) AS Raw_Likelihood,  
FROM  
  [TM Clustering]  
NATURAL PREDICTION JOIN  
(SELECT 28 AS [Age],  
  '2-5 Miles' AS [Commute Distance],  
  'Graduate Degree' AS [Education],  
  0 AS [Number Cars Owned],  
  0 AS [Number Children At Home]) AS t  

Oczekiwane wyniki:

Default_Likelihood Normalized_Likelihood Raw_Likelihood
6.30672792729321E-08 6.30672792729321E-08 9.5824454056846E-48

Różnica między tymi wynikami pokazuje efekt normalizacji. Wartość surowa CaseLikelihood sugeruje, że prawdopodobieństwo wystąpienia przypadku wynosi około 20 procent; Jednak gdy normalizujesz wyniki, staje się jasne, że prawdopodobieństwo wystąpienia jest bardzo niskie.