SystemGetClusterCrossValidationResults (Analysis Services - minería de datos)

Se aplica a: SQL Server 2019 y versiones anteriores de Analysis Services Azure Analysis Services Fabric/Power BI Premium

Importante

La minería de datos estaba en desuso en SQL Server 2017 Analysis Services y ahora se descontinuó en SQL Server 2022 Analysis Services. La documentación no se actualiza para las características en desuso y descontinuadas. Para más información, consulte Compatibilidad con versiones anteriores de Analysis Services.

Este procedimiento almacenado divide la estructura de minería de datos en el número especificado de secciones cruzadas, entrena un modelo para cada partición y devuelve métricas de precisión para cada partición.

Nota Use este procedimiento almacenado solo con una estructura de minería de datos que tenga al menos un modelo de agrupación en clústeres. Para validar entre modelos no agrupados, use SystemGetCrossValidationResults (Analysis Services - Minería de datos).

Syntax

  
SystemGetClusterCrossValidationResults(  
<structure name>,   
[,<mining model list>]  
,<fold count>}  
,<max cases>  
<test list>])  

Arguments

estructura de minería de datos
Nombre de una estructura de minería de datos en la base de datos actual.

(obligatorio)

lista de modelos de minería de datos
Lista separada por comas de modelos de minería de datos que se van a validar.

Si no especifica una lista de modelos de minería de datos, la validación cruzada se ejecuta en todos los modelos de agrupación en clústeres de la estructura especificada.

Nota:

Para validar entre modelos que no son modelos de agrupación en clústeres, use un procedimiento almacenado independiente, SystemGetCrossValidationResults (Analysis Services - Minería de datos).

(opcional).

recuento de plegamientos
Entero en el que se especifica el número de particiones en las que se va a separar el conjunto de datos. El valor mínimo es 2. El número máximo de plegamientos es el número máximo de enteros o el número de casos, lo que sea menor.

Cada partición contiene aproximadamente este número de casos: número máximo deplegamientos de casos/.

No hay valor predeterminado.

Nota:

El número de plegamientos afecta considerablemente al tiempo necesario para realizar la validación cruzada. Si selecciona un número demasiado alto, la consulta puede ejecutarse durante mucho tiempo. En algunos casos, el servidor podría dejar de responder o agotar el tiempo de espera.

(obligatorio)

casos máximos
Entero que especifica el número máximo de casos que se pueden probar.

Un valor de 0 indica que el procedimiento usa todos los casos del origen de datos.

Si especifica un número superior al número real de casos del conjunto de datos, el procedimiento prueba todos los casos del origen de datos.

(obligatorio)

lista de pruebas
Cadena que especifica las opciones de prueba.

Nota Este parámetro está reservado para uso futuro.

(opcional).

Tipo devuelto

La tabla Tipo de valor devuelto contiene puntuaciones para cada partición individual y agregados para todos los modelos.

En la tabla siguiente se describen las columnas devueltas.

Nombre de la columna Description
NombreDelModelo Nombre del modelo que se probó.
NombreDelAtributo Nombre de la columna de predicción. En el caso de los modelos de clúster, siempre null.
AttributeState Valor de destino especificado en la columna de predicción. En el caso de los modelos de clúster, siempre null.
PartitionIndex Índice basado en 1 que identifica a qué partición se aplican los resultados.
PartitionSize Entero que indica cuántos casos se han incluido en cada partición.
Test Tipo de prueba que se realizó.
Medida Nombre de la medida devuelta por la prueba. Las medidas de cada modelo dependen del tipo del valor predecible. Para obtener una definición de cada medida, consulte Validación cruzada (Analysis Services - Minería de datos).

Para obtener una lista de las medidas devueltas para cada tipo de predicción, vea Medidas en el informe de validación cruzada.
Importancia Valor de la medida de prueba especificada.

Observaciones

Para devolver métricas de precisión para todo el conjunto de datos, use SystemGetClusterAccuracyResults (Analysis Services - Minería de datos).

Si el modelo de minería de datos ya contiene pliegues, use SystemGetClusterAccuracyResults (Analysis Services - Minería de datos) para omitir el procesamiento y devolver solo los resultados de validación cruzada.

Examples

En este ejemplo se crea una partición de una estructura de minería de datos en tres plegamientos y se prueban dos modelos de agrupación en clústeres asociados.

En la línea tres se enumeran los modelos de minería de datos que se van a probar. Si no muestra ningún modelo, el código prueba todos los modelos de agrupación en clústeres asociados a la estructura.

La línea cuatro especifica el número de plegamientos y la línea cinco especifica el número máximo de casos que se van a usar.

Los modelos de agrupación en clústeres no requieren que especifique un atributo o valor de predicción.

CALL SystemGetClusterCrossValidationResults(  
[v Target Mail],  
[Cluster 1], [Cluster 2],  
3,  
10000  
)  

Resultados de ejemplo:

NombreDelModelo NombreDelAtributo AttributeState PartitionIndex PartitionSize Test Medida Importancia
Clúster 1 1 3025 Clustering Probabilidad de casos 0.930524511864121
Clúster 1 2 3025 Clustering Probabilidad de casos 0.919184178430778
Clúster 1 3 3024 Clustering Probabilidad de casos 0.929651120490248
Clúster 2 1 1289 Clustering Probabilidad de casos 0.922789726933607
Clúster 2 2 1288 Clustering Probabilidad de casos 0.934865535691068
Clúster 2 3 1288 Clustering Probabilidad de casos 0.924724595688798

Requisitos

A partir de SQL Server 2008, solo SQL Server Enterprise admite la validación cruzada.

Véase también

SystemGetCrossValidationResults (Analysis Services - Minería de datos)
SystemGetAccuracyResults (Analysis Services - Minería de datos)
SystemGetClusterCrossValidationResults
SystemGetClusterAccuracyResults (Analysis Services - Minería de datos)