Nota:
El acceso a esta página requiere autorización. Puede intentar iniciar sesión o cambiar directorios.
El acceso a esta página requiere autorización. Puede intentar cambiar los directorios.
Puede trabajar con conjuntos duplicados de valores a través de transformaciones que pueden quitar duplicados de los datos. O bien, puede filtrar los datos para mostrar solo duplicados, por lo que puede centrarse en ellos.
Advertencia
Power Query distingue mayúsculas de minúsculas. Al trabajar con valores duplicados, Power Query considera el caso del texto, lo que podría provocar resultados no deseados. Como solución alternativa, puede aplicar una transformación a mayúsculas o a minúsculas antes de eliminar duplicados.
En este artículo, los ejemplos usan la tabla siguiente con las columnas ID, Category y Total .
Nota:
La aplicación de un paso para quitar duplicados podría aumentar significativamente el consumo de memoria si Power Query no puede descargar esta operación en el origen de datos back-end (conocido como "plegado").
Quitar filas duplicadas en Power Query
Use Quitar duplicados para eliminar filas en las que las columnas seleccionadas contienen valores repetidos. Power Query distingue entre mayúsculas y minúsculas al comparar valores, por lo que aplique primero una transformación a mayúsculas o minúsculas si no quiere que esa diferencia afecte a la comparación.
Seleccione las columnas que contienen valores duplicados.
Vaya a la pestaña Inicio .
En el grupo Reducir filas , seleccione Quitar filas.
En el menú desplegable, seleccione Quitar duplicados.
Advertencia
Power Query no garantiza que mantenga la primera instancia de un conjunto de duplicados cuando elimina duplicados. Para obtener más información sobre cómo conservar la ordenación, consulte Conservar la ordenación.
Eliminación de duplicados de varias columnas
Con la tabla de ejemplo con las columnas ID, Category y Total , en este ejemplo se quitan filas duplicadas basadas en todas las columnas.
Tiene cuatro filas que son duplicadas. El objetivo es quitar esas filas duplicadas, por lo que solo hay filas únicas en la tabla. Seleccione todas las columnas de la tabla y, a continuación, seleccione Quitar duplicados.
La tabla de salida solo contiene filas con combinaciones únicas en todas las columnas.
Nota:
También puede realizar esta operación con un subconjunto de columnas.
Quitar duplicados de una sola columna
Con la misma tabla de ejemplo, en este ejemplo se quitan filas duplicadas basadas solo en la columna Categoría .
Desea quitar los duplicados y mantener solo valores únicos. Para quitar duplicados de la columna Categoría , selecciónelo y, a continuación, seleccione Quitar duplicados.
La tabla de salida conserva solo la primera fila para cada valor de categoría único.
Mantener filas duplicadas en Power Query
Usa Mantener duplicados para filtrar tu tabla de modo que solo muestre las filas con valores repetidos en las columnas seleccionadas. Power Query distingue mayúsculas de minúsculas al comparar valores.
Seleccione las columnas que contienen valores duplicados.
Vaya a la pestaña Inicio .
En el grupo Reducir filas , seleccione Mantener filas.
En el menú desplegable, seleccione Mantener duplicados.
Mantener duplicados de varias columnas
Con la tabla de ejemplo con las columnas ID, Category y Total , en este ejemplo solo se conservan las filas que aparecen más de una vez en todas las columnas.
Tiene cuatro filas que son duplicadas. El objetivo de este ejemplo es mantener solo las filas duplicadas en la tabla. Seleccione todas las columnas de la tabla y, a continuación, seleccione Mantener duplicados.
La tabla de salida contiene solo las filas que tenían valores coincidentes en otra fila.
Conservar duplicados de una sola columna
Con la misma tabla de ejemplo, este ejemplo solo mantiene las filas en las que el valor de la columna ID aparece más de una vez.
En este ejemplo, tienes varios duplicados que quieres conservar en tu tabla. Para mantener duplicados de la columna ID , seleccione la columna ID y, a continuación, seleccione Mantener duplicados.
La tabla de salida contiene todas las filas donde el valor de identificador apareció más de una vez.