Trabajar con valores duplicados

Puede trabajar con conjuntos duplicados de valores a través de transformaciones que pueden quitar duplicados de los datos. O bien, puede filtrar los datos para mostrar solo duplicados, por lo que puede centrarse en ellos.

Advertencia

Power Query distingue mayúsculas de minúsculas. Al trabajar con valores duplicados, Power Query considera el caso del texto, lo que podría provocar resultados no deseados. Como solución alternativa, puede aplicar una transformación a mayúsculas o a minúsculas antes de eliminar duplicados.

En este artículo, los ejemplos usan la tabla siguiente con las columnas ID, Category y Total .

Captura de pantalla de la tabla de ejemplo inicial que contiene las columnas ID, Category y Total.

Nota:

La aplicación de un paso para quitar duplicados podría aumentar significativamente el consumo de memoria si Power Query no puede descargar esta operación en el origen de datos back-end (conocido como "plegado").

Quitar filas duplicadas en Power Query

Use Quitar duplicados para eliminar filas en las que las columnas seleccionadas contienen valores repetidos. Power Query distingue entre mayúsculas y minúsculas al comparar valores, por lo que aplique primero una transformación a mayúsculas o minúsculas si no quiere que esa diferencia afecte a la comparación.

  1. Seleccione las columnas que contienen valores duplicados.

  2. Vaya a la pestaña Inicio .

  3. En el grupo Reducir filas , seleccione Quitar filas.

  4. En el menú desplegable, seleccione Quitar duplicados.

    Captura de pantalla que muestra la ubicación de la opción Quitar duplicados en Quitar filas.

Advertencia

Power Query no garantiza que mantenga la primera instancia de un conjunto de duplicados cuando elimina duplicados. Para obtener más información sobre cómo conservar la ordenación, consulte Conservar la ordenación.

Eliminación de duplicados de varias columnas

Con la tabla de ejemplo con las columnas ID, Category y Total , en este ejemplo se quitan filas duplicadas basadas en todas las columnas.

Captura de pantalla de la tabla inicial con duplicados en varias columnas resaltadas.

Tiene cuatro filas que son duplicadas. El objetivo es quitar esas filas duplicadas, por lo que solo hay filas únicas en la tabla. Seleccione todas las columnas de la tabla y, a continuación, seleccione Quitar duplicados.

La tabla de salida solo contiene filas con combinaciones únicas en todas las columnas.

Captura de pantalla de la tabla final con duplicados quitados de todas las columnas.

Nota:

También puede realizar esta operación con un subconjunto de columnas.

Quitar duplicados de una sola columna

Con la misma tabla de ejemplo, en este ejemplo se quitan filas duplicadas basadas solo en la columna Categoría .

Captura de pantalla de la tabla inicial que identifica duplicados en la columna Categoría.

Desea quitar los duplicados y mantener solo valores únicos. Para quitar duplicados de la columna Categoría , selecciónelo y, a continuación, seleccione Quitar duplicados.

La tabla de salida conserva solo la primera fila para cada valor de categoría único.

Captura de pantalla de la tabla final con duplicados quitados de la columna Categoría.

Mantener filas duplicadas en Power Query

Usa Mantener duplicados para filtrar tu tabla de modo que solo muestre las filas con valores repetidos en las columnas seleccionadas. Power Query distingue mayúsculas de minúsculas al comparar valores.

  1. Seleccione las columnas que contienen valores duplicados.

  2. Vaya a la pestaña Inicio .

  3. En el grupo Reducir filas , seleccione Mantener filas.

  4. En el menú desplegable, seleccione Mantener duplicados.

    Captura de pantalla que muestra la ubicación de la opción Mantener duplicados en Mantener filas.

Mantener duplicados de varias columnas

Con la tabla de ejemplo con las columnas ID, Category y Total , en este ejemplo solo se conservan las filas que aparecen más de una vez en todas las columnas.

Captura de pantalla de la tabla inicial para gestionar duplicados en varias columnas.

Tiene cuatro filas que son duplicadas. El objetivo de este ejemplo es mantener solo las filas duplicadas en la tabla. Seleccione todas las columnas de la tabla y, a continuación, seleccione Mantener duplicados.

La tabla de salida contiene solo las filas que tenían valores coincidentes en otra fila.

Captura de pantalla de la tabla final con solo filas duplicadas de varias columnas.

Conservar duplicados de una sola columna

Con la misma tabla de ejemplo, este ejemplo solo mantiene las filas en las que el valor de la columna ID aparece más de una vez.

Tabla inicial para conservar duplicados de una sola columna.

En este ejemplo, tienes varios duplicados que quieres conservar en tu tabla. Para mantener duplicados de la columna ID , seleccione la columna ID y, a continuación, seleccione Mantener duplicados.

La tabla de salida contiene todas las filas donde el valor de identificador apareció más de una vez.

Tabla final con solo filas duplicadas de una sola columna.

Herramientas de generación de perfiles de datos