Coordenadas Paralelas
Parallel Coordinates
Qué es
Ejes verticales paralelos (uno por variable) con líneas que conectan los valores de cada observación en todos los ejes. Permite explorar datos multidimensionales.
Para qué sirve
Para explorar patrones y clusters en datasets con muchas variables numéricas simultáneamente, especialmente en análisis exploratorio.
Cómo leerlo
Anatomía
La técnica se formalizó a mediados de la década de 1980 como un problema de geometría computacional: cómo representar en el plano —dos dimensiones— relaciones entre N variables sin perder la posibilidad de leer geometría exacta entre ellas. El hallazgo central es una dualidad punto-línea: un punto en el espacio N-dimensional se convierte en una polilínea que cruza N ejes paralelos, y ciertas propiedades geométricas del espacio original —convexidad, proximidad, agrupamiento— se conservan como propiedades visuales de esas líneas. La técnica se aplicó primero a control de procesos industriales y aviación antes de llegar a la visualización de datos exploratoria. Solo se ven con claridad las relaciones directas entre ejes adyacentes; reordenar los ejes revela o esconde correlaciones distintas entre el mismo conjunto de variables.
Por qué funciona
Fundamento perceptivo
Permite ver relaciones entre muchas variables a la vez. Las líneas que no se cruzan en dos ejes adyacentes indican correlación positiva entre esas variables.
Errores comunes
Caos con muchas observaciones
se satura visualmente, así que la interactividad (filtrar por rango en cada eje) es esencial para que sea útil analíticamente.
Dónde se usa
Contextos de aplicación

Comparación de productos en varias dimensiones
Cada producto es una línea que cruza precio, peso, potencia y consumo.

Perfiles de clientes multivariados
Los clusters aparecen como haces de líneas con trayectorias similares.

Exploración de datos de sensores
Muchas variables simultáneas, cada registro cruzándolas todas.
Cómo construirlo
El mismo gráfico, en 11 librerías open source
Cada librería resuelve las mismas decisiones de diseño, como la escala, el espaciado entre barras o la inserción de la etiqueta de valor, de un modo distinto. Algunas las automatizan; otras las dejan explícitas en el código, a criterio de quien lo escribe. Comparar once implementaciones con los mismos datos y el mismo color de marca aísla esa diferencia, que de otro modo queda oculta detrás de estilos visuales distintos.
Cinco regiones de Chile, tres formas de ser distintas
Fuente: Fundación Sol (ESI 2024), INE (Censo 2024) y BCN
Cinco regiones de Chile en tres variables con escalas muy distintas entre sí (mismo dataset que el ejemplo principal de esta ficha): ingreso mediano, población y superficie. ECharts y Plotly tienen un tipo de coordenadas paralelas nativo, con cada eje conservando su propia escala real; las demás 9 librerías necesitan normalizar los tres valores a un rango 0-1 compartido para que convivan en un solo eje vertical. Sin coordenadas paralelas nativas: se normaliza cada dimensión a 0-1 y se dibuja como un line plot común, con una línea vertical por dimensión a modo de eje.
import matplotlib.pyplot as plt
# Sin coordenadas paralelas nativas: se normaliza cada dimension a 0-1
# (porque las tres escalas son incompatibles entre si) y se dibuja
# como un line plot comun sobre un eje x categorico, con una linea
# vertical por cada dimension a modo de "eje".
for region in regiones:
ax.plot(range(3), normalizar(region["valores"]), color=region["color"], marker="o")
ax.set_xticks(range(3)); ax.set_xticklabels(nombres_dims)
ax.set_yticks([])
plt.show()Herramientas para construirlo
No-code, desktop y plataformas web, con su licencia visible, abierta o comercial.
Términos relacionados
Con datos reales
Ejemplos de uso.
Cinco regiones de Chile, tres formas de ser distintas
Ingreso mediano, población y superficie por región.
Gráficos relacionados