Clustering es una tecnología de Aprendizaje no supervisado para encontrar estructuras intrínsecas a los datos. El clustering organiza los datos en grupos con similaridades llamados clusters. Los datos en un mismo cluster son similares entre sí.

Existe clustering:

  • Particional: genera clusters mutuamente excluyentes. Ejemplo: K-means.
  • Jerárquico: el Clustering Jerárquico agrupa mediante una secuencia anidada de clusters.

El clustering necesita una función de similaridad o distancia.