Clustering es una tecnología de Aprendizaje no supervisado para encontrar estructuras intrínsecas a los datos. El clustering organiza los datos en grupos con similaridades llamados clusters. Los datos en un mismo cluster son similares entre sí.
Existe clustering:
- Particional: genera clusters mutuamente excluyentes. Ejemplo: K-means.
- Jerárquico: el Clustering Jerárquico agrupa mediante una secuencia anidada de clusters.
El clustering necesita una función de similaridad o distancia.