↗jriediger/duplicate-clusteringCluster similar documents based on text similarity (semantic duplicates)