Spectral Clustering 並用silhouette指標值確定最優聚類數目

本文轉載自查看原文 2019-02-19 11:08 1815 python

clusterDatathon.py 說明：

輸入：（dataExample）

處理：選擇一系列的cluster數目，進行spectral clustering（經過比較，感覺spectral clustering可能效果好一點），通過silhouette指標值確定最優聚類數目

輸出：

代碼如下：

 1 import pandas as pd
 2 import numpy as np
 3 from sklearn import metrics
 4 from sklearn.cluster import SpectralClustering
 5 
 6 ##讀入data
 7 dfs = pd.read_excel(r"C:\Users\Yi\Desktop\datathon\dataExample.xls")
 8 dfs = dfs.values
 9 [n_examples,n_features]=dfs.shape
10 
11 ##用spectral clustering
12 ##用一系列的cluster數目，根據silhouette指標值確定最優分類數目
13 small=5
14 large=40
15 silScore=np.zeros([1,large-small+1])
16 
17 for i in range(small,large):
18     clustering_i = SpectralClustering(n_clusters=i,assign_labels="discretize",random_state=5).fit(dfs)
19     labels = clustering_i.labels_
20     silScore[0,i-small]=metrics.silhouette_score(dfs, labels, metric='euclidean')
21 
22 ##找到silhouette指標值最大時 cluster數目                                               
23 index=np.argmax(silScore)
24 
25 ##此時的聚類結果
26 n_clusters=index+small
27 cluster_result=SpectralClustering(n_clusters,assign_labels="discretize",random_state=5).fit(dfs)
28 labels_result=cluster_result.labels_
29 
30 ##輸出各example的所屬類
31 print("the number of clusters: \n", n_clusters)
32 print("to which cluster, the example belongs: \n",labels_result)

免責聲明！

本站轉載的文章為個人學習借鑒使用，本站對版權不負任何法律責任。如果侵犯了您的隱私權益，請聯系本站郵箱yoyou2525@163.com刪除。

猜您在找 譜聚類算法(Spectral Clustering) 譜聚類(Spectral Clustering)詳解譜聚類（Spectral clustering）（1）：RatioCut 譜聚類（Spectral clustering）（2）:NCut 譜聚類算法(Spectral Clustering)優化與擴展譜聚類（spectral clustering）原理總結【譜聚類】關於譜聚類（Spectral Clustering）的一個總結 Spectral Clustering Clustering[Spectral Clustering] 【機器學習】確定最佳聚類數目的10種方法