聚类分析(Q型,R型聚类)算法
- 格式:doc
- 大小:91.50 KB
- 文档页数:10
r型聚类算法r型聚类算法聚类算法是一种常用的数据挖掘技术,通过对数据进行分组,使得同一组内的数据相似度较高,而不同组之间的数据相似度较低。
其中,r型聚类算法是一种基于密度的聚类算法,能够有效地识别出复杂的聚类结构。
一、引言在数据挖掘和机器学习领域,聚类是一项重要任务。
聚类算法的目标是将数据集划分成不同的组,使得同一组内的数据具有较高的相似度,而不同组之间的数据具有较低的相似度。
r型聚类算法是一种热门的聚类算法,具有高效、准确的特点,被广泛应用于各种领域。
二、r型聚类算法原理r型聚类算法基于密度的概念,通过计算数据点周围的点的密度来确定聚类结构。
其核心思想是找到具有高密度的局部区域,这些区域被认为是聚类的中心。
1. 密度定义r型聚类算法中,密度被定义为某个点周围半径为r的圆内包含的点的个数。
密度越大,表示该点周围的数据点越密集。
2. 核心对象核心对象是指在半径为r的圆内包含的点的个数大于等于某个阈值MinPts的点。
核心对象是聚类算法的关键。
3. 直接密度可达(Directly Density Reachable)在r型聚类算法中,直接密度可达是指对于两个点p和q来说,如果q在p的r-领域内,并且p是一个核心对象,那么就称q是直接密度可达于p的。
这个关系是聚类的基础。
4. 密度可达(Density Reachable)对于两个点p和q来说,如果存在一条点的序列p1,p2,...,pn,使得p1=p,pn=q,并且pi+1是pi的直接密度可达点,那么就称q是密度可达于p的。
5. 密度相连(Density Connected)如果存在一个点o,使得点p和q对于o来说是密度可达的,那么称p和q是密度相连的。
密度相连是一种传递关系,能够将具有相似密度的点连接在一起。
三、算法步骤r型聚类算法的具体步骤如下:1. 初始化:设置半径r和最小密度阈值MinPts。
2. 寻找核心对象:遍历数据集中的每一个点,计算其半径为r的圆内包含的点的个数,如果大于等于MinPts,则将其标记为核心对象。
聚类分析cluster analysis聚类分析方法是按样品(或变量)的数据特征,把相似的样品(或变量)倾向于分在同一类中,把不相似的样品(或变量)倾向于分在不同类中。
聚类分析根据分类对象不同分为Q型和R型聚类分析在聚类分析过程中类的个数如何来确定才合适呢?这是一个十分困难的问题,人们至今仍未找到令人满意的方法。
但是这个问题又是不可回避的。
下面我们介绍几种方法。
1、给定阈值——通过观测聚类图,给出一个合适的阈值T。
要求类与类之间的距离不要超过T值。
例如我们给定T=0.35,当聚类时,类间的距离已经超过了0.35,则聚类结束。
聚类分析的出发点是研究对象之间可能存在的相似性和亲疏关系。
样品间亲疏程度的测度研究样品或变量的亲疏程度的数量指标有两种,一种叫相似系数,性质越接近的变量或样品,它们的相似系数越接近于1或一l,而彼此无关的变量或样品它们的相似系数则越接近于0,相似的为一类,不相似的为不同类;另一种叫距离,它是将每一个样品看作p维空间的一个点,并用某种度量测量点与点之间的距离,距离较近的归为一类,距离较远的点应属于不同的类。
变量之间的聚类即R型聚类分析,常用相似系数来测度变量之间的亲疏程度。
而样品之间的聚类即Q型聚类分析,则常用距离来测度样品之间的亲疏程度。
定义:在聚类分析中反映样品或变量间关系亲疏程度的统计量称为聚类统计量,常用的聚类统计量分为距离和相似系数两种。
距离:用于对样品的聚类。
常用欧氏距离,在求距离前,需把指标进行标准化。
相似系数:常用于对变量的聚类。
一般采用相关系数。
相似性度量:距离和相似系数。
距离常用来度量样品之间的相似性,相似系数常用来度量变量之间的相似性。
样品之间的距离和相似系数有着各种不同的定义,而这些定义与变量的类型有着非常密切的关系。
距离和相似系数这两个概念反映了样品(或变量)之间的相似程度。
相似程度越高,一般两个样品(或变量)间的距离就越小或相似系数的绝对值就越大;反之,相似程度越低,一般两个样品(或变量)间的距离就越大或相似系数的绝对值就越小。
聚类分析是一种建立分类的多元统计分析方法,它能够将一批样本(或变量)数据根据其诸多特征,按照在性质上的亲疏程度在没有先验知识的情况下进行自动分类,产生多个分类结果,类内部个体特征具有相似性,不同类间个体特征的差异性较大。
没有先验知识是指没有事先指定分类标准。
亲疏程度是指各变量取之上的总体差异程度。
对亲疏程度的测量一般有两个角度:第一,个体间的相似程度;第二,个体间的差异程度。
相似程度通常用简单相关系数或等级相关系数。
差异程度通常计算某种距离来测度。
距离公式:①欧氏距离(Euclidean distance )(),EUCLID x y =②平方欧氏距离(Squared Euclidean distance )()()21,ki i i SEUCLID x y x y ==-∑③切比雪夫(Chebychev )距离(),max i i CHEBYCHEV x y x y =-④布洛克(Block )距离()1,ki i i BLOCK x y x y ==-∑⑤明考斯基(Minkowski )距离(),MINKOWSKI x y =⑥夹角余弦定理(Cosine )距离()()2,ki i x y COSINE x y =∑⑦用户自定义(Customized )距离(),CUSTOMIZED x y =在数据类型不同的情况下,个体间的距离计算也有相应的不同。
主要有: 定距型(Interval )计数变量(Count ) 二值变量(Binary )在计数变量时,有卡方距离和Phi 方距离 ①卡方距离(Chi-Square measure )(),CHISQ x y =②Phi 方距离(Phi-Square measure )(),PHISQ x y =二值变量时,有简单匹配系数和雅科比系数 ①简单匹配系数(Simple Matching )(),S x y a b c d =+++②雅科比系数(Jaccard )(),b cJ x y a b c+=++聚类分析的应注意的几点:1.变量的选择:所选择的变量应符合聚类的要求(即指标体系要符合要求)2.数量级的问题:变量之间不应该有数量级上的差异。
聚类分析也是一种分类技术。
与多元分析的其他方法相比,该方法较为粗糙,理论上还不完善,但应用方面取得了很大成功。
与回归分析、判别分析一起被称为多元分析的三大方法。
聚类的目的。
根据已知数据,计算各观察个体或变量之间亲疏关系的统计量(距离或相关系数)。
根据某种准则(最短距离法、最长距离法、中间距离法、重心法),使同一类内的差别较小,而类与类之间的差别较大,最终将观察个体或变量分为若干类。
聚类分析又叫群分析、点群分析或者簇分析,是直接比较各事物之间的性质,将性质相近的归为一类,将性质差别较大的归入不同的类。
1、聚类分析聚类分析也称群分析、点群分析。
例如,我们可以根据各个银行网点的储蓄量、人力资源状况、营业面积、特色功能、网点级别、所处功能区域等因素情况,将网点分为几个等级,再比较各银行之间不同等级网点数量对比状况。
1、基本思想:我们所研究的样品(网点)或指标(变量)之间存在程度不同的相似性(亲疏关系——以样品间距离衡量)。
于是根据一批样品的多个观测指标,具体找出一些能够度量样品或指标之间相似程度的统计量,以这些统计量为划分类型的依据。
把一些相似程度较大的样品(或指标)聚合为一类,把另外一些彼此之间相似程度较大的样品(或指标)又聚合为另一类,直到把所有的样品(或指标)聚合完毕,这就是分类的基本思想。
在聚类分析中,通常我们将根据分类对象的不同分为Q型聚类分析和R型聚类分析两大类。
R型聚类分析是对变量进行分类处理,Q型聚类分析是对样本进行分类处理。
R型聚类分析的主要作用是:1、不但可以了解个别变量之间的关系的亲疏程度,而且可以了解各个变量组合之间的亲疏程度。
2、根据变量的分类结果以及它们之间的关系,可以选择主要变量进行回归分析或Q型聚类分析。
Q型聚类分析的优点是:1、可以综合利用多个变量的信息对样本进行分类;2、分类结果是直观的,聚类谱系图非常清楚地表现其数值分类结果;3、聚类分析所得到的结果比传统分类方法更细致、全面、合理。
信息与计算科学专业课程设计信息与计算科学专业实验报告课程名称数据挖掘原理与算法总实验学时:第次共次实验项目名称聚类分析本次实验学时数:实验类型日期20 16 年 5 月 25 日星期三年级本13信计01班学生姓名黄顺团学号20134390131 课任教师唐志刚1.实验目的:用数据挖掘聚类算法(Q型聚类、R型聚类)求分类微博数据。
2.实验环境:MATLAB 7.0。
Windows 7操作系统。
3.实验内容由于数据集比较大,数据TXT文件不引入报告中。
命名为julei.txt。
相关两个源文件代码文件如下:1、Untitled.mclc,clearload julei.txt %把原始数据保存在纯文本文件julei.txt 中r=corrcoef(julei); %计算相关系数矩阵d=1-r; %进行数据变换,把相关系数转化为距离d=tril(d); %取出矩阵d 的下三角元素d=nonzeros(d); %取出非零元素d=d'; %化成行向量z=linkage(d,'average'); %按类平均法聚类dendrogram(z); %画聚类图T=cluster(z,'maxclust',4) %把变量划分成4类for i=1:4tm=find(T==i); %求第i 类的对象tm=reshape(tm,1,length(tm)); %变成行向量fprintf('第%d类的有%s \n',i,int2str(tm)); %显示分类结果endr %显示相关系数矩阵2、Untitled2.mclc,clearload julei.txt %把原始数据保存在纯文本文件julei.txt中julei(:,5)=[]; %删除数据矩阵的第5列,即使用变量1,2,3,4 julei=zscore(julei); %数据标准化y=pdist(julei); %求对象间的欧氏距离,每行是一个对象z=linkage(y,'average'); %按类平均法聚类dendrogram(z); %画聚类图for k=2:8fprintf('划分成%d类的结果如下:\n',k)T=cluster(z,'maxclust',k); %把样本点划分成k类for i=1:ktm=find(T==i); %求第i类的对象tm=reshape(tm,1,length(tm)); %变成行向量fprintf('第%d类的有%s \n',i,int2str(tm)); %显示分类结果 endif k==8breakendfprintf('************\n');End输出结果为:1、图一(R型聚类)>> T =42312第1类的有4第2类的有2 5第3类的有3第4类的有1>> r =1.0000 -0.1824 0.0439 -0.0298 -0.0871-0.1824 1.0000 0.2844 0.4158 0.90030.0439 0.2844 1.0000 0.1883 0.3327-0.0298 0.4158 0.1883 1.0000 0.4965-0.0871 0.9003 0.3327 0.4965 1.00002、图2 (各对象聚类树形图)划分成2类的结果如下:第1类的有128 268第2类的有1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 41 42 43 44 45 46 47 48 49 50 51 52 53 54 55 56 57 58 59 60 61 62 63 64 65 66 67 68 69 70 71 72 73 74 75 76 77 78 79 80 81 82 83 84 85 86 87 88 89 90 91 92 93 94 95 96 97 98 99 100 101 102 103 104 105 106 107 108 109 110 111 112 113 114 115 116 117 118 119 120 121 122 123 124 125 126 127 129 130 131 132 133 134 135 136 137 138 139 140 141 142 143 144 145 146 147 148 149 150 151 152 153 154 155 156 157 158 159 160 161 162 163 164 165 166 167 168 169 170 171 172 173 174 175 176 177 178 179 180 181 182 183 184 185 186 187 188 189 190 191 192 193 194 195 196 197 198 199 200 201 202 203 204 205 206 207 208 209 210 211 212 213 214 215 216 217 218 219 220 221 222 223 224 225 226 227 228 229 230 231 232 233 234 235 236 237 238 239 240 241 242 243 244 245 246 247 248 249 250 251 252 253 254 255 256 257 258 259 260 261 262 263 264 265 266 267 269 270 271 272 273 274 275 276 277 278 279 280 281 282 283 284 285 286 287 288 289 290 291 292 293 294 295 296 297 298 299 300************划分成3类的结果如下:第1类的有125 274第2类的有1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 41 42 43 44 45 46 47 48 49 50 51 52 53 54 55 56 57 58 59 60 61 62 63 64 65 66 67 68 69 70 71 72 73 74 75 76 77 78 79 80 81 82 83 84 85 86 87 88 89 90 91 92 93 94 95 96 97 98 99 100 101 102 103 104 105 106 107 108 109 110 111 112 113 114 115 116 117 118 119 120 121 122 123 124 126 127 129 130 131 132 133 134 135 136 137 138 139 140 141 142 143 144 145 146 147 148 149 150 151 152 153 154 155 156 157 158 159 160 161 162 163 164 165 166 167 168 169 170 171 172 173 174 175 176 177 178 179 180 181 182 183 184 185 186 187 188 189 190 191 192 193 194 195 196 197 198 199 200 201 202 203 204 205 206 207 208 209 210 211 212 213 214 215 216 217 218 219 220 221 222 223 224 225 226 227 228 229 230 231 232 233 234 235 236 237 238 239 240 241 242 243 244 245 246 247 248 249 250 251 252 253 254 255 256 257 258 259 260 261 262 263 264 265 266 267 269 270 271 272 273 275 276 277 278 279 280 281 282 283 284 285 286 287 288 289 290 291 292 293 294 295 296 297 298 299 300第3类的有128 268************划分成4类的结果如下:第1类的有19 25 41 101 111 121 171 173 260 283第2类的有1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 20 21 22 23 24 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 42 43 44 45 46 47 48 49 50 51 52 53 54 55 56 57 58 59 60 61 62 63 64 65 66 67 68 69 70 71 72 73 74 75 76 77 78 79 80 81 82 83 84 85 86 87 88 89 90 91 92 93 94 95 96 97 98 99 100 102 103 104 105 106 107 108 109 110 112 113 114 115 116 117 118 119 120 122 123 124 126 127 129 130 131 132 133 134 135 136 137 138 139 140 141 142 143 144 145 146 147 148 149 150 151 152 153 154 155 156 157 158 159 160 161 162 163 164 165 166 167 168 169 170 172 174 175 176 177 178 179 180 181 182 183 184 185 186 187 188 189 190 191 192 193 194 195 196 197 198 199 200 201 202 203 204 205 206 207 208 209 210 211 212 213 214 215 216 217 218 219 220 221 222 223 224 225 226 227 228 229 230 231 232 233 234 235 236 237 238 239 240 241 242 243 244 245 246 247 248 249 250 251 252 253 254 255 256 257 258 259 261 262 263 264 265 266 267 269 270 271 272 273 275 276 277 278 279 280 281 282 284 285 286 287 288 289 290 291 292 293 294 295 296 297 298 299 300第3类的有125 274第4类的有128 268************划分成5类的结果如下:第1类的有10 48 215 233第2类的有1 2 3 4 5 6 7 8 9 11 12 13 14 15 16 17 18 20 21 22 23 24 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 42 43 44 45 46 47 49 50 51 52 53 54 55 56 57 58 59 60 61 62 63 64 65 66 67 68 69 70 71 72 73 74 75 76 77 78 79 80 81 82 83 84 85 86 87 88 89 90 91 92 93 94 95 96 97 98 99 100 102 103 104 105 106 107 108 109 110 112 113 114 115 116 117 118 119 120 122 123 124 126 127 129 130 131 132 133 134 135 136 137 138 139 140 141 142 143 144 145 146 147 148 149 150 151 152 153 154 155 156 157 158 159 160 161 162 163 164 165 166 167 168 169 170 172 174 175 176 177 178 179 180 181 182 183 184 185 186 187 188 189 190 191 192 193 194 195 196 197 198 199 200 201 202 203 204 205 206 207 208 209 210 211 212 213 214 216 217 218 219 220 221 222 223 224 225 226 227 228 229 230 231 232 234 235 236 237 238 239 240 241 242 243 244 245 246 247 248 249 250 251 252 253 254 255 256 257 258 259 261 262 263 264 265 266 267 269 270 271 272 273 275 276 277 278 279 280 281 282 284 285 286 287 288 289 290 291 292 293 294 295 296 297 298 299 300第3类的有19 25 41 101 111 121 171 173 260 283第4类的有125 274第5类的有128 268************划分成6类的结果如下:第1类的有29 30 31 32 33 34 35 36 37 42 43 44 45 46 47 49 50 70 120 161 187 188 189 190 191 197 198 199 200 282第2类的有1 2 3 4 5 6 7 8 9 11 12 13 14 15 16 17 18 20 21 22 23 24 26 27 28 38 39 40 51 52 53 54 55 56 57 58 59 60 61 62 63 64 65 66 67 68 69 71 72 73 74 75 76 77 78 79 80 81 82 83 84 85 86 87 88 89 90 91 92 93 94 95 96 97 98 99 100 102 103 104 105 106 107 108 109 110 112 113 114 115 116 117 118 119 122 123 124 126 127 129 130 131 132 133 134 135 136 137 138 139 140 141 142 143 144 145 146 147 148 149 150 151 152 153 154 155 156 157 158 159 160 162 163 164 165 166 167 168 169 170 172 174 175 176 177 178 179 180 181 182 183 184 185 186 192 193 194 195 196 201 202 203 204 205 206 207 208 209 210 211 212 213 214 216 217 218 219 220 221 222 223 224 225 226 227 228 229 230 231 232 234 235 236 237 238 239 240 241 242 243 244 245 246 247 248 249 250 251 252 253 254 255 256 257 258 259 261 262 263 264 265 266 267 269 270 271 272 273 275 276 277 278 279 280 281 284 285 286 287 288 289 290 291 292 293 294 295 296 297 298 299 300第3类的有10 48 215 233第4类的有19 25 41 101 111 121 171 173 260 283第5类的有125 274第6类的有128 268************划分成7类的结果如下:第1类的有10第2类的有48 215 233第3类的有29 30 31 32 33 34 35 36 37 42 43 44 45 46 47 49 50 70 120 161 187 188 189 190 191 197 198 199 200 282第4类的有1 2 3 4 5 6 7 8 9 11 12 13 14 15 16 17 18 20 21 22 23 24 26 27 28 38 39 40 51 52 53 54 55 56 57 58 59 60 61 62 63 64 65 66 67 68 69 71 72 73 74 75 76 77 78 79 80 81 82 83 84 85 86 87 88 89 90 91 92 93 94 95 96 97 98 99 100 102 103 104 105 106 107 108 109 110 112 113 114 115 116 117 118 119 122 123 124 126 127 129 130 131 132 133 134 135 136 137 138 139 140 141 142 143 144 145 146 147 148 149 150 151 152 153 154 155 156 157 158 159 160 162 163 164 165 166 167 168 169 170 172 174 175 176 177 178 179 180 181 182 183 184 185 186 192 193 194 195 196 201 202 203 204 205 206 207 208 209 210 211 212 213 214 216 217 218 219 220 221 222 223 224 225 226 227 228 229 230 231 232 234 235 236 237 238 239 240 241 242 243 244 245 246 247 248 249 250 251 252 253 254 255 256 257 258 259 261 262 263 264 265 266 267 269 270 271 272 273 275 276 277 278 279 280 281 284 285 286 287 288 289 290 291 292 293 294 295 296 297 298 299 300第5类的有19 25 41 101 111 121 171 173 260 283第6类的有125 274第7类的有128 268************划分成8类的结果如下:第1类的有1 2 3 4 5 6 8 9 11 12 13 14 15 16 17 18 20 21 22 23 24 26 27 28 38 39 51 52 54 55 56 57 58 59 60 61 62 63 64 65 66 67 68 69 71 72 73 74 75 76 77 78 79 80 81 82 83 84 85 86 87 88 89 90 91 92 93 94 95 96 97 98 99 100 102 103 104 105 106 107 109 110 112 113 114 115 116 117 118 119 122 123 126 127 129 130 131 132 133 134 135 136 137 138 139 140 141 142 143 144 145 146 147 148 149 150 151 153 154 155 156 157 158 159 160 162 163 164 165 168 169 170 172 174 175 176 177 178 179 180 181 182 183 184 185 186 192 193 194 195 196 201 202 203 204 205 206 207 208 209 210 211 212 213 214 216 217 218 219 220 221 222 223 224 225 226 227 228 229 230 231 232 234 235 236 237 238 239 241 242 243 244 245 246 247 248 249 250 251 252 253 254 255 256 258 259 263 264 265 266 267 269 270 271 272 273 275 276 277 278 279 280 281 284 285 286 287 288 289 290 291 292 293 294 295 296 297 298 299 300第2类的有7 40 53 108 124 152 166 167 240 257 261 262第3类的有10第4类的有48 215 233第5类的有29 30 31 32 33 34 35 36 37 42 43 44 45 46 47 49 50 70 120 161 187 188 189 190 191 197 198 199 200 282第6类的有19 25 41 101 111 121 171 173 260 283第7类的有125 274第8类的有128 268转化为源字符数据为:划分成2类的结果如下:第1类的有曹国伟曹国伟第2类的有其他************划分成3类的结果如下:第1类的有张向东周鸿祎第2类的有其他第3类的有曹国伟曹国伟************划分成4类的结果如下:第1类的有 Hitwise 王建硕小小数据分析师琳琳乱飞麦田程苓峰-云科技淘宝指数fengyuncrawl 王烁龚宇第2类的有其他第3类的有张向东周鸿祎第4类的有曹国伟曹国伟************划分成5类的结果如下:第1类的有白鸦陈坤淘宝网万客团第2类的有其他第3类的有 Hitwise 王建硕小小数据分析师琳琳乱飞麦田程苓峰-云科技淘宝指数fengyuncrawl 王烁龚宇第4类的有张向东周鸿祎第5类的有曹国伟曹国伟************划分成6类的结果如下:第1类的有 MINI金石头雷军夢想家林志穎羅志祥范范范瑋琪苍井空大S 小S 孟非 DCCI互联网数据中心沈浩老师韩庚文章同學林俊杰周立波胡歌黄健翔国美在线王微俞永福当当网库巴网孙燕姿蔡依林林俊杰苏宁易购京东商城夢想家林志穎范范范瑋琪金错刀第2类的有其他第3类的有白鸦陈坤淘宝网万客团第4类的有 Hitwise 王建硕小小数据分析师琳琳乱飞麦田程苓峰-云科技淘宝指数fengyuncrawl 王烁龚宇第5类的有张向东周鸿祎第6类的有曹国伟曹国伟************划分成7类的结果如下:第1类的有白鸦第2类的有陈坤淘宝网万客团第3类的有 MINI金石头雷军夢想家林志穎羅志祥范范范瑋琪苍井空大S 小S 孟非 DCCI 互联网数据中心沈浩老师韩庚文章同學林俊杰周立波胡歌黄健翔国美在线王微俞永福当当网库巴网孙燕姿蔡依林林俊杰苏宁易购京东商城夢想家林志穎范范范瑋琪金错刀第4类的有其他第5类的有 Hitwise 王建硕小小数据分析师琳琳乱飞麦田程苓峰-云科技淘宝指数fengyuncrawl 王烁龚宇第6类的有张向东周鸿祎第7类的有曹国伟曹国伟************划分成8类的结果如下:第1类的有其他第2类的有董勤峰数据化管理微数据spark 张鹏古永锵王建硕小小数据分析师社会网络与数据挖掘 1号商城-品质百货宫玉国吴晓波 cnsns第3类的有白鸦第4类的有陈坤淘宝网万客团第5类的有 MINI金石头雷军夢想家林志穎羅志祥范范范瑋琪苍井空大S 小S 孟非 DCCI 互联网数据中心沈浩老师韩庚文章同學林俊杰周立波胡歌黄健翔国美在线王微俞永福当当网库巴网孙燕姿蔡依林林俊杰苏宁易购京东商城夢想家林志穎范范范瑋琪金错刀第6类的有 Hitwise 王建硕小小数据分析师琳琳乱飞麦田程苓峰-云科技淘宝指数fengyuncrawl 王烁龚宇第7类的有张向东周鸿祎第8类的有曹国伟曹国伟5.小结、体会或建议(2至3行):本实验用MATLAB实验,根据聚类结果,得出相关微博数据之间的分类关系,可以粗略的看出微博用户的粉丝数、关注数、微博数、收藏数、互粉数之间的聚类关系及相互的聚类结果。