聚类分析简单例子-PPT.ppt
![资源得分’ title=](/images/score_1.gif)
![资源得分’ title=](/images/score_1.gif)
![资源得分’ title=](/images/score_1.gif)
![资源得分’ title=](/images/score_1.gif)
![资源得分’ title=](/images/score_05.gif)
《聚类分析简单例子-PPT.ppt》由会员分享,可在线阅读,更多相关《聚类分析简单例子-PPT.ppt(38页珍藏版)》请在淘文阁 - 分享文档赚钱的网站上搜索。
1、聚类分析简单例子聚类分析简单例子二、类间距离与系统聚类法二、类间距离与系统聚类法n在进行系统聚类之前,我们首先要定义类与类之间的距离,在进行系统聚类之前,我们首先要定义类与类之间的距离,由类间距离定义的不同产生了不同的系统聚类法。常用的类由类间距离定义的不同产生了不同的系统聚类法。常用的类间距离定义有间距离定义有8种之多,与之相应的系统聚类法也有种之多,与之相应的系统聚类法也有8种,分种,分别为最短距离法、最长距离法、中间距离法、重心法、类平别为最短距离法、最长距离法、中间距离法、重心法、类平均法、可变类平均法、可变法和离差平方和法。它们的归类均法、可变类平均法、可变法和离差平方和法。它们的归
2、类步骤基本上是一致的,主要差异是类间距离的计算方法不同。步骤基本上是一致的,主要差异是类间距离的计算方法不同。以下用以下用dij表示样品表示样品Xi与与Xj之间距离,用之间距离,用Dij表示类表示类Gi与与Gj之间的距离。之间的距离。1.最短距离法最短距离法定义类定义类Gi与与Gj之间的距离为两类最近样品的距离,即为之间的距离为两类最近样品的距离,即为 (5.11)设设Gk类与合并成一个新类记为类与合并成一个新类记为Gr,则任一类与的距离为,则任一类与的距离为 (5.12)n最短距离法进行聚类分析的步骤如下:最短距离法进行聚类分析的步骤如下:(1)定义样品之间距离,计算样品的两两距离,得一距离
3、)定义样品之间距离,计算样品的两两距离,得一距离 阵记为阵记为D(0),开始每个样品自成一类,显然这时,开始每个样品自成一类,显然这时Dij=dij。(2)找出距离最小元素,设为)找出距离最小元素,设为Dpq,则将,则将Gp和和Gq合并成一个合并成一个 新类,记为新类,记为Gr,即,即Gr=Gp,Gq。(3)按()按(5.12)计算新类与其它类的距离。)计算新类与其它类的距离。(4)重复()重复(2)、()、(3)两步,直到所有元素。并成一类为)两步,直到所有元素。并成一类为 止。如果某一步距离最小的元素不止一个,则对应这些止。如果某一步距离最小的元素不止一个,则对应这些 最小元素的类可以同时
4、合并。最小元素的类可以同时合并。n【例例5.1】设有六个样品,每个只测量一个指标,分别是设有六个样品,每个只测量一个指标,分别是1,2,5,7,9,10,试用最短距离法将它们分类。,试用最短距离法将它们分类。(1)样品采用绝对值距离,计算样品间的距离阵)样品采用绝对值距离,计算样品间的距离阵D(0),见,见表表5.1表表5.1(2)D(0)中最小的元素是中最小的元素是D12D561,于是将,于是将G1和和G2合合并成并成G7,G5和和G6合并成合并成G8,并利用(,并利用(5.12)式计算新类与其)式计算新类与其它类的距离它类的距离D(1),见表,见表5.2表表5.2 (3)在)在D(1)中最
5、小值是中最小值是D34D482,由于,由于G4与与G3合并,合并,又与又与G8合并,因此合并,因此G3、G4、G8合并成一个新类合并成一个新类G9,其与其,其与其它类的距离它类的距离D(2),见表,见表5.3表表5.3 大家有疑问的,可以询问和交流大家有疑问的,可以询问和交流可以互相讨论下,但要小声点可以互相讨论下,但要小声点可以互相讨论下,但要小声点可以互相讨论下,但要小声点(4)最后将)最后将G7和和G9合并成合并成G10,这时所有的六个样品聚为一,这时所有的六个样品聚为一类,其过程终止。类,其过程终止。上述聚类的可视化过程见图上述聚类的可视化过程见图5.1所示,横坐标的刻度表示并类所示,
6、横坐标的刻度表示并类的距离。这里我们应该注意,聚类的个数要以实际情况所定,的距离。这里我们应该注意,聚类的个数要以实际情况所定,其详细内容将在后面讨论。其详细内容将在后面讨论。图图5.1 最短距离聚类法的过程最短距离聚类法的过程n再找距离最小两类并类,直至所有的样品全归为一类为止。再找距离最小两类并类,直至所有的样品全归为一类为止。可以看出最长距离法与最短距离法只有两点不同:可以看出最长距离法与最短距离法只有两点不同:一是类与类之间的距离定义不同;一是类与类之间的距离定义不同;另一是计算新类与其它类的距离所用的公式不同。另一是计算新类与其它类的距离所用的公式不同。3.中间距离法中间距离法最短、
7、最长距离定义表示都是极端情况,我们定义类间距离最短、最长距离定义表示都是极端情况,我们定义类间距离可以既不采用两类之间最近的距离也不采用两类之间最远的可以既不采用两类之间最近的距离也不采用两类之间最远的距离,而是采用介于两者之间的距离,称为中间距离法。距离,而是采用介于两者之间的距离,称为中间距离法。中间距离将类中间距离将类Gp与与Gq类合并为类类合并为类Gr,则任意的类,则任意的类Gk和和Gr的距的距离公式为离公式为 (14 0)(5.15)设设DkrDkp,如果采用最短距离法,则,如果采用最短距离法,则Dkr=Dkp,如果采用,如果采用最长距离法,则最长距离法,则Dkr=Dkq。如图。如图
- 配套讲稿:
如PPT文件的首页显示word图标,表示该PPT已包含配套word讲稿。双击word图标可打开word文档。
- 特殊限制:
部分文档作品中含有的国旗、国徽等图片,仅作为作品整体效果示例展示,禁止商用。设计者仅对作品中独创性部分享有著作权。
- 关 键 词:
- 聚类分析 简单 例子 PPT
![提示](https://www.taowenge.com/images/bang_tan.gif)
限制150内