聚类分析简单例子ppt课件.ppt
《聚类分析简单例子ppt课件.ppt》由会员分享,可在线阅读,更多相关《聚类分析简单例子ppt课件.ppt(38页珍藏版)》请在淘文阁 - 分享文档赚钱的网站上搜索。
1、严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。一、系统聚类的基本思想一、系统聚类的基本思想n系统聚类的基本思想是:距离相近的样品(或变量)先聚成系统聚类的基本思想是:距离相近的样品(或变量)先聚成类,距离相远的后聚成类,过程一直进行下去,每个样品类,距离相远的后聚成类,过程一直进行下去,每个样品(或变量)总能聚到合适的类中。系统聚类过程是:假设总(或变量)总能聚到合适的类中。系统聚类过程是:假设总共有共有n个样品(或变
2、量),第一步将每个样品(或变量)独个样品(或变量),第一步将每个样品(或变量)独自聚成一类,共有自聚成一类,共有n类;第二步根据所确定的样品(或变量)类;第二步根据所确定的样品(或变量)“距离距离”公式,把距离较近的两个样品(或变量)聚合为一公式,把距离较近的两个样品(或变量)聚合为一类,其它的样品(或变量)仍各自聚为一类,共聚成类,其它的样品(或变量)仍各自聚为一类,共聚成n 1类;类;第三步将第三步将“距离距离”最近的两个类进一步聚成一类,共聚成最近的两个类进一步聚成一类,共聚成n 2类;类;,以上步骤一直进行下去,最后将所有的样品,以上步骤一直进行下去,最后将所有的样品(或变量)全聚成一
3、类。为了直观地反映以上的系统聚类过(或变量)全聚成一类。为了直观地反映以上的系统聚类过程,可以把整个分类系统画成一张谱系图。所以有时系统聚程,可以把整个分类系统画成一张谱系图。所以有时系统聚类也称为谱系分析。除系统聚类法外,还有有序聚类法、动类也称为谱系分析。除系统聚类法外,还有有序聚类法、动态聚类法、图论聚类法、模糊聚类法等,限于篇幅,我们只态聚类法、图论聚类法、模糊聚类法等,限于篇幅,我们只介绍系统聚类方法。介绍系统聚类方法。严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。严格执行突发事件上报制度、校外活动报批制度等相关规章制
4、度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。二、类间距离与系统聚类法二、类间距离与系统聚类法n在进行系统聚类之前,我们首先要定义类与类之间的距离,在进行系统聚类之前,我们首先要定义类与类之间的距离,由类间距离定义的不同产生了不同的系统聚类法。常用的类由类间距离定义的不同产生了不同的系统聚类法。常用的类间距离定义有间距离定义有8种之多,与之相应的系统聚类法也有种之多,与之相应的系统聚类法也有8种,分种,分别为最短距离法、最长距离法、中间距离法、重心法、类平别为最短距离法、最长距离法、中间距离法、重心法、类平均法、可变类平均法、可变法和离差平方和法。它们的归类均法、可变类平均法、可变
5、法和离差平方和法。它们的归类步骤基本上是一致的,主要差异是类间距离的计算方法不同。步骤基本上是一致的,主要差异是类间距离的计算方法不同。以下用以下用dij表示样品表示样品Xi与与Xj之间距离,用之间距离,用Dij表示类表示类Gi与与Gj之间的距离。之间的距离。严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。1.最短距离法最短距离法定义类定义类Gi与与Gj之间的距离为两类最近样品的距离,即为之间的距离为两类最近样品的距离,
6、即为 (5.11)设设Gk类与合并成一个新类记为类与合并成一个新类记为Gr,则任一类与的距离为,则任一类与的距离为 (5.12)严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。n最短距离法进行聚类分析的步骤如下:最短距离法进行聚类分析的步骤如下:(1)定义样品之间距离,计算样品的两两距离,得一距离)定义样品之间距离,计算样品的两两距离,得一距离 阵记为阵记为D(0),开始每个样品自成一类,显然这时,开始每个样品自成一类,
7、显然这时Dij=dij。(2)找出距离最小元素,设为)找出距离最小元素,设为Dpq,则将,则将Gp和和Gq合并成一个合并成一个 新类,记为新类,记为Gr,即,即Gr=Gp,Gq。(3)按()按(5.12)计算新类与其它类的距离。)计算新类与其它类的距离。(4)重复()重复(2)、()、(3)两步,直到所有元素。并成一类为)两步,直到所有元素。并成一类为 止。如果某一步距离最小的元素不止一个,则对应这些止。如果某一步距离最小的元素不止一个,则对应这些 最小元素的类可以同时合并。最小元素的类可以同时合并。严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违
8、纪行为或突发事件。严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。n【例例5.1】设有六个样品,每个只测量一个指标,分别是设有六个样品,每个只测量一个指标,分别是1,2,5,7,9,10,试用最短距离法将它们分类。,试用最短距离法将它们分类。(1)样品采用绝对值距离,计算样品间的距离阵)样品采用绝对值距离,计算样品间的距离阵D(0),见,见表表5.1表表5.1 严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做
9、到及时发现、制止、汇报并处理各类违纪行为或突发事件。(2)D(0)中最小的元素是中最小的元素是D12D561,于是将,于是将G1和和G2合合并成并成G7,G5和和G6合并成合并成G8,并利用(,并利用(5.12)式计算新类与其)式计算新类与其它类的距离它类的距离D(1),见表,见表5.2表表5.2 严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。(3)在)在D(1)中最小值是中最小值是D34D482,由于,由于G4与与G
10、3合并,合并,又与又与G8合并,因此合并,因此G3、G4、G8合并成一个新类合并成一个新类G9,其与其,其与其它类的距离它类的距离D(2),见表,见表5.3表表5.3 严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。(4)最后将)最后将G7和和G9合并成合并成G10,这时所有的六个样品聚为一,这时所有的六个样品聚为一类,其过程终止。类,其过程终止。上述聚类的可视化过程见图上述聚类的可视化过程见图5.1所示,横坐标的刻度表
11、示并类所示,横坐标的刻度表示并类的距离。这里我们应该注意,聚类的个数要以实际情况所定,的距离。这里我们应该注意,聚类的个数要以实际情况所定,其详细内容将在后面讨论。其详细内容将在后面讨论。图图5.1 最短距离聚类法的过程最短距离聚类法的过程严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。严格执行突发事件上报制度
12、、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。n再找距离最小两类并类,直至所有的样品全归为一类为止。再找距离最小两类并类,直至所有的样品全归为一类为止。可以看出最长距离法与最短距离法只有两点不同:可以看出最长距离法与最短距离法只有两点不同:一是类与类之间的距离定义不同;一是类与类之间的距离定义不同;另一是计算新类与其它类的距离所用的公式不同。另一是计算新类与其它类的距离所用的公式不同。严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。严格执行突发事件上报制度、校外活动报批制度等相关规章制度。
13、做到及时发现、制止、汇报并处理各类违纪行为或突发事件。3.中间距离法中间距离法最短、最长距离定义表示都是极端情况,我们定义类间距离最短、最长距离定义表示都是极端情况,我们定义类间距离可以既不采用两类之间最近的距离也不采用两类之间最远的可以既不采用两类之间最近的距离也不采用两类之间最远的距离,而是采用介于两者之间的距离,称为中间距离法。距离,而是采用介于两者之间的距离,称为中间距离法。中间距离将类中间距离将类Gp与与Gq类合并为类类合并为类Gr,则任意的类,则任意的类Gk和和Gr的距的距离公式为离公式为 (14 0)(5.15)设设DkrDkp,如果采用最短距离法,则,如果采用最短距离法,则Dk
14、r=Dkp,如果采用,如果采用最长距离法,则最长距离法,则Dkr=Dkq。如图。如图5.2所示,所示,(5.15)式就是取它式就是取它们(最长距离与最短距离)的中间一点作为计算们(最长距离与最短距离)的中间一点作为计算Dkr的根据。的根据。严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。n特别当特别当 =14,它表示取中间点算距离,公式为,它表示取中间点算距离,公式为 (5.16)图图5.2 中间距离法中间距离法严格执行
15、突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。n n 严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。严格执行突发事件上报制度、校外活动报批制
16、度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。n 严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。严格执行突发事件上报制度、校外活动报批制度等相关规章制度。做到及时发现、制止、汇报并处理各类违纪行为或突发事件。n【例例5.2】针对例针对例5.1的数据,试用重心法将它们聚类。的数据,试用
- 配套讲稿:
如PPT文件的首页显示word图标,表示该PPT已包含配套word讲稿。双击word图标可打开word文档。
- 特殊限制:
部分文档作品中含有的国旗、国徽等图片,仅作为作品整体效果示例展示,禁止商用。设计者仅对作品中独创性部分享有著作权。
- 关 键 词:
- 聚类分析 简单 例子 ppt 课件
限制150内