模式识别(第十二章2010).ppt_第1页
模式识别(第十二章2010).ppt_第2页
模式识别(第十二章2010).ppt_第3页
模式识别(第十二章2010).ppt_第4页
模式识别(第十二章2010).ppt_第5页
已阅读5页,还剩35页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

第十二章模糊模式识别方法 基础 模糊集理论传统集合论的推广 模糊集 集合理论模糊逻辑 二值逻辑 模糊集理论 对客观事物更合理的抽象和描述 模糊也是一种不确定性 模糊数学 从数学角度研究模糊集与模糊逻辑 模糊数学可应用于很多领域 将其用于模式识别 则形成了模糊模式识别 12 2模糊集的基本知识 模糊集 FussySet 由隶属度函数uA x 描述或定义的 其自变量是所有可能属于集合A的对象 隶属度函数 表征元素x隶属于集合A的程度 用uA x 表示 uA x 取值 0 1 完全不属于A 完全属于A uA x 越接近1 表示x属于A的程度越高 uA x 越接近0 则x属于A的程度越低 模糊集可表示为 或 空间X中 的样本集合称为模糊集A的支持集S A 支持集中的元素称作A的元素 显然确定集可看作模糊集的特例 的情况 例1 5个学生 其中男生3人 女生2人 A1 A2分别表示男女生集合 则 显然 A1 A2分界分明 但当构成一个表示 有才干的学生 的集合时 传统集合难以应用 这是可对每个元素确定一个数 表示隶属程度 例2 有1 2 3 4 5五个数 用模糊集表示 大的数 和 小的数 适当选取隶属度 则有 例3 用水的温度表示 开水 用模糊集表示更合理 更接近日常理解 模糊集的不确定性是人脑对客观事物的一种主观反映 人的心理过程就是其隶属函数形成的基本过程 确定隶属度函数的方法 非常重要 1 根据个人经验和认识 专家确定法 比较适合于元素离散 有限的情况 2 选用典型函数 已有公认的对客观事物真实而本质化的 指标 可直接采用这些指标描述问题的不确定性 例 S形 形隶属函数p278 可采用常见的模糊分布 矩形分布 分布 正态分布 梯形分布 三角分布等 3 根据统计特性得到的经验曲线 应用较广泛的方法 模糊集运算 1 相等 2 包含 B是A的子集 3 并 隶属函数 隶属函数 也定义为 A的补 A 的隶属函数 图12 3 模糊函数的基本运算 12 2模糊特征和模糊分类 一 特征模糊化 即特征的变换 将原特征 模糊特征 明确分类 模糊分类 由于类别 本质 和特征 表象 之间可能存在较复杂的非线性关系 直接利用特征分类识别 必然效果不佳或方法复杂 为使关系更直接 简单 可将原来特征值域分成若干部分 并且使各部分特征含义做更本质的变换 于是特征模糊化 例 将 4 4 间的连续变化量转化为模糊量 正大 正小 零 负小 负大 首先可将 4 4 离散化 4对应 正大 的隶属度为1 隶属函数若采用三角函数 则可得不同模糊量的隶属度 当读入精确量3 2时 可归入最近的离散值3 则有 将精确量转化为模糊量 特征模糊化 用这些新的模糊特征代替原来的特征进行模式识别 例 针对人的体重分类特征 体重可分为 偏轻 中等 偏重三个模糊特征 按照一定的模糊规律 把原来的一个或多个特征分为多个模糊变量 同时配以一定的隶属函数 使其每个模糊变量表达原来特征的某一局部特性 这些新特征能更好反映目标的本质 提高分类器性能 可选用图12 4的函数表示隶属函数 如 x 75kg u中等 0 5 u偏重 0 5x 72kg u中等 0 8 u偏重 0 2 缺点 特征维数增加体重 1维 轻 中 重 3维 优点 准确性增加 尽管特征数增多了 却可使分类结果与特征之间的关系线性化 达到更好的分类效果 原特征变为模糊特征 能更好反映问题的本质 二 结果的模糊化 分类是把样本集合分成若干子集 用模糊子集代替 得到模糊的分类结果 即分类结果模糊化 样本不再是明确的属于每个确定的类别 而是以不同程度属于各个类别 即 以一定的隶属度属于各个类别 因此更真实 具有更多信息 例 针对某一区域 则隶属程度为 模糊子集A为 表示圆块这一模糊概念 优点 1 分类结果比较真实的反映了分类的不确定性 利于决策 2 当分类是多级时 有利于下一级分类 因为模糊的分类结果保留了更多的信息 模糊分类的三个主要步骤 1 特征提取 将原来普通意义上的特征值变为模糊特征 即从样本集中 提取各种模糊特征量 2 建立x属于A的隶属度函数 建立一个明确算法以产生隶属函数uA uA的确定没有普遍的原则 带有主观性 经验性 或建立元素之间的模糊相似关系 并确定这个关系的隶属函数 即相关程度 3 确定归属准则进行分类识别 模糊分类 使用模糊技术分类 其结果不再使一个样本明确地属于某一类或不属于某一类 而是以一定的隶属度属于各个类别 结果更真实 具有更多的信息 识别基本方法 最小距离原则 择近原则 最大隶属原则 去模糊化 在此基础上 再按某种归属原则对x进行判决 指出属哪一类 12 5模糊聚类方法 FCM算法就是在迭代寻优过程中 不断更新各类中心及隶属度的值 直到下列准则函数最小化 模糊C均值算法 FCM 设样本集 欲分成c类 为每个聚类中心 表示第i个样本对于第j类的隶属函数 定义准则函数 即 要求每一个样本xi属于各类的程度总和为1 与隶属函数有关的聚类准则函数 其中b 1 可控制聚类结果的模糊程度 权重 问题 怎样确定mi和 约束条件 利用拉格朗日乘子法 求Jf的极值 得 4 比较更新前后的准则函数 以确定更新是否保持 若Jf变化较大 重复3 4的过程 直到Jf不变为止 FCM算法步骤 1 确定聚类数目c和参数b 2 初始化各聚类中心mi 即代表点 很敏感 3 用迭代算法 更新mi以及 i 用当前的聚类中心 计算新的隶属函数 ii 用当前新的隶属函数更新各类的聚类中心 当算法收敛后 得到各类的聚类中心和样本属于各类的隶属度值 完成了模糊聚类划分 即每个样本以一定的隶属度属于各个类别 去模糊化 模糊结果转化为确定性分类 方法1 择近原则 方法2 最大隶属原则 所有样本对各类的隶属度总和为n 改进的模糊C均值法 对于野值点样本 属于各类的隶属度都应该很小 但由于的归一化要求 即 使其对各类都有较大的隶属度 例两类uA x 0 5 因此野值点将影响迭代的最终结果 为此放松归一化条件 计算的公式不变 而计算式则为 对mi初值仍十分敏感 可采用确定性C均值法或普通的模糊C均值法的结果作为初值 改进的FCM 其中 Ai表示一个模糊样本类wi 分类结果的确定性 去模糊化 1 择近原则 2 最大隶属原则 对于给定的x 若有隶属度为 则判x归属于Ai所代表的类 即 例 若x属于体重偏轻类Ai 有对应的某种疾病类 作为该病的一个判别指标 3 阈值原则 规定一个阈值 0 1 作为停止条件 则判 令 若a 则拒判 若a 则比较 与的大小 若有k个 即 解释图12 5 a 第一种数据分布 三种方法效果相同b 第二种数据分布 分类有一定重叠 改进的模糊C均值法效果好些c 第三种数据分布 两类完全重叠 图中看出 改进的模糊C均值法能合理给出比预设数目少的聚类 三种方法比较 解释图12 6 实际的c 4 设定的c 3 可见改进的模糊C均值法能正确给出3个聚类中心 12 4特征的模糊评价 如何评价所得到的特征 用模糊集的模糊程度评价特征对于分类性能的表现 1 模糊程度的度量度量一个模糊集的模糊程度很重要 可从总体上反映各元素属于或不属于一个集合的明确性 uA x 越接近1或0越不模糊 越接近0 5越模糊 1 距离模糊度 刻画了一个模糊集的整体模糊程度 其中n是集合A中 uA x 0的点的个数 即支持点数目 是包含A中uA x 0 5的支持点 是A与之间的距离 k是一个调节参数 使r A 值在0 1之间 随采用的距离方式不同而变化 定义 例 若采用广义汉明距离 k 1 称为线性模糊度 若采用欧氏距离 k 2 有 2 熵 模糊度 熵 模糊度 定义 显然或时 r A 和H A 为最小值 等于0 即模糊度为0 A为确定集 定义的意义 当时 r A 和H A 为最大值 等于1 模糊程度最大 2 如何评价特征提取效果 距离模糊度和熵的作用类似于前面章节所定义的类内类间离散度度量 可利用S形或 形隶属函数计算出距离模糊度或熵 由此判断特征性能对分类器

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论