内容简介:分类问题之 KNN
分类问题之 KNN
简介
- lazy learning, 训练阶段仅仅保存样本, 没有显式的学习过程, 待收到测试样本后再进行处理
- 三要素: k值的选择, 距离度量(街区, 欧式, 闵可夫斯基), 分类决策规则(majority vote)
-
分类步骤
1.计算测试点到训练集各个点的距离 2.找出距离最小的 k 个点 3.投票法得出类别
- k 太小, 则对噪声敏感; k 太大, 则可能包含太多其他类别的点
- 属性中需要归一化, 防止某一属性在计算距离的时候占主导地位
优点
- 复杂度较低
- 效率高
- 非常适用于简单数据集的分类
- 抗噪,对噪声鲁棒
- 选取最优决策树是NP完全问题
其他
- PEBLS: Parallel Examplar-Based Learning System (Cost & Salzberg)
以上所述就是小编给大家介绍的《数据挖掘复习笔记---04.2分类问题之 KNN》,希望对大家有所帮助,如果大家有任何疑问请给我留言,小编会及时回复大家的。在此也非常感谢大家对 码农网 的支持!
猜你喜欢:- 数据挖掘竞赛指南:曾经的数据挖掘少年,如今的阿里算法大佬
- 数据挖掘实操:用文本挖掘剖析近 5 万首《全唐诗》
- 数据挖掘复习笔记---02.数据
- Python之数据挖掘
- 趋势分析之数据挖掘
- python 数据挖掘算法简要
本站部分资源来源于网络,本站转载出于传递更多信息之目的,版权归原作者或者来源机构所有,如转载稿涉及版权问题,请联系我们。
计算机程序设计艺术(第3卷 英文版·第2版)
Donald E.Knuth / 人民邮电出版社 / 2010-10 / 119.00元
《计算机程序设计艺术》系列被公认为计算机科学领域的权威之作,深入阐述了程序设计理论,对计算机领域的发展有着极为深远的影响。本书是该系列的第3卷,扩展了第1卷中信息结构的内容,主要讲排序和查找。书中对排序和查找算法进行了详细的介绍,并对各种算法的效率做了大量的分析。 本书适合从事计算机科学、计算数学等各方面工作的人员阅读,也适合高等院校相关专业的师生作为教学参考书,对于想深入理解计算机算法的读......一起来看看 《计算机程序设计艺术(第3卷 英文版·第2版)》 这本书的介绍吧!
JS 压缩/解压工具
在线压缩/解压 JS 代码
XML、JSON 在线转换
在线XML、JSON转换工具