数据挖掘复习笔记---04.2分类问题之 KNN

栏目: 数据库 · 发布时间: 7年前

内容简介：分类问题之 KNN

分类问题之 KNN

简介

lazy learning, 训练阶段仅仅保存样本, 没有显式的学习过程, 待收到测试样本后再进行处理
三要素: k值的选择, 距离度量(街区, 欧式, 闵可夫斯基), 分类决策规则(majority vote)

分类步骤

1.计算测试点到训练集各个点的距离
2.找出距离最小的 k 个点
3.投票法得出类别

k 太小, 则对噪声敏感; k 太大, 则可能包含太多其他类别的点
属性中需要归一化, 防止某一属性在计算距离的时候占主导地位

优点

复杂度较低
效率高
非常适用于简单数据集的分类
抗噪，对噪声鲁棒
选取最优决策树是NP完全问题

其他

PEBLS: Parallel Examplar-Based Learning System (Cost & Salzberg)

以上所述就是小编给大家介绍的《数据挖掘复习笔记---04.2分类问题之 KNN》，希望对大家有所帮助，如果大家有任何疑问请给我留言，小编会及时回复大家的。在此也非常感谢大家对码农网的支持！

查看所有标签

猜你喜欢:

本站部分资源来源于网络，本站转载出于传递更多信息之目的，版权归原作者或者来源机构所有，如转载稿涉及版权问题，请联系我们。

码农书籍

C专家编程

[美] Peter Vander Linde / 徐波 / 人民邮电出版社 / 2002-12 / 40.00元

《C专家编程》展示了最优秀的C程序员所使用的编码技巧，并专门开辟了一章对C++的基础知识进行了介绍。书中对C的历史、语言特性、声明、数组、指针、链接、运行时、内存，以及如何进一步学习C++等问题作了细致的讲解和深入的分析。全书撷取几十几个实例进行讲解，对C程序员具有非常高的实用价值。这本《C专家编程》可以帮助有一定经验的C程序员成为C编程方面的专家，对于具备相当的C语言基础的程序员......一起来看看《C专家编程》这本书的介绍吧!

码农工具

数据挖掘复习笔记---04.2分类问题之 KNN

简介

优点

其他

C专家编程

在线进制转换器

随机密码生成器

XML、JSON 在线转换