数据挖掘复习笔记---04.2分类问题之 KNN

栏目: 数据库 · 发布时间: 5年前

内容简介:分类问题之 KNN

分类问题之 KNN

简介

  • lazy learning, 训练阶段仅仅保存样本, 没有显式的学习过程, 待收到测试样本后再进行处理
  • 三要素: k值的选择, 距离度量(街区, 欧式, 闵可夫斯基), 分类决策规则(majority vote)
  • 分类步骤

    1.计算测试点到训练集各个点的距离
    2.找出距离最小的 k 个点
    3.投票法得出类别
  • k 太小, 则对噪声敏感; k 太大, 则可能包含太多其他类别的点

    数据挖掘复习笔记---04.2分类问题之 KNN

  • 属性中需要归一化, 防止某一属性在计算距离的时候占主导地位

优点

  • 复杂度较低
  • 效率高
  • 非常适用于简单数据集的分类
  • 抗噪,对噪声鲁棒
  • 选取最优决策树是NP完全问题

其他

  • PEBLS: Parallel Examplar-Based Learning System (Cost & Salzberg)

    数据挖掘复习笔记---04.2分类问题之 KNN


以上所述就是小编给大家介绍的《数据挖掘复习笔记---04.2分类问题之 KNN》,希望对大家有所帮助,如果大家有任何疑问请给我留言,小编会及时回复大家的。在此也非常感谢大家对 码农网 的支持!

查看所有标签

猜你喜欢:

本站部分资源来源于网络,本站转载出于传递更多信息之目的,版权归原作者或者来源机构所有,如转载稿涉及版权问题,请联系我们

运营其实很简单:互联网运营进阶之道

运营其实很简单:互联网运营进阶之道

郑文博 / 人民邮电出版社 / 2018-2 / 49.80元

为了帮助从事运营或即将从事运营的广大读者更好、更快地了解运营、学习运营、入职运营,本书详细阐述运营对于用户、企业的帮助,同时以单个理论点 单个实战案例的方式详细分析了社群运营、活动运营、新媒体运营、内容运营、渠道运营、精细化运营、场景化运营、用户化运营、商业化运营等模块及运营工作、渠道整合、社群知识、渠道优化、SOP流程等细节,力求让读者在求职路上快速上手,在迷茫途中快速定位。 《运营其实很简单 ......一起来看看 《运营其实很简单:互联网运营进阶之道》 这本书的介绍吧!

图片转BASE64编码
图片转BASE64编码

在线图片转Base64编码工具

随机密码生成器
随机密码生成器

多种字符组合密码

URL 编码/解码
URL 编码/解码

URL 编码/解码