数据挖掘复习笔记---01.概述

栏目: 数据库 · 发布时间: 5年前

内容简介:Chp1

Chp1

DM, Data Mining

  • 为什么需要 Data Mining

    信息技术的发展,计算机---存储和处理信息,网络---传播信息,物联网---收集信息,移动互联网---更加便捷地收集和传播信息

    问题:数据总量爆炸式增加,如何从中提取真正有价值的信息

    产生了新的领域(DM)

  • 什么是 DM

    Data Mining, 数据挖掘

    Knowledge Discovery, 知识发现

    Machine Learning, 机器学习

    Knowledge Discovery in Database, KDD

  • 理解 DM

    KDD, 从数据库获取数据---数据清洗---放入数据仓库(warehouse)---选出可能相关的感兴趣的信息---数据挖掘---评估---知识

    数据挖掘复习笔记---01.概述

    BI, Business Intelligence, 商业智能

    数据挖掘复习笔记---01.概述

    ML, 机器学习

    数据挖掘复习笔记---01.概述

  • 从 4 个不同的角度理解 DM

    • 待挖掘数据的种类: 文本,图像,视频,音频,...
    • 挖掘方法: 统计学,机器学习,可视化,...
    • 挖掘出的知识: 特征,类别,趋势,区别,关联,...
    • 应用领域: 互联网,销售,银行,股票,生物,...
  • DM 和 ML 的区别

    数据挖掘复习笔记---01.概述

    DM: 发现规律,填补单个空缺

    ML: 预测一整行

  • DM 的历史

  • DM 面临的主要挑战

    用户交互

    效率和可扩展性

    数据类型的多样性

    挖掘方法和技术

    社会问题

Big Data, 大数据

  • 定义: 4V

    Volume, 数据体量巨大,PB 级别

    Velocity, 要求处理速度快,1 秒定律,可从各种类型的数据中快速获得高价值的信息

    Variety, 数据类型繁多

    Value, 只要合理利用数据并对其进行正确、准确的分析,将会带来很高的价值回报

  • 应用

    Google Flu Trends Prediction

    Promotion of pregnant women products in Target supermarket


以上就是本文的全部内容,希望本文的内容对大家的学习或者工作能带来一定的帮助,也希望大家多多支持 码农网

查看所有标签

猜你喜欢:

本站部分资源来源于网络,本站转载出于传递更多信息之目的,版权归原作者或者来源机构所有,如转载稿涉及版权问题,请联系我们

修改代码的艺术

修改代码的艺术

Michael Feathers / 刘未鹏 / 人民邮电出版社 / 2007-09-25 / 59.00元

我们都知道,即使是最训练有素的开发团队,也不能保证始终编写出清晰高效的代码。如果不积极地修改、挽救,随着时间流逝,所有软件都会不可避免地渐渐变得复杂、难以理解,最终腐化、变质。因此,理解并修改已经编写好的代码,是每一位程序员每天都要面对的工作,也是开发程序新特性的基础。然而,与开发新代码相比,修改代码更加令人生畏,而且长期以来缺乏文献和资料可供参考。 本书是继《重构》和《重构与模式》之后探讨......一起来看看 《修改代码的艺术》 这本书的介绍吧!

RGB转16进制工具
RGB转16进制工具

RGB HEX 互转工具

RGB HSV 转换
RGB HSV 转换

RGB HSV 互转工具

HEX CMYK 转换工具
HEX CMYK 转换工具

HEX CMYK 互转工具