返回首页
当前位置: 主页 > 互联网技术 > 数据挖掘 >

数据挖掘的流程图解

时间:2014-10-04 00:21来源:电脑教程学习网 www.etwiki.cn 编辑:admin

1.数据挖掘环境

数据挖掘时指一个完整的过程,该过程从大型数据库中挖掘先前未知的,有效的,可实用的信息,并使用这些信息作出决策或丰富知识。

数据挖掘环境科示意如下图:

数据挖掘的流程 - 伊凡 - little bug

 2.数据挖掘过程图

下图描述了数据挖掘的基本过程和主要步骤:

数据挖掘的流程 - 伊凡 - little bug

 3.数据挖掘过程工作量

在数据挖掘中被研究的业务对象是整个过程的基础,它驱动了整个数据挖掘的过程,也是检验最后结果和指引分析人员完成数据挖掘的依据和顾问。

4.数据挖掘过程简介

过程中各步骤的大体内容如下:

1.1确定业务对象

清晰地定义业务问题,认清数据挖掘的目的是数据挖掘的重要一步,挖掘的最后结构式不可预测的,但要探索的问题应是有预见的,为了数据挖掘而数据挖掘则带有盲目性,是不会成功的。

2.2数据准备

1)数据的选择

搜索所有与业务对象有关的内部和外部数据信息,并从中选择出适用于数据挖掘应用的数据;

2)数据的预处理

研究数据的质量,为进一步的分析做准备,并确定将要进行的挖掘操作的类型。

3)数据的转换

将数据转换成一个分析模型,这个分析模型是针对挖掘算法建立的。建立一个真正适合挖掘算法的分析模型是数据挖掘成功的关键,

3.3数据挖掘

对所得到的经过转换的数据进行挖掘,除了完善从选择合适的挖掘算法外,其余一切工作都能自动地完成。

4.4结果分析

解释并评估结果。其使用的分析方法一般应做数据挖掘操作而定,通常会用到可视化技术。

5.5知识的同化

将分析所得到的知识集成到业务信息系统的组织结构中去。

5.数据挖掘需要的人员

数据挖掘过程的分步实现,不同的步会需要有不同专长的人员,他们大体可以分为三类:

业务分析人员:要求精通业务,能够解释业务对象,并根据各业务对象确定出用于数据定义和挖掘算法的业务需求。

数据分析人员:精通数据分析技术,并对统计学有较熟练的掌握,有能力把业务需求转化成数据挖掘的各步操作,并为每步操作选择合适的技术。

数据管理人员:精通数据管理技术,并从数据库或数据仓库中搜集数据。

------分隔线----------------------------
标签(Tag):数据挖掘
------分隔线----------------------------
推荐内容
猜你感兴趣