导航:首页 > 编程大全 > 数据挖掘数据库

数据挖掘数据库

发布时间:2023-12-02 10:35:17

大数据挖掘是什么

数据挖掘(DataMining)是从大量的、不完全的、有噪声的、模糊的、随机的数据中提取隐含在其中的、人们事先不知道的、但又是潜在有用的信息和知识的过程。

数据挖掘对象

根据信息存储格式,北大青鸟昌平计算机学院认为用于挖掘的对象有关系数据库、面向对象数据库、数据仓库、文本数据源、多媒体数据库、空间数据库、时态数据库、异质数据库以及Internet等。

数据挖掘流程

定义问题:清晰地定义出业务问题,确定数据挖掘的目的。

数据准备:数据准备包括:选择数据_在大型数据库和数据仓库目标中提取数据挖掘的目标数据集;数据预处理_进行数据再加工,包括检查数据的完整性及数据的一致性、去噪声,填补丢失的域,删除无效数据等。

数据挖掘:根据数据功能的类则明型和和数据的特点选择相应的算法,在净化和转换过的数据集上进行数据挖掘。

结果分析:对数据挖掘的结果进行解释和评价,转换成为能够最终被用户理解的知识。

数据挖掘分类

直接数据挖掘:目标是利用可用的数据建立一个模型,这个模型对剩余的数据,对一个特定的变量(可以理解成数据库中表的属性,即列)进行描述。

间接数据挖掘:目标中没有选出某一具体的变量,用模型进行描述;而是在所有的变量中建立起某种关系。

数据挖掘的方法

神经网络方法

神经网络由于本身良好的鲁棒性、自组织自适应性、并行处理、分布存储和高度容错等特性非常适合解决数据挖掘的问题,因此近年来越来越受到人们的关注。

遗传算法

遗传算法是一种基于生物自然选择与遗传机理的随机搜索算法,是一种仿生全局优化方法。遗传算法具有的隐含并行性孙裤告、易于和其它模型结合等性质使得它纯扮在数据挖掘中被加以应用。

决策树方法

决策树是一种常用于预测模型的算法,它通过将大量数据有目的分类,从中找到一些有价值的,潜在的信息。它的主要优点是描述简单,分类速度快,特别适合大规模的数据处理。


阅读全文

与数据挖掘数据库相关的资料

热点内容
allwaysync局域网教程 浏览:285
微信48mb文件打不开 浏览:210
word默认的行距和字符间距是多少 浏览:983
如何通过数据解决问题 浏览:663
微信给自己发文件 浏览:795
如何更换excel文件密码 浏览:842
大数据技术是什么系 浏览:90
怎样在手机上复制文件夹里面的文件夹里 浏览:395
word乱码恢复器 浏览:138
如何保存页面密码 浏览:967
传输文件内容 浏览:22
word文档中的图片 浏览:815
江门哪里好学编程 浏览:185
nike的app怎么登 浏览:590
宽带升级为什么变慢了 浏览:623
宽带连接ipv6无网络访问权限 浏览:581
诛仙手游文件哪些可以清理 浏览:873
javaweb范例宝典pdf 浏览:229
编程需要干什么 浏览:143
文件夹代码加密 浏览:592

友情链接