人工智能\机器学习\统计学\数据挖掘之间有什么区别？

大数据与机器学习文摘 · 公众号 · 大数据 · 2017-06-23 17:16

正文

（点击上方公众号，可快速关注）

英文：shakthydoss，编译：伯乐在线 - 蓝枫紫叶

如有好文章投稿，请点击 → 这里了解详情

【伯乐在线导读】：前段时间，作者在 stats.stackexchange.com（译注：国外的一个系列问答网站，其中Stack Overflow是其中一个子站）看到一个很有意思的问题，引起了他的注意。经过阅读和分析 StackExchange 上的所有答案后，他觉得有必将其想法写下来。

以下是 StackExchange 上的问题：

人工智能、机器学习、统计学和数据挖掘有什么区别？

是否可以这样说，它们是利用不同方法解决相似问题的四个领域？它们之间到底有什么共同点和不同点？如果它们之间有层次等级的区分，应该是怎样一回事？

我假定题主是想得到一个清晰的图，上面有各个领域清晰的分界线。因此，在这里我尝试用我最简单的方式来解释这个问题。

机器学习是一门涉及自学习算法发展的科学。这类算法本质上是通用的，可以应用到众多相关问题的领域

数据挖掘是一类实用的应用算法（大多是机器学习算法），利用各个领域产出的数据来解决各个领域相关的问题。

统计学是一门研究怎样收集，组织，分析和解释数据中的数字化信息的科学。统计学可以分为两大类：描述统计学和推断统计学。描述统计学涉及组织，累加和描绘数据中的信息。推断统计学涉及使用抽样数据来推断总体。

机器学习利用统计学（大多是推断统计学）来开发自学习算法。

数据挖掘则是在从算法得到的结果上应用统计学（大多是描述统计学），来解决问题。

数据挖掘作为一门学科兴起，旨在各种各样的行业中（尤其是商业）求解问题，求解过程需要用到不同研究领域的不同技术和实践。

1960年求解问题的从业者使用术语Data fishing来称呼他们所做的工作。1989年Gregory Piatetsky Shapiro使用术语knowledge Discovery in the Database（KDD，数据集上的知识发掘）。1990年一家公司在商标上使用术语数据挖掘来描述他们的工作。现如今现如今数据挖掘和KDD两词可以交换使用。

人工智能这门科学的目的在于开发一个模拟人类能在某种环境下做出反应和行为的系统或软件。由于这个领域极其广泛，人工智能将其目标定义为多个子目标。然后每个子目标就都发展成了一个独立的研究分支。