Hadoop介绍[亲测有效]

Hadoop介绍[亲测有效]Hadoop是Apache旗下的一个用java语言实现开源软件框架,是一个开发和运行处理大规模数据的软件平台,允许使用简单的编程模型在大量的计算机集群上对大型数据集进行分布式处理。 下面是Hadoop

Hadoop介绍

Hadoop是Apache旗下的一个用java语言实现开源软件框架,是一个开发和运行处理大规模数据的软件平台,允许使用简单的编程模型在大量的计算机集群上对大型数据集进行分布式处理。

下面是Hadoop的版本:

Hadoop介绍[亲测有效]

HDFS(分布式文件系统):解决海量数据存储

YARN(作业调度和集群资源管理的框架):解决资源任务调度

MAPREDUCE(分布式运算编程框架):解决海量数据计算

其中Hadoop2.0版本中多了YARN,更加合理的来解决资源任务调度问题,分解了Hadoop1.0版本中MapRuce的压力。

 

Hadoop特性优点:

扩容能力:Hadoop是可用的计算机集群间分配数据并完成计算任务的,这些集群可用方便的扩展到数以千计的节点中

成本低:Hadoop通过普通廉价的机器组成服务器集群来分发以及处理数据,以至于成本很低

高效率:通过并发数据,Hadoop可以在节点之间动态并行的移动数据,使得速度非常快。

可靠性:能自动维护数据的多份复制,并且在任务失败后能自动重新部署计算任务,所以Hadoop的按位存储和处理数据的能力值得人们信赖。

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容, 请发送邮件至 举报,一经查实,本站将立刻删除。
转载请注明出处: https://daima100.com/7730.html

(0)
上一篇 2023-03-15 12:00
下一篇 2023-03-15

相关推荐

发表回复

您的电子邮箱地址不会被公开。 必填项已用*标注