Hadoop 的三大组件是指 Hadoop 分布式文件系统(HDFS)、MapReduce 和 Yet Another Resource Negotiator(YARN)。
HDFS:Hadoop 分布式文件系统是 Hadoop 的分布式文件系统,它是将大规模数据分散存储在多个节点上的基础。HDFS 主要负责数据的存储和管理,可以将大数据集分成多个数据块,并将这些数据块分配到不同的计算节点上存储,提高数据的可靠性和处理效率。
MapReduce:MapReduce 是 Hadoop 的分布式计算框架,它提供了一种简单的编程模型,通过将大规模数据分解成多个小任务并行处理,可以大大提高数据处理的效率。MapReduce 模型包括 Map 和 Reduce 两个阶段,其中 Map 阶段将数据分解成多个小块进行处理,Reduce 阶段将处理结果合并。
YARN:Yet Another Resource Negotiator(YARN)是 Hadoop 的资源管理器,它负责为多个应用程序分配和管理计算资源,可以有效地提高计算资源的利用率。YARN 可以将集群中的计算资源划分为多个容器,为不同的应用程序提供适当的资源,并监控和管理各个应用程序的运行状态。
综上所述,HDFS、MapReduce 和 YARN 是 Hadoop 的三大组件,它们共同构成了 Hadoop 分布式计算框架的核心。