hadoop三大组件:1、hdfs,一个高可靠、高吞吐量的分布式文件系统;2、mapreduce,一个分布式的离线并行计算框架;3、yarn,分布式资源管理框架。
本文操作环境:windows7系统,dell g3电脑。
hadoop三大组件:
1、hdfs
一个高可靠、高吞吐量的分布式文件系统
存储海量数据
分布式
安全性
副本数据
数据是以block的方式进行存储的,128m
比如:200m—128m 72m
2、mapreduce
一个分布式的离线并行计算框架
对海量数据的处理
分布式
思想:
分而治之
大数据集分为小的数据集
每个数据集进行逻辑业务处理(map)
合并统计数据结果(reduce)
3、yarn
分布式资源管理框架
管理整个集群的资源(内存、cpu核数)
分配调度集群的资源
相关视频推荐:php编程从入门到精通
以上就是hadoop三大组件是什么的详细内容。