Mapreduce

1.MapReduce进程

一个完整的MapReduce程序在分布式运行时有三类实例进程:
(1)MrAppMaster:负责整个程序的过程调度及状态协调。
(2)MapTask:负责Map阶段的整个数据处理流程。
(3)ReduceTask:负责Reduce阶段的整个数据处理流程。

2.常用数据序列化类型

3.MapReduce的编程规范

用户编写的程序分成三个部分:Mapper、Reducer和Driver。

4.WordCount案例

原文地址:https://www.cnblogs.com/xiao-bu/p/14283335.html