如何编写最简单的MapReduce之WordCount程序


Mapper端:
Map端传入的数据是一个文本格式的数据,每一行都分别执行map方法,map方法调用的次数等同于文本的行数

如何编写最简单的MapReduce之WordCount程序


Redecer端:

map端传来的数据进入reduce方法前会分组和排序,因此进入reduce方法的数据是已经按key分组后的数据,每一个相同的key所对应的多个value都存放到迭代器中,所有相同key的数据一起执行一次reduce方法,因此reduce方法调用的次数等同于key值得种类

如何编写最简单的MapReduce之WordCount程序



Main方法:

main方法中负责调度自定义的MapReduce,通过job对象来为任务分配路径以及一些其他的配置。

如何编写最简单的MapReduce之WordCount程序