hadoop入门之wordcount学习
2017-07-28 13:49
375 查看
一天下班,看到一个公开课,一不下心就看到了半夜,讲的Hadoop特别生动易懂。后来我又找了一些资料学习了一下,先记录一下,更加深入的东西仍需投入时间学习和理解。
假设输入为两个文件
第一步:input
InputFormat类将输入文件划分成多个splits,同时将这些splits转化为<K,V>的形式,如下,可以发现,当使用默认的TextInputFormat进行处理的时候,K为偏移量,V为每行的文本。
第二步:map
第三步shuffle:
第四步:reduce
第五步:output
假设输入为两个文件
第一步:input
InputFormat类将输入文件划分成多个splits,同时将这些splits转化为<K,V>的形式,如下,可以发现,当使用默认的TextInputFormat进行处理的时候,K为偏移量,V为每行的文本。
第二步:map
第三步shuffle:
第四步:reduce
第五步:output
相关文章推荐
- hadoop入门学习系列之五Eclipse下搭建Hadoop2.6.5开发环境并写wordcount
- 知识学习——Hadoop MapReduce开发入门程序WordCount详解
- hadoop入门学习系列之二hadoop的mapreduce的wordcount流程介绍
- hadoop学习笔记(三)mapreduce程序wordcount
- Hadoop MapReduce编程 API入门系列之wordcount版本5(九)
- Hadoop大数据平台入门——第一个小程序WordCount
- Hadoop入门实例——WordCount统计单词
- 【hadoop学习】在伪分布式hadoop上实践word count程序——c/c++ pipes版本
- Hadoop入门WordCount代码
- Hadoop实战学习(1)-WordCount
- Hadoop入门程序WordCount的执行过程
- Hadoop MapReduce编程 API入门系列之wordcount版本2(六)
- Hadoop入门概述-概念及WordCount实例详解
- hadoop word count 学习总结
- Hadoop入门—WordCount代码分析
- Hadoop学习笔记(六)实战word count
- hadoop学习之HDFS(2.1):linux下eclipse中配置hadoop-mapreduce开发环境并运行WordCount.java程序
- hadoop入门程序WordCount代码详解
- Hadoop 从零开始学习系列-wordCount
- 【hadoop学习】在伪分布式hadoop上手把手实践word count程序【下】