• linkedu视频
  • 平面设计
  • 电脑入门
  • 操作系统
  • 办公应用
  • 电脑硬件
  • 动画设计
  • 3D设计
  • 网页设计
  • CAD设计
  • 影音处理
  • 数据库
  • 程序设计
  • 认证考试
  • 信息管理
  • 信息安全
菜单
linkedu.com
导航菜单
  • 网页制作
  • 数据库
  • 程序设计
  • 操作系统
  • CMS教程
  • 游戏攻略
  • 脚本语言
  • 平面设计
  • 软件教程
  • 网络安全
  • 电脑知识
  • 服务器
  • 视频教程
  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx
您的位置:首页 > 服务器 >云计算 > MapReduce编程之WordCount,mapreducewordcount

MapReduce编程之WordCount,mapreducewordcount

作者:网友 字体:[增加 减小] 来源:互联网

本文主要包含mapreduce wordcount,mapreduce map,mapreduce,mapreduce是什么,mapreduce原理等服务器相关知识,网友希望可以进行参考

MapReduce编程之WordCount,mapreducewordcount


//mapreduce程序 import java.io.IOException; import java.util.StringTokenizer;   import org.apache.hadoop.conf.Configuration; import org.apache.hadoop.fs.Path; import org.apache.hadoop.io.IntWritable; import org.apache.hadoop.io.LongWritable; import org.apache.hadoop.io.Text; import org.apache.hadoop.mapreduce.Job; import org.apache.hadoop.mapreduce.Mapper; import org.apache.hadoop.mapreduce.Reducer; import org.apache.hadoop.mapreduce.lib.input.FileInputFormat; import org.apache.hadoop.mapreduce.lib.output.FileOutputFormat;   public class WordCount {     /**    * TokenizerMapper 继续自 Mapper<LongWritable, Text, Text, IntWritable>    *    * [一个文件就一个map,两个文件就会有两个map]    * map[这里读入输入文件内容 以" \t\n\r\f" 进行分割,然后设置 word ==> one 的key/value对]    *    * @param Object  Input key Type:    * @param Text    Input value Type:    * @param Text    Output key Type:    * @param IntWritable Output value Type:    *    * Writable的主要特点是它使得Hadoop框架知道对一个Writable类型的对象怎样进行serialize以及deserialize.    * WritableComparable在Writable的基础上增加了compareT接口,使得Hadoop框架知道怎样对WritableComparable类型的对象进行排序。    *    * @ author liuqingjie    *    */   public static class TokenizerMapper        extends Mapper<LongWritable, Text, Text, IntWritable>{       private final static IntWritable one = new IntWritable(1);     private Text word = new Text();     public void map(LongWritable key, Text value, Context context) throws IOException, InterruptedException {       StringTokenizer itr = new StringTokenizer(value.toString());       while (itr.hasMoreTokens()) {         word.set(itr.nextToken());         context.write(word, one);       }     }   }     /**    * IntSumReducer 继承自 Reducer<Text,IntWritable,Text,IntWritable>    *    * [不管几个Map,都只有一个Reduce,这是一个汇总]    * reduce[循环所有的map值,把word ==> one 的key/value对进行汇总]    *    * 这里的key为Mapper设置的word[每一个key/value都会有一次reduce]    *    * 当循环结束后,最后的确context就是最后的结果.    
分享到:QQ空间新浪微博腾讯微博微信百度贴吧QQ好友复制网址打印

您可能想查找下面的文章:

  • MapReduce编程之WordCount,mapreducewordcount

相关文章

  • 开源图计算框架GraphLab介绍,开源图框架graphlab
  • 系统监控软件Ganglia的安装,监控软件ganglia
  • HBase shell 启动出错 org.apache.zookeeper.KeeperException$ConnectionLossException: KeeperErrorCode = Con,
  • 新增数据页面360浏览器样式异常,新增360浏览器样式
  • kernel interrupt,interrupt
  • spark一些入门资料,spark入门资料
  • Mellanox网卡,使用netperf进行性能测试,mellanoxnetperf
  • Jedis分片Sentinel连接池实验,jedissentinel实验
  • Centos 安装R 集成 Hadoop、RHive 配置安装手册,centoshadoop
  • 机器学习数学基础- gradient descent算法(下),gradientdescent

文章分类

  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx

最近更新的内容

    • LXC学习,学习中国app上线
    • 在Java程序中调用Salesforce REST API,salesforcerest
    • Scala函数声明与定义,Scala函数声明定义
    • Web.xml配置详解,web.xml详解
    • Spark开发指南,spark指南
    • 机器学习算法-Adaboost,学习算法-adaboost
    • 与Greenplum度过的三个星期,greenplum三个星期
    • Zookeeper实践之:通过Zookeeper实现一个消费者进程分配程序,zookeeper消费者
    • Greenplum+Hadoop学习笔记-14-定义数据库对象之创建与管理表空间,hadoop-14-
    • 上海第五次Spark meetup会议资料分享,sparkmeetup

关于我们 - 联系我们 - 免责声明 - 网站地图

©2020-2025 All Rights Reserved. linkedu.com 版权所有