• linkedu视频
  • 平面设计
  • 电脑入门
  • 操作系统
  • 办公应用
  • 电脑硬件
  • 动画设计
  • 3D设计
  • 网页设计
  • CAD设计
  • 影音处理
  • 数据库
  • 程序设计
  • 认证考试
  • 信息管理
  • 信息安全
菜单
linkedu.com
导航菜单
  • 网页制作
  • 数据库
  • 程序设计
  • 操作系统
  • CMS教程
  • 游戏攻略
  • 脚本语言
  • 平面设计
  • 软件教程
  • 网络安全
  • 电脑知识
  • 服务器
  • 视频教程
  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx
您的位置:首页 > 服务器 >云计算 > MapReduce编程之倒排索引,mapreduce编程索引

MapReduce编程之倒排索引,mapreduce编程索引

作者:网友 字体:[增加 减小] 来源:互联网

本文主要包含mapreduce倒排索引,mapreduce编程实例,mapreduce编程模型,mapreduce编程,mapreduce编程模板等服务器相关知识,网友希望可以进行参考

MapReduce编程之倒排索引,mapreduce编程索引


任务要求:

//输入文件格式

18661629496 110

13107702446 110

1234567 120

2345678 120

987654 110

2897839274 18661629496

//输出文件格式格式

11018661629496|13107702446|987654|18661629496|13107702446|987654|

1201234567|2345678|1234567|2345678|

186616294962897839274|2897839274|

mapreduce程序编写:

1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 41 42 43 44 45 46 47 48 49 50 51 52 53 54 55 56 57 58 59 60 61 62 63 64 65 66 67 68 69 70 71 72 73 74 75 76 77 78 79 80 81 82 83 84 85 86 import java.io.IOException; import java.util.StringTokenizer;   import org.apache.hadoop.conf.Configuration; import org.apache.hadoop.fs.Path; import org.apache.hadoop.io.IntWritable; import org.apache.hadoop.io.LongWritable; import org.apache.hadoop.io.Text; import org.apache.hadoop.mapreduce.Job; import org.apache.hadoop.mapreduce.Mapper; import org.apache.hadoop.mapreduce.Reducer; import org.apache.hadoop.mapreduce.lib.input.FileInputFormat; import org.apache.hadoop.mapreduce.lib.output.FileOutputFormat;   public class Test2 {     enum Counter     {         LINESKIP,//记录出错的行     }     public static class Map extends Mapper<LongWritable, Text, Text, Text>{             public void map(LongWritable key, Text value, Context context)                 throws IOException, InterruptedException {              String line = value.toString();//读取源数据              try              {                  //数据处理                  String [] lineSplit = line.split(" ");//18661629496,110                  String anum = lineSplit[0];                  String bnum = lineSplit[1];                    //输出格式:110,18661629496                                 context.write(new Text(bnum), new Text(anum));                                 }              catch(ArrayIndexOutOfBoundsException e)              {                  context.getCounter(Counter.LINESKIP).increment(1);//出错时计数器+1                  return;              }           }     }       
分享到:QQ空间新浪微博腾讯微博微信百度贴吧QQ好友复制网址打印

您可能想查找下面的文章:

  • MapReduce编程之倒排索引,mapreduce编程索引
  • MapReduce实现倒排索引,mapreduce实现索引

相关文章

  • 机器学习--k均值聚类(k-means)算法,--kk-means
  • 云计算容器服务该何去何从,容器该何去何从
  • solr实战-(一),solr实战
  • Hive Developing,hivedeveloping
  • 安装配置openstack 中的 Open vSwitch (OVS) service,openstackvswitch
  • hadoop 2.6.0 安装过程,hadoop2.6.0
  • hbase,hbase安装
  • Nova client源码分析---nova list命令,nova---nova
  • 关于分布式程序 java的内存管理浅谈,java内存管理浅谈
  • MapReduce的两表join一般操作,mapreduce表join

文章分类

  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx

最近更新的内容

    • 用Bash Script编写Hadoop MapReduce Streaming,hadoopmapreduce
    • Andrew Ng机器学习课程10,andrewng机器课程
    • docker compose自定义网络实现固定容器ip地址
    • Apache Spark的设计思路,apachespark
    • hadoop权威指南(第四版)要点翻译(1)——Foreword and Preface,hadoopforeword
    • R语言数据分析系列之一,数据分析系列之一
    • Deploy FAILURE:An app Was not successfully detected by any available buildpack,deploybuildpack
    • mongoVUE的增删改查操作使用说明;一、查询;1、精确查询;1)右键点击集合名,再左键点击Find;或者直接点击工具栏上的Find;2)查询界面,包括四个区域;{Find}区,查询条件格式{&quot;se,m
    • Docker 中文文档目录,docker文档目录
    • MapReduce处理二次排序(分区-排序-分组),mapreduce二次

关于我们 - 联系我们 - 免责声明 - 网站地图

©2020-2025 All Rights Reserved. linkedu.com 版权所有