• linkedu视频
  • 平面设计
  • 电脑入门
  • 操作系统
  • 办公应用
  • 电脑硬件
  • 动画设计
  • 3D设计
  • 网页设计
  • CAD设计
  • 影音处理
  • 数据库
  • 程序设计
  • 认证考试
  • 信息管理
  • 信息安全
菜单
linkedu.com
导航菜单
  • 网页制作
  • 数据库
  • 程序设计
  • 操作系统
  • CMS教程
  • 游戏攻略
  • 脚本语言
  • 平面设计
  • 软件教程
  • 网络安全
  • 电脑知识
  • 服务器
  • 视频教程
  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx
您的位置:首页 > 服务器 >云计算 > Hadoop之—— Linux搭建hadoop环境(简化篇),linuxhadoop

Hadoop之—— Linux搭建hadoop环境(简化篇),linuxhadoop

作者:网友 字体:[增加 减小] 来源:互联网

本文主要包含linux安装hadoop,linux hadoop,linux下安装hadoop,linux hadoop eclipse,linux搭建hadoop等服务器相关知识,网友希望可以进行参考

Hadoop之—— Linux搭建hadoop环境(简化篇),linuxhadoop


转载请注明出处:http://blog.csdn.net/l1028386804/article/details/45771619

1、安装JDK(此处以安装JDK1.6为例,具体安装JDK的版本不限)

  (1)下载安装JDK:确保计算机联网之后命令行输入下面命令安装JDK
       sudo apt-get install sun-java6-jdk
  (2)配置计算机Java环境:打开/etc/profile,在文件最后输入下面内容
       export JAVA_HOME = (Java安装目录)
       export CLASSPATH = ".:$JAVA_HOME/lib:$CLASSPATH"
       export PATH = "$JAVA_HOME/:PATH"
  (3)验证Java是否安装成功
  输入 java -version ,输出Java版本信息即为安装成功。

2、安装配置SSH

  (1)下载安装SSH:同样在命令行输入下面命令安装SSH
      sudo apt-get install ssh
  (2)配置无密码登录本机:在命令行输入下面两条命令
     $ ssh-keygen -t rsa -P '' -f ~/.ssh/id_rsa
         直接回车,完成后会在~/.ssh/生成两个文件:id_rsa和id_rsa.pub;这两个成对出现,类似钥匙和锁。
        
         再把id_rsa.pub追加到授权key里面(当前并没有authorized_keys文件)
         $ cat ~/.ssh/id_rsa.pub >> ~/.ssh/authorized_keys
   
  (3)验证SSH是否安装成功
       输入 ssh localhost 。如果显示本机登录成功就表明安装成功。

3、关闭防火墙

   $sudo ufw disable
   注意:这步非常重要,如果不关闭,会出现找不到datanode的问题

4、安装运行Hadoop(以0.20.2版本为例)

  (1)下载Hadoop:在http://www.apache.org/dyn/closer.cgi/hadoop/core/页面上下载Hadoop。
  (2)安装配置Hadoop
   单节点配置:
   安装单节点的Hadoop无需配置,在这种方式下,Hadoop被认作为一个单独的Java进程。
   伪分布配置:
   伪分布的Hadoop是只有一个节点的集群。在这个集群中,计算机既是master也是slave,
     即使 namenode也是datanode,既是jobtracker也是tasktracker。

  配置的过程如下:

  a、进入conf文件夹修改下面的文件。
  Hadoop-env.sh中加入下面内容:
  export JAVA_HOME = (JAVA安装目录)
  core-site.xml文件内容修改为下面内容:
<configuration>

     <!-- global properties -->
     <property>
    <name>hadoop.tmp.dir</name>
    <value>/home/liuyazhuang/tmp</value>
   </property>

    <!-- file system properties -->
   <property>
    <name>fs.default.name</name>
    <value>hdfs://localhost:9000</value>
   </property>
  </configuration>
  hdfs-site.xml文件内容修改为下面内容:(replication默认为3,如果不修改,datanode少于三台就会报错)
<configuration>
   <property>
    <name>fs.replication</name>
    <value>1</value>
   </property>
  </configuration>

mapred-site.xml文件内容修改为下面内容:

<pre name="code" class="html">
  <configuration>
   <property>
    <name>mapred.job.tracker</name>
    <value>localhost:9001</value>
   </property>
  </configuration>


  b、格式化Hadoop文件系统,在命令行输入命令:  bin/hadoop namenode -format 

          多次格式化先删除 /home/liuyazhuang/tmp(此目录与core-site.xml中配置的目录相同)这个文件夹后在执行格式化操作,

        c、启动Hadoop,在命令行输入命令:  bin/start-all.sh  

        d、验证Hadoop是否安装成功,在浏览器中输入下面网址,如果正常打开说明安装成功。  

        http://localhost:50030 (mapreduce的web页面)  http://localhost:50070 (hdfs的web页面)

5、运行实例

    (1)先在本地磁盘建立两个输入文件 file01和file02   $echo "Hello World Bye World" > file01   $echo "Hello Hadoop Goodbye Hadoop" > file02  

    (2)在hdfs中建立一个input目录:$hadoop fs -mkdir input  

    (3)将file01和file02拷贝到hdfs中:      $hadoop fs -copyFromLocal /home/liuyazhuang/file0* input  

    (4)执行wordcount:      $hadoop jar hadoop-0.20.2-examples.jar wordcount input output  

    (5)完成之后,查看结果      $hadoop fs -cat output/part-r-00000

export JAVA_HOME = /home/chuanqing/profile/jdk-6u13-linux-i586.zip_FILES/jdk1.6.0_13
export CLASSPATH = ".:$JAVA_HOME/lib:$CLASSPATH"
export PATH = "$JAVA_HOME/:PATH"
export HADOOP_INSTALL=/home/chuanqing/profile/hadoop-0.20.203.0
export PATH=$PATH:$HADOOP_INSTALL/bin
export HADOOP_INSTALL=/home/zhoulai/profile/hadoop-0.20.203.0
export PATH=$PATH:$HADOOP_INSTALL/bin

分享到:QQ空间新浪微博腾讯微博微信百度贴吧QQ好友复制网址打印

您可能想查找下面的文章:

  • Hadoop之—— Linux搭建hadoop环境(简化篇),linuxhadoop
  • Hadoop之——Linux基本命令回顾,hadooplinux回顾

相关文章

  • 架构设计(ASP.NET MVC+Knockout+Web API+SignalR),knockoutsignalr
  • Hive作为Mondrian的数据源,hivemondrian
  • Heron(一)—-storm的一些短板,heron-storm
  • HDFS小文件的合并优化
  • SSH无密码登陆配置,ssh无密码登陆
  • Flume 开发者指南V1.5.2,flume开发者v1.5.2
  • springmvc No mapping found for HTTP request with URI in Dispatc,springmvcdispatc
  • Scala非值类型,Scala值类型
  • Cloud Foundry service broker开发部署实例解析(下),foundrybroker
  • Zookeeper常见问题整理,zookeeper常见问题

文章分类

  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx

最近更新的内容

    • MapReduce对输入多文件的处理,mapreduce输入处理
    • 一步一步跟我学习hadoop(4)----hadoop Map/Reduce教程(1),hadoop----hadoop
    • 2015年中国的云计算标准有哪些?,2015年中国标准
    • 配置tomcat默认项目,tomcat默认项目
    • 在streaming process中为什么需要类似sql查询语言,streamingprocess
    • R720 disable hyperthreading,r720hyperthreading
    • 解决sqoop导入关系库更新联合主键的问题,sqoop主键
    • inet_ntoa issue,inet_ntoa
    • Java服务端限制下载速度,java服务端下载速度
    • Hadoop集群性能优化一,Hadoop集群性能优化

关于我们 - 联系我们 - 免责声明 - 网站地图

©2020-2025 All Rights Reserved. linkedu.com 版权所有