• linkedu视频
  • 平面设计
  • 电脑入门
  • 操作系统
  • 办公应用
  • 电脑硬件
  • 动画设计
  • 3D设计
  • 网页设计
  • CAD设计
  • 影音处理
  • 数据库
  • 程序设计
  • 认证考试
  • 信息管理
  • 信息安全
菜单
linkedu.com
导航菜单
  • 网页制作
  • 数据库
  • 程序设计
  • 操作系统
  • CMS教程
  • 游戏攻略
  • 脚本语言
  • 平面设计
  • 软件教程
  • 网络安全
  • 电脑知识
  • 服务器
  • 视频教程
  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx
您的位置:首页 > 服务器 >云计算 > 上传到dfs和hadoop统计计算

上传到dfs和hadoop统计计算

作者:求人不如求己 字体:[增加 减小] 来源:互联网

本文主要包含hadoop等服务器相关知识,求人不如求己希望可以进行参考
        stop-all.sh     

        start-all.sh
        start-dfs.sh

datanode没有启动成功,删除格式化日志

解决:
        1)删除“/usr/hadoop/tmp”里面的内容
               rm -rf /usr/hadoop/tmp/*
        2)删除“/tmp”下以“hadoop”开头的文件
               rm -rf /tmp/hadoop*
        3)重新格式化hadoop
               hadoop namenode -format
        4)启动hadoop
               start-all.sh

启动hadoop

hadoop fs -ls hdfs://localhost:9000/

将本文件放到dfs文件上

hadoop fs -put install.log.syslog hdfs://127.0.0.1:9000/

查看hadoop的dfs下根目录

    hadoop fs -ls /

获取dfs上的文件刚才上传的文件

    hadoop fs -get /install.log.syslog 

======>初步实验
去到目录
/usr/mysoft/hadoop-2.4.0/share/hadoop/mapreduce

建目录

hadoop fs -mkdir /testdata
hadoop fs -mkdir /testdata/sample

准备的test.data数据

hello tom
hello jack
hello tangch
hello gogog
hello cat
hel baby
hello andy
hello redis
hel jack

将数据test.data上传到指定的/testdata/sample文件目录下

fs -put test.data /testdata/sample

统计词汇

hadoop jar hadoop-mapreduce-examples-2.4.0.jar wordcount /testdata/sample /testdata/output

去到结果目录

hadoop fs -ls /testdata/output

查看统计结果

    hadoop fs -cat /testdata/output/part-r-00000

例子2
计算圆周率pi

hadoop jar hadoop-mapreduce-examples-2.4.0.jar pi 5 5
分享到:QQ空间新浪微博腾讯微博微信百度贴吧QQ好友复制网址打印

您可能想查找下面的文章:

相关文章

  • Deploy FAILURE:An app Was not successfully detected by any available buildpack,deploybuildpack
  • 大数据处理算法一:Bitmap算法,数据处理bitmap算法
  • 高阶MapReduce_3_reducer侧联结原理,mapreduce原理
  • kafka 安装步骤,kafka安装步骤
  • hadoop 2.4.1 64位编译记录,hadoop2.4.1
  • HDP出现Could not create the Java Virtual Machine解决方法,hdpvirtual
  • HIVE动态分区实战,hive动态实战
  • hadoop集群只有一个datanode启动问题,hadoop集群datanode
  • vlan trunk and access,vlantrunk
  • 讨论Spark的配置监控和性能优化,spark监控性能优化

文章分类

  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx

最近更新的内容

    • 在spark上运行独立程序(Self-Contained Applications),selfcontained
    • Maven构建Hadoop Web项目,maven构建hadoopweb
    • spark core源码分析10 Task的运行,sparkcore
    • 智能助手相伴,享受人机温情,智能助手人机
    • hadoop修改启动主机名称
    • HIVE的数据存储,HIVE数据存储
    • 什么是Code Review,CodeReview
    • Scala类型详解,scala详解
    • 浅谈大数据,浅谈数据
    • hadoop2企业级集群部署(DNS域名解析+NFS密钥共享+AWK批量复制),hadoop2awk

关于我们 - 联系我们 - 免责声明 - 网站地图

©2020-2025 All Rights Reserved. linkedu.com 版权所有