• linkedu视频
  • 平面设计
  • 电脑入门
  • 操作系统
  • 办公应用
  • 电脑硬件
  • 动画设计
  • 3D设计
  • 网页设计
  • CAD设计
  • 影音处理
  • 数据库
  • 程序设计
  • 认证考试
  • 信息管理
  • 信息安全
菜单
linkedu.com
导航菜单
  • 网页制作
  • 数据库
  • 程序设计
  • 操作系统
  • CMS教程
  • 游戏攻略
  • 脚本语言
  • 平面设计
  • 软件教程
  • 网络安全
  • 电脑知识
  • 服务器
  • 视频教程
  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx
您的位置:首页 > 服务器 >云计算 > Sqoop工具,sqoop安装

Sqoop工具,sqoop安装

作者:网友 字体:[增加 减小] 来源:互联网

本文主要包含sqoop工具,sqoop安装,sqoop1.99.7安装,sqoop1.4.6安装,sqoop安装问题等服务器相关知识,网友希望可以进行参考

Sqoop工具,sqoop安装


简介

SQOOP是用于对数据进行导入导出的。
(1)把MySQL、Oracle等数据库中的数据导入到HDFS、Hive、HBase中
(2)把HDFS、Hive、HBase中的数据导出到MySQL、Oracle等数据库中

安装sqoop

1.解压sqoop

tar  -zxvf  sqoop-1.4.3.bin_hadoop-1.0.0.tar.gz

2.重命名

mv  sqoop-1.4.3.bin_hadoop-1.0.0   sqoop

3.设置环境变量

vi  /etc/profile
export SQOOP_HOME=/usr/local/sqoop

将$SQOOP_HOME/bin 添加到 PATH 中

source  /etc/profile

完毕!

注意:下面在命令行里的绿色长线是双横线,markdown编辑后博客显示的是一条长线,暂时还不知道该问题如何解决

把mysql数据导入到hdfs或者hive中

我们主要使用的是sqoop脚本。
注:因为要连接mysql 所以需要jdbc驱动

把数据从mysql导入到hdfs(默认是/user/username)中:

sqoop import  --connect jdbc:mysql://hadoop:3306/hive  --username root --password admin --table TBLS --fields-terminated-by '\t'
--null-string  ‘**’ 

表示对于null值使用**代替 默认使用NULL ‘- -’不能使用,专有字符

Sqoop在导入时,使用4个MapReduce并行执行 ,可以指定一个如下:

sqoop import --connect jdbc:mysql://hadoop:3306/hive  --username root --password admin --table TBLS --fields-terminated-by '\t'  -m 1

hdfs不可以多次写入,解决办法:

sqoop import --connect jdbc:mysql://hadoop:3306/hive  --username root --password admin --table TBLS --fields-terminated-by '\t'  -m 1  --append

也可以导入到hive中,但前提是删除 /user/root/目录下内容:

hadoop fs -rmr  /user/root/*

因为在执行导入后,会再次在/user/root下生成 sqoop文件

sqoop import --connect jdbc:mysql://hadoop:3306/hive --username root --password admin --table TBLS --fields-terminated-by '\t' -m 1 --append --hive-import

导入增量:

sqoop import --connect jdbc:mysql://hadoop:3306/hive --username root --password admin --table 


 
分享到:QQ空间新浪微博腾讯微博微信百度贴吧QQ好友复制网址打印

您可能想查找下面的文章:

  • Sqoop工具,sqoop安装

相关文章

  • MapReduce的两表join操作优化,mapreduce表join
  • LinkedIn Cubert 实践指南,linkedincubert
  • Spark MLlib Deep Learning Deep Belief Network (深度学习-深度信念网络)2.1,mllibbelief
  • 【Spark】弹性分布式数据集RDD概述,sparkrdd概述
  • 通过 JMX 获取Hadoop/HBase监控数据,jmxhadoop
  • hive的变量传递设置,hive变量传递设置
  • Hadoop之——HBase笔记,hadoophbase
  • Docker image的工作原理,dockerimage
  • Apache MRQL——Apache又一开源孵化利器,mrqlapache
  • Hive学习笔记(三),hive学习笔记

文章分类

  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx

最近更新的内容

    • H3C config vlan access and trunk links,h3ctrunk
    • 玩转OpenStack网络Neutron(2)--使用Open vSwitch实现VLAN类型租户网络,openstackvswitch
    • Hadoop集群优化,hadoop集群
    • MapReduce程序之实现单表关联,mapreduce单表关联
    • 机器学习算法-K-means聚类,算法-k-means聚类
    • Scala类型详解,scala详解
    • 2015 OpenCloud峰会总结,2015opencloud峰会
    • MapReduce的两表join一般操作,mapreduce表join
    • The superclass "javax.servlet.http.HttpServlet" was not found on the Java Build Path,httpservlet
    • redis学习笔记之pipeline,redispipeline

关于我们 - 联系我们 - 免责声明 - 网站地图

©2020-2025 All Rights Reserved. linkedu.com 版权所有