• linkedu视频
  • 平面设计
  • 电脑入门
  • 操作系统
  • 办公应用
  • 电脑硬件
  • 动画设计
  • 3D设计
  • 网页设计
  • CAD设计
  • 影音处理
  • 数据库
  • 程序设计
  • 认证考试
  • 信息管理
  • 信息安全
菜单
linkedu.com
导航菜单
  • 网页制作
  • 数据库
  • 程序设计
  • 操作系统
  • CMS教程
  • 游戏攻略
  • 脚本语言
  • 平面设计
  • 软件教程
  • 网络安全
  • 电脑知识
  • 服务器
  • 视频教程
  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx
您的位置:首页 > 服务器 >云计算 > Hive快速入门,hive入门

Hive快速入门,hive入门

作者:网友 字体:[增加 减小] 来源:互联网

本文主要包含hive入门,hive sql,hive游学网,hive,hive-inn酒店等服务器相关知识,网友希望可以进行参考

Hive快速入门,hive入门



一、      什么是Hive Hive是基于Hadoop的一个数据仓库工具,可以将结构化的数据文件映射为一张数据库表,并提供简单的sql查询功能,可以将sql语句转换为MapReduce任务进行运行。同时,这个语言也允许熟悉 MapReduce  开发者的开发自定义的 mapper  和 reducer  来处理内建的 mapper 和 reducer  无法完成的复杂的分析工作。 二、      为什么使用Hive 学习成本低,可以通过类SQL语句快速实现简单的MapReduce统计,不必开发专门的MapReduce应用,十分适合数据仓库的统计分析。 三、      Hive 系统架构
 
用户接口主要有三个:CLI,JDBC/ODBC和 WebUI 1.    CLI,即Shell命令行 2.    JDBC/ODBC 是 Hive 的Java,与使用传统数据库JDBC的方式类似 3.    WebGUI是通过浏览器访问 Hive Metastore(Hive的元数据) 1.    元数据包含了Hive包表的表名、字段分区属性等表的属性信息 2.    默认使用Derby数据库作为默认的元数据仓库(嵌入式,只支持单session回话) 四、      Hive与传统数据的对比
     Hive       RDBMS   
   查询语言       HQL       SQL   
   数据存储       HDFS       Raw Device or Local FS   
   执行       MapReduce       Excutor   
   执行延迟       高       低   
   处理数据规模       大       小   
   索引       0.8版本后加入位图索引       有复杂的索引   
五、      Hive与hadoop 的调用关系  
六、      Hive安装 1.    下载hive源文件 2.    解压hive文件 3.    进入$HIVE_HOME/conf/修改文件 a)    cp  hive-env.sh.template  hive-env.sh b)    cp  hive-default.xml.template  hive-site.xml 4.    修改$HIVE_HOME/bin的hive-env.sh,增加以下三行 a)    exportJAVA_HOME=/usr/local/jdk1.7.0_45 b)    exportHIVE_HOME=/usr/local/hive-0.14.0 c)    exportHADOOP_HOME=/usr/local/hadoop-2.6.0 5.    伪分布模式使用默认的Derby就可以直接启动Hive控制台了,但一般都会修改为MySQL 修改$HIVE_HOME/conf/hive-site.xml <property>       <name>javax.jdo.option.ConnectionURL</name>       <value>jdbc:mysql://192.168.1.100:3306/crxy_job?                createDatabaseIfNotExist=true</value> </property> <property>       <name>javax.jdo.option.ConnectionDriverName</name>       <value>com.mysql.jdbc.Driver</value> </property> <property>       <name>javax.jdo.option.ConnectionUserName</name>       <value>root</value> </property> <property>       <name>javax.jdo.option.ConnectionPassword</name>       <value>admin</value> </property> 6.    将MySQL的驱动包jar文件存放在HIVE_HOME/lib下 7.    启动Hive,现在就可以执行Sql语句创建表了! 更多精彩内容请关注 

分享到:QQ空间新浪微博腾讯微博微信百度贴吧QQ好友复制网址打印

您可能想查找下面的文章:

  • Hive快速入门,hive入门

相关文章

  • storm的集群安装与配置,storm集群配置
  • 孙其功陪你学之——Spark 正则化和SparkSQL,孙其功sparksql
  • centos源码编译docker,centos源码docker
  • 新增数据页面360浏览器样式异常,新增360浏览器样式
  • Greenplum数据库升级实务(上),greenplum实务
  • Zoho产品经理谈中小企业面临的挑战及应对之策,zoho产品经理
  • Openfire Hazelcast集群详解,openfirehazelcast
  • hive优化-----控制hive任务的reduce数,hivereduce
  • docker compose自定义网络实现固定容器ip地址
  • 基于 ssh + Xpra 构建 Docker 桌面系统,xpradocker

文章分类

  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx

最近更新的内容

    • CRM市场及Zoho模式,CRM市场Zoho模式
    • ZooKeeper+Hadoop2.6.0的ResourceManager HA搭建,hadoop2.6集群搭建
    • HIVE动态分区实战,hive动态实战
    • 超人学院Hadoop大数据资源分享,超人学院hadoop分享
    • Jedis分片Sentinel连接池实验,jedissentinel实验
    • HDFS API基本操作,hdfsapi基本操作
    • openstack性能测试用例和测试结果,openstack性能测试
    • 【解决】hive动态增加partitions不能超过100的问题,hivepartitions
    • RabbitMQ(python实现)学习之二:Producer发送消息至多个消息队列queue(广播消息),rabbitmqqueue
    • 玩转OpenStack网络Neutron(2)--使用Open vSwitch实现VLAN类型租户网络,openstackvswitch

关于我们 - 联系我们 - 免责声明 - 网站地图

©2020-2025 All Rights Reserved. linkedu.com 版权所有