【Hadoop离线基础总结】Hive的安装部署以及使用方式

Hive的安装部署以及使用方式

安装部署

Derby版hive直接使用

cd /export/softwares

将上传的hive软件包解压：tar -zxvf hive-1.1.0-cdh5.14.0.tar.gz -C ../servers/

cd /export/servers/hive-1.1.0-cdh5.14.0/

启动：bin/hive

缺点：多个地方安装hive后，每一个hive是拥有一套自己的元数据，大家的库、表就不统一；
使用mysql共享hive元数据

1.国内下载mysql源：http://mirrors.163.com/mysql/Downloads/

2.下载完成后将tar包解压到/var/cache/yum/x86_64/7/mysql57-community/packages

3.可以用两种方法安装

(1) yum install mysql mysql-server mysql-devel （安装包已经放到指定路径下，就不用再下载了）

(2) rpm -ivh *.rpm（安装前要先cd到上面说的文件夹）

第二种安装时如果出现“公钥未安装”之类的字眼，在后面加 --force --nodeps即可

4.启动mysql的服务

service mysqld start或systemctl start mysqld.service（CentOS 7 之后的版本两个都能用）

5.查看mysql服务是否启动成功

service mysqld status或systemctl status mysql.service

6.初始化mysql并生成随机密码

初始化mysql：mysqld --initialize

查看随机密码：cat /var/log/mysqld.log

7.使用随机密码登录，并修改密码

登录：mysql -uroot -p

修改密码强度：set global validate_password_length=6;

修改密码长度：set global validate_password_policy=LOW;（因为打算设置一个简单的密码，所以需要修改）

修改密码：ALTER USER 'root'@'localhost' IDENTIFIED BY '123456';

8.退出mysql，修改mysql安装配置

修改mysql安装配置：/usr/bin/mysql_secure_installation

需要选择是n/y，我的顺序是n/y/n/y/y

9.进去mysql，修改访问权限

修改访问权限：grant all privileges on *.* to 'root'@'%' identified by '123456' with grant option;

*.* 第一个*表示数据库名称，第二个*表示数据库下面的哪个表

'root'@'%' root表示mysql的用户，%表示ip地址，可以从哪台机器使用那个用户来连接数据库

all privileges 所有的权限，这里还可以写insert update delete select

identified by 远程连接的时候的密码，与mysql的root用户密码无关

实际线上环境，关于mysql的控制比较严格，不同的人分配不同的用户，创建不同的数据库，分配不同的权限

刷新权限表：flush pricileges;

10.修改hive的两个配置文件

修改hive-env.sh

cd /export/servers/hive-1.1.0-cdh5.14.0/conf

cp hive-env.sh.template hive-env.sh

vim hive-env.sh

创建hive-site.xml

<?xml-stylesheet type="text/xsl" href="configuration.xsl"?>

<configuration>

        <property>

                <name>javax.jdo.option.ConnectionURL</name>

                <value>jdbc:mysql://node03.hadoop.com:3306/hive?createDatabaseIfNotExist=true</value>

        </property>

        <property>

                <name>javax.jdo.option.ConnectionDriverName</name>

                <value>com.mysql.jdbc.Driver</value>

        </property>

        <property>

                <name>javax.jdo.option.ConnectionUserName</name>

                <value>root</value>

        </property>

        <property>

                <name>javax.jdo.option.ConnectionPassword</name>

                <value>123456</value>

        </property>

        <property>

                <name>hive.cli.print.current.db</name>

                <value>true</value>

        </property>

        <property>

                <name>hive.cli.print.header</name>

                <value>true</value>

        </property>

        <property>

                <name>hive.server2.thrift.bind.host</name>

                <value>node03.hadoop.com</value>

        </property>

<!--

        <property>

                <name>hive.metastore.uris</name>

                <value>thrift://node03.hadoop.com:9083</value>

        </property>

-->

</configuration>

11.上传mysql的lib驱动包

上传到这里：cd /export/servers/hive-1.1.0-cdh5.14.0/lib

参照mysql-connector-java和mysql的对应关系进行选择下载（图转自CSDN博主「hchhan89」）

使用方式

第一种交互方式

使用hive的bin/hive可以进入hive的客户端，执行sql语句

cd /export/servers/hive-1.1.0-cdh5.14.0

启动：bin/hive

查看所有的数据库：hive (default)> SHOW DATABASES;

创建一个数据库：hive (default)> CREATE DATABASE myhive;

使用该数据库并创建数据库表：hive (default)> USE myhive

hive (default)> CREATE TABLE test(id INT,name STRING)
第二种交互方式

Hive JDBC服务

可以前台启动服务端：bin/hive --service hiveserver2 在前台就会一直占用一个窗口

也可以把进程挂在后台： nohup bin/hive --service hiveserver2 2>&1 &

再使用beeline进行交互：bin/beeline !connect jdbc:hive2://node03:10000
第三种交互方式

Hive命令

-e参数表示直接执行hql的语句：bin/hive -e "use myhive;select * from test;"

-f参数表示通过指定文本文件来执行hql语句：bin/hive -f hive.sql

更多参数参考

【Hadoop离线基础总结】Hive的安装部署以及使用方式的更多相关文章

【Hadoop离线基础总结】oozie的安装部署与使用
目录简单介绍概述架构安装部署 1.修改core-site.xml 2.上传oozie的安装包并解压 3.解压hadooplibs到与oozie平行的目录 4.创建libext目录,并拷贝依赖包 ...
【Hadoop离线基础总结】Hue的简单介绍和安装部署
目录 Hue的简单介绍概述核心功能安装部署下载Hue的压缩包并上传到linux解压编译安装启动启动Hue进程 hue与其他框架的集成 Hue与Hadoop集成 Hue与Hive集成 Hue ...
【Hadoop离线基础总结】impala简单介绍及安装部署
目录 impala的简单介绍概述优点缺点 impala和Hive的关系 impala如何和CDH一起工作 impala的架构及查询计划 impala/hive/spark 对比 impala的安 ...
【Hadoop离线基础总结】Hive调优手段
Hive调优手段最常用的调优手段 Fetch抓取 MapJoin 分区裁剪列裁剪控制map个数以及reduce个数 JVM重用数据压缩 Fetch的抓取出现原因 Hive中对某些情况的查询不 ...
【Hadoop离线基础总结】流量日志分析网站整体架构模块开发
目录数据仓库设计维度建模概述维度建模的三种模式本项目中数据仓库的设计 ETL开发创建ODS层数据表导入ODS层数据生成ODS层明细宽表统计分析开发流量分析受访分析访客visit分 ...
【Hadoop离线基础总结】Sqoop常用命令及参数
目录常用命令常用公用参数公用参数:数据库连接公用参数:import 公用参数:export 公用参数:hive 常用命令&参数从关系表导入--import 导出到关系表--expor ...
【Hadoop离线基础总结】Hive的基本操作
Hive的基本操作创建数据库与创建数据库表创建数据库的相关操作创建数据库:CREATE TABLE IF NOT EXISTS myhive hive创建表成功后的存放位置由hive-site. ...
Hadoop(分布式系统基础架构)---Hive与HBase区别
对于刚接触大数据的用户来说,要想区分Hive与HBase是有一定难度的.本文将尝试从其各自的定义.特点.限制.应用场景等角度来进行分析,以作抛砖引玉之用. Hive是什么? Apache Hive是 ...
【Hadoop离线基础总结】工作流调度器azkaban
目录 Azkaban概述工作流调度系统的作用工作流调度系统的实现常见工作流调度工具对比 Azkaban简单介绍安装部署 Azkaban的编译 azkaban单服务模式安装与使用 azkaban ...

随机推荐

ThinkPHP6.0学习笔记-验证器
验证器 By:Mirror王宇阳验证器定义验证器的使用,必须定义它:系统提供了一条命令直接生产一个验证器类: php think make:validate User 自动再应用目录下生成一个va ...
食物链 POJ - 1182 (并查集的两种写法)
这是一个非常经典的带权并查集,有两种写法. 1 边权并查集规定一下,当x和y这条边的权值为0时,表示x和y是同类,当为1时,表示x吃y,当为2时,表示x被y吃. 一共有三种状态,如图,当A吃B,B吃 ...
mysql相关面试题（一）
1.主键自增,姓名字段重复.删除重复的姓名数据,只留一条 -- Every derived table must have its own alias 子查询要起别名 -- 思路:分组后只会显示一条, ...
PHP代码审计理解(三)---EMLOG某插件文件写入
此漏洞存在于emlog下的某个插件---友言社会化评论1.3. 我们可以看到, uyan.php 文件在判断权限之前就可以接收uid参数.并且uid未被安全过滤即写入到了$uyan_code中. 我们 ...
Pycharm 操作数据库
view--->Tool Buttons,点击Pycharm右侧的Database 1.连接数据库 2.建立一个表,添加数据通过以上操作把用户名和密码储存到了数据库中 3.连 ...
xhprof windows下安装和使用（转载）
1.使用5.3.3以上的php版本,或者直接下载wamp2.1集成环境. 2.下载xhprof for windows版本,地址:http://www.benjamin-carl.de/?downlo ...
js 函数对象的继承 inherit 带插件完整解析版[helpers.js]
前言: 本人纯小白一个,有很多地方理解的没有各位大牛那么透彻,如有错误,请各位大牛指出斧正!小弟感激不尽. 本篇文章为您分析一下原生JS的对象继承方法需求分析: 1. ...
面试题总结-Java部分
1 集合 1.1 hashmap原理 HashMap是基于哈希表实现的,每一个元素是一个key-value对,实现了Serializable.Cloneable接口,允许使用null值和null键.不 ...
POJ2155/LNSYOJ113 Matrix【二维树状数组+差分】【做题报告】
这道题是一个二维树状数组,思路十分神奇,其实还是挺水的题目描述给定一个N∗NN∗N的矩阵AA,其中矩阵中的元素只有0或者1,其中A[i,j]A[i,j]表示矩阵的第i行和第j列(1≤i,j≤N)( ...
FastReport.Net中使用列表和数组作为报表数据源
大多数现代报告工具允许您使用几乎任何数据库,然而,并不是所有报表工具都能以一个数据源的列表或数组来工作.本文中将展示如何使用FastReport .Net报表工具来实现. 请注意以下重要几点: 清单中 ...

【Hadoop离线基础总结】Hive的安装部署以及使用方式

Hive的安装部署以及使用方式

安装部署

使用方式

【Hadoop离线基础总结】Hive的安装部署以及使用方式的更多相关文章

随机推荐

热门专题