sqoop部署

下载安装包	sqoop-1.99.3-bin-hadoop200.tar.gz
解压	tar zxvf sqoop-1.99.3-bin-hadoop200.tar.gz
建立sqoop链接	ln -s sqoop-1.99.3-bin-hadoop200 sqoop
修改sqoop配置	cd sqoop vi server/conf/catalina.properties 修改内容如下：找到common.loader行，把/usr/lib/hadoop/lib/.jar改成你的hadoop jar 包目录例如:/home/hadoop/hadoop/share/hadoop/yarn/lib/.jar, /home/hadoop/hadoop/share/hadoop/yarn/.jar, /home/hadoop/hadoop/share/hadoop/hdfs/.jar, /home/hadoop/hadoop/share/hadoop/hdfs/lib/.jar, /home/hadoop/hadoop/share/hadoop/mapreduce/.jar, /home/hadoop/hadoop/share/hadoop/mapreduce/lib/.jar, /home/hadoop/hadoop/share/hadoop/common/lib/.jar, /home/hadoop/hadoop/share/hadoop/common/*.jar vi server/conf/sqoop.properties 找到：mapreduce.configuration.directory行，修改值为你的hadoop配置文件目录如：/home/hadoop/hadoop/etc/hadoop/ 并且替换@LOGDIR@ 和@BASEDIR@ ： 0,$ s/@LOGDIR@/logs/g 0,$ s/@BASEDIR@/base/g 然后找到你的数据库jdbc驱动复制到sqoop/lib目录下，如果不存在则创建
修改环境参数	vi /etc/profile 增加以下内容： export SQOOP_HOME=/home/hadoop/sqoop export PATH=$PATH:$SQOOP_HOME/bin export CATALINA_BASE=$SQOOP_HOME/server export LOGDIR=$SQOOP_HOME/logs/
执行环境参数	source /etc/profile
启动	./bin/sqoop.sh server start
测试	bin/sqoop.sh client 默认sqoop开启ports 12000 and 12001
停止	./bin/sqoop.sh server stop

Configure client to use your Sqoop server:

sqoop:000> set server --host your.host.com --port 12000 --webapp sqoop

显示版本：show version --all

显示连接器：show connector --all

创建连接：create connection --cid 1

Creating connection for connector with id 1

Please fill following values to create new connection object

Name: First connection

Configuration configuration

JDBC Driver Class: com.mysql.jdbc.Driver

JDBC Connection String: jdbc:mysql://mysql.server/database

Username: sqoop

Password: *****

JDBC Connection Properties:

There are currently 0 values in the map:

entry#

Security related configuration options

Max connections: 0

New connection was successfully created with validation status FINE and persistent id 1

显示连接：show connection

创建任务：create job --xid 1 --type import

sqoop:000> create job --xid 1 --type import

Creating job for connection with id 1

Please fill following values to create new job object

Name: First job

Database configuration

Table name: users

Table SQL statement:

Table column names:

Partition column name:

Boundary query:

Output configuration

Storage type:

  0 : HDFS

Choose: 0

Output directory: /user/jarcec/users

New job was successfully created with validation status FINE and persistent id 1

Throttling resources

Extractors: 20

Loaders: 10

注意创建job过程中会出现Extractors跟Loaders分别对应map 跟reduce个数

启动任务：start job --jid 1

启动任务同步执行:start job --jid 1 -s

显示任务：status job --jid 1

显示所有任务：show job -a

停止任务：stop job --jid 1

克隆连接：clone connection --xid 1

克隆任务：clone job --jid 1

运行wordcount出现:Application application_1396260476774_0001 failed 2 times due to AM Container for appattempt_1396260476774_0001_000002 exited with exitCode: 1 due to: Exception from container-launch

查看

hadoop/logs/userlogs/application_1386683368281_0001/container_1386683368281_0001_01_000001/stderr

yarn配置修改完后，可以正常跑wordcount,sqoop还是提示Exception from container-launch: 这个时候把sqoop server 重启就行

导出数据出现异常

is running beyond physical memory limits. Current usage: 1.1 GB of 1 GB physical memory used; 1.6 GB of 6 GB virtual memory used. Killing container.

修改mapred-site.xml

<name>mapred.map.child.java.opts</name>

</property>

yarn-site.xml

<name>yarn.nodemanager.vmem-pmem-ratio</name>

</property>

<name>yarn.app.mapreduce.am.resource.mb</name>

</property>

使用sqoop导入数据时，当数据量变大时，在map/reduce的过程中就会提示 java heap space error。经过总结，解决方法有两个：

1、修改每个运行子进程的jvm大小

修改mapred-site.xml文件，添加以下属性：

<name>mapred.child.java.opts</name>

</property>

<name>mapred.reduce.child.java.opts</name>

</property>

<name>mapred.map.child.java.opts</name>

</property>

2、增加map数量，

sqoop job里设置Extractors与Loaders数量

sqoop部署的更多相关文章

Hadoop生态圈-Sqoop部署以及基本使用方法
Hadoop生态圈-Sqoop部署以及基本使用方法作者:尹正杰版权声明:原创作品,谢绝转载!否则将追究法律责任. Sqoop(发音:skup)是一款开源的工具,主要用于在Hadoop(Hive)与 ...
sqoop部署及使用
一.概述 sqoop是hive.hdfs.hbase等与RDMBS(mysql等)之间的沟通桥梁,主要通过JDBC与RDMBS进行交互.有两个版本sqoop1和sqoop2,sqoop1架构简单,使用 ...
sqoop部署与使用
sqoop安装 1.下载并解压 scp sqoop-1.4.6.bin__hadoop-2.0.4-alpha.tar.gz mini1:/root/apps/ tar -zxvf sqoop-1.4 ...
数据搬运组件：基于Sqoop管理数据导入和导出
本文源码:GitHub || GitEE 一.Sqoop概述 Sqoop是一款开源的大数据组件,主要用来在Hadoop(Hive.HBase等)与传统的数据库(mysql.postgresql.ora ...
hadoop伪分布式平台组件搭建
第一部分:系统基础配置系统基础配置中主完成了安装大数据环境之前的基础配置,如防火墙配置和安装MySQL.JDK安装等第一步:关闭防火墙 Hadoop与其他组件的服务需要通过端口进行通信,防火墙的存 ...
sqoop安装部署(笔记)
sqoop是一个把关系型数据库数据抽向hadoop的工具.同时,也支持将hive.pig等查询的结果导入关系型数据库中存储.由于,笔者部署的hadoop版本是2.2.0,所以sqoop的版本是:sqo ...
大数据学习笔记——Sqoop完整部署流程
Sqoop详细部署教程 Sqoop是一个将hadoop与关系型数据库之间进行数据传输,批量数据导入导出的工具,注意,导入是指将数据从RDBMS导入到hadoop而导出则是指将数据从hadoop导出到R ...
阿里云ECS服务器部署HADOOP集群（七）：Sqoop 安装
本篇将在阿里云ECS服务器部署HADOOP集群(一):Hadoop完全分布式集群环境搭建阿里云ECS服务器部署HADOOP集群(二):HBase完全分布式集群搭建(使用外置ZooKeeper) 阿 ...
Sqoop的安装部署
在root的用户下 1):前提安装JDK环境 2):前提安装Hadoop和Hive客户端环境,如果需要导出到HBase则需要安装HBase客户端 3):下载sqoop : 命令: wget htt ...

随机推荐

如何自学 Java 开发
如何自学 Java 开发? 568赞同反对,不会显示你的姓名李艾米IT路上学习 568 人赞同 Java Web前端技术 HTML 入门视频课程 1 HTML 简介 2 HTML基本结构[ 3 HT ...
使用spring注解@Controller @Service @Repository简化配置
前言:在web项目中引入spring框架中的配置文件,我们给每一个java bean进行相关配置可以非常安全,便捷的管理我们的bean.那么,问题来了,如果一个项目中所涉及到的java bean十分庞 ...
忍不住记录下小型的CMDB系统
js 闭包理解
1.什么是闭包定义:是指有权访问另一个函数作用域中的变量的函数创建闭包:在一个函数内部创建另一个函数基本特点在返回的匿名函数中可以调用外部函数的变量如下例中所示内部函数(匿名函数) 可以 ...
ueditor 百度编辑器，取消或自定义右键菜单
如图:有2种自定义方法,一种是改源码,一种是初始化初始化,如下代码: var ue = UE.getEditor('XXXid',{ // contextMenu:[ {label:'', cmdN ...
jquery实现复选框全选
$("#checkAll").change(function () { $(this).closest("table") .find(":checkb ...
大熊君大话NodeJS之------Connect中间件模块（第一季）
一,开篇分析截止到今天来说,NodeJS系列文章已经有将近十篇了,让我们回顾一下: (1),大熊君大话NodeJS之开篇------Why NodeJS(将Javascript进行到底) (2),大 ...
守护进程demon.c
1 #include <stdio.h> #include <unistd.h> #include <errno.h> #include <time.h> ...
CSS高效开发实战:CSS 3、LESS、SASS、Bootstrap、Foundation --读书笔记（3）线性渐变
线性渐变可以设置3个参数值:方向.起始颜色.结束颜色.最简单的模式只需要定义起始颜色和结束颜色,起点.终点和方向默认自元素的顶部到底部.下面举例说明: .test{ background:linear ...
UVALive 3644 X-Plosives
X-Plosives Time Limit: 3000MS Memory Limit: Unknown 64bit IO Format: %lld & %llu [Submit] ...

sqoop部署

sqoop部署的更多相关文章

随机推荐

热门专题