使用Sqoop将MySQL数据导入到Hadoop

文章由LinuxBoy分享于2019-03-31 02:03:19热评（142）

使用Sqoop将MySQL数据导入到Hadoop

Hadoop的安装配置这里就不讲了。

Sqoop的安装也很简单。 Sqoop的安装与使用完成sqoop的安装后，可以这样测试是否可以连接到mysql(注意：mysql的jar包要放到 SQOOP_HOME/lib 下)： sqoop list-databases --connect jdbc:mysql://192.168.1.109:3306/ --username root --password 19891231 结果如下

即说明sqoop已经可以正常使用了。

CentOS安装和配置Hadoop2.2.0

Ubuntu 13.04上搭建Hadoop环境

Ubuntu 12.10 +Hadoop 1.2.1版本集群配置

Ubuntu上搭建Hadoop环境（单机模式+伪分布模式）

Ubuntu下Hadoop环境的配置

单机版搭建Hadoop环境图文教程详解

搭建Hadoop环境（在Winodws环境下用虚拟机虚拟两个Ubuntu系统进行搭建）

下面，要将mysql中的数据导入到hadoop中。我准备的是一个300万条数据的身份证数据表：

先启动hive（使用命令行：hive 即可启动）然后使用sqoop导入数据到hive： sqoop import --connect jdbc:mysql://192.168.1.109:3306/hadoop --username root --password 19891231 --table test_sfz --hive-import sqoop 会启动job来完成导入工作。