Hbase通过 Mapreduce 写入数据到Mysql

数据库|mysql教程 Hbase通过 Mapreduce 写入数据到Mysql

Hbase,Mapreduce,写入,数据,Mysql

数据库-mysql教程

仿贴吧网页源码,vscode添加依赖包,ubuntu内核网(,tomcat日志输出屏蔽,兔肉爬虫,判断时间格式 php,seo是哪些单词缩写,cms教育网站系统,学校首页模板lzw

我们可能会有一个疑问，hadoop是一种分布式存储和分布式计算的一个开源项目，而Mapreduce 也是基于此的一个分布式计算的模型，而基于分布式存储的列存储数据库Hbase应该是我们要讨论的话题，为什么会说到Mysql 其实Hbase 存储的数据时一些量大简单而有规则的

html89个源码,vscode返回上一级函数,ubuntu建立vnc,tomcat超时会话数,pyqt爬虫教程,php和前端那个难,贵阳seo优化搜索排名哪里有lzw

网页信息管理系统源码,ubuntu下编译arm,皮肤被爬虫晕了,php项目团队,seo155lzw

我们可能会有一个疑问，hadoop是一种分布式存储和分布式计算的一个开源项目，而Mapreduce 也是基于此的一个分布式计算的模型，而基于分布式存储的列存储数据库Hbase应该是我们要讨论的话题，为什么会说到Mysql

其实Hbase 存储的数据时一些量大简单而有规则的数据，但关系型数据库也有他的优势，那就是提供了友好的方面我们操作的用户接口，我们可以实现简单的查询。并且数据本身并不大，而我们又需要对此数据进行各种复杂的分析和查询，那关系型数据库则帮我们实现。

从Hbase map出数据如何写入Mysql 从网上查估计也能查询到，但是可能不太友好，我做了一个简单的例子，贴出来供大家参考，希望对大家有些帮助。

习惯从main 方法谈起看代码：

public static void main(String[] args) throws Exception {
Configuration conf = HBaseConfiguration.create();
//在此我用到了旧的API ，因为我从资料上找不出新的API中有支持DBOutputFormat 的接口或者方法

//希望大家如果了解这方面的给我提出意见我也了解一下新的API中如何实现此功能

JobConf job = new JobConf(conf,CopyHbaseData2Mysql.class);

//设定Job 输入类型为 TableInputFormat.class

job.setInputFormat(TableInputFormat.class);

//旧的API 没有设置输入表的地方，如果看过Hadoop TableInputFormat 的源码就可以看到下面两个参数可以设定输入表和查询hbase 的columns

job.set(“mapred.input.dir”, “hbase_table”);
job.set(“hbase.mapred.tablecolumns”, “info:column”);//查询column

//下面两个方法是map 的输入的key 和value 类型
job.setMapOutputKeyClass(ImmutableBytesWritable.class);
job.setMapOutputValueClass(ImmutableBytesWritable.class);
//设定输入类型为 DBOutputFormat.class

job.setOutputFormat(DBOutputFormat.class);
// 下面是配置 mysql 驱动以及用户名密码

//此时一定要注意不论是编译还是打包，都必须把mysql的驱动加入的环境变量中

//此处还要注意的是 192.168.10.10 如果是在本机跑，一定要注意你的mysql 用户是否支持远程访问，不然会拒绝连接
DBConfiguration.configureDB(job, “com.mysql.jdbc.Driver”, “jdbc:mysql://192.168.10.10/test”, “username”, “password”);

//下面是输入表以及相应字段的设定
String[] fields = {“id”,”username”};
DBOutputFormat.setOutput(job, “user_info”, fields);

//设定Map和Reduce
job.setMapperClass(MyMapper.class);
job.setReducerClass(MyReducer.class);

//run
JobClient.runJob(job);

}

其实写到这基本上就把具体的流程全部写出来了，候选的map 和reduce 根据大家相关的业务大家自己组织，但是还有一个重要的概念，此处的

我们的输入为：DBWritable 为此类为一个接口，并没有实现，所以我们要使用的时候必须实现这个接口，去实现自己的 Writable类

先不做介绍了。

后续我会把实现DBWritable 的类也贴出来，如果认为有需要的话

贴出来欢迎大家板砖，本人也是学习没多久，希望大家踊跃提意见，也好提高自己

mapreduce