Flink Data Source 用于定义 Flink 程序的数据来源,Flink 官方提供了多种数据获取方法,用于帮助开发者简单快速地构建输入流,具体如下:
阅读全文
Flink Sink
在使用 Flink 进行数据处理时,数据经 Data Source 流入,然后通过系列 Transformations 的转化,最终可以通过 Sink 将计算结果进行输出,Flink Data Sinks 就是用于定义数据流最终的输出位置。Flink 提供了几个较为简单的 Sink API 用于日常
阅读全文
Azkaban简介
一个完整的大数据分析系统,必然由很多任务单元 (如数据收集、数据清洗、数据存储、数据分析等) 组成,所有的任务单元及其之间的依赖关系组成了复杂的工作流。复杂的工作流管理涉及到很多问题:
阅读全文
Azkaban Flow 2.0的使用
Azkaban 目前同时支持 Flow 1.0 和 Flow2.0 ,但是官方文档上更推荐使用 Flow 2.0,因为 Flow 1.0 会在将来的版本被移除。Flow 2.0 的主要设计思想是提供 1.0 所没有的流级定义。用户可以将属于给定流的所有 job / properties 文件合并到单个流
阅读全文
Azkaban Flow 1.0 的使用
Azkaban 主要通过界面上传配置文件来进行任务的调度。它有两个重要的概念:
阅读全文
docker mysql 数据库备份脚本
在宿主机备份docker里面的mysql的database
阅读全文
mysql in 子查询优化
mysql in 子查询优化
阅读全文
datax 使用
datax 使用的目录
阅读全文
datax userGuid 使用
datax userGuid 使用
阅读全文
datax txtfilewriter 使用
datax txtfilewriter 使用
阅读全文