通过 Docker 搭建一个围绕大数据热门框架的高可用集群环境,代替传统虚拟机环境部署。 从本地离线数据源将源数据读入 HDFS,使用 Spark Python API,在 Pthon 中调用 SparkSQL 进行数据操作和数据分析后,借助 Azkaban 进行作业调度,再将分析之后的 PM2.5 空气质 量等级对比数据写进 Elasticsearch 搜索引擎,最终经由 Kibana可视化
通过 Docker 搭建一个围绕大数据热门框架的高可用集群环境,代替传统虚拟机环境部署。 从本地离线数据源将源数据读入 HDFS,使用 Spark Python API,在 Pthon 中调用 SparkSQL 进行数据操作和数据分析后,借助 Azkaban 进行作业调度,再将分析之后的 PM2.5 空气质 量等级对比数据写进 Elasticsearch 搜索引擎,最终经由 Kibana可视化
人工智能-机器学习-深度学习-异常水果检测综合项目
Java Hadoop电商行为日志分析
最近一年贡献:0 次
最长连续贡献:0 日
最近连续贡献:0 日
贡献度的统计数据包括代码提交、创建任务 / Pull Request、合并 Pull Request,其中代码提交的次数需本地配置的 git 邮箱是 Gitee 帐号已确认绑定的才会被统计。