大数据流水线系统 PiFlow

大数据流水线系统 PiFlow

BSD
Java
跨平台
2019-03-18
红薯

PiFlow 是一个基于分布式计算框架Spark开发的大数据流水线系统。该系统将数据的采集、清洗、计算、存储等各个环节封装成组件,以所见即所得方式进行流水线配置。简单易用,功能强大。它具有如下特性:

  1. 简单易用:可视化配置流水线,实时监控流水线运行状态,查看日志
  2. 功能强大:提供100+的数据处理组件, 包括Hadoop 、Spark、MLlib、Hive、Solr、Redis、MemCache、ElasticSearch、JDBC、MongoDB、HTTP、FTP、XML、CSV、JSON等,同时集成了微生物领域的相关算法。
  3. 扩展性强:支持自定义开发数据处理组件
  4. 性能优越:基于分布式计算引擎Spark开发
加载中

评论(8)

j
jikewenku
看了上面的评论,我也不敢用了
静谧星空
静谧星空
看了上面的评论,我也不敢用了
不好好上班天天发动弹
看了上面的评论,我也不敢用了
colynn
colynn
看了上面的评论,我也不敢用了
j
javanetbean
:smile:,看了上面各位的评论。我也不敢用了
z
zb4165965
这个工具有谁成功部署过的么?
pake35110
pake35110
红薯 君,确实不好用哎。自己折腾折腾还可以
y
yqqroot
差评,release 版本都不能直接使用。根据readme文档,根本无法使用

PiFlow v0.8 发布,大数据流水线系统

PiFlow是一个基于分布式计算框架Spark开发的大数据流水线系统。该系统将数据的采集、清洗、计算、存储等各个环节封装成组件,以所见即所得方式进行流水线配置。简单易用,功能强大。本次版本...

09/30 10:47

PiFlow v0.7 发布:大数据流水线系统

PiFlow是一个基于分布式计算框架Spark开发的大数据流水线系统。该系统将数据的采集、清洗、计算、存储等各个环节封装成组件,以所见即所得方式进行流水线配置。简单易用,功能强大。本次版本...

06/02 10:12

PiFlow v0.5 发布:大数据流水线系统

PiFlow是一个基于分布式计算框架Spark开发的大数据流水线系统。该系统将数据的采集、清洗、计算、存储等各个环节封装成组件,以所见即所得方式进行流水线配置。简单易用,功能强大。它具有如...

2019/03/18 18:55

没有更多内容

加载失败,请刷新页面

没有更多内容

暂无问答

2019年3月22日 开源软件

https://k3s.io/ https://github.com/codercom/code-server https://github.com/Microsoft/monaco-editor https://github.com/krisk/Fuse https://github.com/markdown-it/markdown-it https...

2019/03/22 15:22
84
0
女神节直播 | 和先荐一起来听六位技术女神讲述她们眼中的智能技术!

一年一度的女神节又来了。 先荐向所有的女性,特别是在技术领域工作的女性提前表示祝福。在这个群体中,女性显得尤为宝贵。 我们很高兴能够联合领英、开源中国、Datafun、Datagirls等合作伙伴...

03/05 15:18
16
0

没有更多内容

加载失败,请刷新页面

没有更多内容

返回顶部
顶部