大数据流水线系统PiFlow v0.5 开源发布

March 19, 2019

2019年3月18日由中科院计算机网络信息中心大数据部自主研发的大数据流水线管理系统PiFlow v0.5 在开源中国正式发布! 链接如下:PiFlow v0.5 发布:大数据流水线系统

PiFlow是一个基于分布式计算框架Spark开发的大数据流水线系统。该系统将数据的采集、清洗、计算、存储等各个环节封装成组件,以所见即所得方式进行流水线配置。简单易用,功能强大。它具有如下特性:

点击试用 ,用户名/密码:admin/admin
查看安装使用说明

功能介绍:

1.登录
2.流水线列表
3.创建流水线
4.配置流水线
5.运行及加载流水线
6.监控流水线
7.查看流水线日志
8.运行中流水线列表
9.模板列表
10.保存模板