PiFlow是一个基于分布式计算框架Spark开发的大数据流水线系统。该系统将数据的采集、清洗、计算、存储等各个环节封装成组件,以所见即所得方式进行流水线配置。简单易用,功能强大。本次版本更新如下特性:
- 新增交互式编程功能,支持在线编写代码并进行调试;
- 新增全局参数功能,支持定义全局参数,并在流水线中全局可用;
- 优化后端代码,统一持久化框架MyBatis;
- 修复已知Bug;
GitHub地址: https://github.com/cas-bigdatalab/piflow
Gitee地址: https://gitee.com/opensci/piflow
1)交互式编程
2)全局变量
原创文章,作者:Maggie-Hunter,如若转载,请注明出处:https://blog.ytso.com/145332.html