PiFlow v0.5 发布:大数据流水线系统
2019/3/22 11:35:51 中科院计算机网络信息中心

     点击“蓝色”关注

     春暖花开

    

     PiFlow v0.5 发布:大数据流水线系统

    

     PiFlow是一个基于分布式计算框架Spark开发的大数据流水线系统。该系统将数据的采集、清洗、计算、存储等各个环节封装成组件,以所见即所得方式进行流水线配置。简单易用,功能强大。它具有如下特性:

     1. 简单易用:可视化配置流水线,实时监控流水线运行状态,查看日志

     2. 功能强大:提供100+的数据处理组件, 包括Hadoop 、Spark、MLlib、Hive、Solr、Redis、MemCache、ElasticSearch、JDBC、MongoDB、HTTP、FTP、XML、CSV、JSON等,同时集成了微生物领域的相关算法。

     3. 扩展性强:支持自定义开发数据处理组件

     4. 性能优越:基于分布式计算引擎Spark开发

     试用地址:http://piflow.ml/piflow-web/login

     用户名/密码:admin/admin

     安装使用说明详见:https://github.com/cas-bigdatalab/piflow

    

    

     支持的数据处理组件如下:

    

    

    

     关注我们

    

    

     微信:cnicweixin

     中科院计算机网络信息中心

     长按二维码关注我们

    http://weixin.100md.com
返回 中科院计算机网络信息中心 返回首页 返回百拇医药