人工智能学习

人工智能算法可以分为机器学习算法（Machine Learning）和深度学习算法（Deep Learning）

Piflow
（一）概念
是一个基于分布式计算框架Spark开发的大数据流水线系统。该系统将数据的采集、清洗、计算、存储等各个环节封装成组件，以所见即所得方式进行流水线配置。简单易用，功能强大。
（二）特性
简单易用：可视化配置流水线，实时监控流水线运行状态，查看日志。
功能强大：提供100+的数据处理组件，包括Hadoop 、Spark、MLlib、Hive、Solr、Redis、MemCache、ElasticSearch、JDBC、MongoDB、HTTP、FTP、XML、CSV、JSON等，同时集成了微生物领域的相关算法。
扩展性强：支持自定义开发数据处理组件。
性能优越：基于分布式计算引擎Spark开发。

PackOne
（一）概念
PackOne 可以实现大数据环境快速部署，可以通过对云 API 和 Apache Ambari API 的联合调用，完成 Hadoop、Spark、NiFi、PiFlow、Kylin、MangoDB、Neo4J 等流行的大数据管理/处理软件在云端的一键部署和一键伸缩。
（二）特性
支持在空白虚拟机上完成大数据处理集群的全自动部署；
通过 Apache Ambari 对已部署的大数据软件进行状态监控、配置管理；
通过将模版集群物化为系统镜像，实现新集群的分钟级快速部署；
通过集群节点的全自动增删，实现各类大数据软件处理能力的分钟级弹性伸缩；
在同一个界面上对来自不同云的虚拟机、存储卷、镜像、模版等进行 CURD 操作。

©著作权归作者所有,转载或内容合作请联系作者
【社区内容提示】社区部分内容疑似由AI辅助生成，浏览时请结合常识与多方信息审慎甄别。
平台声明：文章内容（如有图片或视频亦包括在内）由作者上传并发布，文章内容仅代表作者本人观点，简书系信息发布平台，仅提供信息存储服务。

人工智能学习

友情链接更多精彩内容