微软HDInsight正式支援Apache Spark
报价宝综合消息微软HDInsight正式支援Apache Spark

图片来源:
微软
趁著本周Apache Spark高峰会(Spark Summit)的登场,微软宣布正式推出Azure HDInsight for Spark。
Apache Spark为一开源丛集运算框架,采用内存内运算技术,内含核心、Spark SQL、Spark Streaming及分散式机器学习MLlib等元件,由于它具备速度快、易用、通用及多模式等特性,使得它成为热门的大数据运算框架。
Azure HDInsight则是微软用来部署及管理Apache Hadoop云端丛集的服务,目的在于针对大数据进行处理、分析及产生报告。开源的分散处理暨储存框架Hadoop及Spark已被视为是未来大数据领域最有前景的组合。
负责Hadoop、大数据及资料仓储的微软行销经理Oliver Chiu指出,Spark可在内存内执行大规模的资料分析应用,与传统的大数据解决方案相较,Spark的查询速度快上100倍,Spark for Azure HDInsight则带来企业等级的Spark解决方案,提供完整的管理、安全与可靠性,以及更方便的操作界面。
其实微软在去年7月便已释出Spark for Azure HDInsight的公开预览版,在经历近一年的推广之后,目前HDInsight的新丛集部署已有一半采用Spark for Azure HDInsight。
