Hadoop的过去、现在和未来

2016-08-19 04:07:00 作者:比特网 分类 : 比特网

  Hadoop是目前大数据分析领域中应用最广泛的一种分布式架构,而经过相当长时间的发展,Hadoop在功能上也越来越成熟。不过,在这个星球上,你找不到拥有11年Hadoop经验的人。因为目前在Hadoop领域经验最丰富的人是Doug Cutting,他在Hadoop方面拥有的经验是10年零7个月。而这位Doug Cutting正是Hadoop之父,Cloudera公司首席架构师

  作为处理海量数据最常用的方法,Hadoop的核心是Map和Reduce,也就是将一个庞大的任务进行分解,然后再将结果进行汇总。但经过10年发展,Hadoop的功能早已不是MapReduce这么简单。今天的Hadoop是分布式计算所涉及的计算、存储、文件系统、网络、安全、负载均衡、管理等一系列软件方法的合集。也正是由于其完整性和成熟度,今天的Hadoop虽然面临Spark等新兴技术的竞争,却仍是分布式计算领域不可或缺的基础和前提。

  作为一个开源项目,Hadoop目前仍在告诉发展、快速更新;作为开源软件服务的成功践行者,Cloudera的Hadoop发行版本正在成为越来越多企业在部署分布式计算系统时的首选。

  开源与商业,过去和未来;身为Hadoop之父、Cloudera公司首席架构师、Apache基金会前主席,Doug Cutting确实有话要说。

  Hadoop成功的基础

  Hadoop无疑是Apache基金会中最引人注目和最庞大的顶级项目之一。由于Hadoop定义了分布式计算的方方面面,因此日常的代码提交量也非常巨大。而在海量的代码见决定Hadoop未来走向的则是一个接近百人的评审委员会。

  Doug Cutting表示:评审委员会的成员来自各个领域,他们有IT企业中的技术达人、有相关学科的大学教授、有应用专家、更有单纯的技术爱好者。而在这个庞大的评审委员会中,所有成员均拥有“一票否决权”。虽然委员们各自有不同的背景甚至公司利益,但在委员会中,所有人的投票都是相当慎重的。投票所考虑的核心因素只有一个,那就是Hadoop未来的发展。而任何否决票的出现也必须给出技术上的合理解释。

  可以说,Hadoop与Apache基金会的其他项目一样,是一个“人人为我、我为人人”的开放环境。

  由于有越来越多Cloudera这样的开源企业源源不断的将自己的创新和Debug回馈给整个社区以及优秀的委员会机制,Hadoop在今天仍保持着相当旺盛的生命力。

  总结Hadoop过去的成功无非两点:一是从技术上开创了分布式计算时代,二是Apache基金会和Hadoop项目开放、合作、共享的管理理念。

  Hadoop如何保持成功

  任何一项技术都有其自身的发展路径。而作为一项非常有潜力的技术,Hadoop的未来发展的根基仍然要依靠广泛的应用基础。

  Cloudera是目前众多Hadoop发行版中最流行的一个,而Cloudera回馈社区的方式也并不只是简单的贡献代码。

  日前,Cloudera与清华大学联合发布BASE (Big Analytics Skill Enablement)倡议,旨在帮助清华大学数据科学研究院培养更多大数据分析专业人才,以填补国内大数据领域人才匮乏的现状。

  换句话说,Cloudera将帮助清华大学数据科学研究院培养更多Hadoop使用者和开发者。这样做一方面能够缓解国内大数据人才紧缺的现状,让大数据技术能够进入更多企业和行业;另一方面也为Hadoop项目在未来能够持续发展创造条件,毕竟对于一向技术来说,有人用才有未来。

  虽然清华大学是国内首家与Cloudera合作的高效,但从全球来看,Cloudera与教育界的合作已经开展多年。Doug Cutting表示:Cloudera已经与美国、欧洲、新加坡以及亚洲其他国家的高校和研究机构开展了广泛的合作,为他们提供全套免费课程,帮助大学生和研究人员能够更好的使用大数据技术。

  显然,Cloudera所执行的是一项相当长远的计划,这也说明Cloudera对Hadoop技术未来发展的信心。

  面对竞争,Hadoop的未来是怎样的?

  与商业领域一样,技术同样面临竞争。在很多人看来,Hadoop目前最大的竞争对手正是非常火爆的Spark。

  对此,Doug Cutting表示:Spark的确在MapReduce方面相比Hadoop拥有更大的性能优势。但Hadoop本身还包括分布式文件系统和任务调度、规划等众多功能;而这些则是Spark所没有的。

  作为开源技术,Hadoop和Spark都是模块化开发的。这也就意味着他们是可以相互融合,一起使用的。

  在未来,我们很可能看到Spark取代了Hadoop中的MapReduce模块,但分布式计算系统中的存储和调度等功能仍需要Hadoop来实现。

  换句话说,Hadoop与Spark之争实际是个伪命题,同样是大数据分析技术,他们的未来应该是融合和协作。

  大数据的故事才刚刚开始

  从行业整体的发展来看,人类只是刚刚意识到了大数据的重要性,而大数据技术本身的发展和完善仍需要相当长的时间。而对于像Cloudera这样在大数据领域取得先发优势的企业来说,无论是大数据还是开源技术,故事才知是刚刚开始。未来仍旧不可估量。

* 本文为ChinaByte比特网原创内容,版权所有,转载请注明出处和原文链接,未经授权请勿用于商业用途。

最近更新
科普

科普图集
带着朋友和机器人上月亮散步

带着朋友和机器人上月亮散步>>详情

比食人鱼更恐怖:长着人类牙齿的鱼

比食人鱼更恐怖:长着人类牙齿的鱼>>详情

邮件订阅

软件信息化周刊
比特软件信息化周刊提供以数据库、操作系统和管理软件为重点的全面软件信息化产业热点、应用方案推荐、实用技巧分享等。以最新的软件资讯,最新的软件技巧,最新的软件与服务业内动态来为IT用户找到软捷径。
商务办公周刊
比特商务周刊是一个及行业资讯、深度分析、企业导购等为一体的综合性周刊。其中,与中国计量科学研究院合力打造的比特实验室可以为商业用户提供最权威的采购指南。是企业用户不可缺少的智选周刊!
网络周刊
比特网络周刊向企业网管员以及网络技术和产品使用者提供关于网络产业动态、技术热点、组网、建网、网络管理、网络运维等最新技术和实用技巧,帮助网管答疑解惑,成为网管好帮手。
服务器周刊
比特服务器周刊作为比特网的重点频道之一,主要关注x86服务器,RISC架构服务器以及高性能计算机行业的产品及发展动态。通过最独到的编辑观点和业界动态分析,让您第一时间了解服务器行业的趋势。
存储周刊
比特存储周刊长期以来,为读者提供企业存储领域高质量的原创内容,及时、全面的资讯、技术、方案以及案例文章,力求成为业界领先的存储媒体。比特存储周刊始终致力于用户的企业信息化建设、存储业务、数据保护与容灾构建以及数据管理部署等方面服务。
安全周刊
比特安全周刊通过专业的信息安全内容建设,为企业级用户打造最具商业价值的信息沟通平台,并为安全厂商提供多层面、多维度的媒体宣传手段。与其他同类网站信息安全内容相比,比特安全周刊运作模式更加独立,对信息安全界的动态新闻更新更快。
新闻中心热点推荐
新闻中心以独特视角精选一周内最具影响力的行业重大事件或圈内精彩故事,为企业级用户打造重点突出,可读性强,商业价值高的信息共享平台;同时为互联网、IT业界及通信厂商提供一条精准快捷,渗透力强,覆盖面广的媒体传播途径。
云计算周刊
比特云计算周刊关注云计算产业热点技术应用与趋势发展,全方位报道云计算领域最新动态。为用户与企业架设起沟通交流平台。包括IaaS、PaaS、SaaS各种不同的服务类型以及相关的安全与管理内容介绍。
CIO俱乐部周刊
比特CIO俱乐部周刊以大量高端CIO沙龙或专题研讨会以及对明星CIO的深入采访为依托,汇聚中国500强CIO的集体智慧。旨为中国杰出的CIO提供一个良好的互融互通 、促进交流的平台,并持续提供丰富的资讯和服务,探讨信息化建设,推动中国信息化发展引领CIO未来职业发展。
IT专家网
IT专家新闻邮件长期以来,以定向、分众、整合的商业模式,为企业IT专业人士以及IT系统采购决策者提供高质量的原创内容,包括IT新闻、评论、专家答疑、技巧和白皮书。此外,IT专家网还为读者提供包括咨询、社区、论坛、线下会议、读者沙龙等多种服务。
X周刊
X周刊是一份IT人的技术娱乐周刊,给用户实时传递I最新T资讯、IT段子、技术技巧、畅销书籍,同时用户还能参与我们推荐的互动游戏,给广大的IT技术人士忙碌工作之余带来轻松休闲一刻。