当前位置: 首页 > news >正文

Hadoop知识点之Hadoop发展历程

一、Hadoop名字的起源

Hadoop这个名字不是一个缩写,它是一个虚构的名字。

该项目的创建者,Doug Cutting如此解释Hadoop:

这个名字是我孩子给一头吃饱了的棕黄色大象命名的。我的命名标准就是简短,容易发音和拼写,没有太多的意义,并且不会被用于别处。小孩子是这方面的高手。Googol就是由小孩命名的。

 

二、Hadoop发展史

  1. 2002年10月,Doug Cutting和Mike Cafarella创建了开源网页爬虫项目Nutch,Nutch的设计目标是构建一个大型的全网搜索引擎,包括网页抓取、索引、查询等功能,但随着抓取网页数量的增加,遇到了严重的可扩展性问题——如何解决数十亿网页的存储和索引问题。。

  2. 2003年10月,Google发表Google File System论文。

  3. 2004年7月,Doug Cutting和Mike Cafarella在Nutch中实现了类似GFS的功能,即后来HDFS的前身。

  4. 2004年10月,Google发表了MapReduce论文。

  5. 2005年2月,Mike Cafarella在Nutch中实现了MapReduce的最初版本。

  6. 2005年12月,开源搜索项目Nutch移植到新框架,使用MapReduce和NDFS在20个节点稳定运行。

  7. 2006年1月,Doug Cutting加入雅虎,Yahoo!提供一个专门的团队和资源将Hadoop发展成一个可在网络上运行的系统。

  8. 2006年2月,Apache Hadoop项目正式启动以支持MapReduce和HDFS的独立发展。

  9. 2006年3月,Yahoo!建设了第一个Hadoop集群用于开发。

  10. 2006年4月,第一个Apache Hadoop发布。

  11. 2006年11月,Google发表了Bigtable论文,激起了Hbase的创建。

  12. 2007年10月,第一个Hadoop用户组会议召开,社区贡献开始急剧上升。

  13. 2007年,百度开始使用Hadoop做离线处理。

  14. 2007年,中国移动开始在“大云”研究中使用Hadoop技术。

  15. 2008年,淘宝开始投入研究基于Hadoop的系统——云梯,并将其用于处理电子商务相关数据。

  16. 2008年1月,Hadoop成为Apache顶级项目。

  17. 2008年2月,Yahoo!运行了世界上最大的Hadoop应用,宣布其搜索引擎产品部署在一个拥有1万个内核的Hadoop集群上。

  18. 2008年4月,在900个节点上运行1TB排序测试集仅需209秒,成为世界最快。

  19. 2008年8月,第一个Hadoop商业化公司Cloudera成立。

  20. 2008年10月,研究集群每天装载10TB的数据。

  21. 2009 年3月,Cloudera推出世界上首个Hadoop发行版——CDH(Cloudera's Distribution including Apache Hadoop)平台,完全由开放源码软件组成。

  22. 2009年6月,Cloudera的工程师Tom White编写的《Hadoop权威指南》初版出版,后被誉为Hadoop圣经。

  23. 2009年7月 ,Hadoop Core项目更名为Hadoop Common;

  24. 2009年7月 ,MapReduce 和 Hadoop Distributed File System (HDFS) 成为Hadoop项目的独立子项目。

  25. 2009年8月,Hadoop创始人Doug Cutting加入Cloudera担任首席架构师。

  26. 2009年10月,首届Hadoop World大会在纽约召开。

  27. 2010年5月,IBM提供了基于Hadoop 的大数据分析软件——InfoSphere BigInsights,包括基础版和企业版。

  28. 2011年3月,Apache Hadoop获得Media Guardian Innovation Awards媒体卫报创新奖

  29. 2012年3月,企业必须的重要功能HDFS NameNode HA被加入Hadoop主版本。

  30. 2012年8月,另外一个重要的企业适用功能YARN成为Hadoop子项目。

  31. 2014年2月,Spark逐渐代替MapReduce成为Hadoop的缺省执行引擎,并成为Apache基金会顶级项目。

  32. 2017年12月,Release 3.0.0 generally available

http://www.lryc.cn/news/169532.html

相关文章:

  • 阿里云无影电脑:免费体验无影云电脑3个月
  • 菜鸟教程《Python 3 教程》笔记(20):面向对象
  • vue2编辑markdown
  • PCB走线规则
  • webpack静态资源上传到CDNS (阿里云 OSS,亚马逊 AWS S3,七牛云 Qiniu Cloud Kodo)webpack-plugin-cdns
  • python 异常
  • stm32--独立看门狗
  • vue3中css使用script中定义的变量
  • Ubuntu 22.04 安装配置 flatpak
  • oracle创建数据库以及用户,并导入dmp格式数据
  • [deeplearning]pytorch实现softmax多分类问题预测训练
  • 【C++初阶】动态内存管理
  • Mac电脑安装Zulu Open JDK 8 使用 spring-kafka 消费不到Kafka Partition中的消息
  • CodeArts Check代码检查服务用户声音反馈集锦(2)
  • 红帽RHCE9.0学什么内容,新版有什么变化
  • 线性代数的本质(一)——向量空间
  • PP-Tracking之C++部署
  • 智慧公厕建设,要以技术为支撑、体验为目的、业务为驱动
  • 通过Sealos 180秒部署一套K8S集群
  • 如何获取美团的热门商品和服务
  • 开启编程之门
  • 【ES】Too many dynamic script compilations within, max: [75/5m]; 问题处理
  • LED智能家居灯 开关调光 台灯落地灯控制驱动 降压恒流IC AP5191
  • 贪心算法的思路和典型例题
  • 演讲笔记|《一个ppt者的成长故事》
  • 【八大经典排序算法】堆排序
  • Redis五大基本数据类型
  • AI一点通: OpenAI whisper 在线怎么调用,怎么同时输出时间信息?
  • OpenText EnCase Mobile Investigator 查看、分析和报告被调查手机的证据
  • 【JavaScript】video标签配置及相关事件: