Hadoop能做什么 – 大数据那些事儿 – 博客频道 – CSDN.NET

Hadoop能做什么?” ,概括如下:

1、搜索引擎(Doug Cutting  设计Hadoop的初衷,为了针对大规模的网页快速建立索引)。

2、数据存储,利用Hadoop的分布式存储能力,例如数据备份、数据等。

3、数据处理,利用Hadoop的分布式处理能力,例如数据挖掘、数据分析等。

4、科学研究,Hadoop是一种分布式的开源框架,对于分布式计算有很大程度地参考价值。

Hadoop是Doug  Cutting 基于Google公司的GFS和MapReduce思想不断完善项目Nutch中脱胎而出的。

Hadoop是适合于大数据的分布式存储和处理平台,是一种开源的框架。

数据时代已经到来,给我们的生活、工作、思维方式都带来变革。如何寻求大数据后面的价值,既是机遇又是挑战。不管是金融数据、还是电商数据、又还是社交数据、游戏数据…….这些数据的规模、结构、增长的速度都给传统数据存储和处理技术带来巨大考验。幸运的是,Hadoop的诞生和所构建成的生态系统给大数据的存储、处理和分析带来了曙光。

不管是国外的著名公司Google、Yahoo!、微软、亚马逊、 EBay、FaceBook、Twitter、LinkedIn等和初创公司Cloudera、Hortonworks等,又还是国内的著名公司中国移动、阿里巴巴、华为、腾讯、百度、网易、京东商城等,都在使用Hadoop及相关技术解决大规模化数据问题,以满足公司需求和创造商业价值。

例如:Yahoo! 的垃圾邮件识别和过滤、用户特征建模;Amazon.com(亚马逊)的协同过滤推荐系统;Facebook的Web日志分析;Twitter、LinkedIn的人脉寻找系统;淘宝商品推荐系统、淘宝搜索中的自定义筛选功能……这些应用都使用到Hadoop及其相关技术。

 

来源URL:http://cache.baiducontent.com/c?m=9d78d513d99912f905b0d6690c66c0171f43f6122bd6a00209d1843c97735a31501790ac53540774a4d20a1116ae394b9a842105371421c78cb9885da9b9866f6fd6286e365ac45613a004b29b18789437902db8ee4fbbadf045cff994ce9a070f9f0d583ed7a3d5041d478a29ab456fb4bbcf1f530c4be4ac2d65fd5b77229e2445&p=882a9546d39702f610b5cc2d02148f&newp=8b2a970ea49814e706bd9b7e0e1382231610db2151dcd55e0d8fc600cd&user=baidu&fm=sc&query=hadoop%C4%DC%D7%F6%CA%FD%BE%DD%BF%E2%C2%F0&qid=942fc99f0000408e&p1=2