1

学习大数据首先要了解大数据的学习路线,首先搞清楚先学什么,再学什么,大的学习框架知道了,剩下的就是一步一个脚印踏踏实实从最基

础的开始学起。这里给大家普及一下学习路线:hadoop生态圈——Strom——Spark——算法。所以学习hadoop是第一步,在这里声明一下,

在学习hadoop之前需要有java基础,因为hadoop底层全是用java写的;还需要系统层面学会使用linux的基本shell命令,因为你学习hadoop得首

先会安装hadoop。Hadoop在大数据技术体系中的地位至关重要,Hadoop是大数据技术的基础,对Hadoop基础知识的掌握的扎实程度,会决

定在大数据技术道路上走多远。

下面谈谈一谈如何开始学习hadoop。本文的思路是:以安装部署Apache Hadoop2.x版本为主线,来介绍Hadoop2.x的架构组成、各模块协同工作原理、技术细节。安装不是目的,通过安装认识Hadoop才是目的。

Hadoop环境搭建

第一部分:Linux环境安装

Hadoop是运行在Linux,虽然借助工具也可以运行在Windows上,但是建议还是运行在Linux系统上,第一部分介绍Linux环境的安装、配置、

Java JDK安装等。

第二部分:Hadoop本地模式安装

Hadoop本地模式只是用于本地开发调试,或者快速安装体验Hadoop,这部分做简单的介绍。

第三部分:Hadoop伪分布式模式安装

学习Hadoop一般是在伪分布式模式下进行。这种模式是在一台机器上各个进程上运行Hadoop的各个模块,伪分布式的意思是虽然各个模块是

在各个进程上分开运行的,但是只是运行在一个操作系统上的,并不是真正的分布式。

第四部分:完全分布式安装

完全分布式模式才是生产环境采用的模式,Hadoop运行在服务器集群上,生产环境一般都会做HA,以实现高可用。

第五部分:Hadoop HA安装

HA是指高可用,为了解决Hadoop单点故障问题,生产环境一般都做HA部署。这部分介绍了如何配置Hadoop2.x的高可用,并简单介绍了HA的工作原理。

安装过程中,会穿插简单介绍涉及到的知识。希望能对大家有所帮助。

上面环境的搭建只是讲了一下框架,由于时间有限,具体如何操作可以留言与我交流。

环境搭建好后,然后尝试编写mapreduce进行打包运行。当你对hadoop应用编程层面没有疑问的时候,可以尝试去深入了解mapreduce的核心思想,尤其是map,shuffle,join,reduce等。

对于新手来说入门会遇到很多问题,这是正常的,不过遇到问题不可怕,只要想办法解决了自己的能力就会一点一点的提高,在这里预祝在大数据之路上求仙的伙伴们学有所成。

相关阅读:

大数据架构的分析应用

大数据学习路线(自己制定,从零开始)

对于学习大数据的新人,面对开发语言和分析软件时,该如何选择?

关注中国IDC圈官方微信:idc-quan 我们将定期推送IDC产业最新资讯

查看心情排行你看到此篇文章的感受是:


  • 支持

  • 高兴

  • 震惊

  • 愤怒

  • 无聊

  • 无奈

  • 谎言

  • 枪稿

  • 不解

  • 标题党
2018-10-19 10:20:15
大数据应用 美国健康医疗大数据应用与隐私安全实践
美国行业在构建满足隐私安全管理要求的服务体系中形成了基友重要指导意义的标准与自治规范,其中以电子病历互操作性为核心的平台是实现健康医疗数据在胡拿着照护场景中应用 <详情>
2018-10-19 10:11:20
大数据资讯 人民邮电出版社社长顾翀:大数据成为加快转型升级的重要引擎
10月18日,“2018第五届中国国际大数据大会”在京开幕。本届大会以“实体融合新动能,数字经济新发展”为主题,聚焦我国大数据产业关注热点话题,务实促进大数据在各行业落 <详情>
2018-10-19 10:05:34
大数据资讯 联想大数据为工业互联网插上智慧的翅膀
2018年,业界提及最多的就是“AI”、“工业互联网”,众多行业尤其是工业制造业更是将“AI”、“工业互联网”当做发展之根本。“工业互联网”看似是2018年的新名词,实则早 <详情>
2018-10-18 14:20:58
大数据 云计算 预2020年全球大数据市场规模将达到570亿
云计算的核心思想,是将大量用网络连接的计算资源统一管理和调度,构成一个计算资源池向用户按需服务。 <详情>
2018-10-18 14:17:39
大数据 银行金融科技与大数据
2015年以来,伴随互联网技术,尤其是移动互联网技术的成熟,以客户服务为中心进行金融生态重构,平台经济应运而生。 <详情>