Haoop开发环境搭建全套流程

AI权益加码!Claude Code、Cursor等20+工具免费用! 购周边限时加赠Coding Plan Lite,畅享主流AI工具!学习进阶更高效! 阅读详情

Hadoop集群搭建(完全分布式)

实验环境

∎ 系统:64位Linux系统(ubuntu-12.04.3-desktop-amd.iso)

∎ JDK:64位 jdk-6u45-linux-x64.bin

∎ Hadoop版本:hadoop-1.2.1.tar.gz

∎ Eclipse版本:eclipse-standard-kepler-R-linux-gtk-64.tar.gz

∎ Hadoop插件:hadoop-eclipse-plugin-1.2.1.jar

∎ 硬件环境:三台PC机

Hadoop只能用JDK1.6以上版本

安装完Linux系统Ubuntu之后,然后做接下来的工作:

­­一、准备安装环境

本机环境是安装windows7和Ubuntu双系统。集群环境为一个master,两个slave,节点代号分别为master、slave1、slave2。要保证三个节点IP地址可以ping通,并在/etc/hosts中进行配置

机器名

IP地址

作用

Master

192.168.1.120

NameNode、JobTracker

Slave1

192.168.1.100

DataNode、TaskTracker

Slave2

192.168.1.110

DataNode、TaskTracker

下面开始安装环境

1、启动root超级用户

与其他linux版本不同,Ubuntu安装时默认使用一个非root用户,在首次进入系统后,需要启用root超级用户,以便后面获得一些权限。

方法:以普通用户登录,进入终端(Ctrl+Alt+T)输入命令:

sudo passwd root

然后会提示输入密码:root

若是想以root用户登录系统,则需要在lightdm.conf中写入以下语句:

vi /etc/lightdm/lightdm.conf

greeter-show-manual-login=true            # 禁用客人会话

allow-guest=false                                        #开启图形登陆

如下图所示

完成之后重启系统,以root用户名和密码登录进行以后所有的操作;没有配置lightdm.conf的话,可以在普通用户登陆的情况下,控制台中使用suroot 进行账户切换。

2、配置节点host文件,修改主机名

hosts文件是最重要的配置文件,hosts文件中会配置namenodedatanodeip

方法:

按照在所有namenode和datanode节点的/etc/hosts文件中添加节点ip和对

应的机器名,所有节结点的hosts文件相同:既包含namenode的IP又包含

datanode的IP

                      vi/etc/hosts 

              其中各个节点masterslave1slave2的配置如下:

               192.168.1.120           master

                    192.168.1.100           slave1

                     192.168.1.110           slave2

         若是机器名和别名不一致,则可以将机器名修改和对应别名一致,如本集群的master主机名为student-OptiPlex-380,则可将其修改为master即可;或者直接在hosts里将其机器名也配置上,配置结果如图

 

3、添加用户

在root权限下使用以下命令添加hadoop用户,在三个虚拟机上都添加这个用户

sudo adduser hadoop

如下图所示

4、关闭Linux防火墙

推荐关闭Linux防火墙,原因是,遇到很多很多蛋疼的问题都与防火墙有关,所以推荐关闭防火墙,目前没找到什么好的办法

                  方法:

                            命令行输入

                                     sudo ufw disable

二、安装JDK

         Hadoop只能用JDK1.6以上版本

1、下载JDK

64位 jdk-6u45-linux-x64.bin下载地址

http://www.oracle.com/technetwork/java/javasebusiness/downloads/java-archive-downloads-javase6-419409.html#jdk-6u45-oth-JPR

2、解压安装

进入文件所在目录,将文件拷贝到/home/hadoop下,如下图所示

然后修改jdk安装包权限

执行:

./jdk-6u45-linux-x64.bin

此处解压到: /home/hadoop/jdk1.6.0_45

3、修改环境变量

切换到root用户下

su root

进入

vi /etc/profile

                   然后在profile最后添加

                            export JAVA­_HOME=/home/hadoop/jdk1.6.0_45

                            export PATH=$PATH:JAVA_HOME/bin

                            exportCLASS_PATH=.:$JAVA_HOME/lib/dt.jar:$JAVA_HOME/lib/tools.jar

                   如下图

保存退出,输入以下命令使之立即生效:

source ~/.profile

 

4、测试

执行java -version 看到相对应的版本信息则配置成功,如下图

若是出现多个需要选择性安装提示,则需要进行下面第5步的配置

5、配置默认JDK

由于Ubuntu中可能会有默认的JDK,如openjdk,所以,为了将我们安装的JDK

hadoop部署过程-笔记 hadoop全分布环境搭建 1.所需文件 以下文件均问本次实验所用版本,无强制要求 Xftp7.0.0071p.exe(文件交互) hadoop-2.9.2.tar.gz jdk-8u191-linux-x64.tar.gz VMware-workstation-full-15.5.0-14665864.exe CentOS-7-x86_64-DVD-2009.iso MobaXterm_CHS.exe 2.三个状态 状态一:配置静态ip、环境变量、域名映射、主机名、jdk和hadoop安装 状态 阅读详情

相关推荐

Intellij idea下hadoop开发环境搭建和相应的编程实践(HDFS)

开篇 先简单描述一下这边博客主要要讲的内容,首先是配置idea可以编写hadoop的程序,然后是一个操作hdfs的小程序演示。 Hadoop搭建 一直跟随的是厦门大学林老师的课程,这边是hadoop搭建教程的链接,我是用自己的机子搭建的单机伪分布式。所以下面的一些操作都是适用于单机伪分布式的。 idea开发环境搭建 这边需要我们做的是两件事,导入jar包,林老师的教程就让我导入了两...

Ding_xiaofei的博客 1万+

Hadoop安装部署简明步骤详解

本文向大家介绍一下Hadoop安装部署方面的知识,这是我们在学习Hadoop时必须要掌握的内容,本节主要包括硬件环境,目录结构和SSH配置等内容,希望通过本文的学习大家能够掌握Hadoop安装部署的步骤。 Hadoop安装部署  1.硬件环境 共有3台机器,均使用的FC5系统,Java使用的是jdk1.6.0。IP配置如下: dbrg-1:202.197.18.72 dbrg-2

Derry的专栏 1293

基于centos7搭建haoop与hive

centos7搭建hadoop

congge_study的博客 7902

关于大数据Haoop虚拟环境搭建

将jdk、hadoop安装包上传到服务器/usr 下(个人建议) 并解压到当前目录 进入usr目录下 解压: tar -zxvf 压缩包名称 删除压缩包:rm -rf 压缩包名称 修改文件夹名称:mv 旧名/ 新名 建议改为名称修改为以便后期清洗时用到jdk 和 hadoop 环境变量配置 修改配置文件 vim /etc/profile 在文件下面添加环境配置: 可复制下面内容放到profile文件种最后: export JAVA_HOME=/usr/jdk export HA...

m0_59387690的博客 1357

KINECT 开发环境搭建

我用的vs2012,所以只能以vs2012为例了。 打开vs2012,file=>new=>project,找到C#,创建一个WPF Application工程项目,view=>solution explorer,右键工程名称Add reference,在 Assemblies=>framework=>microsoft.kinect. 打开MainWindow.xaml.cs文件,添加

shiwaxinbin的专栏 1217

Eclipse使用频率最高的快捷键

发过一个快捷键总结被埋了,现在搞个标题党试试。 代码助手:Ctrl+Space(简体中文操作系统是Alt+/) 快速修正:Ctrl+1 单词补全:Alt+/ 打开外部Java文档:Shift+F2 显示搜索对话框:Ctrl+H 快速Outline:Ctrl+O 打开资源:Ctrl+Shift+R 打开类型:Ctrl+Shift+T 显示重构菜单:Alt+Shift+T 上一个/下一个光标...

世说新语 2297

Haoop集群的搭建(小白教学)

Hadoop集群小白搭建

一枚数学专业的小码农的博客 870

03.Haoop 全分布式搭建步骤

搭建的过程中一定要记得做一些快照,这样方便回滚。否则搭建错的时候就要从来来过,特别麻烦! 我主要用 1台 windows 电脑 和 1台 mac 电脑 共同搭建网络。 这里节点数一般设置4个就行,1个 作为Namenode, 3个作为Datanode 就够了。 hostnamectl set-hostname node01用来修改 虚拟机的名字,记得 reboot 重启。 1....

weixin_42210772的博客 298

haoop2.x ha搭建

1.搭建:https://www.jianshu.com/p/7904fcc727d7 2.注意: 1). ha模式,在一个选为active的namenode节点上执行格式化命令hdfs namenode -format后, 先用命令hadoop-daemon.sh start namenode单独启动该namenode。然后在其他namenode节 ...

join_null的博客 337

使用MAVEN搭建Haoop开发环境

1.创建工程mvn archetype:generate -DgroupId=my.hadoopstudy -DartifactId=hadoopstudy -DarchetypeArtifactId=maven-archetype-quickstart -DinteractiveMode=false 2.在Pom.xml文件中添加Hadoop依赖的包(hadoop-common, hadoop-c

Andrew的成长之路 768

haoop简单的命令

haoop简单的命令hadoop帮助命令显示根目录下所有文件显示根目录下所有文件的大小显示根目录中文件数量移动文件flow.log到111目录下复制111目录下的flow.log文件到根目录下删除文件或文件夹本地文件复制到hdfs本地文件移动到hdfs上复制文件到本地将源目录中的所有文件排序合并到一个文件中在终端显示文件内容创建一个空文件夹创建一个空文件 hadoop帮助命令 hadoop fs ...

JAVA & HTML 233

hadoop集群搭建-Linux(Haoop cluster on Linux)

1.hadoop简介 hadoop是当今流行的分布式并行计算框架和大数据解决方案,利用基于商品硬件的计算机集群,具有容错性好和伸缩性强的特点。造价低廉,技术通用开放,维护和管理方便。特别适合超大数据的处理,对于TB和PB级的数据都可以应付(当然需要往集群中加入更多的机器,上百、上千或者上万台机器的hadoop集群都屡见不鲜)。 与其他并行计算不同的一个鲜明特点是其计算理念:代码向数据处移动,而

tonyhuang_google_com的专栏 1605

docker:Haoop集群

年前学习了docker的相关知识,过年休息了多半月,现在开始继续学习,这次要完成我之前多次做实验的一个设想,就是用docker进行Hadoop集群部署,真正的完成一次构建,导出运行。至此集群的基本框架搭建完毕,可以更加自己的需要选择保存镜像或者上传仓库。

weixin_50835854的博客 1384

Centos6.5搭建Haoop集群,及日常错误

搭建完整机器只要需要三台机器 Hadoop三大构建 Hdfs Mapreduce Yarn ------------------------------------------- 这三台机器构造 hadoop102 hadoop102 hadoop103 Jps Jps Jp...

weixin_42971363的博客 250

haoop笔记

8:00 2019/3/141:什么是hadoop? hadoop是解决大数据问题的一整套技术方案 2:hadoop的组成? 核心框架 分布式文件系统 分布式计算框架 分布式资源分配框架 hadoop对象存储 机器计算 3:hadoop 云计算 大数据 微服务 人工智能关系 参见word学习文档 1. 现阶段,云计算的两大底层支撑技术为“虚拟化”和“大数...

weixin_30559481的博客 148

Ubuntu18.04搭建Haoop2.7.7单机及伪分布式

看了零零散散的一系列安装教程后,终于磕磕绊绊勉强完成了Ubuntu搭建Haoop 实在是太不希望看零零散散的乱七八糟的教程 所以我决定自己亲手写一份保姆级别的安装配置教程

Dean_xiu的博客 567

eclipse hadoop开发环境配置

win7下安装hadoop完成后,接下来就是eclipse hadoop开发环境配置了。具体的操作如下: 一、在eclipse下安装开发hadoop程序的插件 安装这个插件很简单,haoop-0.20.2自带一个eclipse的插件,在hadoop目录下的 contrib\eclipse-plugin\hadoop-0.20.2-eclipse-plugin.jar,把这个文件copy到ecl

非同凡想 3万+

haoop的相关介绍及概念

文章目录前言hadoop介绍Hadoop的集群优点:关于hadoop的相关概念:分布式存储:命名空间主从节点:Block容灾 前言 cluster:集群 LB:负载均衡 LVS SLB HAPROXY,nginx HA:高可用 MHA,keepalived,hearebeat HPC: Hadoop: 大批量的计算辅助存储和运算 什么是分布式: 分散的 hadoop介绍 Hadoop 是 L...

互联网老辛 2659
上一篇: MFC三态树控件自绘
下一篇: MFC消息反射机制实例
-年轮-
博客等级 码龄14年 9粉丝 29原创
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值