Hadoop——实验三:Hadoop集群安装部署

开发者福利!热门AI工具限时免费用 购周边即赠Coding Plan Lite,Claude Code、Cursor等20+工具畅享,效率翻倍! 阅读详情

一. 实验目的

  掌握Hadoop集群集群安装部署技术。

二. 实验内容

  安装Hadoop集群并完成分布式实例。
  参考:http://dblab.xmu.edu.cn/blog/install-hadoop-cluster/

三. 实验步骤及结果分析

 1. 安装Hadoop集群

  说明:将实验二中创建的K1.ubuntukylin14.04(简称K1)系统完全克隆,生成独立的K2.ubuntukylin14.04(简称K2)系统,本实验在这两个系统上完成,其中K1为Master主节点,K2为Slave副节点。

 1.1 网络配置

  修改主机名。启动K1和K2虚拟机系统,在K2中打开终端,输入sudo vim /etc/hostname命令打开存放主机名的hostname文件,修改主机名为K2,重启后生效。
在这里插入图片描述
在这里插入图片描述
  修改IP映射。分别在K1和K2输入ifconfig命令查看各自的IP地址,分别输入sudo vim /etc/hosts命令打开存放IP和主机名映射关系的hosts文件,删除其中除了127.0.0.1 localhost之外的映射关系,并将K1和K2的IP和主机名映射关系填上,如下所示:
在这里插入图片描述
在这里插入图片描述
在这里插入图片描述
在这里插入图片描述
  测试连通性。分别在K1和K2输入ping K1 -c 3命令和ping K2 -c 3命令查看是否能够连通,正确的话会显示以下内容:
在这里插入图片描述
在这里插入图片描述

 1.2 SSH无密码登录配置

  在K1终端输入cd ~/.ssh命令和rm ./id_rsa*命令删除之前的公匙,输入ssh-keygen -t rsa命令并回车生成新的公匙,输入cat ./id_rsa.pub >> ./authorized_keys命令将公匙加入系统授权,输入scp ~/.ssh/id_rsa.pub mcf14@K2:/home/mcf14/命令将公匙从K1传输到K2上,需要输入yes和K2的密码admin
在这里插入图片描述
在这里插入图片描述
  在K2终端输入mkdir ~/.ssh命令创建SSH文件夹(若已创建则忽略),输入cat ~/id_rsa.pub >> ~/.ssh/authorized_keys命令将K1传输过来的公匙加入系统授权,然后输入rm ~/id_rsa.pub命令删除公匙,此时,在K1终端输入ssh K2命令登录K2节点就无须密码验证了,输入exit命令退出。
在这里插入图片描述
在这里插入图片描述

 1.3 集群分布式环境配置

  集群/分布式模式必须修改五个配置文件slavescore-site.xmlhdfs-site.xmlmapred-site.xmlyarn-site.xml,均位于/usr/local/hadoop/etc/hadoop 中。
  slaves文件内容默认为localhost,每行一个主机名,在伪分布式配置时K1既作为NameNode 也作为 DataNode。集群分布式配置可以保留localhost让K1主节点也作为DataNode;也可以删除localhost让K2副节点作为DataNode、K1主节点作为Namenode。在本次实验中删除localhost添加K2即只让K2作为DataNode。在K1终端输入vim /usr/local/hadoop/etc/hadoop/slaves命令打开slaves文件,删除localhost添加K2保存并退出。
在这里插入图片描述
  core-site.xml文件。在K1终端输入vim /usr/local/hadoop/etc/hadoop/core-site.xml命令打开core-site.xml文件,将文件末尾改为以下配置内容:

<configuration>
        <property>
                <name>fs.defaultFS</name>
                <value>hdfs://K1:9000</value>
        </property>
        <property>
                <name>hadoop.tmp.dir</name>
                <value>file:/usr/local/hadoop/tmp</value>
                <description>Abase for other temporary directories.</description>
        </property>
</configuration>

在这里插入图片描述
在这里插入图片描述
  hdfs-site.xml文件。在K1终端输入vim /usr/local/hadoop/etc/hadoop/hdfs-site.xml命令打开hdfs-site.xml文件,将文件末尾改为以下配置内容:

<configuration>
        <property>
                <name>dfs.namenode.secondary.http-address</name>
                <value>K1:50090</value>
        </property>
        <property>
                <name>dfs.replication</name>
                <value>1</value>
        </property>
        <property>
                <name>dfs.namenode.name.dir</name>
                <value>file:/usr/local/hadoop/tmp/dfs/name</value>
        </property>
        <property>
                <name>dfs.datanode.data.dir</name>
                <value>file:/usr/local/hadoop/tmp/dfs/data</value>
        </property>
</configuration>

在这里插入图片描述
在这里插入图片描述
  mapred-site.xml文件。输入mv /usr/local/hadoop/etc/hadoop/mapred-site.xml.template /usr/local/hadoop/etc/hadoop/mapred-site.xml命令将默认文件名 mapred-site.xml.template改为mapred-site.xml后,在K1终端输入vim /usr/local/hadoop/etc/hadoop/mapred-site.xml命令打开hdfs-site.xml文件,将文件末尾改为以下配置内容:

<configuration>
        <property>
                <name>mapreduce.framework.name</name>
                <value>yarn</value>
        </property>
        <property>
                <name>mapreduce.jobhistory.address</name>
                <value>K1:10020</value>
        </property>
        <property>
                <name>mapreduce.jobhistory.webapp.address</name>
                <value>K1:19888</value>
        </property>
</configuration>

在这里插入图片描述
在这里插入图片描述
  yarn-site.xml文件。在K1终端输入vim /usr/local/hadoop/etc/hadoop/yarn-site.xml命令打开yarn-site.xml文件,将文件末尾改为以下配置内容:

<configuration>
        <property>
                <name>yarn.resourcemanager.hostname</name>
                <value>K1</value>
        </property>
        <property>
                <name>yarn.nodemanager.aux-services</name>
                <value>mapreduce_shuffle</value>
        </property>
</configuration>

在这里插入图片描述
在这里插入图片描述

 1.4 配置文件传输至节点

  将K1上的/usr/local/hadoop文件夹复制到各个节点上。在K1终端输入cd /usr/local命令和sudo rm -r ./hadoop/tmp命令删除Hadoop临时文件,输入sudo rm -r ./hadoop/logs/*命令删除Hadoop日志文件;输入tar -zcf ~/hadoop.master.tar.gz ./hadoop命令将hadoop文件夹先压缩再复制为hadoop.master.tar.gz压缩包,存放在mcf14用户主目录下;输入cd ~命令和scp ./hadoop.master.tar.gz K2:/home/mcf14命令将其发送到K2副节点上。
在这里插入图片描述
  在K2终端输入sudo rm -r /usr/local/hadoop命令删除旧的hadoop文件夹(没有则忽略),输入sudo tar -zxf ~/hadoop.master.tar.gz -C /usr/local命令将从K1传输过来的hadoop.master.tar.gz压缩包解压到/usr/local中,输入sudo chown -R mcf14 /usr/local/hadoop命令将解压后的hadoop文件夹权限为用户mcf14所有。
在这里插入图片描述

 1.5 启动Hadoop集群

  首次启动需要先在K1主节点执行NameNode的格式化。在K1终端输入hdfs namenode -format命令进行格式化(注意!以后尽量不要格式化),如下所示即为正常,然后输入start-dfs.shstart-yarn.shmr-jobhistory-daemon.sh start historyserver三个命令启动Hadoop集群。然后分别在K1和K2上输入jps命令查看进程,如下所示即为成功。
在这里插入图片描述
在这里插入图片描述
在这里插入图片描述
在这里插入图片描述
  可以通过Web页面查看DataNode和NameNode的状态:http://K1:50070/ 。如果不成功,可以通过启动日志排查原因,一般通过查看日志可以解决很多问题。
在这里插入图片描述
在这里插入图片描述

 2. 完成分布式实例

 2.1 在HDFS上创建用户目录

  在K1终端启动Hadoop集群后,输入hdfs dfs -mkdir -p /user/mcf14命令在HDFS上创建mcf14用户目录。
在这里插入图片描述
  输入hdfs dfs -mkdir input命令在HDFS中创建input输入目录,输入hdfs dfs -put /usr/local/hadoop/etc/hadoop/*.xml input命令将/usr/local/hadoop/etc/hadoop中的配置文件作为输入文件复制到分布式文件系统中。
在这里插入图片描述

 2.2 运行MapReduce作业分布式实例

  输入hadoop jar /usr/local/hadoop/share/hadoop/mapreduce/hadoop-mapreduce-examples-*.jar grep input output 'dfs[a-z.]+'命令就能运行程序,过程中会显示MapReduce Job的进度,实例运行完后输入hdfs dfs -cat output/*命令可以查看输出结果。
在这里插入图片描述
在这里插入图片描述
在这里插入图片描述
  可以通过Web界面查看任务进度:http://K1:8088/cluster ,在Web界面点击“Tracking UI”这一列的History连接,可以看到任务的运行信息。

在这里插入图片描述
在这里插入图片描述
在这里插入图片描述

大数据导论实验一:搭建Hadoop集群 搭建Hadoop集群,要求至少是3个节点的真分布式集群系统,包含1个NameNode,两个DataNode。 阅读详情

相关推荐

Hadoop集群安装部署教学

前提: 创建台虚拟机 主机名 node01、node02、node03 Ip 自己定 磁盘大小50G 安装虚拟机 安装linux系统 Hadoop集群安装部署 1、 服务器主机名和IP配置(台) 2、 修改每个主机的/etc/hosts文件,添加IP和主机名的对应关系(台) 3、 管理节点到从节点配置无密码登录 4、 配置jdk 1.8(台) 5、 关闭防火墙(台) 6、 关闭selinux(台) vi /etc/selinux/config SELINUX=enforcing 改

Ele_sorriu的博客 2万+

Hadoop搭建实验报告

NULL 博文链接:https://daxiangwanju.iteye.com/blog/1962175

Hadoop集群安装部署详细过程

3.Hadoop集群安装背景(1)关闭防火墙(2)实现免密登陆① 修改主机名② 修改/etc/hosts文件③ 生成密钥④ 测试免密登陆(3)创建文件夹及上传安装包(4)修改一系列配置文件① 修改core-site.xml文件② 修改hadoop-env.sh文件③ 修改hdfs-site.xml文件④ 新建并修改mapred-site.xml文件⑤ 修改slaves文件⑥ 修改yarn-site.xml文件⑦ 修改yarn-env.sh文件(5)主节点初始化(6)启动hadoop(7)运行自带的wo

qq_36392247的博客 3500

搭建Hadoop集群

实验二搭建Hadoop集群 1实验目的 搭建Hadoop集群; 掌握Linux分发; 掌握Hadoop启动和关闭。 2实验内容 搭建Hadoop集群,配置etc/下的配置文件,设置主从节点,设置Hadoop环境变量,分发到其他电脑,运行hdfs和yarn,启动namenode、datanode。 3 实验知识点 Hadoop配置文件修改; 主从节点设置; 环境变量配置; 分发; 格式化namenode文件夹。 启动集群 4实验时长 8学时。 5实验环境 VMw...

m0_62670963的博客 4830

Hadoop安装实验报告

如果读者正在使用Linux操作系统,则不需要了解Windows系统上的Linux虚拟机安装方法;鉴于目前很多读者正在使用Windows操作系统,因此,为了完成本书的后续实验,这里有必要通过本实验让读者掌握在Windows操作系统上搭建Linux虚拟机的方法。VMware Workstation Player软件的下载地址: https://www.vmware.com/products/workstation-player/workstation-player-evaluation.html。

wujddjdjndn的博客 9653

Hadoop安装实验报告

jdk安装以及Hadoop 安装

weixin_44364897的博客 1万+

【李老师云计算】实验:在Docker中部署Hadoop集群

Docker部署Hadoop

WtcSky的博客 1万+

Hadoop 集群安装部署(超详细)

Hadoop 安装部署(詳細): 文章目录Hadoop 安装部署(詳細):前言Hadoop特点**Hadoop能做什么**一、pandas是什么?二、安裝部署1.引入库一、设置主机名hostnamectl set-hostname hadoopxxxvim /etc/hosts (四台服务器都需添加)二、添加公钥(台centos服务器互相添加公钥)安装jdk四、上传Hadoop 包到指定目录 /opt/module/五、配置循环复制脚本 前言 - Hadoop是Yahoo!开发,后贡献给了A

weixin_42539417的博客 3028

hadoop集群部署

hadoop简介 Hadoop是一个由Apache基金会所开发的分布式系统基础架构, 是一个存储系统+计算框架的软件框架,主要解决海量数据存储与计算的问题,是大数据技术中的基石。 Hadoop以一种可靠、高效、可伸缩的方式进行数据处理,用户可以在不了解分布式底层细节的情况下,开发分布式程序,用户可以轻松地在Hadoop上开发和运行处理海量数据的应用程序。 Hadoop的框架最核心的设计就是:HDFSMapReduceHDFS为海量的数据提供了存储,则MapReduce为海量的数据提供了计算。 hadoo

Cat God 007的博客 7924

Hadoop教程(五)Hadoop分布式集群部署安装

hadoop2.0中通常由两个NameNode组成,一个处于active状态,另一个处于standby状态。Active NameNode对外提供服务,而Standby NameNode则不对外提供服务,仅同步activenamenode的状态,以便能够在它失败时快速进行切换。 hadoop2.0官方提供了两种HDFS HA的解决方案,一种是NFS,另一种是QJM。这里我们使用简单的QJM。在该方案中,主备NameNode之间通过一组JournalNode同步元数据信息,一条数据只要成功写入多数J

yuan_xw的专栏 1万+

Hadoop 全分布安装部署

Hadoop 全分布安装部署: 目录 Hadoop 全分布安装部署: 一: 安装前准备 二: 配置jdk 部署hadoop集群 四: 启动hadoop集群 五: 总结 VMWare上安装liunx系统:装虚拟机及linux系统 hadoop伪分布安装请移步:hadoop伪分布安装 一: 安装前准备 安装工具准备: 都已经在hadoop伪分布中准备齐全,自取 hadoop伪分布安装 ...

m0_46440794的博客 2979

Hadoop部署实验

打开“cMaster:50070”,点击链接“Browse the filesystem”,将会看到刚才的输入数据“/in”和输出结果数据“/out/wc-01/part-r-00000”。解决方案:用命令ifconfig查看ip地址是否正确,或者在cMaster里面是否可以ping通cSlave1和cSlave2,如果不正确需要修改ip地址。此Hadoop集群台机器(cMaster,cSlave0和cSlave1),其中cMaster作为主节点,cSlave0和cSlave1作为从节点。

liuwenliangjing的博客 964

Hadoop集群安装部署

hadoop集群的搭建

qq_48391148的博客 3843

实验一 5分钟学会Hadoop集群部署

Hadoop集群部署前言一、虚拟环境安装配置二、虚拟机中的网络配置步骤一:本地网络配置查看步骤二:设置虚拟机网络环境Hadoop伪分布环境安装与配置任务1:Java JDK-8u181版本下载与安装任务2:Java JDK-8u181版本环境变量配置任务3:Hadoop-2.10.0版本下载与安装任务4:Hadoop-2.10.0版本环境变量配置任务5:Hadoop-2.10.0版本核心配置文件配置任务6:格式化DFS分布式文件系统任务7:启动hadoop-2.10.0服务任务8:Hadoop HDFS

葫芦娃的博客 3154

Hadoop集群部署

p今天我们基于开源软件搭建满足企业需求的Hadoop生态系统,构建基础的大数据分析平台准备3台机器搭建Hadoop全分布集群,其中1台机器作为Master节点,另外两台机器作为Slave节点,主机名分别为Slave1和Slave2。

景巧巧的博客 1202

Hadoop】创建Hadoop集群(3个节点)—— 安装部署一个3个节点构成的hbase集群

互联网的快速发展带来了数据快速增加,海量数据的存储已经不是一台机器所能处理的问题了。Hadoop的技术应运而生,对于伪分布式存储,Hadoop有自己的一套系统Hadoop distribution file system来处理,为什么分布式存储需要一个额外的系统来处理,而不是就把1TB以上的文件分开存放就好了呢,如果不采用新的系统,我们存放的东西没办法进行一个统一的管理。

disy924的博客 7294

hadoop集群部署教程

本文介绍了如何安装和配置Hadoop,一个用于分布式存储和处理大规模数据的开源框架。通过按照本文提供的步骤,您可以在自己的机器上搭建一个Hadoop集群,并通过浏览器访问Hadoop的管理页面。本文详细介绍了安装准备、安装JDK、安装Hadoop、修改配置文件、格式化文件系统以及启动Hadoop的步骤。hadoop的只读默认配置文件位于安装目录下的目录。通过本文的指导,您已经学会了如何安装和配置Hadoop,并搭建了一个Hadoop集群

zcs2312852665的博客 5453

Linux的hadoop集群部署

命令: wget https://mirrors.aliyun.com/apache/hadoop/common/hadoop-3.4.0/hadoop-3.4.0.tar.gz。五:修改配置文件hadoop-env.sh 命令: vi /export/server/hadoop-3.4.0/etc/hadoop/hadoop-env.sh。命令: ln -s /export/server/hadoop-3.4.0 /export/server/hadoop

m0_72898512的博客 1525
上一篇: Hadoop——实验二:Hadoop集群单节点非分布和伪分布安装
下一篇: Hadoop——实验四:建立Eclipse开发环境
诗卿°
博客等级 码龄7年 371粉丝 23原创
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

诗卿°

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值