hadoop-3.0.0-beta1运维手册(010):hdfs3.0.0动态添加节点(2)

开发者福利!热门AI工具限时免费用 购周边即赠Coding Plan Lite,Claude Code、Cursor等20+工具畅享,效率翻倍! 阅读详情

写在前面的话

Hdfs采用分布式架构,为上层的应用和用户提供可扩展、高吞吐、高可靠的数据存储服务。在整个Hadoop生态系统中,hdfs处于最底层,也是最无可替代的一个基础设施。从2008hadoop-0.10.1版本开始到现在的hadoop-3.0.0-beta1hdfs已经走过了近10个年头,其架构和功能特性也发生了巨大的变化。特别是hdfs3.0.0系列,和hdfs2.x相比,增加了基于纠删码(erasure encoding)的容错方式,与传统的副本方式相比,在同等可用性的情况下, 能大幅节省一半以上的空间,这也是自hdfs诞生近这十年来,数据可靠性机制上的一个重大变化(之前一直都是副本容错方式)。此外hdfs3.0.0还增加了其它的一些特性,例如在Namenode HA中支持3Namenode,可以容忍2Namenode失效,而hdfs2.x只能容忍1Namenode失效。

本文以连载的方式,在大数据学习网”上记录自己使用hadoop-3.0.0-beta1hdfs的点点滴滴,包括从零开始搭建分布式hdfs3.0,如何动态扩展hdfs节点、如何使用hdfs3.0的纠删码容错等等。不当之处,请大家发邮件aishuc@126com给艾叔,谢谢!

 

 

5.3 启动hdfs3.0

启动nn1,运行下面的命令。

[user@nn1 ~]$ cd ~/hadoop-3.0.0-beta1

[user@nn1 hadoop-3.0.0-beta1]$ sbin/start-dfs.sh

输出如下

Starting namenodes on [nn1]

Starting datanodes

Starting secondary namenodes [nn1]

使用hdfs命令验证

[user@nn1 hadoop-3.0.0-beta1]$ hdfs dfsadmin -report

如果我们可以看到下面的信息,则说明hdfs3.0启动成功,并且只有1datanode

-------------------------------------------------

Live datanodes (1):

 

Name: 192.168.182.11:9866 (nn1)

Hostname: nn1

下面我们就要动态加入datanode节点了。

 

nn1上添加host解析

[root@nn1 user]# vi /etc/hosts

内容如下,添加绿色的部分

127.0.0.1   localhost localhost.localdomain localhost4 localhost4.localdomain4

::1         localhost localhost.localdomain localhost6 localhost6.localdomain6

192.168.182.11 nn1

192.168.182.12 dn1

测试,如果能够ping通,则说明host解析设置成功

[user@nn1 ~]$ ping dn1

PING dn1 (192.168.182.12) 56(84) bytes of data.

 

测试nn1dn1的无密码登录,应该是可以直接登录的。

[user@nn1 ~]$ ssh dn1

The authenticity of host 'dn1 (192.168.182.12)' can't be established.

ECDSA key fingerprint is 02:18:29:20:9d:55:88:d6:b2:e6:84:d2:16:10:80:a7.

Are you sure you want to continue connecting (yes/no)? yes

Warning: Permanently added 'dn1,192.168.182.12' (ECDSA) to the list of known hosts.

Last login: Thu Nov 30 03:57:52 2017 from 192.168.182.1

 

 

5.4 动态加入dn1

dn1上,启动datanode

[user@dn1 hadoop-3.0.0-beta1]$ hdfs --daemon start datanode

注意:使用上面的命令启动datanode,原来的hadoop-deamon.sh启动方法已经不用了。

Jps验证,如果能够看到DataNode,则说明正常。

[user@dn1 hadoop-3.0.0-beta1]$ jps

3272 Jps

3215 DataNode

nn1上查看节点是否加入成功

[user@nn1 hadoop-3.0.0-beta1]$ hdfs dfsadmin -report

显示

-------------------------------------------------

Live datanodes (2):

则说明加入成功

注意:以上是在原有的hdfs3.0集群不停机的情况下,加入dn1的。

为了便于后续管理,编辑hadoopworkers文件,加入dn1

[user@nn1 ~]$ cd hadoop-3.0.0-beta1

[user@nn1 hadoop-3.0.0-beta1]$ vi etc/hadoop/workers

内容如下,其中dn1是新添加的

nn1

dn1

 

5.5 查看dn1后副本的分布

web中可以看到,profile的副本数是3,由于之前datanode只有1个,因此,实际只存储了1个副本。

 

现在加入了一个dn1,下面我们可以看到profileBlock0的副本又增加一个存储节点dn1,这是自动进行的。

 

 

5-19 hdfs3.0web界面查看Block分布

 

上一篇:hadoop-3.0.0-beta1运维手册(009):hdfs3.0.0基本操作-hdfs动态加入节点(1)》

原创文章,转载请注明: 转载自大数据学习网,作者:艾叔

本文链接地址http://www.bigdatastudy.net/show.aspx?id=457&cid=8

hadoop2.6.0控制集群节点个数 要控制集群节点的个数,只需要更改主控节点(master)Hadoop安装目录下面./etc/hadoop下面的slaves文件,通过添加或删除slave的ip或ip映射的名字,然后在主控节点执行start-all.sh就可以了. 1.slaves里面放一个slave slave1 启动集群后,查看状态: hadoop@master:/opt/hadoop$ jps 27 阅读详情

相关推荐

hadoop-3.0.0-beta1运维手册011):HDFS Erasure Coding纠删码使用

写在前面的话 Hdfs采用分布式架构,为上层的应用和用户提供可扩展、高吞吐、高可靠的数据存储服务。在整个Hadoop生态系统中,hdfs处于最底层,也是最无可替代的一个基础设施。从2008年hadoop-0.10.1版本开始到现在的hadoop-3.0.0-beta1hdfs已经走过了近10个年头,其架构和功能特性也发生了巨大的变化。特别是hdfs3.0.0系列,和hdfs2.x相比,增加了基

aishuc的博客 5305

Hadoop datanode正常启动,但是Live nodes中却突然缺少节点

问题解决关键:多个节点存放data数据的目录路径相同了,造成了报告中误认为只有一个datanode,于是通过命令查看live datanodes的个数时候,会发现节点全部启动,但是datanodes数目并不能正常显示。解决办法:修改hdfs-site.xml文件master中的hdfs-site.xml文件 <property> <name>dfs.datanode.data.dir

额不食烟火 3320

hadoop-3.0.0-beta1运维手册008):hdfs3.0.0基本操作-查看HDFS文件系统、查看文本文件、使用帮助

写在前面的话 Hdfs采用分布式架构,为上层的应用和用户提供可扩展、高吞吐、高可靠的数据存储服务。在整个Hadoop生态系统中,hdfs处于最底层,也是最无可替代的一个基础设施。从2008年hadoop-0.10.1版本开始到现在的hadoop-3.0.0-beta1hdfs已经走过了近10个年头,其架构和功能特性也发生了巨大的变化。特别是hdfs3.0.0系列,和hdfs2.x相比,增加了基

aishuc的博客 932

hadoop搭建--datanode信息为0Live datanodes0

背景 hadoop集群启动后,无有效的datanode节点,表现形式为: 使用hdfs dfsadmin -report查看节点的情况时,都是0 xf@master01:~/hadoop-2.6.5$ hdfs dfsadmin -report Configured Capacity: 0 (0 B) Present Capacity: 0 (0 B) DFS Remaining: 0 (0 B) DFS Used: 0 (0 B) DFS Used%: NaN% Under replicated bloc

weixin_36343850的博客 2841

Hadoop问题解决集合

文章目录在web端查看Hdfs界面只有一个Live Node节点解决方法一解决方法二解决方法三hadoop jar xxxx/hadoop-mapreduce-examples-2.9.2.jar xxx 命令报错的解决方法问题描述及解决方法windows运行Hadoop报错:Did not find winutils.exe、Could not locate Hadoop executable:错误提示错误原因 在web端查看Hdfs界面只有一个Live Node节点 解决方法一 首先查看日志,发现

qq_43408367的博客 559

Live datanodes节点显示不全

问题描述:一共添加了6个slave,但是活跃节点只显示4个hadoop dfsadmin -report #显示节点的情况jps查看一下,发现datanode都开启了浏览器也只显示4个问题解决配置文件hdfs-site.xml中&lt;property&gt; &lt;name&gt;dfs.datanode.data.dir&lt;/name&gt; &lt...

weixin_41661222的博客 2042

hadoop-3.0.0-beta1运维手册009):hdfs3.0.0动态添加节点1

写在前面的话 Hdfs采用分布式架构,为上层的应用和用户提供可扩展、高吞吐、高可靠的数据存储服务。在整个Hadoop生态系统中,hdfs处于最底层,也是最无可替代的一个基础设施。从2008年hadoop-0.10.1版本开始到现在的hadoop-3.0.0-beta1hdfs已经走过了近10个年头,其架构和功能特性也发生了巨大的变化。特别是hdfs3.0.0系列,和hdfs2.x相比,增加了基

aishuc的博客 639

hadoop-3.0.0-beta1运维手册003):安装全分布式HDFS3.0.0-准备软件和配置CentOS网络

3.1 准备软件 HDFSHadoop的一个组件,它并没有单独发布,因此,我们需要下载Hadoop的安装包。 1. 下载Hadoop3.0.0-beta1,保存到d:\hdfs3\soft 3-1 Hadoop存储路径图 有关beta1版本的介绍:它是API稳定的版本,但不保证质量,并且不打算用于生产环境。因此,此版本可以用来提前学习,待stable版本出来后,可以直接替换上生产环境

aishuc的博客 897

hadoop-3.0.0-beta1运维手册006):hdfs3.0.0分布式构建-启动hdfs

写在前面的话 Hdfs采用分布式架构,为上层的应用和用户提供可扩展、高吞吐、高可靠的数据存储服务。在整个Hadoop生态系统中,hdfs处于最底层,也是最无可替代的一个基础设施。从2008年hadoop-0.10.1版本开始到现在的hadoop-3.0.0-beta1hdfs已经走过了近10个年头,其架构和功能特性也发生了巨大的变化。特别是hdfs3.0.0系列,和hdfs2.x相比,增加了基

aishuc的博客 1114

hadoop-3.0.0-beta1运维手册007):hdfs3.0.0基本操作-上传、下载、删除文件或目录

写在前面的话 Hdfs采用分布式架构,为上层的应用和用户提供可扩展、高吞吐、高可靠的数据存储服务。在整个Hadoop生态系统中,hdfs处于最底层,也是最无可替代的一个基础设施。从2008年hadoop-0.10.1版本开始到现在的hadoop-3.0.0-beta1hdfs已经走过了近10个年头,其架构和功能特性也发生了巨大的变化。特别是hdfs3.0.0系列,和hdfs2.x相比,增加了基

aishuc的博客 763

hadoop-3.0.0-beta1运维手册004):安装分布式hdfs3.0.0-配置JDK、设置主机名

3.4 配置JDK 1. 解压 注意:我们所指的路径是/home/user 解压的命令是:tar xf jdk-8u152-linux-x64.tar.gz 解压后,ls,可以看到蓝色的目录:jdk1.8.0_152 3-33 jdk解压目录 2. 添加JDK相关的环境变量 切换到root用户 3-34 su命令切换 编辑/etc/profile文件   3-35

aishuc的博客 396

hadoop-3.0.0-beta1运维手册005):hdfs3.0.0分布式构建-hdfs配置、无密码登录

写在前面的话 Hdfs采用分布式架构,为上层的应用和用户提供可扩展、高吞吐、高可靠的数据存储服务。在整个Hadoop生态系统中,hdfs处于最底层,也是最无可替代的一个基础设施。从2008年hadoop-0.10.1版本开始到现在的hadoop-3.0.0-beta1hdfs已经走过了近10个年头,其架构和功能特性也发生了巨大的变化。特别是hdfs3.0.0系列,和hdfs2.x相比,增加了基

aishuc的博客 561

hadoop-3.0.0-beta1运维手册002):安装Guest操作系统

2.1 什么是Guest操作系统 Guest指虚拟机,安装Guest操作系统,就是在我们刚才定制的虚拟机nn1上安装操作系统。 我们要安装的操作系统是Linux,它有很多发行版,在这里我们选择Centos系列,它主要用作服务器操作系统,非常稳定,在生产环境中应用广泛。具体版本是Centos 7,64位,下载地址为:CentOS-7-x86_64-Everything-1511。整个光盘有7

aishuc的博客 679

hadoop-3.0.0-beta1运维手册011):HDFS Erasure Coding纠删码

转自:https://blog.csdn.net/aishuc/article/details/78734572 Hdfs采用分布式架构,为上层的应用和用户提供可扩展、高吞吐、高可靠的数据存储服务。在整个Hadoop生态系统中,hdfs处于最底层,也是最无可替代的一个基础设施。从2008年hadoop-0.10.1版本开始到现在的hadoop-3.0.0-beta1hdfs...

weixin_33819479的博客 388

大数据Hadoop运维应用实践——Hbase与hadoop的整合_Hbase的配置安装

本文详细介绍了HBase分布式数据库的配置安装与使用实践。主要内容包括:1. HBase的介绍(是什么?有啥用?优缺点、适用与不适用场景)。2. 版本选型指南:针对不同JDK版本HBase和Hadoop环境提供兼容性矩阵。3. 集群部署实践:包含环境变量配置、JVM参数调优、核心参数(hbase-site.xml)详解,特别强调内存分配(堆内外)、ZK超时、Region分裂等关键配置与高可用配置。最后提供了Ansible自动化批量部署脚本,适合企业级生产环境安装部署HBase参考。

提供C#相关开发 、云计算、运维测试、网络安全相关技术分享与服务,有意向可联系。 180

Flink部署实战:从Standalone到K8s的架构选型与生产配置指南

实时流处理是构建现代数据架构的核心技术,其核心原理是通过分布式系统对无界数据流进行连续计算。在技术实现上,Apache Flink凭借其高吞吐、低延迟和精确一次(Exactly-Once)的容错保障,成为业界主流选择。其技术价值在于能够统一处理有状态的流计算与批处理任务,为实时数据分析、事件驱动应用和复杂事件处理提供强大引擎。在实际应用场景中,无论是实时监控、金融风控还是实时推荐系统,一个稳定高效的Flink生产部署都是业务成功的基石。本文将聚焦于**部署模式**与**资源管理**两大核心维度,深入解析St

weixin_33806914的博客 438

Apache SeaTunnel企业级部署架构:构建高可用数据集成管道的完整指南

Apache SeaTunnel作为一款多模态、高性能、分布式的海量数据集成工具,在企业级数据架构中扮演着关键角色。其核心价值在于提供统一的数据集成API,实现与执行引擎的完全解耦,使得相同的数据连接器能够在SeaTunnel Engine(Zeta)、Apache Flink和Apache Spark上无缝运行。这种设计理念不仅简化了数据集成流程,更在性能、可靠性和扩展性方面为企业级应用提供了坚

gitblog_00672的博客 436

数据科学算力演进路径:VM→BM→Serverless Spark实战指南

在数据科学工程实践中,计算资源选型本质是平衡资源确定性、弹性响应、运维成本与单位算力价格的技术决策。从单机虚拟机(VM)到裸金属服务器(BM),再到Serverless Spark,这一演进并非线性升级,而是由内存带宽瓶颈、负载变异系数(CV)、P95延迟容忍等可量化指标驱动的阶段性跃迁。VM适合小规模探索性分析,BM解决高吞吐确定性计算,而Serverless Spark则针对波峰波谷明显、任务高频并发、SLA严苛的生产级ETL与模型训练场景,实现秒级调度与按需计费。本文基于真实业务压测数据与三年成本账单

图灵教育官方博客 387

【信息科学与工程学】【数据中心】 第七篇 智算中心CLOS组网整体设计

区域主要功能网络要求技术选型安全等级可用性要求训练区​大规模AI模型训练,分布式计算超高带宽(100G+),超低延迟(<1ms),无损网络RoCEv2,PFC,DCQCN,多路径P4(最高)99.99%推理区​实时AI推理,模型服务低延迟(<10ms),高可用,弹性扩展智能负载均衡,服务网格,容器网络P3()99.999%公共服务区​统一认证,API网关,数据服务多租户隔离,安全防护,弹性带宽VXLAN,EVPN,微隔离P3()99.99%存储区​高性能存储,数据湖超高带宽,低延迟,高IOPSNVMe-

weixin_49199313的博客 1313
上一篇: hadoop-3.0.0-beta1运维手册(009):hdfs3.0.0动态添加节点(1)
下一篇: hadoop-3.0.0-beta1运维手册(011):HDFS Erasure Coding纠删码使用
艾叔
博客等级 码龄11年 15粉丝 16原创
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值