hadoop-3.0.0-beta1运维手册(007):hdfs3.0.0基本操作-上传、下载、删除文件或目录

开发者福利!热门AI工具限时免费用 购周边即赠Coding Plan Lite,Claude Code、Cursor等20+工具畅享,效率翻倍! 阅读详情

写在前面的话

Hdfs采用分布式架构,为上层的应用和用户提供可扩展、高吞吐、高可靠的数据存储服务。在整个Hadoop生态系统中,hdfs处于最底层,也是最无可替代的一个基础设施。从2008hadoop-0.10.1版本开始到现在的hadoop-3.0.0-beta1hdfs已经走过了近10个年头,其架构和功能特性也发生了巨大的变化。特别是hdfs3.0.0系列,和hdfs2.x相比,增加了基于纠删码(erasure encoding)的容错方式,与传统的副本方式相比,在同等可用性的情况下, 能大幅节省一半以上的空间,这也是自hdfs诞生近这十年来,数据可靠性机制上的一个重大变化(之前一直都是副本容错方式)。此外hdfs3.0.0还增加了其它的一些特性,例如在Namenode HA中支持3Namenode,可以容忍2Namenode失效,而hdfs2.x只能容忍1Namenode失效。

本文以连载的方式,在大数据学习网”上记录自己使用hadoop-3.0.0-beta1hdfs的点点滴滴,包括从零开始搭建分布式hdfs3.0,如何动态扩展hdfs节点、如何使用hdfs3.0的纠删码容错等等。不当之处,请大家发邮件aishuc@126com给艾叔,谢谢!

 

4.1 查看目录内容

例子,查看hdfs的根目录内容,绿色部分表示要查看的路径

[user@nn1 ~]$ hdfs dfs -ls /

 

4.2 上传文件

例子,将/etc/profile上传到hdfs的根目录下,并验证。

注意

1. file:///etc/profilefile://表示本地文件系统,/etc/profile是本地文件的路径。

2. 后面的/,表示的是hdfs的根目录,因为core-site.xml中配置了默认的文件系统是hdfs://nn1:9001

[user@nn1 ~]$ hdfs dfs -cp file:///etc/profile /

[user@nn1 ~]$ hdfs dfs -ls /

Found 1 items

-rw-r--r--   3 user supergroup       1872 2017-11-27 14:45 /profile

 

4.3 上传目录

例子,将hadoop配置文件目录上传到hdfs的根目录下,并验证。

[user@nn1 ~]$ hdfs dfs -cp file:///home/user/hadoop-3.0.0-beta1/etc/hadoop/ /

[user@nn1 ~]$ hdfs dfs -ls /

Found 2 items

drwxr-xr-x   - user supergroup          0 2017-11-27 14:49 /hadoop

-rw-r--r--   3 user supergroup       1872 2017-11-27 14:45 /profile

[user@nn1 ~]$ hdfs dfs -ls /hadoop

Found 31 items

-rw-r--r--   3 user supergroup       7861 2017-11-27 14:49 /hadoop/capacity-scheduler.xml

-rw-r--r--   3 user supergroup       1335 2017-11-27 14:49 /hadoop/configuration.xsl

注意

1. file:///home/user/hadoop-3.0.0-beta1/etc/hadoop/ 是源路径,它和后面的/之间有一个空格

2. 后面的/,表示hdfs的根目录

3. 上传文件和上传目录的用法一样,并不需要增加-r选项

4.4 下载文件

例子,将刚上传的profile下载到本地/tmp目录下

[user@nn1 ~]$ hdfs dfs -cp /profile file:///tmp/

[user@nn1 ~]$ ls -l /tmp/profile

-rw-r--r--. 1 user user 1872 Nov 27 15:02 /tmp/profile

注意

1. 上传和下载其实就是对调一下hdfs和本地路径,我们只需要清楚:本地路径前面要加file://,而hdfs直接用就可以了;

2. 如果在core-site.xml中配置默认文件系统为file://,那么/表示的就是本地文件系统的根目录,如果要访问hdfs,则要使用hdfs://nn1:9001/后面再跟路径。

 

4.5 下载目录

例子,下载hdfs中的/hadoop/tmp目录下

[user@nn1 ~]$ hdfs dfs -cp /hadoop file:///tmp/

[user@nn1 ~]$ ls -l /tmp/

total 28

drwxr-xr-x. 3 user user 4096 Nov 27 15:05 hadoop

注意:复制目录和复制文件用法完全一样。

 

4.6 删除文件

删除刚上传的profile

[user@nn1 ~]$ hdfs dfs -rm /profile

Deleted /profile

[user@nn1 ~]$ hdfs dfs -ls /

Found 1 items

drwxr-xr-x   - user supergroup          0 2017-11-27 14:49 /hadoop

 

4.7 删除目录

删除刚上传的hadoop目录

[user@nn1 ~]$ hdfs dfs -rm -r /hadoop

Deleted /hadoop

[user@nn1 ~]$ hdfs dfs -ls /

注意:删除目录多了一个选项-r

 

上一篇:hadoop-3.0.0-beta1运维手册(006):hdfs3.0.0分布式构建-启动hdfs》

原创文章,转载请注明: 转载自大�����据学习网,作者:艾叔

本文链接地址http://www.bigdatastudy.net/show.aspx?id=454&cid=8

Hadoop大数据部署与运维实战手册 Hadoop Distributed File System(HDFS)是Hadoop的核心组件之一,设计用来存储大量数据,它使用低成本硬件并提供了高吞吐量的数据访问。HDFS具有高度容错性的特点,并被设计为适合在普通的硬件上运行。HDFS的工作原理是将大型文件分割成固定大小的数据块,默认大小为128MB256MB,这些数据块存储在Hadoop集群中的多个DataNodes上。为了保证数据的可靠性,HDFS还会对数据块进行复制,复制的数量可以通过参数配置,默认是3份。 阅读详情

相关推荐

Cloudera CDH集群运维手册

Cloudera CDH集群运维手册,带截图的,挺详细,有用Cloudera cdh集群的可以看看

hadoop集群维护手册.pdf

hadoop集群维护手册.pdf

Hadoop运维12问--应急手册(中国程序员)

Hadoop运维12问--应急手册(中国程序员) Hadoop运维12问--应急手册(中国程序员)

hadoop—集群维护手册分享.pdf

hadoop—集群维护手册分享.pdf

Hadoop集群运维管理

Hadoop集群运维管理相关

slb190623的博客 1954

大数据平台运维hadoop入门(保姆篇))----概述及基本环境配置(HA-1)

大数据运维基础

weixin_62875153的博客 3462

hadoop大数据部署运维手册

hadoop大数据部署运维手册

Hadoop运维手册

在宿主机(这里是MacOS Intel Chip)上利用VMWare Fusion虚拟化3个虚机,网络采用Bridge模式,IP配置成静态地址。

2201_76110643的博客 859

hadoop-3.0.0-beta1运维手册005):hdfs3.0.0分布式构建-hdfs配置、无密码登录

写在前面的话 Hdfs采用分布式架构,为上层的应用和用户提供可扩展、高吞吐、高可靠的数据存储服务。在整个Hadoop生态系统中,hdfs处于最底层,也是最无可替代的一个基础设施。从2008年hadoop-0.10.1版本开始到现在的hadoop-3.0.0-beta1hdfs已经走过了近10个年头,其架构和功能特性也发生了巨大的变化。特别是hdfs3.0.0系列,和hdfs2.x相比,增加了基

aishuc的博客 562

Hadoop集群运维-基础、均衡器

为了使Hadoop集群保持健康的状态,集群需要进行日常的维护,主要从基础运维,集群扩容和异常处理三个方面。 1、基础运维 1.1 启动 / 停止HadoopHadoop_HOME/bin下执行./start-all.sh./stop-all.sh命令。(官方不推荐使用这两个命令1.2 启动 / 停止 HDFSHadoop_HOME/bin下执行./start-dfs.sh./stop-dfs.sh命令1.3 启动 / 停止 MapReduce 在Hadoop_H

洋葱专栏-有灵魂的程序员 649

Hadoop / YARN / Hive 运维操作教程

本文提供了一套完整的Hadoop/YARN/Hive运维操作指南,包含10个关键运维场景的操作方法。主要内容包括:Hadoop配置同步脚本实现多节点配置一致性;Hadoop+Hive集群自动启动脚本;Hadoop服务管理命令;YARN应用状态查询和日志查看技巧;节点管理与标签配置;ResourceManager启停方法;Hive基本操作;系统与集群监控命令;MapReduce任务管理以及常用日志路径和调试方法。该手册为大数据集群运维提供了标准化操作流程,可有效提升日常维护效率,特别适用于多节点Hadoop

weixin_46244623的博客 542

ClouderaManager运维_中文手册

ClouderaManager官方的中文运维手册,有需要的同学拿走。。

CDH集群运维手册

CDH集群运维手册,最新的CDH版本,支持各种平台 CDH集群运维手册,最新的CDH版本,支持各种平台

大数据运维手册

大数据运维手册 

大数据平台组件日常运维操作说明(Hadoop/Zookeeper/Kafa/ES/Mysql/Spark/Flume/Logstash/Tomcat)

调整shard刷新时间:`curl -XPUT http://localhost:9200/metricbeat-6.2.4-2018.05.21/_settings?提交模板配置文件:`curl -XPUT localhost:9200/_template/devops-logstore-template -d @devops-logstore.json`删除模板:`curl -XDELETE http://127.0.0.1:9200/_template/metricbeat-6.2.4`

love6a6的博客 1488

【深入理解Hadoop之一】 Hadoop1.0,2.03.0区别

1.X,2.X区别: 从HDFS角度来看: 1Hadoop2.0新增了HDFS HA机制,HA增加了standbynamenode进行热备份,解决了1.0的单点故障问题。 2:Hadoop2.0新增了HDFS federation,解决了HDFS水平可扩展能力。 ...

XVII 的博客 8725

hadoop-3.0.0-beta1运维手册011):HDFS Erasure Coding纠删码

转自:https://blog.csdn.net/aishuc/article/details/78734572 Hdfs采用分布式架构,为上层的应用和用户提供可扩展、高吞吐、高可靠的数据存储服务。在整个Hadoop生态系统中,hdfs处于最底层,也是最无可替代的一个基础设施。从2008年hadoop-0.10.1版本开始到现在的hadoop-3.0.0-beta1hdfs...

weixin_33819479的博客 388

hadoop部署与集群运维

里面讲了一些hadoo是如何部署与运维的知识点,希望对初学者有所帮助!

Linux运维入门Hadoop实验参照手册二(安装Hadoop

Linux运维入门Hadoop实验参照手册二(安装Hadoop

上一篇: hadoop-3.0.0-beta1运维手册(006):hdfs3.0.0分布式构建-启动hdfs
下一篇: hadoop-3.0.0-beta1运维手册(008):hdfs3.0.0基本操作-查看HDFS文件系统、查看文本文件、使用帮助
艾叔
博客等级 码龄11年 15粉丝 16原创
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值