在Ubuntu下JDK1.8和Hadoop2.6.0的安装与配置

限时加码!20+主流AI编程工具免费用 购周边加赠Coding Plan Lite,Claude Code、Cursor等即刻畅享,学习进阶更高效! 阅读详情

安装前的准备

这里给出JKD1.8.0的下载地址:https://www.cnblogs.com/xiximayou/p/12377900.html
Hadoop2.6.0的下载地址:https://archive.apache.org/dist/hadoop/common/hadoop-2.6.0/

环境

主机的测试环境为:

  • Ubuntu 16.04
  • Hadoop 2.6.0
  • JDK 1.8.0

一. 创建Hadoop用户

$ sudo useradd -m hadoop -s /bin/bash   #创建hadoop用户,并使用/bin/bash作为shell
$ sudo passwd hadoop                    #为hadoop用户设置密码,之后需要连续输入两次密码
$ sudo adduser hadoop sudo              #为hadoop用户增加管理员权限
$ su - hadoop                           #切换当前用户为用户hadoop
$ sudo apt-get update                   #更新hadoop用户的apt,方便后面的安装

 
 

二. 安装SSH并设置SSH免密码登录

SSH(Secure Shell)是一种建立在应用层和传输层基础上的安全协议,专为远程登录会话和其他网络服务提供安全性的协议。

$ sudo apt-get install openssh-server   #安装SSH server
$ ssh localhost                         #登陆SSH,第一次登陆输入yes
$ exit                                  #退出登录的ssh localhost
$ cd ~/.ssh/                            #如果没法进入该目录,执行一次ssh localhost
$ ssh-keygen -t rsa 					#生成 RSA密钥

输入完 ssh-keygen -t rsa 之后系统提示 “Enter file in which to save the key(home/hadoop/.ssh/id_rsa)” 时,连续按三次回车键,其中第一次回车是让KEY存于默认位置,方便后续输出,第二第三次是为了确定passphrase,如图所示:
在这里插入图片描述
当三次回车之后会出现下图,即安装成功:

在这里插入图片描述
接着再输入如下代码,如果没有提示密码登录,表示免密码登录成功:

$ cat ./id_rsa.pub >> ./authorized_keys  #加入授权
$ ssh localhost                          #若没有要求输入密码登录,表示免密码登录成功

在这里插入图片描述
 
 

三. 安装JDK1.8

在这里可以根据自己电脑配置选择jdk的版本,我选择的是版本是 jdk-8u11-linux-x64.tar.gz,其他版本也可以到oracle官网下载:http://www.oracle.com/technetwork/java/javase/downloads/index.html 。
接下来是安装与配置:

$ mkdir /usr/lib/jvm                                          #创建jvm文件夹
$ sudo tar zxvf jdk-7u80-linux-x64.tar.gz  -C /usr/lib/jvm    #/ 解压到/usr/lib/jvm目录下
$ cd /usr/lib/jvm                                             #进入该目录
$ mv  jdk1.7.0_80 java                                        #重命名为java

注: 其中如果权限不够,无法在相关目录下创建jvm文件夹,那么可以使用 $ sudo -i 语句进入root账户来创建文件夹。
接着使用 vim 对jdk进行环境变量配置(此时的地址在 /usr/local/hadoop):

$ sudo vim ~/.bashrc                                 #给JDK配置环境变量

如果没有vim,可以使用 $sudo apt-get install vim 进行下载。
打开 .bashrc 之后,在末尾添加如下代码,如图所示(后面都一样,都是在文件末尾添加):

export JAVA_HOME=/usr/lib/jvm/java
export JRE_HOME=${JAVA_HOME}/jre
export CLASSPATH=.:${JAVA_HOME}/lib:${JRE_HOME}/lib
export PATH=${JAVA_HOME}/bin:$PATH

在这里插入图片描述

修改完文件后,输入代码:

$ source ~/.bashrc                       #使新配置的环境变量生效
$ java -version                          #检测是否安装成功,查看java版本

当输入 java -version 后出现下图内容,即为安装成功:

在这里插入图片描述

 
 

四. 安装Hadoop2.6.0

先对Hadoop进行安装:

$ sudo tar -zxvf  hadoop-2.6.0.tar.gz -C /usr/local    #解压到/usr/local目录下
$ cd /usr/local
$ sudo mv  hadoop-2.6.0    hadoop                      #重命名为hadoop
$ sudo chown -R hadoop ./hadoop                        #修改./hadoop文件所有者为hadoop

接着使用 vim 对 hadoop 进行环境配置(此时的地址在 /usr/local/hadoop)

$ sudo vim ~/.bashrc

同样地,在末尾添加如下代码:

export HADOOP_HOME=/usr/local/hadoop
export CLASSPATH=$($HADOOP_HOME/bin/hadoop classpath):$CLASSPATH
export HADOOP_COMMON_LIB_NATIVE_DIR=$HADOOP_HOME/lib/native
export PATH=$PATH:$HADOOP_HOME/bin:$HADOOP_HOME/sbin

修改完 ~/.bashrc 文件后,输入代码使其激活:

$ source ~/.bashrc
$ hadoop version

当输入 hadoop version之后出现如下图内容,即为安装成功:
在这里插入图片描述
 
 

五.伪分布式配置

Hadoop有三种运行方式:
1. Local(Standalone)Mode(本地模式,Hadoop的默认运行模式): 在该模式下所有程序都运行在同一个JVM(Java Virtual Machine,Java虚拟机)里。MapReduce直接使用Linux的本地文件系统存储数据,而不使用HDFS系统。该模式主要用于测试和调试MapReduce程序,适合开发阶段使用。
2. Rseudo-Distribution Mode(即伪分布模式): 在该模式下,Hadoop的守护进程在本地机器上。该模式模拟一个分布式集群,数据存储于分布式文件系统HDFS,而不保存于Linux的本地文件系统。同时,该模式通过创建不同的JVM实例来实现程序的分布式运行。这种模式主要是考虑用户没有足够的机器去部署一个完全分布式的环境。
3. Fully-Distribution Mode(即完全分布模式): 在该模式下,Hadoop在集群中的每个节点上启动一个守护进程,系统依靠HDFS实现数据的分布式存储,MapReduce程序中的Map任务和Reduce任务通过调度机制并发地运行于不同的节点之中,实现数据的就近处理。

而今天所要安装的是第二个模式——伪分布模式。Hadoop 进程以分离的 Java 进程来运行,节点既作为 NameNode 也作为 DataNode,同时,读取的是 HDFS 中的文件。Hadoop 的配置文件位于 /usr/local/hadoop/etc/hadoop/ 中,伪分布式需要修改2个配置文件 core-site.xmlhdfs-site.xml
首先将jdk1.7的路径添加到hadoop-env.sh文件(此时的地址在 /usr/local/hadoop ):

$ sudo vim etc/hadoop/hadoop-env.sh

接着在文件末尾添加代码:

export JAVA_HOME=/usr/lib/jvm/java 				#将jdk的路径添加到hadoop-env.sh中

接下来修改配置文件 core-site.xml,用来定义NameNode进程的URI:

<configuration>
        <property>
             <name>hadoop.tmp.dir</name>
             <value>file:/usr/local/hadoop/tmp</value>
             <description>namenode工作时的临时文件夹.</description>
        </property>
        <property>
             <name>fs.defaultFS</name>
             <value>hdfs://localhost:9000</value>
             <description>HDFS的URI,localhost为主节点的名字.</description>
        </property>
</configuration>

再修改配置文件 hdfs-site.xml,用来设置HDFS的NameNode和DataNode两大进程的重要参数:

<configuration>
        <property>
             <name>dfs.replication</name>
             <value>3</value>
             <description>副本个数,默认值是3.</description>
        </property>
        <property>
             <name>dfs.namenode.name.dir</name>
             <value>file:/usr/local/hadoop/tmp/dfs/name</value>
             <description>NameNode上的HDFS命名空间元数据的存储位置.</description>
        </property>
        <property>
             <name>dfs.datanode.data.dir</name>
             <value>file:/usr/local/hadoop/tmp/dfs/data</value>
              <description>DateNode数据块的存储位置.</description>
        </property>
</configuration>

Hadoop 的运行方式是由配置文件决定的(运行 Hadoop 时会读取配置文件),因此如果需要从伪分布式模式切换回非分布式模式,需要删除 core-site.xml 中的配置项。此外,伪分布式虽然只需要配置 fs.defaultFS 和 dfs.replication 就可以运行(可参考官方教程),不过若没有配置 hadoop.tmp.dir 参数,则默认使用的临时目录为 /tmp/hadoo-hadoop,而这个目录在重启时有可能被系统清理掉,导致必须重新执行 format 才行。所以我们进行了设置,同时也指定 dfs.namenode.name.dir 和 dfs.datanode.data.dir,否则在接下来的步骤中可能会出错。
配置完成后,执行对NameNode的格式化:

$ ./bin/hdfs namenode -format 				#格式化

启动NameNode和DataNode进程,并查看启动结果:

$ ./sbin/start-dfs.sh
$ jps

当输入结果后显示如下图,则表示启动成功:
在这里插入图片描述
成功启动后,可以访问 Web 界面 http://localhost:50070 查看 NameNode 和 Datanode 信息,还可以在线查看 HDFS 中的文件。
在这里插入图片描述
至此,Hadoop配置成功!
 
 

六、 配置YARN

进入 /usr/local/hadoop目录中,输入:

$ cp etc/hadoop/mapred-site.xml.template etc/hadoop/mapred-site.xml

配置MapReduce应用程序以及JobHistory服务的重要参数,打开 mapred-site.xml:

sudo vim etc/hadoop/mapred-site.xml

在文件末尾添加代码:

<configuration>
    <property>
        <name>mapreduce.framework.name</name>
        <value>yarn</value>
    </property>
</configuration>

接着打开 yarn-site.xml,设置ResourceManager和NodeManager两大进程的重要配置参数:

sudo vim etc/hadoop/yarn-site.xml

在文件末尾添加代码:

<configuration>
    <property>
        <name>yarn.nodemanager.aux-services</name>
        <value>mapreduce_shuffle</value>
    </property>
</configuration>

最后启动资源管理器查看结果:

$ ./sbin/start-yarn.sh
$ ./sbin/mr-jobhistory-daemon.sh start historyserver		 #查看历史任务
$ jps

当输入jps后显示如下图,则说明启动成功:
在这里插入图片描述
至此,YARN配置成功!

 
 

七、结束

当使用结束时,关闭资源管理器:

$ ./sbin/stop-all.sh
$ ./sbin/mr-jobhistory-daemon.sh stop historyserver
Ubuntu16.04安装Hadoop+Spark+pyspark大数据python开发环境   一,安装jdk1.8.0.144 下载地址:www.oracle.com/technetwork/java/javase/downloads/java-archive-javase8-2177648.html Ubuntu配置jdk运行环境 export HADOOP_HOME=/usr/local/hadoop export CLASSPATH=$($HADOOP_HOME/bin... 阅读详情

相关推荐

使用aconda3-5.1.0(Python3.6.4) 搭建pyspark远程部署

参考:http://ihoge.cn/2018/anacondaPyspark.html 前言 首次安装的环境搭配是这样的: jdk8 hadoop2.6.5 spark2.1 scala2.12.4 Anaconda3-5.1.0 一连串的报错让人惊喜无限,尽管反复调整配置始终无法解决。 坑了一整天后最后最终发现是版本不兼容!!再次提醒自己一定要...

机器学习算法 3361

Hadoop 2.6 集群搭建从零开始之2 JDK1.8安装

使用ppa/源方式安装1.添加ppasudo add-apt-repository ppa:webupd8team/java sudo apt-get update2.2.安装oracle-java-installer    sudo apt-get install oracle-java8-installersudo update-java-alternatives -s java-8-ora...

陈杰 1609

UbuntuHadoop的单机安装

云计算实验中要求我们在Linux系统安装Hadoop,故来做一个简单的记录。 Hadoop安装步骤如下: 一、更新apt安装vim编辑器 二、配置本机无密码登录SSH 三、安装JAVA环境 四、下载安装Hadoop ...

weixin_46203911的博客 6866

Hadoop2.6+jdk8安装部署(1)——使用jar包安装部署【详细】

2019独角兽企业重金招聘Python工程师标准>>> ...

weixin_34262482的博客 349

Hadoop编译安装

1.准备好对应的软件1.1 Hadoop-2.6.0-cdh5.7.0-src.tar.gz1.2 jdk-7u80-linux-x64.tar.gz 必须是1.7版本的jdk1.8的一...

mm_ren的博客 436

转贴:1795的错误 in exists的性能

http://www.blogjava.net/unilobster/articles/294167.html ORA-01795,inexists性能 今天,客户那边出来一个问题,出现"ORA-01795:列表中...

cuiganglan0701的博客 440

Ubuntu22.04 Hadoop3.3.4 jdk18.02 安装配置

Ubuntu22.04 Hadoop3.3.4 jdk18.02 安装配置

qq_47767419的博客 3601

ubuntu单机版搭建hadoop环境笔记

2019独角兽企业重金招聘Python工程师标准>>> ...

weixin_34008784的博客 101

Ubuntu16.04下Hive的安装配置

Ubuntu16.04下Hive的安装配置 一、系统环境 os : Ubuntu 16.04 LTS 64bit jdk : 1.8.0_161 hadoop : 2.6.4mysql : 5.7.21 hive : 2.1.0配置Hive之前,要先配置Hadoop。 二、安装步骤 1安装配置MySQL 1.1 安装MySQL 运行sudo apt-get install mysql-server,安装mysql,安装过程中会有提示输入登录密码。 启动my...

weixin_56936835的博客 1306

spark1.6.0伪分布式搭建

环境:   hadoop2.6.0   jdk1.8   ubuntu 14.04 64位 1 安装scala环境 版本是scala-2.10.6,官网下载地址http://www.scala-lang.org/download/ 然后配置scala的环境变量:sudo vim /etc/profile export SCALA_HOME=/usr/scala/scal...

baixiao9898的博客 163

ubuntu系统的mysql+hadoop+hive环境搭建

$ mkdir /usr/lib/jvm #创建jvm文件夹 $ sudo tar zxvf jdk-7u80-linux-x64.tar.gz -C /usr/lib #/ 解压到/usr/lib/jvm目录下 $ cd /usr/lib/jvm #进入该目录 $ mv jdk1.7.0_80 java #重命名为java $ vi

chenyh_csdn的博客 2051

hbase的安装配置

实验1 hbase的安装配置安装配置hbase二.实验目的:掌握hbase的本地安装,伪分布模式,完全分布模式的安装配置三.实验原理:安装hbase分以下三种模式:本地安装:不需要hdfs,文件保存在linux的文件系统中伪分布模式:需要hdfs全分布模式:需要hdfs操作系统:ubuntu 16.04Hadoop: hadoop2.6.5或其他2.x的版本Hbase:hbase-1.7.1安装包名称为hbase-1.7.1-bin.tar.gz操作系统用户名:hadoop2006024109

m0_57028879的博客 599

云服务器Ubuntu系统搭建Hadoop集群

一、节点环境介绍 服务器:2台腾讯云服务器,一台百度云服务器 操作系统: Ubuntu 16.04.4 LTS Hadoop版本:hadoop-2.7.6 Java版本:1.8.0_191 二、前期准备 为了更好的在Shell中区分三台主机,修改其显示的主机名,执行如下命令 sudo vim /etc/hostname 在master的/etc/hostname中添加如下配置: master...

whason的博客 750

Ubuntu下搭建伪分布式从0开始安装Hive详细教程(从JDK安装Hadoop搭建开始)

Ubuntu下搭建伪分布式从0开始安装Hive详细教程(从JDK安装Hadoop搭建开始)

皮埃尔的博客 8999

Ubuntu16.04下伪分布式环境搭建之hadoop2.6.0jdk1.7、Hbase0.98安装配置

Ubuntu16.04下伪分布式环境搭建之hadoop2.6.0jdk1.7、Hbase0.98安装配置

Rosun 5734

Hadoop 2.6.0安装配置

系统:Ubuntu 14.10,其部署在VMware workstation 11.0.0JDKjdk-7u25-linux-i586.tar.gz Hadoop:hadoop-2.6.0.tar.gz(下载地址:http://mirror.bit.edu.cn/apache/hadoop/common/) Step1:上传安装包        在windows系统预

蔡先生的专栏 8274

ubuntu20.04server下安装hadoop2.8.5

参考UbuntuHadoop安装(全命令行版) 安装环境 项目 名称 版本 电脑硬件 Huwei Matebook X Pro i7-8550U 16G 512G 操作系统 Windows 10 家庭中文版 虚拟机 VMware® Workstation 15 Pro 15.0.0 build-10134415 运行系统 ubuntu 20.04 server 20.04 amd64 Java虚拟机 OpenJDK 1.8.0_252-8u252-b09 H

lyqdy的博客 3794

UbuntuHadoop安装教程

UbuntuHadoop安装教程,Hadoop的单机配置伪分布式安装 教程 本教程采用的是Ubuntu18.04.4+hadoop2.7.7+jdk1.8 创建Hadoop用户 打开命令行终端(ctrl+alt+t),输入如下命令创建hadoop用户:sudo useradd -m hadoop -s /bin/bash 为hadoop用户设置密码:sudo passwd hadoop(连续输入两次) hadoop用户增加管理员权限:sudo adduser hadoop sudo。 apt工具更新

hjseo_seg的博客 7701

Hadoop Linux安装jdk1.8

本文是按照林子雨老师的课程进行安装Hadoop3.1.3需要JDK版本在1.8及以上。需要按照下面步骤来自己手动安装JDK1.8

耶耶猫猫的博客 4489
上一篇: 【学习笔记】Hadoop1:Hadoop的四大模块
MikeXiao_
博客等级 码龄7年 4粉丝 5原创
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值