Hadoop 2.2.0 单节点安装

开发者福利!热门AI工具限时免费用 购周边即赠Coding Plan Lite,Claude Code、Cursor等20+工具畅享,效率翻倍! 阅读详情

Hadoop 2.2.0已经发布,网上有很多教程说明安装的过程,不过总有些问题存在……这里把我安装的过程分享一下。

建议采用Ubuntu 12.04.3 LTS Server x64版本或者其他长期支持版本。

另外,如果是虚拟机环境,使用32位版本的Ubuntu即可。

建议在安装前,将系统升级到最新:

$sudo apt-get update
$sudo apt-get upgrade

准备工作

java

建议采用Oracle Java JDK6以上版本。

$chmod 755 jdk-7u45-linux-x64.bin
./jdk-7u45-linux-x64.bin
mvjdk1.7.0_45 /opt

则JAVA_HOME地址可以如下配置,在/etc/profile中修改:

$ sudo vim /etc/profile
在末尾加入:
export JAVA_HOME=/opt/jdk1.7.0_45
export JRE_HOME=$JAVA_HOME/jre
export CLASSPATH=$CLASSPATH:$JAVA_HOME/lib:$JRE_HOME/lib
export PATH=$PATH:$JAVA_HOME/bin
注:如果是32位的Linux,请安装jdk-7u45-linux-i58632Java

hadoop 2.2.0

从Apache官方可以下载到Hadoop 2.2.0的发布代码,或者在CNNIC下载:
http://mirrors.cnnic.cn/apache/hadoop/common/hadoop-2.2.0/hadoop-2.2.0.tar.gz
CNNIC相对速度较快。附件中也提供该文件的下载。

Hadoop路径配置

建议将Hadoop安装在/opt下,所以将/opt的属主修改为实际用户(本文以cloud用户为例):
$sudo chown cloud:cloud /opt
然后将下载的压缩包解压并放到/opt下:

$ tar xzvf hadoop-2.2.0.tar.gz
$ mv hadoop-2.2.0 /opt
然后建议使用软连接:

$ ln -s /opt/hadoop-2.2.0 /opt/hadoop

ssh本地互通

配置公钥,使用默认配置即可:

$ sshgen
$ cd ~/.ssh
$ cat id_rsa.pub >> authorized_keys

然后执行以下命令:

$ ssh localhost
首次连接需要输入yes确认,之后每次执行上述ssh命令应当不用输入密码。

全局变量

在/etc/profile的末尾加入:

export HADOOP_HOME=/opt/hadoop
export PATH=$PATH:$HADOOP_HOME/bin:$HADOOP_HOME/sbin

确保可以在任意位置执行hadoop命令。

然后将配置文件启用:

$ source /etc/profile

目录配置

创建Hadoop的数据存储目录,并修改属主权限:

$ sudo mkdir /hadoop
$ sudo chown cloud:cloud /hadoop
$ mkdir /hadoop/dfs
$ mkdir /hadoop/tmp

配置Hadoop

配置hadoop-env.sh

修改hadoop-env.sh文件:

$ cd /opt/hadoop/etc/hadoop
$ vim hadoop-env.sh

将默认的JAVA_HOME修改为:

export JAVA_HOME=/opt/jdk1.7.0_45

配置core-site.xml

修改core-site.xml文件:

$cd /opt/hadoop/etc/hadoop
$vim core-site.xml

<configuration>标签中(即嵌套在该标签中)加入以下内容:

<property>
  <name>hadoop.tmp.dir</name>
  <value>/hadoop/tmp</value>
  <description>temporary directories.</description>
</property>
<property>
  <name>fs.defaultFS</name>
  <value>hdfs://192.168.1.100:9000</value>
  <description>The name of the defaultfile system. Either the literal string "local" or a host:port forNDFS.
  </description>
  <final>true</final>
</property>

更多配置信息,参考:

http://hadoop.apache.org/docs/r2.2.0/hadoop-project-dist/hadoop-common/core-default.xml


配置hdfs-site.xml

修改hdfs-site.xml:

$ vim hdfs-site.xml

<configuration>标签中(即嵌套在该标签中)加入以下内容:

<property>
  <name>dfs.namenode.name.dir</name>
  <value>file:/hadoop/dfs/name</value>
  <description>Determineswhere on the local filesystem the DFS name node should store the name table.</description>
  <final>true</final>
</property>

<property>
  <name>dfs.datanode.data.dir</name>
  <value>file:/hadoop/dfs/data</value>
  <description>Determineswhere on the local filesystem an DFS data node should store its blocks.
  </description>
  <final>true</final>
</property>

<property>
  <name>dfs.replication</name>
  <value>1</value>
</property>

<property>
  <name>dfs.permissions</name>
  <value>false</value>
</property>

更多hdfs-site.xml的配置信息,参考:

http://hadoop.apache.org/docs/r2.2.0/hadoop-project-dist/hadoop-hdfs/hdfs-default.xml

配置mapred-site.xml

默认不存在此文件,需要创建:

$ cp mapred-site.xml.template mapred-site.xml
$ vim mapred-site.xml

<configuration>标签中(即嵌套在该标签中)加入以下内容:

<property>
  <name>mapreduce.framework.name</name>
  <value>yarn</value>
</property>

<property>
  <name>mapred.system.dir</name>
  <value>file:/hadoop/mapred/system</value>
  <final>true</final>
</property>

<property>
  <name>mapred.local.dir</name>
  <value>file:/hadoop/mapred/local</value>
  <final>true</final>
</property>

配置yarn-site.xml

执行以下命令:

$ vim yarn-site.xml

<configuration>标签中(即嵌套在该标签中)加入以下内容:

<property>
  <name>yarn.nodemanager.aux-services</name>
  <value>mapreduce_shuffle</value>
  <description>shuffle service that needsto be set for Map Reduce to run </description>
</property>

<property>
  <name>yarn.resourcemanager.hostname</name>
  <value>192.168.1.100</value>
  <description>hostanem of RM</description>
</property>

yarn.resourcemanager.hostname配置后,其他端口号将使用默认。详见:

http://hadoop.apache.org/docs/current/hadoop-yarn/hadoop-yarn-common/yarn-default.xml

初始化

格式化NameNode:

$ hdfs namenode -format

启动DFS

分别按顺序执行以下命令:

$ hadoop-daemon.sh start namenode
$ hadoop-daemon.sh start datanode

使用jps查看进程是否启动:

$ jps

并在以下网页检查:

http://202.117.16.170:50070/dfshealth.jsp

启动Yarn

$ yarn-daemon.sh start resourcemanager
$ yarn-daemon.sh start nodemanager

异常处理

如果发生任何启动异常,关闭进程后,需要清空数据:
$ rm -rf /hadoop/dfs/*
$ rm -rf /hadoop/tmp/*
然后重新执行格式化:
$ hdfs namenode -format
hadoop-common-2.2.0-bin-master.zip hadoop-common-2.2.0-bin-master(包含windows端开发Hadoop和Spark需要的winutils.exe),Windows下IDEA开发Hadoop和Spark程序会报错,原因是因为如果本机操作系统是windows,在程序中使用了hadoop相关的东西,比如写入文件到HDFS,则会遇到异常, 把此文件解压放置在任意目录下,然后在环境变量中配置 系统变量,命名为HADOOP_HOME 即可。 立即下载

相关推荐

基于ubuntu安装Hadoop详细过程

在Mac虚拟机上使用ubuntu安装Hadoop 的详细过程,中科院数据库新技术大作业。

hadoop-common-2.2.0-bin-32.rar

hadoop-common-2.2.0-bin-32.rarhadoop-common-2.2.0-bin-32.rarhadoop-common-2.2.0-bin-32.rarhadoop-common-2.2.0-bin-32.rarhadoop-common-2.2.0-bin-32.rarhadoop-common-2.2.0-bin-32.rarhadoop-common-2.2.0-bin-32.rarhadoop-common-2.2.0-bin-32.rarhadoop-common-2.2.0-bin-32.rarhadoop-common-2.2.0-bin-32.rarhadoop-common-2.2.0-bin-32.rarhadoop-common-2.2.0-bin-32.rarhadoop-common-2.2.0-bin-32.rarhadoop-common-2.2.0-bin-32.rarhadoop-common-2.2.0-bin-32.rarhadoop-common-2.2.0-bin-32.rarhadoop-common-2.2.0-

Hadoop安装教程_单机/伪分布式配置_Hadoop2.7.1/Ubuntu 16.04

Hadoop安装教程_单机/伪分布式配置_Hadoop2.7.1/Ubuntu 16.04

Hadoop各种版本的百度网盘下载

点个赞再走呗 多谢 下载链接:https://www-eu.apache.org/dist/hadoop/common/ 我已经下载了并存放在网盘中,说好的是开源的,结果有的人就是需要给积分才让你下载。充分贯彻开源 链接:https://pan.baidu.com/s/1XvL_jas1yVniE-FNQnZNWg 提取码:8ab2 复制这段内容后打开百度网盘手机App,操作更方便哦 ...

web15870359587的博客 2849

2024年最全ubuntu安装hodoop详细步骤_ubuntu安装hadoop

有这个界面就说明安装成功。然后进行配置java环境变量,使用vim打开配置文件进去之后输入i,进入输入模式,在第一行添加如下内容然后按esc,再输入shift+:进入到末行模式,输入wq保存退出。继续执行如下命令让.bashrc文件生效。

2401_84181309的博客 6764

(初学者强烈推荐)Ubuntu 配置hadoop 超详细教程(全过程)

本文的教程仅为个人的操作经验所写,每个人下载的版本不一样,所以会出现不同的情况异常等,如有问题可询问博主或百度查找解决方法。

记录和分享、 5万+

Hadoop2.2.0单节点安装及测试

Hadoop2.2.0单节点安装及测试 作者:雨水, 日期:2013-10-24CSDN博客:http://blog.csdn.net/gobitan 摘要:本文记录了Hadoop单节点安装过程,并做了基本配置,启动运行和测试了一个单词统计例子。   一:环境准备:基于Windows下的VMware Player4.0.3中的ubuntu12.04-64server. 下载免费的VM

家辉自留地 2万+

CentOS 6.5单节点编译安装hadoop-2.2.0

这几天在琢磨Hadoop,首先是安装Hadoop,在安装过程中出现过不少问题,现在将整个过程总结一下,网络上已经有很多这方面的资料了,但我觉得还是有必要记述一下部分重要安装过程,方便以后发现与解决问题,也希望能给需要的朋友一些参考。 我所用系统是CentOS6.5 64bit,编译安装hadoop-2.2.0hadoop配置为单节点。在ApacheHadoop下载的hadoop-2.2

Stay Hungry.Stay Foolish. 1460

ubuntu上安装hadoop

ubuntu上安装hadoop集群,三个节点

Hadoop 2.6.0单节点安装参考

1.环境说明    本例介绍了hadoop 2.6.0单节点上的分布式安装方法。    在安装Hadoop前,请确保你的机器上已安装了JDK 1.7或更高版本,并配置了SSH无密码登陆本机。如果还没有设置SSH无密码登陆本机,可以通过如下一句长命令搞定:    rm -rf ~/.ssh;ssh-keygen -t rsa;chmod 700 ~/.ssh;more ~/.ssh/id

Jack Zhu 3257

hadoop 2.2.0 单节点安装和测试

本文是详细记录Hadoop 2.2.0 在Mac OSX系统下单节点安装配置启动的详细步骤,并且演示运行一个简单的job。目录结构如下: 基础环境配置 Hadoop安装配置 启动及演示 详见:http://www.micmiu.com/opensource/hadoop/hadoop2x-single-node-setup/     ...

Michael 222

Ubuntu14.04 (x64) 下hadoop2.5.0单节点安装与测试

Ubuntu14.04 (x64) 下hadoop2.5.0单节点安装与测试 详情见原文地址:http://jeyzhang.com/173/ 在Ubuntu14.04(x64)下对hadoop2.5.0源码包进行编译后,就可以进行hadoop安装与配置了。下面介绍一下如何进行hadoop2.5.0单节点安装及测试验证,整个过程很简单,不用担心。 1.  创建用户组和用户 为了便于ha

hechenghai 590

hadoop 2.6.0单节点-伪分布式模式安装

hadoop 2.6.0单节点-伪分布式模式安装 http://www.aboutyun.com/thread-10554-1-1.html

www.hohode.com 522

Hadoop2.6.0 单节点安装

在win7下装了virtual box ,在虚拟机中安装了Ubuntu15.04 参考教程:http://www.powerxing.com/install-hadoop/ 安装步骤: 我在Ubuntu中创建了一个hadoop用户。 $sudo useradd -m hadoop -s /bin/bash  创建了可以登录的Hadoop用户。并使用/bin/bash作为shell sud

wing的专栏 1167
下一篇: Hadoop 2.2.0 libhadoop.so的disabled stack guard问题
focusheart
博客等级 码龄20年 4粉丝 5原创
评论 6
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值