搭建单机hadoop并运行自带的分词jar包

阅读量：753 次

发布时间：2019-03-22

本文共 2548 字，大约阅读时间需要 8 分钟。

安装单机Hadoop环境（JDK、Tomcat）

前期准备

网络配置

配置IP地址并访问外网

确保虚拟机网卡配置正确，通过 uniformsorus注入图片Promise检查网络IP地址，并验证能够正常ping外网服务器。

设置主机名和DNS解析

修改主机名为hadoop，并在/etc/hosts文件中添加记录：

hostname hadoopvi /etc/hosts

示例内容：

127.0.0.1 localhost172.24.48.10 hadoop

禁用防火墙和SELINUX

禁用CentOS的防火墙：

systemctl stop firewalldsystemctl disable firewalld

禁用SELINUX：

vi /etc/sysconfig/selinuxSELINUX=disabled

安装JDK和Hadoop

1. 创建部署目录

cd /usr/libmkdir javacd /usr/localmkdir soft

2. 取压并解压文件

cd /usr/local/soft/tar -zxvf jdk-8u171-linux-x64.tar.gz -C /usr/local/javatar -zxvf hadoop-2.7.3.tar.gz -C /usr/local/ hadoop

3. 配置环境变量

vi /etc/profile

在文件末尾添加：

JAVA_HOME=/usr/local/java/jdk1.8.0_171export PATH=$PATH:$JAVA_HOME/binHADOOP_HOME=/usr/local/hadoopexport PATH=$PATH:$HADOOP_HOME/bin:$HADOOP_HOME/sbin

应用修改：

source /etc/profile

4. 验证JDK环境

java -version

输出示例：

java version "1.8.0_171"

配置Hadoop生态系统

1. 修改核心配置文件

修改hadoop-env.sh：

vi hadoop-env.sh

添加：

export JAVA_HOME=/usr/local/java/jdk1.8.0_171

修改core-site.xml：

vi core-site.xml

添加内容：


        
             
      
       fs.defaultFS
              
      
       hdfs://hadoop:9000
          
         
             
      
       hadoop.tmp.dir
              
      
       /opt/hadoop/tmp

修改hdfs-site.xml：

vi hdfs-site.xml

添加内容：


        
             
      
       dfs.replication
              
      
       1

修改mapred-site.xml：

mv mapred-site.xml.template mapred-site.xmlvi mapred-site.xml

添加内容：


        
             
      
       mapreduce.framework.name
              
      
       yarn

修改yarn-site.xml：

vi yarn-site.xml

添加内容：


        
             
      
       yarn.resourcemanager.hostname
              
      
       hadoop
          
         
             
      
       yarn.nodemanager.aux-services
              
      
       mapreduce_shuffle

启动与测试

1. 格式化HadoopNameNode

hdfs namenode -format

2. 启动Hadoop

cd /usr/local/hadoop/bin/'start-all.sh

查看进程：

jps

输出示例：

9798 SecondaryNameNode9943 ResourceManager9528 NameNode9646 DataNode10318 Jps10223 NodeManager

3.词存测试

hadoop fs -mkdir /userhadoop fs -put /opt/example-wordcount.txt /user/input/hdfs dfs -ls /user/input/

运行MapReduce任务：

hadoop jar /opt/hadoop/share/hadoop/mapreduce/hadoop-mapreduce-examples-2.7.3.jar wordcount /user/input/example-wordcount.txt /user/input/wordcount-result

查看任务日志：

tail -f /tmp/hadoop/mapreduce/mapred*log

安装并启动Tomcat

1. 解压缩并部署

tar -zxvf apache-tomcat-10.0.5.tar.gz -C /optmv apache-tomcat-10.0.5/ tomcat10

2. 启动Tomcat

cd /opt/tomcat10/bin/./startup.sh

查看启动日志：

tail -f /opt/tomcat10/conf Catalina.out

转载地址：http://xchwk.baihongyu.com/

你可能感兴趣的文章

Plotly-Dash 存在未知问题并创建“加载依赖项时出错“；通过使用 Python-pandas.date_range

查看>>

Plotly-Dash:如何过滤具有多个数据框列的仪表板?

查看>>

Plotly:如何为 x 轴上的时间序列设置主要刻度线/网格线的值?

查看>>

Plotly:如何从 x 轴删除空日期?

查看>>

Plotly:如何从单条迹线制作堆积条形图?

查看>>

Plotly:如何以 Root 样式绘制直方图，仅显示直方图的轮廓?

查看>>

Plotly:如何使用 Plotly Express 组合散点图和线图?

查看>>

Plotly:如何使用 plotly.graph_objects 和 plotly.express 定义图形中的颜色?

查看>>

Plotly:如何使用 Python 对绘图对象条形图进行颜色编码?

查看>>

Plotly:如何使用 updatemenus 更新一个特定的跟踪?

查看>>

Plotly:如何使用长格式或宽格式的 pandas 数据框制作线图?

查看>>

Plotly:如何向烛台图添加交易量

查看>>

Plotly:如何在 plotly express 中找到趋势线的系数?

查看>>

Plotly:如何在桑基图中设置节点位置?

查看>>

pm2 start命令中的json格式详解

查看>>

pm2启动报错

查看>>

pm2通过配置文件部署nodejs代码到服务器