hadoop套件的安装与配置个人笔记

2024-06-17 00:08

本文主要是介绍hadoop套件的安装与配置个人笔记,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

hadoop的官网

hadoop官网

下载并安装hadoop(本人使用的是2.10.1)

  1. 下载:hadoop2.10.1
  2. 安装:tar -zxvf 解压文件
  3. 在linux 环境下也可以 直接用 wget http地址 的形式下载

配置hadoop及启动

  • 集群最好改动一下hadoop的java配置地址:准备启动 Hadoop 群集,解包下载的 Hadoop 分发。在分发中,编辑文件etc/hadoop/hadoop-env.sh以定义一些参数,如下所示

    # set to the root of your Java installation
    export JAVA_HOME=/usr/java/latest
    
  • 单个机子部署(使用伪分布式)配置:
    修改etc/hadoop/core-site.xml 文件

    <configuration>#配置成hdfs模式<property><name>fs.defaultFS</name><value>hdfs://localhost:9000</value></property>#将生产模式的运行日志生成到指定位置<property><name>hadoop.tmp.dir</name><value>/opt/hadoop/hadoop-2.10.1/data/tmp</value></property>
    </configuration>
    

    修改etc/hadoop/hdfs-site.xml 文件

    <configuration><property><name>dfs.replication</name><value>1</value></property>
    </configuration>
    
  • 第一次启动namenode 一定要格式化(只在第一次启动时需要格式化,其他情况不需要)

    bin/hdfs namenode -format
    
  • 启动namenode

    #启动
    sbin/hadoop-daemon.sh start namenode
    #停止
    sbin/hadoop-daemon.sh stop namenode
    
  • 启动datanode

    #启动
    sbin/hadoop-daemon.sh start datanode
    #停止
    sbin/hadoop-daemon.sh stop datanode
    
  • 启动好之后可以通过服务器ip:50070查看情况

  • 创建文件(需要配置使用hdfs才能用)

    bin/hdfs dfs -mkdir /user
    bin/hdfs dfs -mkdir /user/<username>
    #将输入文件复制到分布式文件系统中
    bin/hdfs dfs -mkdir input
    bin/hdfs dfs -put etc/hadoop/*.xml input
    #运行提供的一些示例
    bin/hadoop jar share/hadoop/mapreduce/hadoop-mapreduce-examples-3.2.1.jar grep input output 'dfs[a-z.]+'
    #检查输出文件:将输出文件从分布式文件系统复制到本地文件系统并检查它们
    bin/hdfs dfs -get output output
    cat output/*
    #或者
    bin/hdfs dfs -cat output/*
    

配置下hadoop的环境

vim /etc/profile#hadoop
export HADOOP_HOME=/home/wj/hadoop2.7.7
export PATH=$HADOOP_HOME/bin:$HADOOP_HOME/sbin:$PATHsource /etc/profile

安装hive

在这里插入图片描述
官网下载相应的包

配置环境(一定要先配置好 hadoop的环境)

vim /etc/profile#hive  
export HIVE_HOME=/usr/local/hive
export PATH=$PATH:$HIVE_HOME/binsource /etc/profile

在这里插入图片描述
建立Hive专用的元数据库

在Hive的conf目录下的文件“hive-site.xml”中增加如下配置
原目录没有,可以vim 创建一个hive-site.xml

<configuration>
<property><name>javax.jdo.option.ConnectionURL</name><value>jdbc:mysql://gz-cdb-73kggk47.sql.tencentcdb.com:63524/hive?createDatabaseIfNotExist=true</value>
</property>
<property><name>javax.jdo.option.ConnectionDriverName</name><value>com.mysql.jdbc.Driver</value>
</property>
<property><name>javax.jdo.option.ConnectionUserName</name><value>root</value>
</property>
<property><name>javax.jdo.option.ConnectionPassword</name><value>ccnfgame001</value>
</property>
</configuration>

把MySQL的JDBC驱动包复制到Hive的lib目录下(略,下载地址:https://dev.mysql.com/downloads/connector/j/)

(驱动包名为:mysql-connector-java-5.1.46-bin.jar)看自己数据库什么版本,就下载什么版本就行了

检查连接 在bin目录下运行以下代码

./schematool -initSchema -dbType mysql

在这里插入图片描述
hive 远程服务 (端口号10000) 启动方式 (Thrift服务)

bin/hive –service hiveserver2 &&表示后台运行)
用java,python等程序实现通过jdbc等驱动的访问hive就用这种起动方式了,这个是程序员最需要的方式了

参考文章

安装spark

官网下载相应的包

scala

配置环境(一定要先配置好 hadoop的环境)

vim /etc/profile#scala
export SCALA_HOME=/home/ubuntu/ljq/hadoopAll/spark/scala-2.12.12
export PATH=$PATH:$SCALA_HOME/binsource /etc/profile

参考地址

这篇关于hadoop套件的安装与配置个人笔记的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1067936

相关文章

jdk1.8的Jenkins安装配置实践

《jdk1.8的Jenkins安装配置实践》Jenkins是一款流行的开源持续集成工具,支持自动构建、测试和部署,通过Jenkins,开发团队可以实现代码提交后自动进行构建、测试,并将构建结果分发到测... 目录Jenkins介绍Jenkins环境搭建Jenkins安装配置Jenkins插件安装Git安装配

python版本切换工具pyenv的安装及用法

《python版本切换工具pyenv的安装及用法》Pyenv是管理Python版本的最佳工具之一,特别适合开发者和需要切换多个Python版本的用户,:本文主要介绍python版本切换工具pyen... 目录Pyenv 是什么?安装 Pyenv(MACOS)使用 Homebrew:配置 shell(zsh

Nginx之https证书配置实现

《Nginx之https证书配置实现》本文主要介绍了Nginx之https证书配置的实现示例,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一起... 目录背景介绍为什么不能部署在 IIS 或 NAT 设备上?具体实现证书获取nginx配置扩展结果验证

springboot3.x使用@NacosValue无法获取配置信息的解决过程

《springboot3.x使用@NacosValue无法获取配置信息的解决过程》在SpringBoot3.x中升级Nacos依赖后,使用@NacosValue无法动态获取配置,通过引入SpringC... 目录一、python问题描述二、解决方案总结一、问题描述springboot从2android.x

Python中Request的安装以及简单的使用方法图文教程

《Python中Request的安装以及简单的使用方法图文教程》python里的request库经常被用于进行网络爬虫,想要学习网络爬虫的同学必须得安装request这个第三方库,:本文主要介绍P... 目录1.Requests 安装cmd 窗口安装为pycharm安装在pycharm设置中为项目安装req

nginx跨域访问配置的几种方法实现

《nginx跨域访问配置的几种方法实现》本文详细介绍了Nginx跨域配置方法,包括基本配置、只允许指定域名、携带Cookie的跨域、动态设置允许的Origin、支持不同路径的跨域控制、静态资源跨域以及... 目录一、基本跨域配置二、只允许指定域名跨域三、完整示例四、配置后重载 nginx五、注意事项六、支持

windows下安装Nginx全过程

《windows下安装Nginx全过程》文章介绍了HTTP和反向代理服务器的概念,包括正向代理和反向代理的区别,并详细描述了如何安装和配置Nginx作为反向代理服务器... 目录概念代理正向代理反向代理安装基本属性nginx.conf查询结构属性使用运行重启停止总结概念是一个高性能的HTTP和反向代理we

Spring配置扩展之JavaConfig的使用小结

《Spring配置扩展之JavaConfig的使用小结》JavaConfig是Spring框架中基于纯Java代码的配置方式,用于替代传统的XML配置,通过注解(如@Bean)定义Spring容器的组... 目录JavaConfig 的概念什么是JavaConfig?为什么使用 JavaConfig?Jav

Spring Boot Interceptor的原理、配置、顺序控制及与Filter的关键区别对比分析

《SpringBootInterceptor的原理、配置、顺序控制及与Filter的关键区别对比分析》本文主要介绍了SpringBoot中的拦截器(Interceptor)及其与过滤器(Filt... 目录前言一、核心功能二、拦截器的实现2.1 定义自定义拦截器2.2 注册拦截器三、多拦截器的执行顺序四、过

springboot的controller中如何获取applicatim.yml的配置值

《springboot的controller中如何获取applicatim.yml的配置值》本文介绍了在SpringBoot的Controller中获取application.yml配置值的四种方式,... 目录1. 使用@Value注解(最常用)application.yml 配置Controller 中