AI导航网

技术频道

公众号推荐

微信公众号搜"智元新知"关注
微信扫一扫可直接关注哦！

Hadoop 学习笔记(1)

时间：2022-09-04分类：Hadoop作者：编程之家原文地址

搭建 Hadoop 分布式集群

云平台

1、了解云平台

大数据平台软件需要部署在云平台提供的服务器主机上，云计算是大数据的坚实基础。

2、安装 VMWare 软件

在电脑中安装 VMWare，进而虚拟化出 3 台独立的物理主机，这样可以搭建 Hadoop 分布式集群环境。

一台或两台服务器无法组成集群，集群至少需要三台服务器。

安装 CentOS 6

大数据处理的数据一般来自于企业内部的服务器，而其服务器所用的操作系统大多是 Linux 系统，所以建议选择 Linux 操作系统，将它作为每个虚拟机的操作系统，这里选择 CentOS。

安装 CentOS6

(1) 打开 VMWare，单击【文件】-【新建虚拟机】，可以通过 VMWare 新建虚拟机

(2) 选择【典型】，点击下一步

(3) 选择【安装程序光盘映像文件】，选择指定的 CentOS 系统的 .iso 文件，点击【下一步】

(4) 填写一些信息，单击【下一步】

这里的全名指的是 Linux 操作系统的全称，可以随便取。用户名，指的是在服务器安装 Linux 系统时需要指定一个默认的用户，随后通过这个默认的用户名才能登录操作系统。

(5) 填写虚拟机名称，选择安装位置，单击【下一步】

这里要为即将创建的虚拟机起名，这个名字很重要，我们将其起名为 HadoopMaster。

Hadoop 分布式集群架构是主从架构，所以有主节点和从节点。为了从名字上区分主从，更好地使用集群，主节点一般叫做 HadoopMaster，从节点一般叫做 HadoopSlave 和 HadoopSlave1.

(6) 最大磁盘大小最好适当调大为 30 及以上，单击【下一步】

(7) 使用默认值，单击【完成】

(8) 等待安装完成，系统会自动重启

(10) 输入密码，登录系统

至此，CentOS 7 系统安装完毕。

克隆 HadoopSlave 和 HadoopSlave1

1、关闭 HadoopMaster 服务器，在该节点单击鼠标右键，选择【管理】-【克隆】选项

2、保持界面中的默认选项，单击【下一步】

3、选择【创建完整克隆】，单击【下一步】

4、将虚拟机重命名为 HadoopSlave，并选一个存储位置，单击【完成】

5、等待系统完成克隆

6、按照刚才克隆 HadoopSlave 的方式，再克隆一台 HadoopSlave1 的服务器。

版权声明：本文内容由互联网用户自发贡献，该文观点与技术仅代表作者本人。本站仅提供信息存储空间服务，不拥有所有权，不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容，请发送邮件至 [email protected] 举报，一经查实，本站将立刻删除。

相关推荐

hadoop day2-搭建

hadoop搭建准备工作三台虚拟机：master、node1、node2检查时间是否同步：date检查java的jdk是否被安装好：java-version修改主机名三台分别执行vim/etc/hostname并将内容指定为对应的主机名关闭防火墙：systemctlst...

作者：编程之家时间：2022-11-24

Hadoop 二十三

文件的更名和移动: 获取文件详细信息遇到的问题：不能直接在web上上传文件。权限问题：修改后即可正常创建参考：https://blog.csdn.net/weixin_44575660/article/details/118687993

作者：编程之家时间：2022-11-24

大数据Hadoop之——HDFS小文件问题与处理实战操作

目录一、背景1）小文件是如何产生的？2）文件块大小设置3）HDFS分块目的二、HDFS小文件问题处理方案1）HadoopArchive（HAR）2）Sequencefile3）CombineFileInputFormat4）开启JVM重用5）合并本地的小文件，上传到HDF...

作者：编程之家时间：2022-10-19

大数据Hadoop之——Hadoop HDFS多目录磁盘扩展与数据平衡实战操作

目录一、概述二、HadoopDataNode多目录磁盘配置1）配置hdfs-site.xml2）配置详解1、dfs.datanode.data.dir2、dfs.datanode.fsdataset.volume.choosing.policy3、dfs.datanode.available-space-volume-choosing-polic...

作者：编程之家时间：2022-10-19

平台搭建伪分布式

平台搭建（伪分布式）伪分布式搭建在VM中搭建std-master修改配置文件centos7-cl1.vmdkstd-master.vmx-将配置文件中vm的版本号改成自己电脑对应的vm版本修改客户端的操作系统为centos764位打开虚拟机修改虚拟机网络cd...

作者：编程之家时间：2022-10-13

Harley浅谈HadoopHDFS

一、HDFS概述 1.1、HDFS产出背景及定义 1.1.1、HDFS产生背景随着数据量越来越大，在一个操作系统存不下所有的数据，那么就分配到更多的操作系统管理的磁盘中，但是不方便管理和维护，迫切需要一种系统来管...

作者：编程之家时间：2022-10-13

配置workers进入hadoop/etc/hadoop 编辑workers文件然后分发给另外两个服务器准备启动集群第一次需要初始化. 初始化完成后增加了data文件，进入上面那个路径，就能看到当前服务器的版本号 ...

作者：编程之家时间：2022-10-13

第六周总结8.13

这周我对ssm框架进行了更深一步的开发，加入了多用户，并对除登录外的请求进行了拦截，这样用户在未登录的时候是访问不到资源的。并且对hadoop进行了初步的学习，包括虚拟机的安装等等。下周会对hadoop进行更深一步的...

作者：编程之家时间：2022-10-13

安装Hadoop2.10.1

前言通过在Hadoop1安装Hadoop,然后配置相应的配置文件，最后将Hadoop所有文件同步到其他Hadoop节点。一、集群规划#主机名‘master/hadoop1’‘slave01/hadoop2’‘slave02/hadoop3’#启动节点NamenodeNodemanagerNod...

作者：编程之家时间：2022-10-13

集群崩溃处理

1.先杀死进程（先进入到hadoop版本文件里，我的是/opt/module/hadoop-3.1.3/）sbin/stop-dfs.sh2.删除每个集群上的data以及logsrm-rfdata/logs/3.格式化hdfsnamenode-format4.再启动sbin/sart-dfs.sh

作者：编程之家时间：2022-10-13