Hadoop之NameNode Federation图文详解-6ren

Hadoop之NameNode Federation图文详解

转载作者：qq735679552 更新时间：2022-09-28 22:32:09

26

4

CFSDN坚持开源创造价值，我们致力于搭建一个资源共享平台，让每一个IT人在这里找到属于你的精彩世界.

这篇CFSDN的博客文章Hadoop之NameNode Federation图文详解由作者收集整理，如果你对这篇文章有兴趣，记得点赞哟.

一. 前言。

1.namenode架构的局限性。

（1）namespace（命名空间）的限制。

由于namenode在内存中存储所有的元数据（metadata），因此单个namenode所能存储的对象（文件+块）数目受到namenode所在jvm的heap size的限制。50g的heap能够存储20亿（200million）个对象，这20亿个对象支持4000个datanode，12pb的存储（假设文件平均大小为40mb）。随着数据的飞速增长，存储的需求也随之增长。单个datanode从4t增长到36t，集群的尺寸增长到8000个datanode。存储的需求从12pb增长到大于100pb.

（2）隔离问题。

由于hdfs仅有一个namenode，无法隔离各个程序，因此hdfs上的一个实验程序就很有可能影响整个hdfs上运行的程序.

（3）性能的瓶颈。

由于是单个namenode的hdfs架构，因此整个hdfs文件系统的吞吐量受限于单个namenode的吞吐量.

2.hdfs federation架构设计，如图所示。

能不能有多个namenode 。

Hadoop之NameNode Federation图文详解

hdfs federation架构设计。

二.实现。

namenode ha是为了解决namenode可用性的问题，而namenode federation则主要是为了解决namenode扩展性，隔离性，以及单个namenode性能方面的问题。namenode federation架构如下:

Hadoop之NameNode Federation图文详解

namenode federation使用了多个命名空间，这些命名空间互相独立，自制（其实是对元数据的水平切分），而集群中所有datanode向所有namenode都进行注册，而一个块池（block pool）有属于同一个命名空间的数据块组成，每个datanode可能会存储集群中所有块池的数据块，每个块池互相独立，有一个挂掉了也不会影响其他块池正常工作.

同时部署了namenode ha和namenode federation时，集群结构会相对复杂一点，如下图。在实际的生成环境中，namenode ha几乎是必备，而当集群规模在1000台以下时，几乎是不需要namenode federation的.

Hadoop之NameNode Federation图文详解

总结。

以上就是这篇文章的全部内容了，希望本文的内容对大家的学习或者工作具有一定的参考学习价值，谢谢大家对我的支持。如果你想了解更多相关内容请查看下面相关链接。

原文链接：https://blog.csdn.net/qq_43193797/article/details/85078422 。

最后此篇关于Hadoop之NameNode Federation图文详解的文章就讲到这里了,如果你想了解更多关于Hadoop之NameNode Federation图文详解的内容请搜索CFSDN的文章或继续浏览相关文章，希望大家以后支持我的博客！。

26

4

0

文章推荐： SpringBoot使用@SpringBootTest注解开发单元测试教程

文章推荐： spring boot配置druid连接池的完整步骤

文章推荐： SpringBoot如何使用RequestBodyAdvice进行统一参数处理

文章推荐： java实现微信支付结果通知

jstat 详解
全称“Java Virtual Machine statistics monitoring tool”（statistics 统计；monitoring 监控；tool 工具）用于监控虚拟机的各种运
MongoDB索引操作和执行计划Explain()详解
主要是讲下Mongodb的索引的查看、创建、删除、类型说明，还有就是Explain执行计划的解释说明。可以转载，但请注明出处。
Linux下几种并发服务器的实现模式(详解)
1>单线程或者单进程相当于短链接，当accept之后，就开始数据的接收和数据的发送，不接受新的连接，即一个server，一个client 不存在并发。 2>循环服务器和并发服务器
详解 Linux中的关机和重启命令
详解 linux中的关机和重启命令一 shutdown命令 shutdown [选项] 时间选项： ?
用Newtonsoft将json串转为对象的方法(详解)
首先，将json串转为一个JObject对象： ? 1
Python画图常用命令大全(详解)
matplotlib官网 matplotlib库默认英文字体添加黑体（‘SimHei'）为绘图字体代码： plt.rcParams['font.sans-serif']=['SimHei'
Java中的关键字synchronized 详解
在并发编程中，synchronized关键字是常出现的角色。之前我们都称呼synchronized关键字为重量锁，但是在jdk1.6中对synchronized进行了优化，引入了偏向锁、轻量锁。本篇
详解.NET数据库连接池
一般我们的项目中会使用1到2个数据库连接配置，同程艺龙的数据库连接配置被收拢到统一的配置中心，由DBA统一配置和维护，业务方通过某个字符串配置拿到的是Connection对象。
linux下gettimeofday函数windows替换方法(详解)
实例如下： ? 1
详解.Net缓存之MemoryCahe
1. MemoryCahe NetCore中的缓存和System.Runtime.Caching很相似，但是在功能上做了增强，缓存的key支持object类型；提供了泛型支持；可以读缓存和单个缓存
Javascript基础教程之argument 详解
argument是javascript中函数的一个特殊参数，例如下文，利用argument访问函数参数，判断函数是否执行复制代码代码如下: <script
linux中了minerd之后的完全清理过程(详解)
一不小心装了一个Redis服务，开了一个全网的默认端口，一开始以为这台服务器没有公网ip，结果发现之后悔之莫及啊某天发现cpu load高的出奇，发现一个minerd进程占了大量cpu，googl
基于php编程规范(详解)
今天写这个是为了提醒自己编程过程不仅要有逻辑思想还有要规范代码这样可读性 1、PHP 编程规范与编码习惯最主要的有以下几点： 1 文件说明 2 funct
使用yum查看工具lspci所在包并安装的方法(详解)
摘要：虚拟机安装时一般都采用最小化安装，默认没有lspci工具。一台测试虚拟网卡性能的虚拟机，需要lspci工具来查看网卡的类型。本文描述了在一个虚拟机中安装lspci工具的具体步骤。由于要测试
Linux下高并发socket最大连接数所受的各种限制(详解)
1、修改用户进程可打开文件数限制在Linux平台上，无论编写客户端程序还是服务端程序，在进行高并发TCP连接处理时，最高的并发数量都要受到系统对用户单一进程同时可打开文件数量的限制(这是因为系统
一篇文章带你入门java运算符(详解)
目录算术运算符基本四则运算符增量赋值运算符自增/自减运算符关系运算符逻
PHP面向对象之事务脚本模式(详解)
如下所示： ? 1
详解 MapperScannerConfigurer之sqlSessionFactory注入方式
MapperScannerConfigurer之sqlSessionFactory注入方式讲解首先，Mybatis中的有一段配置非常方便，省去我们去写DaoImpl（Dao层实现类）的时间，这个
详解：Linux网络虚拟化技术
Linux的网络虚拟化是LXC项目中的一个子项目，LXC包括文件系统虚拟化，进程空间虚拟化，用户虚拟化，网络虚拟化，等等，这里使用LXC的网络虚拟化来模拟多个网络环境。本文从基本的网络设备讲
highchart数据源纵轴json内的值必须是int(详解)
? 1

首页

博学

6Ren·AI

商城

Hadoop之NameNode Federation图文详解