namenode_草庐IT

Hadoop 之 HDFS

1HDFS概述1.1HDFS产出背景及定义随着数据量越来越大，在一个操作系统存不下所有的数据，那么就分配到更多的操作系统管理的磁盘中，但是不方便管理和维护，迫切需要一种系统来管理多台机器上的文件，这就是分布式文件管理系统。HDFS只是分布式文件管理系统中的一种。HDFS（HadoopDistributedFileSystem），它是一个文件系统，用于存储文件，通过目录树来定位文件；其次，它是分布式的，由很多服务器联合起来实现其功能，集群中的服务器有各自的角色。HDFS的使用场景：适合一次写入，多次读出的场景，且不支持文件的修改。适合用来做数据分析，并不适合用来做网盘应用。1.2HDFS优缺点优

Hadoop1.x和2.X的HDFS fsimage和edits文件运行机制对比

一、概述之前写过一篇非常详细的,利用QJM在HDFS2.0部署HA策略的文章，主要说了利用QJM进行HA部署以及其原理（http://zengzhaozheng.blog.51cto.com/8219051/1441170 ）。但是，其中没有详细描述HADOOP2.x通过QJM部署HA完毕之后，ActiveNamenode和StandbyNamenode之间的元数据运行机制,实际上由于2.x的HA策略的引入，其元数据的运行机制和1.x比起来已经有了很大的不同。写这篇blog的目的主要是为了对hadoop1.x和hadoop2.x的元数据运行机制进行比较，当是自己的笔记吧。二、fsp_w

Hadoop1 fsimage nbsp NameNode fsp_w_picpath hadoop edits hadoopHa hadoop2.xHadoop 大数据

Hadoop 名称节点无法在 OSX 上运行(错误 org.apache.hadoop.hdfs.server.namenode.NameNode : java.net.SocketException:权限被拒绝)

SocketException NameNode hadoop apache