Hadoop core-site.xml 配置项清单

金霄

2023-12-01

清单中涉及的专业词语使用如下简称

NN:NameNode

DN:DataNode

SNN:SecondaryNameNode

属性

值

说明

fs.default.name

hdfs://master:9000

定义master的URI和端口

fs.checkpoint.dir

${hadoop.tmp.dir}(默认)
/dfs/namesecondary

SNN的元数据以,号隔开,hdfs会把元数据冗余复制到这些目录，一般这些目录是不同的块设备，不存在的目录会被忽略掉

fs.checkpoint.period

1800

定义ND的备份间隔时间，秒为单位，只对SNN效，默认一小时

fs.checkpoint.size

33554432

以日志大小间隔做备份间隔，只对SNN生效，默认64M

fs.checkpoint.edits.dir

${fs.checkpoint.dir}(默认)

SNN的事务文件存储的目录,以,号隔开,hdfs会把事务文件冗余复制到这些目录

fs.trash.interval

10800

HDFS垃圾箱设置，可以恢复误删除，分钟数，0为禁用，添加该项无需重启hadoop

hadoop.tmp.dir

/tmp/hadoop

临时文件夹，指定后需将使用到的所有子级文件夹都要手动创建出来，否则无法正常启动服务。

hadoop.http.filter.initializers

org.apache.hadoop.security.
AuthenticationFilterInitializer
(排版调整，实际配置不要回车)

需要jobtracker,tasktracker
NN,DN等http访问端口用户验证使用，需配置所有节点

hadoop.http.authentication.type

simple | kerberos | #AUTHENTICATION_HANDLER_CLASSNAME#

验证方式，默认为简单，也可自己定义class,需配置所有节点

hadoop.http.authentication.token.validity

36000

验证令牌的有效时间,需配置所有节点

hadoop.http.authentication.signature.secret

默认可不写参数

默认不写在hadoop启动时自动生成私密签名,需配置所有节点

hadoop.http.authentication.cookie.domain

domian.tld

http验证所使用的cookie的域名，IP地址访问则该项无效，必须给所有节点都配置域名才可以。

hadoop.http.authentication. simple.anonymous.allowed

true | false

简单验证专用，默认允许匿名访问，true

hadoop.http.authentication.kerberos.principal

HTTP/localhost@$LOCALHOST

Kerberos验证专用，参加认证的实体机必须使用HTTP作为K的Name

hadoop.http.authentication.kerberos.keytab

/home/xianglei/hadoop.keytab

Kerberos验证专用，密钥文件存放位置

hadoop.security.authorization

true|false

Hadoop服务层级验证安全验证，需配合hadoop-policy.xml使用，配置好以后用dfsadmin,mradmin -refreshServiceAcl刷新生效

hadoop.security.authentication

simple | kerberos

hadoop本身的权限验证，非http访问，simple或者kerberos

hadoop.logfile.size

1000000000

设置日志文件大小，超过则滚动新日志

hadoop.logfile.count

最大日志数

io.bytes.per.checksum

1024

每校验码所校验的字节数，不要大于io.file.buffer.size

io.skip.checksum.errors

true | false

处理序列化文件时跳过校验码错误，不抛异常。默认false

io.serializations

org.apache.hadoop.io.serializer.WritableSerialization

序列化的编解码器

io.seqfile.compress.blocksize

1024000

块压缩的序列化文件的最小块大小，字节

io.compression.codecs

org.apache.hadoop.io.compress.DefaultCodec,
com.hadoop.compression.lzo.LzoCodec,
com.hadoop.compression.lzo.LzopCodec,
org.apache.hadoop.io.compress.GzipCodec,
org.apache.hadoop.io.compress.BZip2Codec,

org.apache.hadoop.io.compress.SnappyCodec
(排版调整，实际配置不要回车)

Hadoop所使用的编解码器，gzip、bzip2为自带，lzo需安装hadoopgpl或者kevinweil，逗号分隔。
snappy需要单独安装并修改hadoop-env.sh配置LD_LIBRARY_PATH=snappy类库位置

io.compression.codec.lzo.class

com.hadoop.compression.lzo.LzoCodec

LZO所使用的压缩编码器

io.file.buffer.size

131072

用作序列化文件处理时读写buffer的大小

webinterface.private.actions

true | false

设为true，则JT和NN的tracker网页会出现杀任务删文件等操作连接，默认是false

topology.script.file.name

/hadoop/bin/RackAware.py

机架感知脚本位置

topology.script.number.args

1000

机架感知脚本管理的主机数，IP地址

Hadoop core-site.xml 配置项清单

相关阅读

相关文章

相关问答

相关文档