elasticsearch 基本配置

基本配置
elasticsearch的config文件夹里面有两个配置文件：elasticsearch.yml 、logging.yml、jvm.options

第一个是es的基本配置文件，第二个是日志配置文件，es也是使用log4j来记录日志的，所以logging.yml里的设置按普通log4j配置文件来设置就行了。

jvm.options 配置

设置 es 启动内存、这个根据系统配置需要来配置。

# cat jvm.options |grep -v ^$ |grep -v ^#

-Xms30g

-Xmx30g

-XX:+UseConcMarkSweepGC

-XX:CMSInitiatingOccupancyFraction=

-XX:+UseCMSInitiatingOccupancyOnly

-XX:+AlwaysPreTouch

-server

-Xss1m

-Djava.awt.headless=true

-Dfile.encoding=UTF-

-Djna.nosys=true

-Djdk.io.permissionsUseCanonicalPath=true

-Dio.netty.noUnsafe=true

-Dio.netty.noKeySetOptimization=true

-Dio.netty.recycler.maxCapacityPerThread=

-Dlog4j.shutdownHookEnabled=false

-Dlog4j2.disable.jmx=true

-Dlog4j.skipJansi=true

-XX:+HeapDumpOnOutOfMemoryError

elasticsearch.yml 配置：

# elasticsearch.yml

cluster.name: elasticsearch

    //配置es的集群名称，默认是elasticsearch，es会自动发现在同一网段下的es，如果在同一网段下有多个集群，就可以用这个属性来区分不同的集群。

node.name: "node name "

    //节点名，默认随机指定一个name列表中名字，该列表在es的jar包中config文件夹里name.txt文件中，其中有很多作者添加的有趣名字。

node.master: true

    //指定该节点是否有资格被选举成为node，默认是true，es是默认集群中的第一台机器为master，如果这台机挂了就会重新选举master。

node.data: true

    //指定该节点是否存储索引数据，默认为true。

index.number_of_shards:

    //设置默认索引分片个数，默认为5片。

index.number_of_replicas:

    //设置默认索引副本个数，默认为1个副本。

path.conf: /path/to/conf

    //设置配置文件的存储路径，默认是es根目录下的config文件夹。

path.data: /path/to/data

    //设置索引数据的存储路径，默认是es根目录下的data文件夹，可以设置多个存储路径，用逗号隔开，例：

path.data: /path/to/data1,/path/to/data2

path.work: /path/to/work

    //设置临时文件的存储路径，默认是es根目录下的work文件夹。

path.logs: /path/to/logs

    //设置日志文件的存储路径，默认是es根目录下的logs文件夹

path.plugins: /path/to/plugins

    //设置插件的存放路径，默认是es根目录下的plugins文件夹

bootstrap.mlockall: true

    //设置为true来锁住内存。因为当jvm开始swapping时es的效率会降低，所以要保证它不swap，可以把ES_MIN_MEM和 ES_MAX_MEM两个环境变量设置成同一个值，并且保证机器有足够的内存分配给es。同时也要允许elasticsearch的进程可以锁住内存，linux下可以通过`ulimit -l unlimited`命令。

network.bind_host: 192.168.0.1

    //设置绑定的ip地址，可以是ipv4或ipv6的，默认为0.0.0.0。

network.publish_host: 192.168.0.1

    //设置其它节点和该节点交互的ip地址，如果不设置它会自动判断，值必须是个真实的ip地址。

network.host: 192.168.0.1

    //这个参数是用来同时设置bind_host和publish_host上面两个参数。

transport.tcp.port:

    //设置节点间交互的tcp端口，默认是9300。

transport.tcp.compress: true

    //设置是否压缩tcp传输时的数据，默认为false，不压缩。

http.port:

    //设置对外服务的http端口，默认为9200。

http.max_content_length: 100mb

    //设置内容的最大容量，默认100mb

http.enabled: false

    //是否使用http协议对外提供服务，默认为true，开启。

gateway.type: local

    //gateway的类型，默认为local即为本地文件系统，可以设置为本地文件系统，分布式文件系统，Hadoop的HDFS，和amazon的s3服务器。

gateway.recover_after_nodes:

    //设置集群中N个节点启动时进行数据恢复，默认为1。

gateway.recover_after_time: 5m

    //设置初始化数据恢复进程的超时时间，默认是5分钟。

gateway.expected_nodes:

    //设置这个集群中节点的数量，默认为2，一旦这N个节点启动，就会立即进行数据恢复。

cluster.routing.allocation.node_initial_primaries_recoveries:

    //初始化数据恢复时，并发恢复线程的个数，默认为4。

cluster.routing.allocation.node_concurrent_recoveries:

    //添加删除节点或负载均衡时并发恢复线程的个数，默认为4。

indices.recovery.max_size_per_sec:

    //设置数据恢复时限制的带宽，如入100mb，默认为0，即无限制。

indices.recovery.concurrent_streams:

    //设置这个参数来限制从其它分片恢复数据时最大同时打开并发流的个数，默认为5。

discovery.zen.minimum_master_nodes:

    //设置这个参数来保证集群中的节点可以知道其它N个有master资格的节点。默认为1，对于大的集群来说，可以设置大一点的值（2-4）

discovery.zen.ping.timeout: 3s

    //设置集群中自动发现其它节点时ping连接超时时间，默认为3秒，对于比较差的网络环境可以高点的值来防止自动发现时出错。

discovery.zen.ping.multicast.enabled: false

    //设置是否打开多播发现节点，默认是true。

discovery.zen.ping.unicast.hosts: ["host1", "host2:port", "host3[portX-portY]"]

    //设置集群中master节点的初始列表，可以通过这些节点来自动发现新加入集群的节点。

一些查询时的慢日志参数设置：

index.search.slowlog.level: TRACE

index.search.slowlog.threshold.query.warn: 10s

index.search.slowlog.threshold.query.info: 5s

index.search.slowlog.threshold.query.debug: 2s

index.search.slowlog.threshold.query.trace: 500ms

index.search.slowlog.threshold.fetch.warn: 1s

index.search.slowlog.threshold.fetch.info: 800ms

index.search.slowlog.threshold.fetch.debug:500ms

index.search.slowlog.threshold.fetch.trace: 200ms

1.2. 高级配置（线程池）

一个Elasticsearch节点会有多个线程池，但重要的是下面四个：

索引（index）：主要是索引数据和删除数据操作（默认是cached类型）

搜索（search）：主要是获取，统计和搜索操作（默认是cached类型）

批量操作（bulk）：主要是对索引的批量操作（默认是cached类型）

更新（refresh）：主要是更新操作（默认是cached类型）

可以通过给设置一个参数来改变线程池的类型（type），例如，把索引的线程池改成blocking类型：

min: 1

size: 30

wait_time: 30s

下面是三种可以设置的线程池的类型：

cache

cache 线程池是一个无限大小的线程池，如果有很多请求的话都会创建很多线程，下面是个例子：

threadpool:

index:

type: cached

fixed

fixed线程池保持固定个数的线程来处理请求队列。

size参数设置线程的个数，默认设置是cpu核心数的5倍

queue_size可以控制待处理请求队列的大小。默认是设置为-，意味着无限制。当一个请求到来但队列满了的时候，reject_policy参数可以控制它的行为。默认是abort，会使那个请求失败。设置成caller会使该请求在io线程中执行。

threadpool:

index:

type: fixed

size:

queue:

reject_policy: caller

blocking

blocking线程池允许设置一个最小值（min，默认为1）和线程池大小（size，默认为cpu核心数的5倍）。它也有一个等待队列，队列的大小（queue_size ）默认是1000，当这队列满了的时候。它会根据定好的等待时间（wait_time，默认是60秒）来调用io线程，如果超时没有执行就会报错。

threadpool:

index:

type: blocking

min:

size:

wait_time: 30s

在实际工作中，由于程序启动时即产生大量请求，导致队列大小溢出的情况，从而查询请求报错，可以在以下2个解决方法权衡处理：

1、增加队列长度，但随之带来的是CPU消耗高。

2、优化程序，适当控制程序的并发请求量。

1.3. 操作系统配置

1、文件句柄限制：ES在索引过程中，尤其是有很多分片和副本时，会创建若干文件。因此操作系统对打开文件数量的限制不能少于32000。对于linux服务器，通过可以在/etc/security/limits.conf中进行修改，并且可以用ulimit命令来查看当前值。

2、节点内存配置：ES每个节点默认的2014M内存空间可能是不够的。如果日志文件中有out of memory error错误，则应将环境变量ES_HEAP_SIZE设为大于1024的值。注意该值应超过总可用物理内存的50%，剩余内存可用作磁盘高速缓存，可大大提高搜索性能。

1.4 数据转换功能节点（es5.0 以上版本）

在 ES5 中，新增数据转换功能节点（Ingest Nodes），使得ES5本身就可以实现Logstash常用的数据过滤能力，比如data、split、convert、grok等。通过定义管道，实现在索引之前对文档进行预处理。默认情况下，节点自动开启了数据转换功能。数据转换对节点性能有一定的消耗，如需关闭节点的转换功能，可以在配置文件（elasticsearch.yml）中添加node.ingest: false配置。

不配置默认是开启的：

可以关闭
# elasticsearch.yml

　node.ingest: false

注：
elasticsearch 中文指南；
https://es.xiaoleilu.com/
github
https://github.com/elastic/elasticsearch/pulls

elasticsearch 基本配置的更多相关文章

【ElasticSearch】：elasticsearch.yml配置
ElasticSearch5的elasticsearch.yml配置注意 elasticsearch.yml中的配置,冒号和后面配置值之间有空格 cluster.name: my-applicati ...
Elasticsearch 基础理论 & 配置调优
一.简介 ElasticSearch是一个基于Lucene的搜索服务器.它提供了一个分布式多用户能力的全文搜索引擎,基于RESTful web接口.Elasticsearch是用Java开发的,并作为 ...
ElasticSearch 安装配置
1. Elasticsearch5.5.2安装 1.1.Elasticsearch安装步骤 #安装之前需安装java 环境,并配置JAVA_HOME环境变量 #直接下载Elasticsearch- ...
Elasticsearch 安装配置外网访问及后台启动
本文转自http://www.jianshu.com/p/658961f707d8 作者:咪博士感谢咪博士分享 Elasticsearch的安装总体来说还是相当简单的,当然中间也会有些小坑.不过大家 ...
ELK 学习笔记之 elasticsearch elasticsearch.yml配置概述
elasticsearch.yml配置概述: 设置集群名字 cluster.name 定义节点名称 node.name 节点作为master,但是不负责存储数据,只是协调. node.master: ...
Elasticsearch 内存配置应用案例
Elasticsearch 内存配置有三个可选项: 你主要做全文检索吗?考虑给 Elasticsearch 4 - 32 GB 的内存, 让 Lucene 通过操作系统文件缓存来利用余下的内存.那些 ...
【ElasticSearch】给ElasticSearch数据库配置慢查询日志
给ElasticSearch引擎配置慢查询日志,可以实时监控搜索过慢的日志.虽然ElasticSearch以快速搜索而出名,但随着数据量的进一步增大或是服务器的一些性能问题,会有可能出现慢查询的情况. ...
Elasticsearch的配置学习笔记
文/朱季谦 Elasticsearch是一个基于Lucene的搜索服务器.它提供一个分布式多用户能力的全文搜索引擎,基于RESTful web接口,Elasticsearch是用Java语言开发的. ...
ElasticSearch已经配置好ik分词和mmseg分词(转)
ElasticSearch是一个基于Lucene构建的开源,分布式,RESTful搜索引擎.设计用于云计算中,能够达到实时搜索,稳定,可靠,快速,安装使用方便.支持通过HTTP使用JSON进行数据索引 ...

随机推荐

codeforces437C
The Child and Toy CodeForces - 437C On Children's Day, the child got a toy from Delayyy as a present ...
Sql 重置自动增长列
Sql 重置自动增长列: dbcc checkident(表名, reseed, 0) 使用的情况,一般出现在主外键关联表,导致无法 truncate 只能delete的情况. 此时我们可能会需要重置 ...
poj 2236 Wireless Network (并查集）
链接:http://poj.org/problem?id=2236 题意: 有一个计算机网络,n台计算机全部坏了,给你两种操作: 1.O x 修复第x台计算机 2.S x,y 判断两台计算机是否联通 ...
day21 正则表达式
正则表达式简单的范围的字符组 0-9 匹配所有的数字 a-z 匹配所有的小写字母 A-Z 匹配所有的大写字母 A-Za-z 匹配所有的字母字符 . 换行符以外的任意字符 \w word 匹配数字, ...
自定义git忽略规则
输入命令 >a.o git status 此时我想让git忽略这个文件的更新输入命令 > .gitignore echo "a.o" >> .gitign ...
本地项目上传到github 报错“master -> master (non-fast-forward)”
接下来第一步:建立git仓库 cd到你的本地项目根目录下,执行git命令,此命令会在当前目录下创建一个.git文件夹. git init 第二步:将项目的所有文件添加到仓库中 git add . 这 ...
【洛谷5月月赛】玩游戏（NTT，生成函数）
[洛谷5月月赛]玩游戏(NTT,生成函数) 题面 Luogu 题解看一下要求的是什么东西 \((a_x+b_y)^i\)的期望.期望显然是所有答案和的平均数. 所以求出所有的答案就在乘一个逆元就好了 ...
洛谷 P2887 [USACO07NOV]防晒霜Sunscreen 解题报告
P2887 [USACO07NOV]防晒霜Sunscreen 题目描述 To avoid unsightly burns while tanning, each of the C (1 ≤ C ≤ 2 ...
c基础：函数参数是 struct(结构)，传的是引用，还是值？
比如函数形式:void func(struct a data1, struct b data2); 答案: 只要不是指针或者数组都是传值,其实指针也是传递的地址值. 追问但是如果这个结构体里面有数组这 ...
函数式编程（九）——map,filter,reduce
编程方法论: 面向过程:按照一个固定的流程去模拟解决问题的流程函数式:编程语言定义的函数 + 数学意义的函数 y = 2*x + 1 函数用编程语言实现 def fun(x): return 2*x ...

elasticsearch 基本配置

elasticsearch 基本配置的更多相关文章

随机推荐

热门专题