详细描述一下 Elasticsearch 索引文档的过程？

协调节点默认使用文档 ID 参与计算（也支持通过 routing），以便为路由提供合适的分片。

shard = hash(document_id) % (num_of_primary_shards)

1、当分片所在的节点接收到来自协调节点的请求后，会将请求写入到 Memory

Buffer，然后定时（默认是每隔 1 秒）写入到 Filesystem Cache，这个从 Momery

Buffer 到 Filesystem Cache 的过程就叫做 refresh；

2、当然在某些情况下，存在 Momery Buffer 和 Filesystem Cache 的数据可能会

丢失，ES 是通过 translog 的机制来保证数据的可靠性的。其实现机制是接收到请

求后，同时也会写入到 translog 中，当 Filesystem cache 中的数据写入到磁盘中

时，才会清除掉，这个过程叫做 flush；

3、在 flush 过程中，内存中的缓冲将被清除，内容被写入一个新段，段的 fsync

将创建一个新的提交点，并将内容刷新到磁盘，旧的 translog 将被删除并开始一

个新的 translog。

4、flush 触发的时机是定时触发（默认 30 分钟）或者 translog 变得太大（默认

为 512M）时；

补充：关于 Lucene 的 Segement：

1、Lucene 索引是由多个段组成，段本身是一个功能齐全的倒排索引。

2、段是不可变的，允许 Lucene 将新的文档增量地添加到索引中，而不用从头重

建索引。

3、对于每一个搜索请求而言，索引中的所有段都会被搜索，并且每个段会消耗

CPU 的时钟周、文件句柄和内存。这意味着段的数量越多，搜索性能会越低。

4、为了解决这个问题，Elasticsearch 会合并小段到一个较大的段，提交新的合并段到磁盘，并删除那些旧的小段。

详细描述一下 Elasticsearch 索引文档的过程？的更多相关文章

详细描述一下 Elasticsearch 索引文档的过程 ?
面试官:想了解 ES 的底层原理,不再只关注业务层面了. 解答: 这里的索引文档应该理解为文档写入 ES,创建索引的过程. 文档写入包含:单文档写入和批量 bulk 写入,这里只解释一下:单文档写入流 ...
详细描述一下 Elasticsearch 索引文档的过程？
这里的索引文档应该理解为文档写入 ES,创建索引的过程. 文档写入包含:单文档写入和批量 bulk 写入,这里只解释一下:单文档写入流程. 记住官方文档中的这个图. 第一步:客户写集群某节点写入数据, ...
分布式搜索elasticsearch 索引文档的增删改查入门
1.RESTful接口使用方法为了方便直观我们使用Head插件提供的接口进行演示,实际上内部调用的RESTful接口. RESTful接口URL的格式: http://localhost:9200/ ...
head插件对elasticsearch 索引文档的增删改查
1.RESTful接口使用方法为了方便直观我们使用Head插件提供的接口进行演示,实际上内部调用的RESTful接口. RESTful接口URL的格式: http://localhost:9200 ...
Elasticsearch 索引文档的增删改查
利用Elasticsearch-head可以在界面上(http://127.0.0.1:9100/)对索引进行增删改查 1.RESTful接口使用方法为了方便直观我们使用Head插件提供的接口进行演 ...
Elasticsearch 索引文档如何使用自动生成 Id？
一个文档的 _index . _type 和 _id 唯一标识一个文档. 我们可以提供自定义的 _id 值,或者让 index API 自动生成. 如果你的数据没有自然的 ID, Elasticsea ...
关于Elasticsearch文档的描述以及如何操作文档的详细总结
文档什么是文档在大多数应用中,多数实体或对象可以被序列化为包含键值对的 JSON 对象. 一个键可以是一个字段或字段的名称,一个值可以是一个字符串,一个数字,一个布尔值, 另一个对象,一些 ...
Elasticsearch必知必会的干货知识一：ES索引文档的CRUD
若在传统DBMS 关系型数据库中查询海量数据,特别是模糊查询,一般我们都是使用like %查询的值%,但这样会导致无法应用索引,从而形成全表扫描效率低下,即使是在有索引的字段精确值查找,面对海量数 ...
Elasticsearch 管理文档
ES支持近实时的索引.更新.查询.删除文档,近实时就意味着刚刚索引的数据需要1秒钟后才能搜索到,这也是与传统的SQL数据库不同的地方. 更多的ES文档资料参考:Elasticsearch官方文档翻译 ...

随机推荐

Android编译优化系列-kapt篇
作者:字节跳动终端技术---王龙海封光兰军健一.背景本文是编译优化系列文章之 kapt 优化篇,后续还会有 build cache, kotlin, dex 优化等文章,敬请期待.本文由Cli ...
linux-noshell的模式
转至:https://blog.csdn.net/ifubing/article/details/95509981 noshell 创建两个用户,一个直接创建,一切按默认的来另一个创建时指定一下no ...
c# 反射实现模型深拷贝
1.支持属性,不支持字段,支持复杂类型属性 2.泛型集合类支持List<T>与Dictionary<TKey,TValue> 3.如果发现有什么问题,希望大家可以多多指教 // ...
【行业Tip】两化融合
工业4.0 智能制造规划两化融合是信息化和工业化的高层次的深度结合, 是指以信息化带动工业化.以工业化促进信息化,走新型工业化道路:两化融合的核心就是信息化支撑,追求可持续发展模式.
pycharm远程调试、开发（详细操作）
如果仅是远程开发,新建 ssh Interpreter 并 apply tools -> deployment -> browser remote host 即可 1.服务器侧准备准备调 ...
Java案例——字符串中的数据排序
需求:有一个字符串"9 1 2 7 4 6 3 8 5 0",请编写程序实现从小到大数据排序分析:最重要的部分是如何将字符串中的数据取出来 1.定义一个字符串为"9 1 ...
关于API和SDK的个人理解及两者区别
关于API和SDK的个人理解及两者区别最近接到公司的一项任务,调用第三方库的一些东西.因此记录一下在使用第三方的功能模块时常常提及到的两个名词--API和SDK. 1.SDK是什么?SDK:概念:软 ...
马哥教育Linux网络班结业考试（架构师）-简答题题目（附答案）
1.叙述 centos7 启动图形界面的开机启动流程? 答:新版本的CentOS7里,已经做了调整.具体/etc/inittab 文件的第7行已经做出了说明: 系统已经使用'targets' 取代了运 ...
redis不重启,切换到RDB备份到AOF备份
redis不重启,切换RDB备份到AOF备份确保redis版本在2.2以上查看redis版本 redis-server -v 实验环境准备本文是在redis4.0中,通过config set命令 ...
基于WebSocket的简易聊天室
用的是Flash + WebSocket 哦~ Flask 之 WebSocket 一.项目结构: 二.导入模块 pip3 install gevent-websocket 三.先来看一个一对一聊天的 ...

详细描述一下 Elasticsearch 索引文档的过程？

详细描述一下 Elasticsearch 索引文档的过程？的更多相关文章

随机推荐

热门专题