solr使用cursorMark做深度分页

深度分页

深度分页是指给搜索结果指定一个很大的起始位移。

普通分页在给定一个大的起始位移时效率十分低下，例如start=1000000,rows=10的查询，搜索引擎需要找到前1000010条记录然后再返回最后10条。Solr为了最后10条记录只会检索排序字段，但是前1000010条记录的内部排序开销依然十分大。

普通分页基础上的深度分页对分布式搜索引擎而言甚至是更低效的，因为为了找到正确的10条记录，来自各个分片的前1000010条记录的排序字段需要被返回和聚合在一个聚合节点。

使用cursorMark（游标记录）

cursorMark参数允许高效地在大结果集上遍历。它可以在单点或分布式搜索引擎上工作。

怎样使用cursorMark：

1.排序必须包括id字段的严格排序策略，这防止了用lucene记录id做内部排序导致的排序中存在相等的情况。

2.任何包括cursorMark的调用start字段必须是0。

3.第一次请求时传递cursorMark=*。

4.Solr的返回结果中会有nextCursorMark，在下次调用时简单地使用这个值作为cursorMark以继续结果集的分页。

深度分页curosrMark实现时要注意的点

1.cursorMark参数自身包含了所有的必要状态，没有服务端的状态。

2.start参数总是返回0，这取决于客户端指出要展示的是什么位置。

3.没必要使用cursorMark排序到底，因为服务端没有保存状态，随时都可以终止排序。

4.你有两种方法知道搜索结果的排序到底了，没有返回和你请求的一样的行数，或者返回的coursorMark和你传递的一样（此时返回的行数为0）。

5.尽管start参数必须是0，每次调用都可以变换row值。

6.修改返回字段和facet字段时，cursorMark也是可以重用的。

7.客户端可以通过再次提交之前的cursorMark高效地往回翻页。

solr使用cursorMark做深度分页的更多相关文章

Solr中使用游标进行深度分页查询以提高效率（适用的场景下）
通常,我们的应用系统,如果要做一次全量数据的读取,大多数时候,采用的方式会是使用分页读取的方式,然而分页读取的方式,在大数据量的情况下,在solr里面表现并不是特别好,因为它随时可能会发生OOM的异 ...
游标深度分页 deep paging
Solr Deep Paging(solr 深分页) - ickes的专栏 - CSDN博客 https://blog.csdn.net/xl_ickes/article/details/427725 ...
大数据学习[16]--使用scroll实现Elasticsearch数据遍历和深度分页[转]
题目:使用scroll实现Elasticsearch数据遍历和深度分页作者:星爷出处: http://lxWei.github.io/posts/%E4%BD%BF%E7%94%A8scroll% ...
elasticsearch深度分页问题
elasticsearch专栏:https://www.cnblogs.com/hello-shf/category/1550315.html 一.深度分页方式from + size es 默认采用的 ...
elasticserach数据库深度分页查询的原理
深度分页存在的问题 https://segmentfault.com/a/1190000019004316?utm_source=tag-newest 在实际应用中,分页是必不可少的,例如,前端页面展 ...
上亿数据怎么玩深度分页？兼容MySQL + ES + MongoDB
面试题 & 真实经历面试题:在数据量很大的情况下,怎么实现深度分页? 大家在面试时,或者准备面试中可能会遇到上述的问题,大多的回答基本上是分库分表建索引,这是一种很标准的正确回答,但现实总是 ...
在Linux上使用Nginx为Solr集群做负载均衡
在Linux上使用Nginx为Solr集群做负载均衡在Linux上搭建solr集群时需要用到负载均衡,但测试环境下没有F5 Big-IP负载均衡交换机可以用,于是先后试了weblogic的proxy ...
腾讯QQ会员技术团队：人人都可以做深度学习应用：入门篇（下）
四.经典入门demo:识别手写数字(MNIST) 常规的编程入门有"Hello world"程序,而深度学习的入门程序则是MNIST,一个识别28*28像素的图片中的手写数字的程序 ...
【腾讯Bugly干货分享】人人都可以做深度学习应用：入门篇
导语 2016年,继虚拟现实(VR)之后,人工智能(AI)的概念全面进入大众的视野.谷歌,微软,IBM等科技巨头纷纷重点布局,AI 貌似将成为互联网的下一个风口. 很多开发同学,对人工智能非常感兴趣, ...

随机推荐

vue-loader v15、vue-loader v14及之前版本，配置css modules的区别
vue-loader v15 配置css modules: 是在 css-loader 里配置官方文档:https://vue-loader.vuejs.org/zh/migrating.html# ...
centos7 虚拟机安装以后不能联网问题
1 设置网络模式为桥接. 2 配置/etx/sysconfig/network-scrips/ifcfg-enthp0s3为如下配置( ip 网段根据自己网段决定) TYPE=Ethernet P ...
Mysql 通信协议抓包分析
mysql在传输层使用的TCP协议.一个TCP payload可能有多个mysql packet.如下图所示. TCP head TCP payload (mysql packet1, mysql p ...
Eclipse各个版本及其对应代号、下载地址列表
版本号代码日期下载地址 Eclipse 3.1 IO[木卫一,伊奥] 2005 http://archive.eclipse.org/eclipse/downloads/drops/R-3.1- ...
java小程序（课堂作业06）
编写一个程序,此程序在运行时要求用户输入一个整数,代表某门课的考试成绩,程序接着给出“不及格”.“及格”.“中”.“良”.“优”的结论. 要求程序必须具备足够的健壮性,不管用户输入什么样的内容,都 ...
Mysql 性能优化4 mysql参数配置
mysql 参数的介绍大概450项参数,大多保持默认就可以了错误的参数崩溃,错误,运行缓慢. 参数最好在生产环境前配置好.最好不要在生产环境中直接配置,有可能不会立即生效,或者之前的数据和配 ...
QT中webkit去掉默认的右键菜单
在qt设计师中,选择webview,按下图选择那一行设置contextMenuPolicy属性:
两招解决异常_Cannot find any information on property 'XXX' in a bean of type 'XXX'的问题
第一招在进行Java Web项目开发的时候,我碰到过下面这个异常: Cannot find any information on property 'XXX' in a bean of type ' ...
GoJS拖动设计
http://192.168.0.149:8035/gojs/intro/groups.html http://192.168.0.149:8035/gojs/intro/ports.html htt ...
python selenium right click on an href and choose Save link as... on Chrome.
From:https://stackoverflow.com/questions/42781483/right-click-on-an-href-and-choose-save-link-as-in- ...

solr使用cursorMark做深度分页

solr使用cursorMark做深度分页的更多相关文章

随机推荐

热门专题