原文出自:http://blog.csdn.net/flyingpig4/article/details/6305488

<pre name="code" class="java">SearchHandler.handleRequestBody():

solr搜索主流程

1.调用:RequestHandlerBase

|--handleRequest(req, rsp);

2.源码分析:

|-prepare() |前期的请求参数准备工作,QueryComponent可以在schemal文件中设置,易扩展

|-- SearchComponent c : components   

               |--queryComponent.prepare()  





|--FQ,FL,SHARDS,Q.SHARDS.ROWS,SHARDS.START  |设置查询的条件,包括分片的查询条件  

|--设置fieldFlags返回的field值

|--设置defType值 |默认lucene,实际指向的是lucenePlugin,可在schema文件中扩展

|--解析QueryParser |对queryString进行解析

      |--解析fq过滤值,生成filter过滤query集

|--设定shards分片信息

|--statComponent.prepare()   

      |--debugComponent.prepare()









|--process()   |单组无shard情况处理

|--String ids = params.get(ShardParams.IDS); |获取shardDoc的id集合,不为空往下执行

|--通过ids获取文档id的集合,并为下一步获取DocList做准备

|--int id = req.getSearcher().getFirstMatch(   

                |--new Term(idField.getName(), idField.getType().toInternal(idArr.get(i))));

|-- luceneIds[docs++] = id;  

|-- res.docList = new DocSlice(0, docs, luceneIds, null, docs, 0);





                |--if (rb.isNeedDocSet()) 存在DocSet需求

|--queries.add(rb.getQuery()); |queryString的查询条件

|--queries.addAll(filters);    |filter查询条件

|--res.docSet = searcher.getDocSet(queries);  |通过queries条件进行DocSet查询

|--rb.setResults(res);  |设置结果返回值

       |--rsp.add("response",rb.getResults().docList);

|--return; |获取结果集后返回

 

|--SolrIndexSearcher.QueryCommand cmd = rb.getQueryCommand();  |获取查询封装的QueryCommand对象

|--searcher.search(result,cmd);

|--getDocListC(qr,cmd); 

|--rb.setResult( result );   |与上同

    |--rsp.add("response",rb.getResults().docList);





|--boolean fsv = req.getParams().getBool(ResponseBuilder.FIELD_SORT_VALUES,false);   |设定fsv,用于排序字段处理

|--SortField[] sortFields  |获取排序的域

|--Field field = new Field("dummy", "", Field.Store.YES, Field.Index.NO); //  仿冒域

|--SolrIndexReader[] readers = reader.getLeafReaders();   |获取所有的IndexReader结点

|--if (readers.length==1)  subReader = readers[0]; |直接处理

|--for (SortField sortField: sortFields)  |循环处理各个排序域

|--FieldComparator comparators[] = (readers==null) ? null : new FieldComparator[readers.length]; |声明域比较器

|--DocIterator it = rb.getResults().docList.iterator(); |过滤docList集合

|--while(it.hasNext())

|--int doc = it.nextDoc();

|--idx = SolrIndexReader.readerIndex(doc, offsets); |获取id所在的Indexreader

|--comparator.copy(0, doc); 

|--Object val = comparator.value(0); |获取comparator的value值

|-- vals.add(val);  |添加至vals当中

|--sortVals.add(fieldname, vals);  |添加至排序值当中

|--rsp.add("sort_values", sortVals); |设置响应对象Response的sort_values的排序值









|--process()   |多组shard处理

|--初始化操作

|-- HttpCommComponent comm = new HttpCommComponent();

|-- rb.outgoing = new LinkedList<ShardRequest>();

|-- rb.finished = new ArrayList<ShardRequest>();

|--while (nextStage != Integer.MAX_VALUE) |循环执行,设置stage状态

|-- for( SearchComponent c : components ) {

                 |--nextStage = Math.min(nextStage, c.distributedProcess(rb)); |distributedProcess(rb)根据rb的stage状态做处理

       

|-- while (rb.outgoing.size() > 0)

|--while (rb.outgoing.size() > 0)

|--ShardRequest sreq = rb.outgoing.remove(0); |取第一个请求值

|--for (String shard : sreq.actualShards)  

|--ModifiableSolrParams params = new ModifiableSolrParams(sreq.params); |设置参数

|--comm.submit(sreq, shard, params); |提交http请求,执行一个Task任务,获取Response响应

|--while (rb.outgoing.size() == 0)  

|--ShardResponse srsp = comm.takeCompletedOrError();  |获取响应

|--rb.finished.add(srsp.getShardRequest());   |完成此次搜索

|--for(SearchComponent c : components)        |完成返回的Response的处理

             
|--c.handleResponses(rb, srsp.getShardRequest());

|-- for(SearchComponent c : components) 

          |-- c.finishStage(rb);  |rb请求响应完成处理

         

         







|--SolrIndexSearcher.getDocSet(List<query>)

|--if (queries.size()==1) return getDocSet(queries.get(0)) |Query集合为1则直接处理

|--for (int i=0; i<sets.length; i++)  |集合存在多个query,且query可能为not查询

|--Query q = queries.get(i);  |取到第i个query

|--Query posQuery = QueryUtils.getAbs(q);  |如果为negative,则为not,则返回相应的补集

|--sets[i] = getPositiveDocSet(posQuery);  |查询query获取DocSet集合

|--if (q==posQuery) |判断是否为negative

|--nge[i] = false;    |为后续判断

|--answer = sets[i];  |是postivi查询设置返回的answer值

|--neg[i] = true;     |否则为正向

|--if(answer == null) answer = getPositiveDocSet(matchAllDocsQuery);  |如果answer为空,则无positive query

|--for (int i=0; i<sets.length; i++)   

|-- if (neg[i]) answer = answer.andNot(sets[i]);    |合并negative查询的answer结果集,并取补集

for (int i=0; i<sets.length; i++) 

|-- if (!neg[i] && i!=smallestIndex) 

|--answer = answer.intersection(sets[i]);   |--循环set集合,取交集生成新的DocSet,详见HashDocSet

|--return answer;

    





|--SolrIndexSearcher.getPositiveDocSet(Query q)

|--if (filterCache != null)

|--answer = (DocSet)filterCache.get(q);

|--else

|--answer = getDocSetNC(q,null);  |normal way to get DocSet

|--if (filterCache != null) filterCache.put(q,answer);
|保存至filterCache当中





 

|--getDocListC(QueryResult qr, QueryCommand cmd)  |通过QueryCommmand进行查找 

|--if (queryResultCache != null && cmd.getFilter()==null) |从queryResultCache中进行查找

|--key = new QueryResultKey(cmd.getQuery(), cmd.getFilterList(), cmd.getSort(), cmd.getFlags());  |计算key值

|--if ((cmd.getFlags() & NO_CHECK_QCACHE)==0)

|--superset = (DocList)queryResultCache.get(key);  |从cache中取出DocList集合

|--out.docList = superset.subset(cmd.getOffset(),cmd.getLen());  |如果子集合不为空

|--if (out.docSet==null && ((cmd.getFlags() & GET_DOCSET)!=0) ) 

               |--if (cmd.getFilterList()==null)    |如果filter为null,则直接查询

|--out.docSet = getDocSet(cmd.getQuery()); |获取DocSet集合

|--else 

|--newList.addAll(cmd.getFilterList());  |添加filterList的Doc集合

|--out.docSet = getDocSet(newList);    |获取DocSet集合

|--return ;查询完成返回

|--boolean useFilterCache=false;  |检查是否需要filterCache

|--for (SortField sf : sfields)   |如果存在SortField,则返回false

|--if (sf.getType() == SortField.SCORE) 

|--useFilterCache=false;

|--break;

|--if(useFilterCache)

|--if (out.docSet == null)  |获取真实的DocSet集合

       |--out.docSet = getDocSet(cmd.getQuery(),cmd.getFilter());

|--DocSet bigFilt = getDocSet(cmd.getFilterList());

|--if (bigFilt != null) out.docSet = out.docSet.intersection(bigFilt);

|--superset = sortDocSet(out.docSet,cmd.getSort(),supersetMaxDoc);  |取出子的设定的返回Doc

|--out.docList = superset.subset(cmd.getOffset(),cmd.getLen());     |设置docList

|--else          |此时无任何缓存,为正常处理模式

|--if ((cmd.getFlags() & GET_DOCSET)!=0) 

|--DocSet qDocSet = getDocListAndSetNC(qr,cmd);

|--else 

|--getDocListNC(qr,cmd);

|--superset = out.docList;

     |--out.docList = superset.subset(cmd.getOffset(),cmd.getLen());

|--if (key != null && superset.size() <= queryResultMaxDocsCached && !qr.isPartialResults())  |设置是否需要设置queryResultCache

       |--queryResultCache.put(key, superset);

    



|--getDocListAndSetNC(QueryResult qr,QueryCommand cmd)

|--DocSet filter = cmd.getFilter()!=null ? cmd.getFilter() : getDocSet(cmd.getFilterList()); |获取filter过滤信息

|--Query query = QueryUtils.makeQueryable(cmd.getQuery()); |设定query为positive的Query条件

|--final Filter luceneFilter = filter==null ? null : filter.getTopFilter();   

|--if (lastDocRequested<=0)

|--if (!needScores)  |是否需要打分

|--collector = setCollector = new DocSetCollector(smallSetSize, maxDoc);

|--else

|--collector = setCollector = new DocSetDelegateCollector(smallSetSize, maxDoc, new Collector()

|--super.search(query, luceneFilter, collector);  |执行查询条件,获取collector信息,前面操作均为构造查询条件,并作相应的缓存的存取处理

|--set = setCollector.getDocSet();

|--else 

|--处理过程与上类似,但参数设置不同,如下 

|--totalHits = topCollector.getTotalHits();

|--TopDocs topDocs = topCollector.topDocs(0, len);

|--ids[i] = scoreDoc.doc;

|--qr.setDocList(new DocSlice(0,sliceLen,ids,scores,totalHits,maxScore));

|--qr.setDocSet(set);

|--return filter==null ? qr.getDocSet() : null;



</pre><br>

Solr查询过程源码分析的更多相关文章

  1. Mybatis执行流程源码分析

    第一部分:项目结构 user_info表:只有id和username两个字段 User实体类: public class User { private String username; private ...

  2. Android系统默认Home应用程序(Launcher)的启动过程源码分析

    在前面一篇文章中,我们分析了Android系统在启动时安装应用程序的过程,这些应用程序安装好之后,还须要有一个Home应用程序来负责把它们在桌面上展示出来,在Android系统中,这个默认的Home应 ...

  3. [Android]从Launcher开始启动App流程源码分析

    以下内容为原创,欢迎转载,转载请注明 来自天天博客:http://www.cnblogs.com/tiantianbyconan/p/5017056.html 从Launcher开始启动App流程源码 ...

  4. [Android]Android系统启动流程源码分析

    以下内容为原创,欢迎转载,转载请注明 来自天天博客:http://www.cnblogs.com/tiantianbyconan/p/5013863.html Android系统启动流程源码分析 首先 ...

  5. Android Content Provider的启动过程源码分析

    本文參考Android应用程序组件Content Provider的启动过程源码分析http://blog.csdn.net/luoshengyang/article/details/6963418和 ...

  6. Android应用程序绑定服务(bindService)的过程源码分析

    Android应用程序组件Service与Activity一样,既能够在新的进程中启动,也能够在应用程序进程内部启动:前面我们已经分析了在新的进程中启动Service的过程,本文将要介绍在应用程序内部 ...

  7. Spring加载流程源码分析03【refresh】

      前面两篇文章分析了super(this)和setConfigLocations(configLocations)的源代码,本文来分析下refresh的源码, Spring加载流程源码分析01[su ...

  8. 【高速接口-RapidIO】5、Xilinx RapidIO核例子工程源码分析

    提示:本文的所有图片如果不清晰,请在浏览器的新建标签中打开或保存到本地打开 一.软件平台与硬件平台 软件平台: 操作系统:Windows 8.1 64-bit 开发套件:Vivado2015.4.2 ...

  9. 转:Spring与Mybatis整合的MapperScannerConfigurer处理过程源码分析

    原文地址:Spring与Mybatis整合的MapperScannerConfigurer处理过程源码分析 前言 本文将分析mybatis与spring整合的MapperScannerConfigur ...

随机推荐

  1. php str_pad() 用法

    $temp = str_pad("    ", 10000); for($i=0;$i<20;$i++){    echo $temp;    echo $i;    sle ...

  2. NOIP2011 观光公交 加强版

    传送门 题目大意 给定从左到右的$n$个车站以及两两之间通行的需要的时间. 有$m$个人,第$i$个人会在$T_i$时刻出现在$a_i$车站,目的地是$b_i$. 一辆车第$0$时刻出现在一号站台,从 ...

  3. Thinking in Java 4th(Java编程思想第四版)文档、源码、习题答案

    Thinking in Java 4th 中.英文两版pdf文档,书中源码及课后习题答案.链接:https://pan.baidu.com/s/1BKJdtgJ3s-_rN1OB4rpLTQ 密码:2 ...

  4. 关键的OOP概念

    OOP的好处  1.封装, 2继承, 3多态. 多态性是指相同的操作或函数.过程可作用于多种类型的对象上并获得不同的结果.不同的对象,收到同一消息将可以产生不同的结果,这种现象称为多态性. <? ...

  5. 重温CLR(三)类型基础

    所有类型都从System.Object派生 “运行时”要求每个类型最终都要从System.Object类型派生.也就是说,一下两个类型的定义完全一致. //隐式派生自Object class Empl ...

  6. debezium 数据变更工具使用

    1.  作用 简单概述就是CDC(change data capture),实时数据分析领域用的比较多   2. 简单使用(基于官网的docker 说明)  备注: 测试没有使用守护进程模式为了方便测 ...

  7. c#学习笔记 VS编辑器常用设置

    1.NET Framework 4.0安装好后目录在哪里? C:\Windows\Microsoft.NET\Framework下面 C#中CLR和IL分别是什么含义? CLR common lang ...

  8. Base64加密算法

    Base64是网络上最常见的用于传输8Bit字节码的编码方式之一,Base64就是一种基于64个可打印字符来表示二进制数据的方法.可查看RFC2045-RFC2049,上面有MIME的详细规范. Ba ...

  9. hive字段原理--有删除一列想到的

    hive删除一张表的字段不会动数据文件,只是修改了一下metadata表里面的表定义:所以会出现一种情况:就是这张表如果之前数据是满的(个格列都有数据),那么被删除的那列后数据都往前窜了一个,最后一个 ...

  10. selenium - xpath - 定位

    前言: XPath 是一门在 XML 文档中查找信息的语言.XPath 可用来在 XML 文档中对元素和属性进行遍历. 看这里介绍:w3school 首先来看一下xpath常用的语法: 一.xpath ...