Lucene--FuzzyQuery与WildCardQuery（通配符）

FuzzyQuery：

创建索引：

IndexWriter writer = new IndexWriter(path, new StandardAnalyzer(), false); 

writer.setUseCompoundFile(false);

Document doc1 = new Document(); 

Document doc2 = new Document(); 

Document doc3 = new Document(); 

Document doc4 = new Document(); 

Document doc5 = new Document(); 

Document doc6 = new Document();

Field f1 = new Field("content", "word", Field.Store.YES,

Field.Index.TOKENIZED); 

Field f2 = new Field("content", "work", Field.Store.YES,

Field.Index.TOKENIZED); 

Field f3 = new Field("content", "seed", Field.Store.YES,

Field.Index.TOKENIZED); 

Field f4 = new Field("content", "sword", Field.Store.YES,

Field.Index.TOKENIZED); 

Field f5 = new Field("content", "world", Field.Store.YES,

Field.Index.TOKENIZED); 

Field f6 = new Field("content", "ford", Field.Store.YES,

Field.Index.TOKENIZED);

doc1.add(f1);

doc2.add(f2);

doc3.add(f3);

doc4.add(f4);

doc5.add(f5);

doc6.add(f6);

writer.addDocument(doc1);

writer.addDocument(doc2);

writer.addDocument(doc3);

writer.addDocument(doc4);

writer.addDocument(doc5);

writer.addDocument(doc6);

writer.close();

注：IndexWriter中的create的变量值一般设为true

搜索：

IndexSearcher searcher = new IndexSearcher(path);

//构建一个Term，然后对其进行模糊查找 

Term t = new Term("content", "work"); 

FuzzyQuery query = new FuzzyQuery(t);

//FuzzyQuery还有两个构造函数，来限制模糊匹配的程度

// 在FuzzyQuery中，默认的匹配度是0.5，当这个值越小时，通过模糊查找出的文档的匹配程度就

// 越低，查出的文档量就越多,反之亦然 

FuzzyQuery query1 = new FuzzyQuery(t, 0.1f); 

FuzzyQuery query2 = new FuzzyQuery(t, 0.1f, 1);

Hits hits = searcher.search(query2); 

for (int i = 0; i  < hits.length(); i++) { 

    System.out.println(hits.doc(i));

}

searcher.close();

模糊搜索的三种构造函数，具体讲一下参数的用法（以第三个为例）；

第一个参数当然是词条对象，第二个参数指的是levenshtein算法的最小相似度，第三个参数指的是要有多少个前缀字母完全匹配：

WildCardQuery：

通配符就更简单了，只要知道“*”表示0到多个字符，而使用“？”表示一个字符就行了：

IndexSearcher searcher=new IndexSearcher(path);

Term t1=new Term("content","?o*");

WildcardQuery query=new WildcardQuery(t1);

Hits hits=searcher.search(query);

for(int i=0;i<hits.length();i++)

{

     System.out.println(hits.doc(i));

}

That“s all！

Lucene--FuzzyQuery与WildCardQuery（通配符）的更多相关文章

Lucene 的四大索引查询 ——bool 域搜索通配符范围搜索
Lucene 的四大索引查询清单1:使用布尔操作符 Java代码 //Test boolean operator blic void testOperator(String indexD ...
Apache Lucene(全文检索引擎)—搜索
目录返回目录:http://www.cnblogs.com/hanyinglong/p/5464604.html 本项目Demo已上传GitHub,欢迎大家fork下载学习:https://gith ...
【转载】Lucene.Net无障碍学习和使用：搜索篇
在上一篇中,我们初步理解了索引的增删改查基本操作.本文着重介绍一下常用的搜索,以及搜索结果的排序和分页.本文的搜索主要是基于前一篇介绍的文本文件的索引,建议下载最后改进的demo对照着看阅读本文,同时 ...
lucene-查询query->WildcardQuery使用通配符搜索
Lucene也提供了通配符的查询,这就是WildcardQuery. package ch11; import org.apache.lucene.analysis.standard.Standard ...
lucene 3.0.2 search 各种各样的Query类型
http://blog.sina.com.cn/s/blog_61d2047c010195mo.html lucene的这种各种各样的查询类型 1.TermQuery 最简单的Qu ...
Lucene系列六：Lucene搜索详解（Lucene搜索流程详解、搜索核心API详解、基本查询详解、QueryParser详解）
一.搜索流程详解 1. 先看一下Lucene的架构图由图可知搜索的过程如下: 用户输入搜索的关键字.对关键字进行分词.根据分词结果去索引库里面找到对应的文章id.根据文章id找到对应的文章 2. L ...
Lucene之模糊、精确、匹配、范围、多条件查询
Lucene的查询方式很丰富,对于数值类型的数据,采取TermRangeQuery的方式,对于String类型的,就可以采取TermQuery等,查询方式了,可以通过采取合适的查询方式,检索到数据. ...
Lucene.Net无障碍学习和使用：搜索篇
一.初步认识搜索先从上一篇示例代码中我们摘录一段代码看看搜索的简单实现: private TopDocs Search(string keyword,string field) { TopDocs ...
后端技术杂谈3：Lucene基础原理与实践
本系列文章将整理到我在GitHub上的<Java面试指南>仓库,更多精彩内容请到我的仓库里查看 https://github.com/h2pl/Java-Tutorial 喜欢的话麻烦点下 ...
基于Lucene的全文检索实践
由于项目的需要,使用到了全文检索技术,这里将前段时间所做的工作进行一个实践总结,方便以后查阅.在实际的工作中,需要灵活的使用lucene里面的查询技术,以达到满足业务要求与搜索性能提升的目的. 一.全 ...

随机推荐

Eclipse下使用PySpark报Could not find valid SPARK_HOME while searching
主要是Eclipse下需要多一步配置,就是需要加上SPARK_HOME的系统变量. 首先,在Windows的环境变量中加入SPARK_HOME 然后,在Eclipse的配置中加入这个环境变量: Win ...
ylbtech-Tool：
ylbtech-Tool: 1.返回顶部 2.返回顶部 3.返回顶部 4.返回顶部 5.返回顶部 6.返回顶部 7.返回顶部 8.返回顶部 9.返回顶部 10. ...
ps -ef 输出具体含义
ps -ef 输出具体含义 UID PID PPID C STIME TTY TIME CMD 各相关信息的意义: UID 程序被该 UID 所拥有 PID 就是这 ...
Oracle11g 搭建单实例DataGuard （转载）
原文:http://blog.itpub.net/29324876/viewspace-1246133/ 环境:主备库都为单实例并且数据库SID相同 OS:red hat 6.5 Oracle:11. ...
cursor: pin S产生原理及解决方法
转自:http://www.dbafree.net/?p=778 今天晚上在一个比较重要的库上,CPU严重的冲了一下,导致DB响应变慢,大量应用连接timeout,紧接着LISTENER就挂了,连接数 ...
Docker,win10
win10:docker下载地址直接下载docker ,no docker toolbox https://get.daocloud.io/toolbox/ 下载完成,双击安装,next知道完成安装 ...
Mathtype 公式显示方框
公式编辑器mathtype中一些符号显示方框,如何解决呢?出现这个问题的原因是这是因为windows中的mtextra.ttf(显示为MT Extra (TrueType))字体文件不存在或版本太低, ...
Spark报错：Failed to locate the winutils binary in the hadoop binary path
之前在mac上调试hadoop程序(mac之前配置过hadoop环境)一直都是正常的.因为工作需要,需要在windows上先调试该程序,然后再转到linux下.程序运行的过程中,报 Failed to ...
vlc框架流程解析(转)
原文地址:http://luzefengoo.blog.163.com/blog/static/1403593882012754481846/ 第二部分程序框架实现 1．播放列表文件src/pla ...
SpringMVC @RequestBody请求参数在postman中的请求
使用SpringMVC框架,controller使用参数 @RequestBody LoginReq req 注解方式模拟http请求需要请求header添加一个参数设置 Header参 ...

Lucene--FuzzyQuery与WildCardQuery（通配符）

Lucene--FuzzyQuery与WildCardQuery（通配符）的更多相关文章

随机推荐

热门专题