检索结果高亮

实现效果：

核心代码

package ucas.ir.lucene;

import java.io.File;

import java.io.IOException;

import javax.print.Doc;

import org.apache.lucene.analysis.Analyzer;

import org.apache.lucene.analysis.TokenStream;

import org.apache.lucene.analysis.core.KeywordAnalyzer;

import org.apache.lucene.analysis.standard.StandardAnalyzer;

import org.apache.lucene.document.Document;

import org.apache.lucene.index.DirectoryReader;

import org.apache.lucene.index.IndexWriter;

import org.apache.lucene.queryparser.classic.QueryParser;

import org.apache.lucene.search.IndexSearcher;

import org.apache.lucene.search.Query;

import org.apache.lucene.search.TopDocs;

import org.apache.lucene.search.highlight.Fragmenter;

import org.apache.lucene.search.highlight.Highlighter;

import org.apache.lucene.search.highlight.QueryScorer;

import org.apache.lucene.search.highlight.SimpleHTMLFormatter;

import org.apache.lucene.search.highlight.SimpleSpanFragmenter;

import org.apache.lucene.search.highlight.TokenSources;

import org.apache.lucene.store.Directory;

import org.apache.lucene.store.FSDirectory;

import org.apache.lucene.util.Version;

import org.wltea.analyzer.lucene.IKAnalyzer;

public class IndexSearch {

    public static void main(String[] args) {

        Directory directory = null;

        try {

            File indexpath = new File("/Users/yp/Documents/workspace/UCASIR/WebContent/index");

            if (indexpath.exists() != true) {

                indexpath.mkdirs();

            }

            // 设置要查询的索引目录

            directory = FSDirectory.open(indexpath);

            // 创建indexSearcher

            DirectoryReader dReader = DirectoryReader.open(directory);

            IndexSearcher searcher = new IndexSearcher(dReader);

            // 设置分词方式

            Analyzer analyze2 = new StandardAnalyzer(Version.LUCENE_43);// 标准分词

            Analyzer analyzer = new IKAnalyzer();

            // 设置查询域

            String field="news_title";

            QueryParser parser = new QueryParser(Version.LUCENE_43, field, analyzer);

            // 查询字符串

            Query query = parser.parse("阿法狗");

            QueryScorer scorer=new QueryScorer(query,field);

            SimpleHTMLFormatter fors=new SimpleHTMLFormatter("<span style=\"color:red;\">", "</span>");

            Highlighter highlighter=new Highlighter(fors, scorer);

            System.out.println("query:" + query.toString());

            // 返回前10条

            TopDocs topDocs = searcher.search(query, 10);

            if (topDocs != null) {

                System.out.println("符合条件第文档总数：" + topDocs.totalHits);

                for (int i = 0; i < topDocs.scoreDocs.length; i++) {

                    Document doc = searcher.doc(topDocs.scoreDocs[i].doc);

                    TokenStream tokenStream=TokenSources.getAnyTokenStream(searcher.getIndexReader(), topDocs.scoreDocs[i].doc, field, analyzer);

                    Fragmenter  fragment=new SimpleSpanFragmenter(scorer);

                    highlighter.setTextFragmenter(fragment);

                    //高亮news_title域

                    String str=highlighter.getBestFragment(tokenStream, doc.get("news_title"));//获取高亮的片段，可以对其数量进行限制

                    System.out.println("高亮title："+str);

                    tokenStream=TokenSources.getAnyTokenStream(searcher.getIndexReader(), topDocs.scoreDocs[i].doc, "news_summary", analyzer);

                    str=highlighter.getBestFragment(tokenStream, doc.get("news_summary"));//获取高亮的片段，可以对其数量进行限制

                    System.out.println("高亮summary："+str);

                }

            }

            directory.close();

            dReader.close();

        } catch (Exception e) {

            e.printStackTrace();

        }

    }

}

结果：

Lucene查询结果高亮的更多相关文章

lucene 查询+分页+排序
lucene 查询+分页+排序 1.定义一个工厂类 LuceneFactory 1 import java.io.IOException; 2 3 import org.apache.lucene.a ...
Lucene7.2.1系列（三）查询及高亮
系列文章: Lucene系列(一)快速入门 Lucene系列(二)luke使用及索引文档的基本操作 Lucene系列(三)查询及高亮一准备创建项目并添加Maven依赖 <dependenc ...
Lucene 查询工具 LQT
Lucene Query Tool (lqt) 是一个命令行工具用来执行 Lucene 查询并对结果进行格式化输出. 使用方法: 01 $ ./lqt 02 usage: LuceneQueryToo ...
Lucene查询语法详解
Lucene查询 Lucene查询语法以可读的方式书写,然后使用JavaCC进行词法转换,转换成机器可识别的查询. 下面着重介绍下Lucene支持的查询: Terms词语查询词语搜索,支持单词和 ...
Lucene查询条数限制
运用Lucene进行索引,在查询的时候是有条数限制的 public virtual TopFieldDocs Search(Query query, Filter filter, int n, Sor ...
kibana使用（ELK）、Lucene 查询语法
Lucene查询 Lucene查询语法以可读的方式书写,然后使用JavaCC进行词法转换,转换成机器可识别的查询. 下面着重介绍下Lucene支持的查询: Terms词语查询词语搜索,支持单词和 ...
Lucene 查询分页技术
常用的Lucene查询代码如下所示,该代码的作用是将path路径下的所有索引信息返回 public String matchAll(String path) { try { Directory dir ...
query_string查询支持全部的Apache Lucene查询语法低频词划分依据模糊查询 Disjunction Max
3.3 基本查询3.3.1词条查询词条查询是未经分析的,要跟索引文档中的词条完全匹配注意:在输入数据中,title字段含有Crime and Punishment,但我们使用小写开头的crime来搜 ...
基于Lucene查询原理分析Elasticsearch的性能
前言 Elasticsearch是一个很火的分布式搜索系统,提供了非常强大而且易用的查询和分析能力,包括全文索引.模糊查询.多条件组合查询.地理位置查询等等,而且具有一定的分析聚合能力.因为其查询场景 ...

随机推荐

z-index的学习整理转述
前言:这是笔者第一次写博客,主要是学习之后自己的理解.如果有错误或者疑问的地方,请大家指正,我会持续更新! z-index属性描述元素的堆叠顺序(层级),意思是A元素可以覆盖B元素,但是B元素并没有消 ...
CSS基础：内联元素
简介内联元素由于涉及到文本字体,读写方向,汉字和字母差异等诸多方面的影响,因此其盒模型比块级元素更加复杂,对于内联非替换元素,比如一行文本,主要由以下几种框构成: "em 框", ...
python 3全栈开发-面向对象之绑定方法（classmethod与staticmethod的区别）、多态、封装的特性property
一.面向对象绑定方法一.类中定义的函数分成两大类 1.绑定方法(绑定给谁,谁来调用就自动将它本身当作第一个参数传入): 1. 绑定到类的方法:用classmethod装饰器装饰的方法. 为类量身定制 ...
两个activity的3D翻转动画.md
一.业务需求这里在公司项目设计时,用到了一个小的需求,就是点击一个按钮然后整个activity的页面进行3d翻转; 二.设计思路由于是2个activity的之间的翻转动画,就意味着前90度是A页面 ...
从零开始系列之vue全家桶（2）安装调试插件vue Devtools
小白安装前提是会用git,会从github上找东西. 第一步: 我们可以先从github上找到vue-devtools的项目,下载到本地.下载vue-devtools链接. 克隆方法:git clon ...
VINS 估计器之检查视差
为什么检查视差 VINS里为了控制优化计算量,在实时情况下,只对当前帧之前某一部分帧进行优化,而不是全部历史帧.局部优化帧的数量就是窗口大小.为了维持窗口大小,需要去除旧的帧添加新的帧,也就是边缘化 ...
[LeetCode] Closest Leaf in a Binary Tree 二叉树中最近的叶结点
Given a binary tree where every node has a unique value, and a target key k, find the value of the n ...
WebApi-路由机制
一.WebApi路由机制是什么? 路由机制通俗点来说:其实就是WebApi框架将用户在浏览器中输入的Url地址和路由表中的路由进行匹配,并根据最终匹配的路由去寻找并匹配相应的Controller和Ac ...
从零开始搭建支持http2的web服务
前段时间开始,公司各项业务开始陆续接入http2,关于http2的优点与所适用的场景网上有很多的文档可以查阅,这里我主要是总结分享一下如何从0到1搭建http2服务. 这里先说明一下,要完成http2 ...
属性添加get和set方法
出错信息: Struts Problem Report Struts has detected an unhandled exception: Messages: File: com/myHibern ...

Lucene查询结果高亮

检索结果高亮

实现效果：

核心代码

Lucene查询结果高亮的更多相关文章

随机推荐

热门专题