`

初识lucene(二)

 
阅读更多

一、field说明

        对于一个文档来说有多个域,域也是对应的搜索模块。

二、field的

   1.一些子类

首先是一个不变的属性值,这类字段还有一个主要用途,就是可以用于对搜索的返回结果集排序或是按范围查询FloatField
DoubleField  
IntField
LongField

BinaryDocValuesField           
NumericDocValuesField
SortedDocValuesField
SortedSetDocValuesField

StoredField                                    整个域要存储的
StringField                                     是一个不需要分词,而直接用于索引的字符串
TextField                                       是一大块需要经过分词的文本

 2.基本使用格式

   StringField

StringField(String name, String value, Field.Store stored) 

   TextField

TextField(String name, Reader reader) 
Creates a new un-stored TextField with Reader value.
 


TextField(String name, String value, Field.Store store) 
Creates a new TextField with String value.
 


TextField(String name, TokenStream stream) 
Creates a new un-stored TextField with TokenStream value. 

  StoreField

StoredField(String name, byte[] value) 
Create a stored-only field with the given binary value.
 


StoredField(String name, byte[] value, int offset, int length) 
Create a stored-only field with the given binary value.
 


StoredField(String name, BytesRef value) 
Create a stored-only field with the given binary value.
 


StoredField(String name, double value) 
Create a stored-only field with the given double value.
 


StoredField(String name, float value) 
Create a stored-only field with the given float value.
 


StoredField(String name, int value) 
Create a stored-only field with the given integer value.
 


StoredField(String name, long value) 
Create a stored-only field with the given long value.
 


StoredField(String name, String value) 
Create a stored-only field with the given string value. 

 

DoubleFielt  数值类型的方法一直

DoubleField(String name, double value, Field.Store stored) 
Creates a stored or un-stored DoubleField with the provided value and default precisionStep NumericUtils.PRECISION_STEP_DEFAULT (4).
 


DoubleField(String name, double value, FieldType type) 
Expert: allows you to customize the FieldType. 

  DocValues的格式

BinaryDocValuesField(String name, BytesRef value) 
Create a new binary DocValues field.

 3.域的选项

      索引选项

   

Index.ANALYZED     域值被分解切能被搜索,对于普通的文本(正文,标题,摘要等)
Index.NOT_ANALYZED 能被搜索但是不被分解,用于精确匹配 日期了,人名了
Index.ANALYZED_NO_NORMS 进行分词但是不存储norms信息,这个norms中包括了创建索引的时间和权值等信息  
Index.NOT_ANALYZED_NO_NORMS 即不进行分词也不存储norms信息
Index.NO            对应不会被搜索

   存储选项

Store.YES    存储   小的信息
Store。NO  不存储 大的文本

 搭配

ANALYZED YES 文档标题和摘要
ANALYZED NO 文档正文
NOT_ANALYZED YES 标识符(主键、文件名),电话号码、身份证号,姓名,日期
NOT_ANALYZED NO 隐藏关键字
NO YES 文档类型,数据库主键(不进行索引)
分享到:
评论

相关推荐

    lucene in action 电子版

    - **章节1:初识Lucene** - **信息组织与访问的发展**:介绍了从最早的纸质图书到数字化时代的信息检索方式的变化,强调了现代搜索引擎技术的重要性。 - **Lucene是什么**: - **定义**:Lucene是一个高性能、全...

    深入理解Luncen搜索引擎开发

    第1章 Lucene初识 Lucene4入门精通实战课程概述 Lucene系统架构 第2章 Lucene索引 Lucene索引里有什么 Lucene索引深入 Lucene索引深入优化 Lucene索引搜索 第3章 Lucene搜索实战 Lucene搜索实战 Lucene搜索深入...

    Lucene 相关

    1. 初识Lucene: - 了解Lucene的基本组件,如Analyzer、Document、Field、IndexReader、IndexWriter、Query等。 - 学习如何创建简单的索引和搜索示例。 - 掌握基本的查询语法,如TermQuery、BooleanQuery、...

    lucene(HelloWord)

    《Lucene:初识搜索引擎库的“Hello World”》 Lucene,作为Apache软件基金会的顶级项目,是一款高性能、全文本检索引擎库,被广泛应用于各类搜索引擎和信息检索系统中。它提供了完整的搜索功能,包括索引、查询、...

    java搜索引擎的设计与实现英文文献外文翻译.doc

    初识Lucene的人可能会误认为它是一个可以直接使用的应用程序,比如文件搜索程序、网络爬虫或网站搜索引擎。实际上,Lucene并非如此,它是一个软件库,更确切地说,是一个工具包,而不是一个完整的功能丰富的搜索应用...

    Elasticsearch初识与简单案例.pdf

    ### Elasticsearch 初识与简单案例 #### 一、Elasticsearch简介 Elasticsearch 是一款基于 Lucene 的分布式全文搜索引擎,具有高度可扩展性及灵活性。它不仅支持文本搜索,还能进行复杂的数据分析任务,因此在众多...

    初识Hadoop 2.x.pdf

    Hadoop 是一个能够处理海量数据的开源软件框架,它最初由Apache Lucene项目演化而来,旨在解决大规模数据处理的问题。Hadoop 2.x 版本相比早期版本有了显著的改进和增强,特别是在性能、稳定性和安全性方面。 - **...

    Hadoop阶段初识学习笔记

    #### 二、Hadoop的核心功能 1. **分布式数据存储**:Hadoop通过其核心组件HDFS(Hadoop Distributed File System)提供分布式存储能力,能够将大量的数据分散存储在多台计算机上,从而实现高可靠性和高性能的数据...

    藏经阁-Elastic Stack 实战手册(早鸟版)-1182.pdf

    Elasticsearch是基于Apache Lucene构建的开源全文搜索引擎,因其易于使用和高性能的特点深受开发者喜爱。它不仅支持实时搜索,还具备分布式、可扩展的特性,可以处理大规模数据。Elasticsearch不仅适用于传统的搜索...

    Elasticsearch入门讲解

    1. ELASTICSEARCH 初识 Elasticsearch(简称ES)是一款基于Lucene的开源分布式搜索引擎,以其强大的全文检索、实时分析和高可扩展性而闻名。它不仅用于传统的搜索功能,还广泛应用于日志分析、监控、物联网(IoT)...

    ES入门文档

    Elasticsearch(简称ES)是一款基于Lucene的开源搜索引擎。它为开发者提供了高效、可靠的搜索和数据分析能力,支持多种数据类型的实时索引与搜索。 **1.2 入门指南** - **1.2.1 初识ES** - Elasticsearch是一个...

    大数据培训课程安排.pdf

    第五阶段: 初识⼤数据 1. 难易程度:三颗星 2. 课时量(技术知识点+阶段项⽬任务+综合能⼒):80课时 3. 主要技术包括:⼤数据前篇(什么是⼤数据,应⽤场景,如何学习⼤数据库,虚拟机概念和安装等)、Linux常见...

Global site tag (gtag.js) - Google Analytics