<转>Lucene1.4与Lucene2.0的Field_㎡-流逝-时光-Ψ

来源：百度文库编辑：神马文学网时间：2024/04/29 22:51:19

<转>Lucene1.4与Lucene2.0的Field2008-08-19 11:35

Field的改进
Lucene1.4主要提供下列四种不同类型的Field:
Keyword,UnStored,UnIndexed,Text

在Lucene2.0中是通过三个内部类Field.Index,Field.Store,Field.termVector(项向量)的组合来区分Field的具体类型.具体如下:
Field.Store.COMPRESS:压缩保存,用于长文本或二进制数据
Field.Store.YES:保存
Field.Store.NO:不保存

Field.Index.NO:不建立索引
Field.Index.TOKENIZED:分词,建索引
Field.Index.UN_TOKENIZED:不分词,建索引
Field.Index.NO_NORMS:不分词,建索引.但是Field的值不像通常那样被保存，而是只取一个byte，这样节约存储空间

Field.TermVector.NO:不保存term vectors
Field.TermVector.YES:保存term vectors
Field.TermVector.WITH_POSITIONS:保存term vectors.(保存值和token位置信息)
Field.TermVector.WITH_OFFSETS:保存term vectors.(保存值和Token的offset)
Field.TermVector.WITH_POSITIONS_OFFSETS:保存term vectors.(保存值和token位置信息和Token的offset)

而Field的构造函数也用到了这三个内部类:
Field(String, byte[],Field.Store)
Field(String, Reader)
Field(String, Reader, Field.TermVector)
Field(String, String, Field.Store, Field.Index)
Field(String, String, Field.Store, Field.Index, Field.TermVector)

其中Field(String, Reader)和Field(String, Reader, Field.TermVector)默认为Field.Index.TOKENIZED和Field.Store.NO的.我们可以很简单的建立起1.4版本的Field类型和2.0间的转换(这看上去似乎没有什么必要,只是觉得对于理解还是有点帮助的)
Keyword <==> Store.YES,Index.UN_TOKENIZED;
UnIndexed <==> Store.YES,Index.NO;
UnStored <==> Store.NO,Index.TOKENIZED;
Text(String, Reader) <==> Store.NO,Index.TOKENIZED;
Text(String,String) <==> Store.YES,Index.TOKENIZED.

<转>Lucene1.4与Lucene2.0的Field_㎡-流逝-时光-Ψ 时光流逝时光流逝而我心安时光流逝，谁是你心中最美的世界小姐？（组图）时光流逝，谁是你心中最美的世界小姐？（组图）时光流逝，谁是你心中最美的世界小姐？（组图）流逝的岁月流逝的青春1 流逝的青春2 流逝的年华流逝着的青春岁月流逝的岁月流逝的青春流逝的美好一时光流逝姿彩不褪影坛八大“色”女郎/组图时光流逝，唯慈母恩情难忘 - Qzone日志时光流逝而我心安-柴静 - 新浪BLOG 时光流逝姿彩不褪影坛八大“色”女郎/组图565355 时光流逝，却有一个我还在这里留住的叫做幸福，流逝的叫做遗憾（转）迷·时光 ? 交易频率与获利可能的概率 (转) 亲爱的：性欲将随时间流逝时间的流逝，你丢掉了什么品味那些匆匆流逝的亲情