Documentation of 'org.apache.lucene.analysis.LowerCaseTokenizer' Java class
LowerCaseTokenizer
org.apache.lucene.analysis

Class LowerCaseTokenizer



  • public final class LowerCaseTokenizer
    extends LetterTokenizer
    LowerCaseTokenizer performs the function of LetterTokenizer and LowerCaseFilter together. It divides text at non-letters and converts them to lower case. While it is functionally equivalent to the combination of LetterTokenizer and LowerCaseFilter, there is a performance advantage to doing the two tasks at once, hence this (redundant) implementation.

    Note: this does a decent job for most European languages, but does a terrible job for some Asian languages, where words are not separated by spaces.

    • Constructor Summary

      Constructors 
      Constructor and Description
      LowerCaseTokenizer(java.io.Reader in)
      Construct a new LowerCaseTokenizer.
    • Method Summary

      • Methods inherited from class java.lang.Object

        equals, getClass, hashCode, notify, notifyAll, toString, wait, wait, wait
    • Constructor Detail

      • LowerCaseTokenizer

        public LowerCaseTokenizer(java.io.Reader in)
        Construct a new LowerCaseTokenizer.

DataMelt 3.0 © DataMelt by jWork.ORG

You see the box below because you did not login.