Documentation of 'org.apache.lucene.analysis.LetterTokenizer' Java class
LetterTokenizer
org.apache.lucene.analysis

Class LetterTokenizer

  • Direct Known Subclasses:
    LowerCaseTokenizer


    public class LetterTokenizer
    extends CharTokenizer
    A LetterTokenizer is a tokenizer that divides text at non-letters. That's to say, it defines tokens as maximal strings of adjacent letters, as defined by java.lang.Character.isLetter() predicate. Note: this does a decent job for most European languages, but does a terrible job for some Asian languages, where words are not separated by spaces.
    • Constructor Summary

      Constructors 
      Constructor and Description
      LetterTokenizer(java.io.Reader in)
      Construct a new LetterTokenizer.
    • Method Summary

      • Methods inherited from class java.lang.Object

        equals, getClass, hashCode, notify, notifyAll, toString, wait, wait, wait
    • Constructor Detail

      • LetterTokenizer

        public LetterTokenizer(java.io.Reader in)
        Construct a new LetterTokenizer.

DataMelt 3.0 © DataMelt by jWork.ORG

You see the box below because you did not login.