Class LuceneCatalanTokenizer

java.lang.Object
org.omegat.tokenizer.BaseTokenizer
org.omegat.tokenizer.LuceneCatalanTokenizer
All Implemented Interfaces:
ITokenizer

public class LuceneCatalanTokenizer extends BaseTokenizer
Tokenizer implementation for processing Catalan language text. This tokenizer utilizes Lucene's CatalanAnalyzer to provide language-specific tokenization and optional stemming and stop word filtering.

The tokenizer can process text while either including or excluding stems and stop words based on the specified configuration.

  • Constructor Details

    • LuceneCatalanTokenizer

      public LuceneCatalanTokenizer()