Class LuceneItalianTokenizer

java.lang.Object
org.omegat.tokenizer.BaseTokenizer
org.omegat.tokenizer.LuceneItalianTokenizer
All Implemented Interfaces:
ITokenizer

public class LuceneItalianTokenizer extends BaseTokenizer
Tokenizer implementation for processing Italian language text using Apache Lucene. This class provides functionality for creating token streams tailored for the Italian language, supporting options for stemming and stop word filtering.

The tokenizer applies Italian-specific text processing based on the Apache Lucene library, utilizing the ItalianAnalyzer when stemming is enabled. When stemming is disabled, a standard token stream is used.

  • Constructor Details

    • LuceneItalianTokenizer

      public LuceneItalianTokenizer()