Class LuceneDanishTokenizer

java.lang.Object
org.omegat.tokenizer.BaseTokenizer
org.omegat.tokenizer.LuceneDanishTokenizer
All Implemented Interfaces:
ITokenizer

public class LuceneDanishTokenizer extends BaseTokenizer
The LuceneDanishTokenizer class extends the BaseTokenizer and provides tokenization functionality for Danish language text processing. It uses the Lucene DanishAnalyzer to handle language-specific tokenization, including stemming and stop words, when enabled.

This tokenizer is marked as the default tokenizer for Danish ("da") language support and works with customizable options for stemming and stop word removal.

  • Constructor Details

    • LuceneDanishTokenizer

      public LuceneDanishTokenizer()