| Package | Description |
|---|---|
| org.canova.nlp.tokenization.tokenizer | |
| org.canova.nlp.tokenization.tokenizerfactory | |
| org.canova.nlp.vectorizer |
| Modifier and Type | Class and Description |
|---|---|
class |
DefaultStreamTokenizer
Tokenizer based on the
StreamTokenizer |
class |
DefaultTokenizer
Default tokenizer
|
class |
PosUimaTokenizer
Filter by part of speech tag.
|
class |
UimaTokenizer
Tokenizer based on the passed in analysis engine
|
| Modifier and Type | Method and Description |
|---|---|
Tokenizer |
PosUimaTokenizerFactory.create(InputStream toTokenize) |
Tokenizer |
UimaTokenizerFactory.create(InputStream toTokenize) |
Tokenizer |
TokenizerFactory.create(InputStream toTokenize)
Create a tokenizer based on an input stream
|
Tokenizer |
DefaultTokenizerFactory.create(InputStream toTokenize) |
Tokenizer |
PosUimaTokenizerFactory.create(String toTokenize) |
Tokenizer |
UimaTokenizerFactory.create(String toTokenize) |
Tokenizer |
TokenizerFactory.create(String toTokenize)
The tokenizer to createComplex
|
Tokenizer |
DefaultTokenizerFactory.create(String toTokenize) |
| Modifier and Type | Method and Description |
|---|---|
abstract void |
TextVectorizer.doWithTokens(Tokenizer tokenizer)
Increment counts, add to collection,...
|
void |
TfidfVectorizer.doWithTokens(Tokenizer tokenizer) |
Copyright © 2015. All rights reserved.