N-gram text classification for large corpus
- Process large files
- Test cases
- Docker support
pyenv local
pyenv activatepython ngrams.py some-large-text.txt
# OR
cat some-large-text.txt | python ngrams.pydocker build . -t ngrams
docker run -i --rm ngrams < ./texts/mobydick.txt
cat ./texts/mobydick.txt | docker run -i --rm ngramspython tests.py