diff --git a/src/lib/index.ts b/src/lib/index.ts index 791c2b6..59a9cdd 100644 --- a/src/lib/index.ts +++ b/src/lib/index.ts @@ -5,6 +5,7 @@ import guessLanguage from './tools/guess_language' const defaults: IOptions = { delimiters: ['\\s+'], language: 'english', + blockwords: [], } export default function process(text: string, opts?: IOptions): string[] { @@ -12,6 +13,10 @@ export default function process(text: string, opts?: IOptions): string[] { if (!opts || !opts.language) { options.language = guessLanguage(text) } + + if (!opts || !opts.blockwords) { + options.blockwords = [] + } const params = merge(options, { corpus: text }) const keywords = rake(params) return keywords diff --git a/src/lib/rake.ts b/src/lib/rake.ts index eb9f422..f410f45 100644 --- a/src/lib/rake.ts +++ b/src/lib/rake.ts @@ -24,7 +24,7 @@ export function rake(params: IParameters): string[] { // step 2: loop through all words, generate ngrams/stems/phrases/metrics const stemmer = new Stemmer(params.language) - const stopwords = load(params.language) + const stopwords = params.blockwords const parser = new Parser(stemmer, stopwords).process(wordArray) // step 3: build a co-occurence matrix for all words (-> stems)