spaCy/spacy/lang/uk/__init__.py

# coding: utf8
from __future__ import unicode_literals

from .tokenizer_exceptions import TOKENIZER_EXCEPTIONS
from .stop_words import STOP_WORDS
from .lex_attrs import LEX_ATTRS

from ..tokenizer_exceptions import BASE_EXCEPTIONS
from ..norm_exceptions import BASE_NORMS
from ...util import update_exc, add_lookups
from ...language import Language
from ...lookups import Lookups
from ...attrs import LANG, NORM
from .lemmatizer import UkrainianLemmatizer


class UkrainianDefaults(Language.Defaults):
    lex_attr_getters = dict(Language.Defaults.lex_attr_getters)
    lex_attr_getters[LANG] = lambda text: "uk"
    lex_attr_getters[NORM] = add_lookups(
        Language.Defaults.lex_attr_getters[NORM], BASE_NORMS
    )
    lex_attr_getters.update(LEX_ATTRS)
    tokenizer_exceptions = update_exc(BASE_EXCEPTIONS, TOKENIZER_EXCEPTIONS)
    stop_words = STOP_WORDS

    @classmethod
    def create_lemmatizer(cls, nlp=None, lookups=None):
        if lookups is None:
            lookups = Lookups()
        return UkrainianLemmatizer(lookups)


class Ukrainian(Language):
    lang = "uk"
    Defaults = UkrainianDefaults


__all__ = ["Ukrainian"]
Ukrainian language added. Small fixes in Russian (#3241) * Classes for Ukrainian; small fix in Russian. * Contributor agreement 2019-02-07 23:05:11 +03:00			`# coding: utf8`
			`from __future__ import unicode_literals`

			`from .tokenizer_exceptions import TOKENIZER_EXCEPTIONS`
			`from .stop_words import STOP_WORDS`
			`from .lex_attrs import LEX_ATTRS`

			`from ..tokenizer_exceptions import BASE_EXCEPTIONS`
			`from ..norm_exceptions import BASE_NORMS`
			`from ...util import update_exc, add_lookups`
			`from ...language import Language`
Update Ukrainian lemmatizer with new lookups (#4359) * Update Ukrainian lemmatizer with new lookups * Add missing import Co-authored-by: Ines Montani <ines@ines.io> 2019-10-02 13:04:06 +03:00			`from ...lookups import Lookups`
Tidy up and fix small bugs and typos 2019-02-08 16:14:49 +03:00			`from ...attrs import LANG, NORM`
Ukrainian language added. Small fixes in Russian (#3241) * Classes for Ukrainian; small fix in Russian. * Contributor agreement 2019-02-07 23:05:11 +03:00			`from .lemmatizer import UkrainianLemmatizer`


			`class UkrainianDefaults(Language.Defaults):`
			`lex_attr_getters = dict(Language.Defaults.lex_attr_getters)`
Tidy up and fix small bugs and typos 2019-02-08 16:14:49 +03:00			`lex_attr_getters[LANG] = lambda text: "uk"`
			`lex_attr_getters[NORM] = add_lookups(`
			`Language.Defaults.lex_attr_getters[NORM], BASE_NORMS`
			`)`
Ukrainian language added. Small fixes in Russian (#3241) * Classes for Ukrainian; small fix in Russian. * Contributor agreement 2019-02-07 23:05:11 +03:00			`lex_attr_getters.update(LEX_ATTRS)`
			`tokenizer_exceptions = update_exc(BASE_EXCEPTIONS, TOKENIZER_EXCEPTIONS)`
			`stop_words = STOP_WORDS`

			`@classmethod`
Update Ukrainian lemmatizer with new lookups (#4359) * Update Ukrainian lemmatizer with new lookups * Add missing import Co-authored-by: Ines Montani <ines@ines.io> 2019-10-02 13:04:06 +03:00			`def create_lemmatizer(cls, nlp=None, lookups=None):`
			`if lookups is None:`
			`lookups = Lookups()`
			`return UkrainianLemmatizer(lookups)`
Ukrainian language added. Small fixes in Russian (#3241) * Classes for Ukrainian; small fix in Russian. * Contributor agreement 2019-02-07 23:05:11 +03:00

			`class Ukrainian(Language):`
Tidy up and fix small bugs and typos 2019-02-08 16:14:49 +03:00			`lang = "uk"`
			`Defaults = UkrainianDefaults`
Ukrainian language added. Small fixes in Russian (#3241) * Classes for Ukrainian; small fix in Russian. * Contributor agreement 2019-02-07 23:05:11 +03:00

Tidy up and fix small bugs and typos 2019-02-08 16:14:49 +03:00			`__all__ = ["Ukrainian"]`