Обработка естественного языка с помощью spaCy
Azadeh Mobasher
Principal data scientist
spaCy для извлечения лингвистических признаков:
spaCy: Doc, Token и Span; предсказывайте семантическое сходство с помощью векторов слов:Matcher и PhraseMatcher из spaCy:
matcher = Matcher(nlp.vocab)
pattern = [{"LOWER": "good"}, {"LOWER": {"IN": ["morning", "evening"]}}]
matcher.add("morning_greeting", [pattern])
matcher = PhraseMatcher(nlp.vocab, attr = "LOWER")
patterns = [nlp.make_doc(term) for term in terms]
matcher.add("InvestmentTerms", patterns)
spaCy и их применение на этапе инференса

Обработка естественного языка с помощью spaCy