Zpracování přirozeného jazyka (NLP) v Pythonu
Fouad Trad
Machine Learning Engineer

text = """Data scientists and data engineers need DATA""" lower_text = text.lower()print(lower_text)
data scientists and data
engineers need data

Úlohy založené na analýze klíčových slov

Úlohy založené na analýze klíčových slov

Úlohy vyžadující rozlišení slov závislých na velikosti písmen


from nltk.stem import PorterStemmerstemmer = PorterStemmer()tokens = ['running', 'bats', 'organizations', 'reading']stemmed = [stemmer.stem(word) for word in tokens]print(stemmed)
['run', 'bat', 'organizat', 'read']

from nltk.stem import WordNetLemmatizernltk.download('wordnet')lemmatizer = WordNetLemmatizer()tokens = ['running', 'bats', 'organizations', 'reading']lemmatized = [lemmatizer.lemmatize(word) for word in tokens]print(lemmatized)
['running', 'bat', 'organization', 'reading']


Zpracování přirozeného jazyka (NLP) v Pythonu