Sentiment Analysis ด้วย Python
Violeta Misheva
Data Scientist
Stemming คือกระบวนการแปลงคำให้เป็นรูปรากศัพท์ แม้ว่ารากศัพท์นั้นอาจไม่ใช่คำที่ถูกต้องในภาษาก็ตาม
staying, stays, stayed ----> stay
house, houses, housing ----> hous
Lemmatization คล้ายกับ Stemming แต่ต่างตรงที่จะลดรูปคำให้เป็นรากศัพท์ที่เป็นคำจริงในภาษา
stay, stays, staying, stayed ----> stay
house, houses, housing ----> house
Stemming
Lemmatization
from nltk.stem import PorterStemmer
porter = PorterStemmer()
porter.stem('wonderful')
'wonder'
Snowball Stemmer: Danish, Dutch, English, Finnish, French, German, Hungarian,Italian, Norwegian, Portuguese, Romanian, Russian, Spanish, Swedish
from nltk.stem.snowball import SnowballStemmer
DutchStemmer = SnowballStemmer("dutch")
DutchStemmer.stem("beginnen")
'begin'
porter.stem('Today is a wonderful day!')
'today is a wonderful day!'
tokens = word_tokenize('Today is a wonderful day!')
stemmed_tokens = [porter.stem(token) for token in tokens]
stemmed_tokens
['today', 'is', 'a', 'wonder', 'day', '!']
from nltk.stem import WordNetLemmatizer
WNlemmatizer = WordNetLemmatizer()
WNlemmatizer.lemmatize('wonderful', pos='a')
'wonderful'
Sentiment Analysis ด้วย Python