Analyse de sentiment en Python
Violeta Misheva
Data Scientist
Objectif : enrichir l'ensemble de données avec des caractéristiques liées à la colonne texte (capturer le sentiment)
reviews.head()
from nltk import word_tokenize
anna_k = 'Happy families are all alike, every unhappy family is unhappy in its own way.'
word_tokenize(anna_k)
['Happy','families','are', 'all','alike',',',
'every','unhappy', 'family', 'is','unhappy','in',
'its','own','way','.']
# Forme générale d'une compréhension de liste
[expression for item in iterable]
word_tokens = [word_tokenize(review) for review in reviews.review]
type(word_tokens)
list
type(word_tokens[0])
list
len_tokens = []
# Parcourir la liste word_tokens
for i in range(len(word_tokens)):
len_tokens.append(len(word_tokens[i]))
# Créer une nouvelle caractéristique : la longueur de chaque évaluation
reviews['n_tokens'] = len_tokens
reviews.head()
Analyse de sentiment en Python