テキストマイニングワークフローの復習
Rで学ぶSentiment Analysis
これまでの内容
polarity()
- tidytext, dplyr, tidyr
- 可視化
6つのステップ
- 問題と目標を定義する
- テキストを特定する
- テキストを整理する
- 特徴を抽出する
- 分析する
- 結論・洞察を導く
ステップ1:問題を定義する
ヒント:
- 明確に定義する
- スコープの拡大を避ける
- 手法や主観性辞書を見直し、一貫性を確保する
ステップ2:テキストを特定する
ヒント:
- 適切なソースを選ぶ(例:株価情報はフォーラムの方がWikipediaより有用な場合がある)
- サイトの利用規約を遵守し、スクレイピングに注意する
- テキストソースによって使用される言語が異なる。ソースのトーンや特性を把握する
練習しましょう!
Rで学ぶSentiment Analysis
Preparing Video For Download...