邏輯斯迴歸:再探

Python 情感分析

Violeta Misheva

Data Scientist

複雜模型與正規化

複雜模型:

  • 複雜模型會擬合雜訊(過度擬合)
  • 特徵或參數數量很多

正規化:

  • 用來簡化並讓模型不那麼複雜的方法
Python 情感分析

邏輯斯迴歸中的正規化

from sklearn.linear_model import LogisticRegression
# Regularization arguments
LogisticRegression(penalty='l2', C=1.0)
  • L2:將所有係數往 0 收縮
  • C 值高:懲罰小,模型更貼合訓練資料。
  • C 值低:懲罰大,模型彈性較低。
Python 情感分析

預測機率 vs. 預測類別

log_reg = LogisticRegression().fit(X_train, y_train)
# Predict labels 
y_predicted = log_reg.predict(X_test)
# Predict probability
y_probab = log_reg.predict_proba(X_test)
Python 情感分析

預測機率 vs. 預測類別

y_probab
array([[0.5002245, 0.4997755],
       [0.4900345, 0.5099655],
        ...,
       [0.7040499, 0.2959501]])
# Select the probabilities of class 1
y_probab = log_reg.predict_proba(X_test)[:, 1]
array([0.4997755, 0.5099655 ..., 0.2959501]])
Python 情感分析

以機率做評估的指標

  • 對機率輸入會拋出 ValueError
  • 準確率與混淆矩陣需使用類別。

# 預設機率編碼:
# 若 probability >= 0.5,則為類別 1;否則為類別 0
Python 情感分析

一起來練習吧!

Python 情感分析

Preparing Video For Download...