キー列での結合

スプレッドシート利用者のためのPandas結合

John Miller

Principal Data Scientist

フレームワーク(続き)

$$

データを確認・把握したら:

  • 関係性を特定
  • キー列の一意性を確認

四角形

スプレッドシート利用者のためのPandas結合

一意キー列

$$ $$ 単一列キーの一意値

df.duplicated('GameKey').sum()

$$ -- -- 0 は重複なしを意味します -- --

df.duplicated(['GameKey', 'PlayId']).sum()

単一列インデックス

複数列インデックス

スプレッドシート利用者のためのPandas結合

フレームワーク(続き)

$$

データを確認・把握したら:

  • 関係性を特定
  • キー列の一意性を確認
  • マージ文を書いて実行

四角形

スプレッドシート利用者のためのPandas結合

マージの実行

$$

文法は同じです。

df1.merge(df2, how='inner', on='')

  • パラメータに注意

$$

完全な構文: DataFrame.merge(right, how='inner', on=None, left_on=None, right_on=None, left_index=False, right_index=False, sort=False, suffixes=('_x', '_y'), indicator=False, validate=None)

スプレッドシート利用者のためのPandas結合

マージの検証

DataFrame.merge(right, how='inner', on=None, left_on=None, right_on=None, left_index=False, right_index=False, sort=False, suffixes=('_x', '_y'), indicator=False, validate=None)

$$

validate の値:

  • "one_to_one" または "1:1"
  • "one_to_many" または "1:m"
  • "many_to_one" または "m:1"
  • "many_to_many" または "m:m"(何もしない)
スプレッドシート利用者のためのPandas結合

Passons à la pratique !

スプレッドシート利用者のためのPandas結合

Preparing Video For Download...