DataFrame 及其方法

面向表格用户的 Python

Chris Cardillo

Data Scientist

回顾上节

import pandas as pd

fruit = pd.read_excel('fruit.xlsx')

print(fruit)

简单水果完整数据集

面向表格用户的 Python

pandas DataFrame 结构

简单水果完整数据集

面向表格用户的 Python

pandas DataFrame 结构

简单水果 DataFrame 列

面向表格用户的 Python

pandas DataFrame 结构

简单水果 DataFrame 数值列

面向表格用户的 Python

pandas DataFrame 结构

简单水果 DataFrame 对象-字符列

面向表格用户的 Python

pandas DataFrame 结构

简单水果 DataFrame 行 1

面向表格用户的 Python

pandas DataFrame 结构

简单水果 DataFrame 行 2

面向表格用户的 Python

pandas DataFrame 结构

简单水果 DataFrame 索引

面向表格用户的 Python

DataFrame 方法

  • .head()
  • .info()
  • .describe()
  • .sort_values()
面向表格用户的 Python

.head() 方法

import pandas as pd

fruit = pd.read_excel('fruit.xlsx')

print(fruit.head())

简单水果 DataFrame 的 head

面向表格用户的 Python

.head() 方法

import pandas as pd

fruit = pd.read_excel('fruit.xlsx')

print(fruit.head(2))

带参数的 head 输出

面向表格用户的 Python

.info() 方法

import pandas as pd

fruit = pd.read_excel('fruit.xlsx')

print(fruit.info())
<class 'pandas.core.frame.DataFrame'>
RangeIndex: 8 entries, 0 to 7
Data columns (total 3 columns):
 #   Column     Non-Null Count  Dtype  
 --  ------     --------------  -----  
 0   name       8 non-null      object 
 1   color      8 non-null      object 
 2   price_usd  8 non-null      float64
dtypes: float64(1), object(2)
memory usage: 272.0+ bytes
面向表格用户的 Python

.describe() 方法

import pandas as pd

fruit = pd.read_excel('fruit.xlsx')

print(fruit.describe())

describe 方法输出

面向表格用户的 Python

.sort_values() 方法

import pandas as pd

fruit = pd.read_excel('fruit.xlsx')

fruit = fruit.sort_values('name')
fruit = fruit.reset_index(drop=True)

print(fruit)

按 name 升序排序的 DataFrame

面向表格用户的 Python

.sort_values() 方法

import pandas as pd

fruit = pd.read_excel('fruit.xlsx')

fruit = fruit.sort_values('price_usd', ascending=False)
fruit = fruit.reset_index(drop=True)

print(fruit.head(3))

按 price_usd 降序排序的前 3 行

面向表格用户的 Python

轮到您了!

面向表格用户的 Python

Preparing Video For Download...