Skip to article frontmatterSkip to article content

Pandas Cheat Sheet / 速查手册

本文翻译自文章:Pandas Cheat Sheet - Python for Data Science,同时添加了部分注解。

对于数据科学家,无论是数据分析还是数据挖掘来说,Pandas是一个非常重要的Python包。它不仅提供了很多方法,使得数据处理非常简单,同时在数据处理速度上也做了很多优化,使得和Python内置方法相比时有了很大的优势。

如果你想学习Pandas,建议先看两个网站。

  1. 官网:Python Data Analysis Library
  2. 十分钟入门Pandas:10 Minutes to pandas

在第一次学习Pandas的过程中,你会发现你需要记忆很多的函数和方法。所以在这里我们汇总一下Pandas官方文档中比较常用的函数和方法,以方便大家记忆。同时,我们提供一个PDF版本,方便大家打印。pandas-cheat-sheet.pdf

关键缩写和包导入

在这个速查手册中,我们使用如下缩写:

df:任意的Pandas DataFrame对象 s:任意的Pandas Series对象

同时我们需要做如下的引入:

import pandas as pd
import numpy as np

导入数据

导出数据

创建测试对象

查看、检查数据

数据选取

数据清理

数据处理:Filter、Sort和GroupBy

数据合并

数据统计