Pandas
2021-8-6
| 2023-8-6
0  |  阅读时长 0 分钟
type
status
date
slug
summary
tags
category
icon
password
Property
notion image
Pandas是一个开放源码、BSD许可的库,提供高性能、易于使用的数据结构和数据分析工具,是Python 语言的一个扩展程序库
Pandas名字衍生自术语 "panel data"(面板数据)和 "Python data analysis"(Python 数据分析)。
Pandas一个强大的分析结构化数据的工具集,基础是 Numpy提供高性能的矩阵运算。
 
Pandas可以从各种文件格式比如 CSV、JSON、SQL、Microsoft Excel 导入数据。
Pandas可以对各种数据进行运算操作,比如归并、再成形、选择,还有数据清洗和数据加工特征。
Pandas广泛应用在学术、金融、统计学等各个数据分析领域。
 
那么问题来了
numpy已经能够帮助我们处理数据,能够结合matplotlib解决数据分析的问题,那么pandas的目的在什么地方呢?
numpy能够帮我们处理处理数值型数据,但是这还不够, 很多时候,数据除了数值之外,还有字符串,还有时间序列等。比如:通过爬虫获取到了存储在数据库中的数据。所以,pandas出现了。
 
 
  • Pandas
  • 矩阵库和线性代数库Pandas数据结构
    目录