Pandas简介 Pandas教程 Pandas环境设置 Pandas是一个开源的Python库,使用其强大的数据结构提供高性能的数据处理和分析工具。Pandas这个名字源自面板数据 - 来自多维数据的计量经济学。 2008年,开发人员Wes McKinney在需要高性能,灵活的数据分析工具时开始开发Pandas。 在Pandas之前,Python主要用于数据管理和准备。它对数据分析的贡献很小。Pandas解决了这个问题。使用Pandas,无论数据来源如何 - 加载,准备,操作,建模和分析,我们都可以完成数据处理和分析中的五个典型步骤。 Python与Pandas一起使用的领域广泛,包括学术和商业领域,包括金融,经济学,统计学,分析学等。 Pandas的主要特点 使用默认和自定义索引的快速高效的DataFrame对象。 用于将数据从不同文件格式加载到内存数据对象的工具。 数据对齐和缺失数据的集成处理。 重新设置和旋转日期集。 大数据集的基于标签的分片,索引和子集。 数据结构中的列可以被删除或插入。 按数据分组进行聚合和转换。 高性能的数据合并和连接。 时间序列功能。 Pandas教程 Pandas环境设置