news 2026/7/31 10:58:51

Python基本库——Pandas

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
Python基本库——Pandas

一、Pandas 核心概念

Pandas 是 Python 中用于数据清洗、数据处理、数据分析的核心库,就像 “Excel 升级版 + 数据库简化版”,能轻松处理表格型数据(比如 CSV、Excel 文件),比纯 Python 列表 / 字典处理数据效率高得多。

核心数据结构有两个:

  1. Series:一维数据(类似单列表格 / 带标签的数组),比如一列学生成绩;
  2. DataFrame:二维数据(类似完整的 Excel 表格),是 Pandas 最常用的结构,由行和列组成,每列可以是不同数据类型(数值、字符串、时间等)。

二、Pandas 基础使用(开箱即用代码)

1. 安装与导入(前置条件)

首先确保安装了 Pandas,终端执行:

bash

运行

pip install pandas # 如果需要读写Excel文件,额外安装: pip install openpyxl xlrd

导入 Pandas(惯例简写为 pd):

python

运行

import pandas as pd
2. 核心操作示例(新手必学)

python

运行

# 1. 创建DataFrame(模拟一份学生成绩数据) data = { "姓名": ["张三", "李四", "王五", "赵六"], "语文": [85, 92, 78, 88], "数学": [90, 80, 85, 95], "班级": ["一班", "二班", "一班", "二班"] } df = pd.DataFrame(data) # 2. 查看数据(基础探索) print("前2行数据:") print(df.head(2)) # 查看前n行,默认5行 print("\n数据基本信息:") print(df.info()) # 查看列名、数据类型、非空值数量 print("\n数值列统计信息:") print(df.describe()) # 均值、标准差、最值等 # 3. 数据筛选(按条件找数据) # 筛选数学成绩≥90的学生 high_math = df[df["数学"] >= 90] print("\n数学≥90分的学生:") print(high_math) # 4. 数据分组统计(按班级算平均分) class_avg = df.groupby("班级")[["语文", "数学"]].mean() print("\n各班级语文/数学平均分:") print(class_avg) # 5. 读写文件(实战常用) df.to_excel("学生成绩.xlsx", index=False) # 保存为Excel,index=False不保存行号 new_df = pd.read_excel("学生成绩.xlsx") # 读取Excel文件 print("\n从Excel读取的数据:") print(new_df)
代码执行效果示例:

plaintext

前2行数据: 姓名 语文 数学 班级 0 张三 85 90 一班 1 李四 92 80 二班 数据基本信息: <class 'pandas.core.frame.DataFrame'> RangeIndex: 4 entries, 0 to 3 Data columns (total 4 columns): # Column Non-Null Count Dtype --- ------ -------------- ----- 0 姓名 4 non-null object 1 语文 4 non-null int64 2 数学 4 non-null int64 3 班级 4 non-null object dtypes: int64(2), object(2) memory usage: 256.0+ bytes None 数值列统计信息: 语文 数学 count 4.000000 4.000000 mean 85.750000 87.500000 std 5.916080 6.454972 min 78.000000 80.000000 25% 83.250000 83.750000 50% 86.500000 87.500000 75% 89.000000 91.250000 max 92.000000 95.000000 数学≥90分的学生: 姓名 语文 数学 班级 0 张三 85 90 一班 3 赵六 88 95 二班 各班级语文/数学平均分: 语文 数学 班级 一班 81.5 87.5 二班 90.0 87.5 从Excel读取的数据: 姓名 语文 数学 班级 0 张三 85 90 一班 1 李四 92 80 二班 2 王五 78 85 一班 3 赵六 88 95 二班

三、Pandas 适用场景

  • 处理结构化数据:比如清洗爬虫数据、分析销售报表、整理问卷调查结果;
  • 数据预处理:机器学习前的缺失值填充、异常值处理、数据格式转换;
  • 快速统计分析:替代 Excel 做批量计算、分组汇总、多表合并。

总结

  1. Pandas 是 Python 处理表格数据的核心库,核心结构是Series(一维)DataFrame(二维)
  2. 新手先掌握:创建 / 查看数据、筛选数据、分组统计、读写文件这 4 个核心操作;
  3. Pandas 优势是高效处理大量数据,比 Excel 更灵活,比纯 Python 代码更简洁。
版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/7/28 11:44:02

Qwen-Image-2512成本控制:小团队也能负担的GPU方案

Qwen-Image-2512成本控制&#xff1a;小团队也能负担的GPU方案 1. 为什么小团队需要关注生成模型的成本&#xff1f; 对于初创团队、自由职业者或小型设计工作室来说&#xff0c;AI图像生成技术虽然诱人&#xff0c;但高昂的硬件投入和运维成本常常让人望而却步。动辄需要多张…

作者头像 李华
网站建设 2026/7/31 10:57:21

如何3步搭建专属纯净音乐空间?告别广告干扰的终极方案

如何3步搭建专属纯净音乐空间&#xff1f;告别广告干扰的终极方案 【免费下载链接】tonzhon-music 铜钟 (Tonzhon.com): 免费听歌; 没有直播, 社交, 广告, 干扰; 简洁纯粹, 资源丰富, 体验独特&#xff01;(密码重置功能已回归) 项目地址: https://gitcode.com/GitHub_Trendi…

作者头像 李华
网站建设 2026/7/31 10:57:26

网易云音乐API终极指南:5分钟搭建个人音乐服务

网易云音乐API终极指南&#xff1a;5分钟搭建个人音乐服务 【免费下载链接】NeteaseCloudMusicApiBackup 项目地址: https://gitcode.com/gh_mirrors/ne/NeteaseCloudMusicApiBackup 想要在自己的项目中快速集成专业的音乐播放功能吗&#xff1f;网易云音乐API项目为你…

作者头像 李华
网站建设 2026/7/29 9:33:20

硬件伪装终极指南:三步快速配置EASY-HWID-SPOOFER

硬件伪装终极指南&#xff1a;三步快速配置EASY-HWID-SPOOFER 【免费下载链接】EASY-HWID-SPOOFER 基于内核模式的硬件信息欺骗工具 项目地址: https://gitcode.com/gh_mirrors/ea/EASY-HWID-SPOOFER 在数字隐私日益重要的今天&#xff0c;硬件指纹追踪已成为威胁个人隐…

作者头像 李华
网站建设 2026/7/31 10:57:30

怎样高效制作电子书:网页内容转换实用攻略

怎样高效制作电子书&#xff1a;网页内容转换实用攻略 【免费下载链接】WebToEpub A simple Chrome (and Firefox) Extension that converts Web Novels (and other web pages) into an EPUB. 项目地址: https://gitcode.com/gh_mirrors/we/WebToEpub 还在为网络小说无法…

作者头像 李华
网站建设 2026/7/28 21:10:57

深度解析Silk v3音频编解码:5个关键技术要点与实战应用

深度解析Silk v3音频编解码&#xff1a;5个关键技术要点与实战应用 【免费下载链接】silk-v3-decoder [Skype Silk Codec SDK]Decode silk v3 audio files (like wechat amr, aud files, qq slk files) and convert to other format (like mp3). Batch conversion support. 项…

作者头像 李华