当前位置: 首页 > news >正文

数据科学和机器学习的“看家兵器”——pandas模块 之二

目录

  pandas 模块介绍

  4.2 pandas 数据读取

  4.2.1 课程目标

  4.2.2 读取 Excel 文件中的数据

  (一)读取某个工作表中的数据

  (二)读取指定数据列的标签内容

  (三)读取指定数据行的标签内容

  (四)读取指定行或者列

  4.2.3、读取 CSV 文件数据

  4.2.4、课程总结回顾

  4.2.5、课后练习题


  

  pandas 模块介绍

  pandas 是 Python 的一个开源数据分析库,为 Python 提供了高性能、易用的数据结构和数据分析工具。它建立在 NumPy 之上,使得以 NumPy 为中心的应用变得更加简单。pandas 的名字衍生自术语 "panel data"(面板数据)和 "Python data analysis"(Python 数据分析)。

  pandas 的主要数据结构是 Series(一维数组)和 DataFrame(二维表格型数据结构),它们能够处理各种类型的数据,无论是时间序列数据、表格数据还是矩阵数据。pandas 提供了高级数据操作功能,包括数据清洗、合并、重塑、聚合和时间序列分析等。它广泛应用于金融、经济、统计、社会科学等领域,是数据科学和机器学习工作流程中不可或缺的工具。

  4.2 pandas 数据读取

  4.2.1 课程目标

  本次课程主要围绕 pandas 的数据读取功能展开,通过理论讲解和案例分析,让同学们掌握从 Excel 和 CSV 文件中读取数据的方法和技巧。同学们学完本次课程后,能够熟练使用 pandas 进行不同格式数据的读取和基本处理。

  4.2.2 读取 Excel 文件中的数据

  pandas 提供了强大而灵活的 Excel 文件读取功能,可以读取整个工作表、指定的行列数据等。下面将详细介绍这些功能并通过案例演示。

  (一)读取某个工作表中的数据

  在 Excel 文件中,可能包含多个工作表。pandas 的read_excel()函数可以通过sheet_name参数指定要读取的工作表。

import pandas as pd# 读取Excel文件
# 实际使用时,请替换为你的文件路径
# excel_file = pd.ExcelFile('path_to_your_excel_file.xlsx')# 为了演示,我们创建一个示例Excel文件
data = {'姓名': ['张三', '李四', '王五', '赵六', '钱七'],'年龄': [25, 30, 28, 35, 40],'性别': ['男', '女', '男', '女', '男'],'职业': ['工程师', '教师', '医生', '律师', '经理'],'收入': [8000, 6500, 12000, 15000, 20000]
}# 创建DataFrame
df = pd.DataFrame(data)# 将DataFrame写入Excel文件
df.to_excel('example.xlsx', sheet_name='Sheet1', index=False)# 读取Excel文件
excel_file = pd.ExcelFile('example.xlsx')# 获取指定工作表中的数据
df = excel_file.parse('Sheet1')# 查看数据的基本信息
print('数据基本信息:')
df.info()# 查看数据集行数和列数
rows, columns = df.shape# 查看数据集行数和列数
if rows < 10 and columns < 10:# 短表数据(行数少于10且列数少于10)查看全量数据信息print("\n数据全部内容信息:")print(df.to_csv(sep='\t', na_rep='nan'))
else:# 长表数
http://www.xdnf.cn/news/464581.html

相关文章:

  • c++从入门到精通(四)--动态内存,模板与泛型编程
  • python克洛伊婚纱摄影预约管理系统
  • P2679 [NOIP 2015 提高组] 子串
  • Linux之Yum源与Nginx服务篇
  • Node.js 安装 + React Flow 快速入门:环境安装与项目搭建
  • Spring Boot 和 Jedis版本搭配的建议
  • 【言语】刷题5
  • win11平台下的docker-desktop中的volume位置问题
  • Newtonsoft.Json.JsonSerializationException
  • 安卓A15系统实现修改锁屏界面默认壁纸功能
  • 多个docker-compose-xx 停止并完全卸载 删除
  • C++:字符数组与字符串指针变量的大小
  • 鸿蒙OSUniApp制作多选框与单选框组件#三方框架 #Uniapp
  • 协作赋能-1-制造业生产流程重构
  • Midjourney 最佳创作思路与实战技巧深度解析【附提示词与学习资料包下载】
  • 一些问题杂记
  • NY244NY249美光闪存颗粒NY252NY256
  • unity terrain 在生成草,树,石头等地形障碍的时候,无法触发碰撞导致人物穿过模型
  • 全链路压测实战指南:从理论到高可用架构的终极验证
  • Transformer的理解
  • Elasticsearch 分片机制高频面试题(含参考答案)
  • 【备忘踩坑】Android单元测试中读取测试assets的方法
  • 一套基于 Bootstrap 和 .NET Blazor 的开源企业级组件库
  • C#中Action的用法
  • Milvus Docker 部署教程
  • 【FFmpeg+SDL】使用FFmpeg捕获屏幕,SDL显示
  • 套路化编程:C# winform ListView 自定义排序
  • 5款AI驱动的MySQL数据库管理工具:提升运维效率的智能之选
  • 数智化招标采购系统如何实现分散评标?
  • Git/GitLab日常使用的命令指南来了!