恒美微站 Logo 恒美微站
  • 首页
  • 关于我们
  • 建站服务
  • 主题模板
  • 案例展示
  • 资讯中心
  • 联系我们

Pandas 基础操作(案持续更新)

  • 首页
  • 资讯中心
  • /
  • Pandas 基础操作(案持续更新)

相关资讯

时序图实战指南:从核心原理到微服务交互设计 2026/8/3 19:18:58
Excel时间计算全解析:从原理到实战,精准处理日期与时分秒 2026/8/3 19:18:58
C++多态机制深度解析:从虚函数表到设计模式实践 2026/8/3 19:18:58

最新资讯

m4s-converter:B站缓存视频无损转换终极指南,守护你的数字记忆
5个高效配置技巧:重新定义fb-mac-messenger的桌面体验
如何在5分钟内为Unreal Engine项目添加Lua脚本支持:UnLua插件完整指南
Primer设计系统迁移实战:3个关键检查点助你平稳升级
如何在Adobe Illustrator中轻松实现专业级LaTeX公式排版:LaTeX2AI插件完全指南
Visio 2019 合法替代方案与专业绘图技巧全解析

今日推荐

无线一体式手持三维扫描仪推荐:摆脱电脑束缚的工业检测新选择
3个让你工作效率翻倍的Umi-OCR实战技巧:免费离线文字识别完全指南
[具身智能-181]:PC+服务器+具身机器人:构建具身智能从仿真到量产的闭环迭代混合架构

本周热门

ncmdumpGUI:一键解锁网易云音乐ncm文件的终极解决方案
分布式配置中心选型实战:Nacos与Consul在创业场景下的对比
MoneyPrinterPlus实战指南:AI视频批量生成与自动化发布完整解决方案

本月精选

如何用DamaiHelper实现演唱会门票的智能自动化抢购:完整技术解决方案指南
第4篇:59 倍性能差距的索引瓶颈定位——一次教科书级的全表扫描调优
终极歌词批量下载神器:5分钟解决离线音乐库歌词同步难题

Pandas 基础操作(案持续更新)

发布时间:2026/8/3 19:23:59
Pandas 基础操作(案持续更新) 引言说到excel或.csv表格中的数据处理就不得不提到pandas模块。这里简单分享一下pandas模块的基础操作。这里表格文件的数据类型以xlsx和csv来举例。正文创建一维带索引的数据Pandas 库中通常我们需要使用 pd.Series() 函数来创建一维数据。Pandas 库中的索引 index 是按行显示index 参数的长度必须要保持和数据的行数一致否则就会报错。dfpd.Series([3,-5,7,4],index[a,b,c,d])print(df) reuslt: a 3 b -5 c 7 d 4 dtype: int64 可以看到一维的数据是以列的形式进行排列的。dfpd.Series([3,-5,7,4])print(df) result: 0 3 1 -5 2 7 3 4 dtype: int64 Pandas 生成的一维数据默认是带索引值的且索引值从 0 开始。注意Pandas Series 创建后默认就有索引而且无法彻底关闭或删除索引因为索引是 Series 的核心数据结构组成部分。但是我们可以在输出的时候令其不显示。一维数据无法设定列名。创建二维带索引的数据Pandas 库中通常我们需要使用 pd.DataFrame() 函数来创建二维数据。默认列名的二维数据data[[Belgium,india,Brazil],[Brussels,New Delhi,Brasilia],[11190846,1303171035,207847528]]dfpd.DataFrame(data)print(df)Pandas 库中二维数据默认的列名称从 0 开始与 index 参数类似。二维数据必须有列名。自定义列名的二维数据从列表指定如果想要自己指定列名可以使用如下方法data[[Belgium,india,Brazil],[Brussels,New Delhi,Brasilia],[11190846,1303171035,207847528]]dfpd.DataFrame(data,columns[Country,Capital,Population])print(df)可以通过 columns 参数指定二维数据的列名称。从字典指定也可以通过字典的关键字信息对二位数据的列名进行指定。importpandasaspd data{Country:[Belgium,india,Brazil],Capital:[Brussels,New Delhi,Brasilia],Population:[11190846,1303171035,207847528]}dfpd.DataFrame(data)print(df)当然也可以再次通过关键字进行列名指定。我们得到与之前一样的结果当前默认列名为[Country, Capital, Population]如果再次通过关键字 columns 进行指定会重写默认列名参数。但是因为此时数据是存放在字典中的列名被改写后原始 values 数据不会存在。importpandasaspd data{Country:[Belgium,india,Brazil],Capital:[Brussels,New Delhi,Brasilia],Population:[11190846,1303171035,207847528]}dfpd.DataFrame(data,columns[0,1,2])print(df)可以看到这里我们创建了一个二维数据其中列标签沿着横向排列。索引值沿着纵向排列。即pd.Series() 函数用于创建一维数据pd.DataFrame() 函数用于创建二维数据。获取一维数据中单个数据值# 通过标签获得单个值dfpd.Series([3,-5,7,4],index[a,b,c,d])print(df[a]) reuslt: 3 # 通过索引获得单个值print(df[0]) reuslt: 3 我们通过标签或者索引均成功地获得了单个数据值获取二维数据中单个数据值数据Country Capital Population0Belgium Brussels111908461india New Delhi13031710352Brazil Brasilia207847528生成数据代码data{Country:[Belgium,india,Brazil],Capital:[Brussels,New Delhi,Brasilia],Population:[11190846,1303171035,207847528]}dfpd.DataFrame(data,columns[Country,Capital,Population])打印数据代码print(df.iloc[0,0])print(df.iat[0,0]) result: Belgium Belgium 可以看到通过DataFrame.iloc()和DataFrame.iat()方法我们均成功地获取到了二维数组中的单个数据值。我们也可以采用其他方式比如print(df.loc[df[Country]Belgium])print(df.loc[df[Country]Belgium].values)print(df.loc[df[Country]Belgium].values[0])print(df.loc[df[Country]Belgium][Country])print(df.loc[df[Country]Belgium][Country].values)print(df.loc[df[Country]Belgium][Country].values[0])print(df.loc[df[Country]Belgium,Country])print(df.loc[df[Country]Belgium,Country].values)print(df.loc[df[Country]Belgium,Country].values[0])print(df.loc[0,Country])输出结果如下读者可自定比对体会Country Capital Population0Belgium Brussels11190846[[BelgiumBrussels11190846]][BelgiumBrussels11190846]0Belgium Name:Country,dtype:object[Belgium]Belgium0Belgium Name:Country,dtype:object[Belgium]Belgium Belgium可以看到df.loc[df[Country]Belgium][Country]与df.loc[df[Country]Belgium, Country]的输出结果一致它们等价可以类比 numpy 二维数组操作。.loc() 函数与 iloc() 函数的区别是loc 基于标签label索引iloc 基于位置position索引。获取DataFrame子集合的值data{Country:[Belgium,india,Brazil],Capital:[Brussels,New Delhi,Brasilia],Population:[11190846,1303171035,207847528]}dfpd.DataFrame(data,columns[Country,Capital,Population])print(df[1:]) result: Country Capital Population 1 india New Delhi 1303171035 2 Brazil Brasilia 207847528 可以看到 我们成功获取到了索引值大于1的原始DataFrame中的所有值。通过标签获得单行的值data{Country:[Belgium,india,Brazil],Capital:[Brussels,New Delhi,Brasilia],Population:[11190846,1303171035,207847528]}dfpd.DataFrame(data,columns[Country,Capital,Population])print(df.loc[[0]]) result: Country Capital Population 0 Belgium Brussels 11190846 可以看到我们成功获取到了单行的值。通过标签获得单列的值data{Country:[Belgium,india,Brazil],Capital:[Brussels,New Delhi,Brasilia],Population:[11190846,1303171035,207847528]}dfpd.DataFrame(data,columns[Country,Capital,Population])print(df[[Country]]) result: Country 0 Belgium 1 india 2 Brazil 可以看到我们成功获取到了单列的值。关于提取数据时参数为什么要带中括号的原因可以看这篇pandas中提取单行单列数据时的参数问题(超链接点击跳转)。码字不易如果大家觉得有用请高抬贵手给一个赞让我上推荐让更多的人看到吧~

关于恒美微站

恒美微站专注于为个体商户、工作室提供极简自助建站服务,让每个人都能轻松拥有专业网站。

快速链接

  • 关于我们
  • 建站服务
  • 主题模板
  • 案例展示
  • 资讯中心

服务项目

  • 可视化建站
  • 拖拽编辑
  • 主题定制
  • SEO 优化
  • 网站托管

联系方式

  • 📍 地址:北京市朝阳区建国路 88 号
  • 📞 电话:400-888-8888
  • ✉️ 邮箱:info@hmyw.cn
  • 🕐 时间:周一至周日 9:00-18:00

© 2024 恒美微站 hmyw.cn 版权所有 | 京 ICP 备 12345678 号