音效素材网提供各类素材，打造精品素材网站！

站内导航站长工具投稿中心手机访问

音效素材

热门搜索： 狗叫声打雷钟声 wordpress模板图标素材

网页制作|编程语言|产品运营|平面设计|操作系统|数据库|服务器|

当前位置：首页 > 教程 > 编程语言 > python编程 > python pandas模糊匹配读取Excel后获取指定指标的操作

python pandas模糊匹配读取Excel后获取指定指标的操作
日期：2021-09-08 13:40:40 来源：脚本之家

1.首先读取Excel文件

数据代表了各个城市店铺的装修和配置费用，要统计出装修和配置项的总费用并进行加和计算；

2.pandas实现过程

import pandas as pd
#1.读取数据
df = pd.read_excel(r'./data/pfee.xlsx')
print(df)

cols = list(df.columns)
print(cols)

#2.获取含有装修 和 配置 字段的数据
zx_lists=[]
pz_lists=[]
for name in cols:
 if '装修' in name:
  zx_lists.append(name)
 elif '配置' in name:
  pz_lists.append(name)
print(zx_lists)
print(pz_lists)

#3.对装修和配置项费用进行求和计算
df['装修-求和'] =df[zx_lists].apply(lambda x:x.sum(),axis=1)
df['配置-求和'] = df[pz_lists].apply(lambda x:x.sum(),axis=1)
print(df)

补充：pandas 中dataframe 中的模糊匹配与pyspark dataframe 中的模糊匹配

1.pandas dataframe

匹配一个很简单,批量匹配如下

df_obj[df_obj['title'].str.contains(r'.*?n.*')] #使用正则表达式进行模糊匹配,*匹配0或无限次,?匹配0或1次

pyspark dataframe 中模糊匹配有两种方式

2.spark dataframe api, filter rlike 联合使用

df1=df.filter("uri rlike 
 'com.tencent.tmgp.sgame|%E8%80%85%E8%8D%A3%E8%80%80_|android.ugc.live|\
 %e7%88f%e8%a7%86%e9%a2%91|%E7%%8F%E8%A7%86%E9%A2%91'").groupBy("uri").\
 count().sort("count", ascending=False)

注意点：

1.rlike 后面进行批量匹配用引号包裹即可

2.rlike 中要匹配特殊字符的话，不需要转义

3.rlike '\\\\bapple\\\\b' 虽然也可以匹配但是匹配数量不全，具体原因不明，欢迎讨论。

In [5]: df.filter("name rlike '%'").show()
+---+------+-----+
|age|height| name|
+---+------+-----+
| 4| 140|A%l%i|
| 6| 180| i%ce|
+---+------+-----+

3.spark sql

spark.sql("select uri from t where uri like '%com.tencent.tmgp.sgame%' or uri like 'douyu'").show(5)

如果要批量匹配的话，就需要在后面继续添加uri like '%blabla%',就有点繁琐了。

对了这里需要提到原生sql 的批量匹配,regexp 就很方便了，跟rlike 有点相似

mysql> select count(*) from url_parse where uri regexp 'android.ugc.live|com.tencent.tmgp.sgame';
+----------+
| count(*) |
+----------+
|  9768 |
+----------+
1 row in set (0.52 sec)

于是这里就可以将sql中regexp 应用到spark sql 中

In [9]: spark.sql('select * from t where name regexp "%l|t|_"').show()
+---+------+------+
|age|height| name|
+---+------+------+
| 1| 150|Al_ice|
| 4| 140| A%l%i|
+---+------+------+

以上为个人经验，希望能给大家一个参考，也希望大家多多支持。如有错误或未考虑完全的地方，望不吝赐教。

python Pandas 模糊匹配读取excel 指定指标

上一篇：解决PyCharm 中写 Turtle代码没提示以及标黄的问题

下一篇：解决一个pandas执行模糊查询sql的坑

您感兴趣的教程

在docker中安装mysql详解

本篇文章主要介绍了在docker中安装mysql详解，小编觉得挺不错的，现在分享给大家，也给大家做个参考。一起跟随小编...

详解安装 docker mysql2017-05-05

win10中文输入法仅在桌面显示怎么办?

win10中文输入法仅在桌面显示怎么办?

win10系统使用搜狗，QQ输入法只有在显示桌面的时候才出来，在使用其他程序输入框里面却只能输入字母数字，win10中...

win10 中文输入法2020-12-07

一分钟掌握linux系统目录结构

这篇文章主要介绍了linux系统目录结构，通过结构图和多张表格了解linux系统目录结构，感兴趣的小伙伴们可以参考一...

结构目录系统 linux2016-05-03

PHP程序员玩转Linux系列 Linux和Windows安装

这篇文章主要为大家详细介绍了PHP程序员玩转Linux系列文章，Linux和Windows安装nginx教程，具有一定的参考价值，感兴趣...

玩转程序员安装系列 PHP2017-04-12

win10怎么安装杜比音效Doby V4.1 win10安装杜

第四代杜比®家庭影院®技术包含了一整套协同工作的技术，让PC 发出清晰的环绕声同时第四代杜比家庭影院技术...

win10杜比音效2015-09-22

纯CSS实现iOS风格打开关闭选择框功能

这篇文章主要介绍了纯CSS实现iOS风格打开关闭选择框,本文通过实例代码给大家介绍的非常详细，对大家的学习或工作...

css ios c2021-09-05

Win7如何给C盘扩容 Win7系统电脑C盘扩容的办法

Win7如何给C盘扩容 Win7系统电脑C盘扩容的

Win7给电脑C盘扩容的办法大家知道吗？当系统分区C盘空间不足时，就需要给它扩容了，如果不管，C盘没有足够的空间...

Win7 C盘扩容2021-03-29

百度推广竞品词的投放策略

SEM是基于关键词搜索的营销活动。作为推广人员，我们所做的工作，就是打理成千上万的关键词，关注它们的质量度...

百度推广竞品词2012-07-31

Visual Studio Code(vscode) git的使用教程

这篇文章主要介绍了详解Visual Studio Code(vscode) git的使用，小编觉得挺不错的，现在分享给大家，也给大家做个参考。...

教程 Studio Visual Code git2017-11-10

七牛云储存创始人分享七牛的创立故事与

这篇文章主要介绍了七牛云储存创始人分享七牛的创立故事与对Go语言的应用,七牛选用Go语言这门新兴的编程语言进行...

七牛 Go语言2015-12-28

Win10预览版Mobile 10547即将发布 9月19日上午

微软副总裁Gabriel Aul的Twitter透露了 Win10 Mobile预览版10536即将发布，他表示该版本已进入内部慢速版阶段，发布时间目...

Win10 预览版2015-09-17

HTML标签meta总结,HTML5 head meta 属性整理

移动前端开发中添加一些webkit专属的HTML5头部标签，帮助浏览器更好解析HTML代码，更好地将移动web前端页面表现出来...

2021-09-03

移动端html5模拟长按事件的实现方法

这篇文章主要介绍了移动端html5模拟长按事件的实现方法的相关资料,小编觉得挺不错的，现在分享给大家，也给大家...

移动端 html5 长按2021-09-04

HTML常用meta大全(推荐)

这篇文章主要介绍了HTML常用meta大全(推荐)，文中通过示例代码介绍的非常详细，对大家的学习或者工作具有一定的参...

2021-09-03

cdr怎么把图片转换成位图? cdr图片转换为位图的教程

cdr怎么把图片转换成位图? cdr图片转换为

cdr怎么把图片转换成位图？cdr中插入的图片想要转换成位图，该怎么转换呢？下面我们就来看看cdr图片转换为位图的...

cdr 图片位图2018-01-29

win10系统怎么录屏?win10系统自带录屏详细教程

win10系统怎么录屏?win10系统自带录屏详细

当我们是使用win10系统的时候，想要录制电脑上的画面，这时候有人会想到下个第三方软件，其实可以用电脑上的自带...

win10 系统自带录屏详细教程2021-05-18

+ 更多教程 +

精选教程

教程标签

pycharm pip install Flask Selenium 关闭浏览器浏览器关闭窗口截图键盘事件 python 元素等待安装使用 Selenium使用爬虫requests模块爬虫模块实现全文搜索中英文搜索表单嵌套 iframe表单嵌套爬虫方法多窗口切换 python3 嵌套式对象下载音乐网易云音乐批量下载鼠标事件爬取百度文库下载百度文库 Cookies自动登录警告框启动项参数启动项 Python爬虫逆向控制浏览器 oBIX 访问Niagara数据迭代元素加法重载 all函数

热门教程

关于我们

音效素材网整合国内外优质的资源，内容涉及js效果代码，平面设计教程，网页设计教程，cms建站，网页模版等领域，提供最新的行业资讯，设计教程和素材参考学习。

版权声明

声明：本站发布的资源均来自互联网，仅供交流学习之用，请勿作商业用途，所有资源版权归原作者所有。如果有侵犯到您的权益，请联系本站删除，谢谢合作！

音效素材网(YinXiaoSuCai.CN)

Copyright © 1999-2022 音效素材网版权所有京ICP备11032199号-4 关于我们 | 广告合作 | 版权声明 | 联系我们 | 友情链接 | RSS订阅 |

ASP编程 JSP编程 PHP编程 .NET编程 python编程