电脑知识|欧美黑人一区二区三区|软件|欧美黑人一级爽快片淫片高清|系统|欧美黑人狂野猛交老妇|数据库|服务器|编程开发|网络运营|知识问答|技术教程文章 - 好吧啦网

您的位置:首頁技術文章
文章詳情頁

python pandas模糊匹配 讀取Excel后 獲取指定指標的操作

瀏覽:2日期:2022-06-26 11:30:53
1.首先讀取Excel文件

python pandas模糊匹配 讀取Excel后 獲取指定指標的操作

數據代表了各個城市店鋪的裝修和配置費用,要統計出裝修和配置項的總費用并進行加和計算;

2.pandas實現過程

import pandas as pd#1.讀取數據df = pd.read_excel(r’./data/pfee.xlsx’)print(df)

python pandas模糊匹配 讀取Excel后 獲取指定指標的操作

cols = list(df.columns)print(cols)

python pandas模糊匹配 讀取Excel后 獲取指定指標的操作

#2.獲取含有裝修 和 配置 字段的數據zx_lists=[]pz_lists=[]for name in cols: if ’裝修’ in name: zx_lists.append(name) elif ’配置’ in name: pz_lists.append(name)print(zx_lists)print(pz_lists)

python pandas模糊匹配 讀取Excel后 獲取指定指標的操作

#3.對裝修和配置項費用進行求和計算df[’裝修-求和’] =df[zx_lists].apply(lambda x:x.sum(),axis=1)df[’配置-求和’] = df[pz_lists].apply(lambda x:x.sum(),axis=1)print(df)

python pandas模糊匹配 讀取Excel后 獲取指定指標的操作

補充:pandas 中dataframe 中的模糊匹配 與pyspark dataframe 中的模糊匹配

1.pandas dataframe

匹配一個很簡單,批量匹配如下

df_obj[df_obj[’title’].str.contains(r’.*?n.*’)] #使用正則表達式進行模糊匹配,*匹配0或無限次,?匹配0或1次

pyspark dataframe 中模糊匹配有兩種方式

2.spark dataframe api, filter rlike 聯合使用

df1=df.filter('uri rlike ’com.tencent.tmgp.sgame|%E8%80%85%E8%8D%A3%E8%80%80_|android.ugc.live| %e7%88f%e8%a7%86%e9%a2%91|%E7%%8F%E8%A7%86%E9%A2%91’').groupBy('uri'). count().sort('count', ascending=False)

注意點:

1.rlike 后面進行批量匹配用引號包裹即可

2.rlike 中要匹配特殊字符的話,不需要轉義

3.rlike ’bappleb’ 雖然也可以匹配但是匹配數量不全,具體原因不明,歡迎討論。

In [5]: df.filter('name rlike ’%’').show()+---+------+-----+|age|height| name|+---+------+-----+| 4| 140|A%l%i|| 6| 180| i%ce|+---+------+-----+3.spark sql

spark.sql('select uri from t where uri like ’%com.tencent.tmgp.sgame%’ or uri like ’douyu’').show(5)

如果要批量匹配的話,就需要在后面繼續添加uri like ’%blabla%’,就有點繁瑣了。

對了這里需要提到原生sql 的批量匹配,regexp 就很方便了,跟rlike 有點相似

mysql> select count(*) from url_parse where uri regexp ’android.ugc.live|com.tencent.tmgp.sgame’;+----------+| count(*) |+----------+| 9768 |+----------+1 row in set (0.52 sec)

于是這里就可以將sql中regexp 應用到spark sql 中

In [9]: spark.sql(’select * from t where name regexp '%l|t|_'’).show()+---+------+------+|age|height| name|+---+------+------+| 1| 150|Al_ice|| 4| 140| A%l%i|+---+------+------+

以上為個人經驗,希望能給大家一個參考,也希望大家多多支持好吧啦網。如有錯誤或未考慮完全的地方,望不吝賜教。

標簽: python
相關文章:
主站蜘蛛池模板: 深圳快餐店设计-餐饮设计公司-餐饮空间品牌全案设计-深圳市勤蜂装饰工程 | 破碎机锤头_合金耐磨锤头_郑州宇耐机械工程技术有限公司 | 艾默生变频器,艾默生ct,变频器,ct驱动器,广州艾默生变频器,供水专用变频器,风机变频器,电梯变频器,艾默生变频器代理-广州市盟雄贸易有限公司官方网站-艾默生变频器应用解决方案服务商 | 蓝鹏测控平台 - 智慧车间系统 - 车间生产数据采集与分析系统 | 威实软件_软件定制开发_OA_OA办公系统_OA系统_办公自动化软件 | 工业雾炮机_超细雾炮_远程抑尘射雾器-世纪润德环保设备 | 桑茶-七彩贝壳桑叶茶 长寿茶| 威海防火彩钢板,威海岩棉复合板,威海彩钢瓦-文登区九龙岩棉复合板厂 | 真空泵厂家_真空泵机组_水环泵_旋片泵_罗茨泵_耐腐蚀防爆_中德制泵 | 婚博会2024时间表_婚博会门票领取_婚博会地址-婚博会官网 | 上海办公室装修,写字楼装修—启鸣装饰设计工程有限公司 | 玻纤土工格栅_钢塑格栅_PP焊接_单双向塑料土工格栅_复合防裂布厂家_山东大庚工程材料科技有限公司 | 安平县鑫川金属丝网制品有限公司,防风抑尘网,单峰防风抑尘,不锈钢防风抑尘网,铝板防风抑尘网,镀铝锌防风抑尘网 | 仓储笼_金属箱租赁_循环包装_铁网箱_蝴蝶笼租赁_酷龙仓储笼租赁 测试治具|过炉治具|过锡炉治具|工装夹具|测试夹具|允睿自动化设备 | 硫酸亚铁-聚合硫酸铁-除氟除磷剂-复合碳源-污水处理药剂厂家—长隆科技 | 酵素生产厂家_酵素OEM_酵素加盟_酵素ODM_酵素原料厂家_厦门益力康 | 上海质量认证办理中心 | 特种电缆厂家-硅橡胶耐高温电缆-耐低温补偿导线-安徽万邦特种电缆有限公司 | 防潮防水通风密闭门源头实力厂家 - 北京酷思帝克门窗 | 武汉高低温试验箱_恒温恒湿试验箱厂家-武汉蓝锐环境科技有限公司 | 睿婕轻钢别墅_钢结构别墅_厂家设计施工报价 | 精密光学实验平台-红外粉末压片机模具-天津博君 | 流量检测仪-气密性检测装置-密封性试验仪-东莞市奥图自动化科技有限公司 | 三轴曲线机-端子插拔力试验机|华杰仪器| 光泽度计_测量显微镜_苏州压力仪_苏州扭力板手维修-苏州日升精密仪器有限公司 | 飞歌臭氧发生器厂家_水处理臭氧发生器_十大臭氧消毒机品牌 | 列管冷凝器,刮板蒸发器,外盘管反应釜厂家-无锡曼旺化工设备有限公司 | 河北凯普威医疗器材有限公司,高档轮椅系列,推车系列,座厕椅系列,协步椅系列,拐扙系列,卫浴系列 | 斗式提升机_链式斗提机_带式斗提机厂家无锡市鸿诚输送机械有限公司 | 聚氨酯复合板保温板厂家_廊坊华宇创新科技有限公司 | 快速卷帘门_硬质快速卷帘门-西朗门业 | 医学动画公司-制作3d医学动画视频-医疗医学演示动画制作-医学三维动画制作公司 | 除尘布袋_液体过滤袋_针刺毡滤料-杭州辉龙过滤技术有限公司 | 拉力测试机|材料拉伸试验机|电子拉力机价格|万能试验机厂家|苏州皖仪实验仪器有限公司 | 环球周刊网| 杭州厂房降温,车间降温设备,车间通风降温,厂房降温方案,杭州嘉友实业爽风品牌 | 拉力机-万能试验机-材料拉伸试验机-电子拉力机-拉力试验机厂家-冲击试验机-苏州皖仪实验仪器有限公司 | 英国公司注册-新加坡公司注册-香港公司开户-离岸公司账户-杭州商标注册-杭州优创企业 | 高效节能电机_伺服主轴电机_铜转子电机_交流感应伺服电机_图片_型号_江苏智马科技有限公司 | 东莞ERP软件_广州云ERP_中山ERP_台湾工厂erp系统-广东顺景软件科技有限公司 | 网站建设,北京网站建设,北京网站建设公司,网站系统开发,北京网站制作公司,响应式网站,做网站公司,海淀做网站,朝阳做网站,昌平做网站,建站公司 |