电脑知识|欧美黑人一区二区三区|软件|欧美黑人一级爽快片淫片高清|系统|欧美黑人狂野猛交老妇|数据库|服务器|编程开发|网络运营|知识问答|技术教程文章 - 好吧啦网

您的位置:首頁技術文章
文章詳情頁

python缺失值的解決方法總結

瀏覽:28日期:2022-06-17 10:12:32
1、解決方法

(1)忽視元組。

缺少類別標簽時,通常這樣做(假設挖掘任務與分類有關),除非元組有多個屬性缺失值,否則該方法不太有效。當個屬性缺值的百分比變化很大時,其性能特別差。

(2)人工填寫缺失值。

一般來說,這種方法需要很長時間,當數據集大且缺少很多值時,這種方法可能無法實現。

(3)使用全局常量填充缺失值。

將缺失的屬性值用同一常數(如Unknown或負無限)替換。如果缺失值都是用unknown替換的話,挖掘程序可能會認為形成有趣的概念。因為有同樣的價值unknown。因此,這種方法很簡單,但不可靠。

(4)使用與給定元組相同類型的所有樣本的屬性平均值。

(5)使用最可能的值填充缺失值。

可以通過回歸、使用貝葉斯形式化的基于推理的工具和決策樹的總結來決定。

2、實例

import numpy as np from sklearn.preprocessing import Imputer imp = Imputer(missing_values=’NaN’, strategy=’mean’, axis=0) import numpy as npfrom sklearn.preprocessing import Imputer ###1.使用均值填充缺失值imp = Imputer(missing_values=’NaN’, strategy=’mean’, axis=0)imp.fit([[1, 2], [np.nan, 3], [7, 6]]) X = [[np.nan, 2], [6, np.nan], [7, 6]]print(imp.transform(X)) [[4. 2.] [6. 3.66666667] [7. 6.]]

知識點擴充:

缺失值的處理方法

由于各種各樣的原因,真實世界中的許多數據集都包含缺失數據,這些數據經常被編碼成空格、nans或者是其他的占位符。但是這樣的數據集并不能被scikit - learn算法兼容,因為大多數的學習算法都會默認數組中的元素都是數值,因此素偶有的元素都有自己的代表意義。

使用不完整的數據集的一個基本策略就是舍棄掉整行或者整列包含缺失值的數值,但是這樣處理會浪費大量有價值的數據。下面是處理缺失值的常用方法:

1.忽略元組

當缺少類別標簽時通常這樣做(假定挖掘任務涉及分類時),除非元組有多個屬性缺失值,否則該方法不是很有效。當每個屬性缺少值的百分比變化很大時,它的性能特別差。

2.人工填寫缺失值

一般該方法很費時,并且當數據集很大,缺少很多值時,該方法可能行不通。

3.使用一個全局常量填充缺失值

將缺失的屬性值用同一個常數(如“Unknown”或 負無窮)替換。如果缺失值都用“unknown”替換,則挖掘程序可能會認為它們形成一個有趣的概念,因為它們都具有相同的值“unknown”。因此,雖然該方法很簡單,但是它十分不可靠。

4.使用與給定元組屬同一類的所有樣本的屬性均值

例如:將顧客按照credit_risk分類,則使用具有相同信用度的給定元組的顧客的平均收入替換income中的缺失值。

Python客棧送紅包、紙質書

5.使用最可能的值填充缺失值

可以用回歸、使用貝葉斯形式化的基于推理的工具或決策樹歸納確定。例如,利用數據集中其他顧客的屬性,可以構造一顆決策樹來預測income的缺失值。

到此這篇關于python缺失值的解決方法總結的文章就介紹到這了,更多相關如何解決python缺失值內容請搜索好吧啦網以前的文章或繼續瀏覽下面的相關文章希望大家以后多多支持好吧啦網!

標簽: Python 編程
相關文章:
主站蜘蛛池模板: 安德建奇火花机-阿奇夏米尔慢走丝|高维|发那科-北京杰森柏汇 | 温泉机设备|温泉小镇规划设计|碳酸泉设备 - 大连连邦温泉科技 | 定硫仪,量热仪,工业分析仪,马弗炉,煤炭化验设备厂家,煤质化验仪器,焦炭化验设备鹤壁大德煤质工业分析仪,氟氯测定仪 | 新能源汽车电机定转子合装机 - 电机维修设备 - 睿望达 | 石家庄救护车出租_重症转院_跨省跨境医疗转送_活动赛事医疗保障_康复出院_放弃治疗_腾康26年医疗护送转诊团队 | 亿诺千企网-企业核心产品贸易| 厦门ISO认证|厦门ISO9001认证|厦门ISO14001认证|厦门ISO45001认证-艾索咨询专注ISO认证行业 | 产业规划_产业园区规划-产业投资选址及规划招商托管一体化服务商-中机院产业园区规划网 | 折弯机-刨槽机-数控折弯机-数控刨槽机-数控折弯机厂家-深圳豐科机械有限公司 | Magnescale探规,Magnescale磁栅尺,Magnescale传感器,Magnescale测厚仪,Mitutoyo光栅尺,笔式位移传感器-苏州连达精密量仪有限公司 | 深圳市万色印象美业有限公司| 一级建造师培训_一建培训机构_中建云筑建造师培训网校 | 我爱古诗词_古诗词名句赏析学习平台 | 网站建设-网站制作-网站设计-网站开发定制公司-网站SEO优化推广-咏熠软件 | 水稻烘干机,小麦烘干机,大豆烘干机,玉米烘干机,粮食烘干机_巩义市锦华粮食烘干机械制造有限公司 水环真空泵厂家,2bv真空泵,2be真空泵-淄博真空设备厂 | 汽车润滑油厂家-机油/润滑油代理-高性能机油-领驰慧润滑科技(河北)有限公司 | 广东机电安装工程_中央空调工程_东莞装饰装修-广东粤标建设有限公司 | 99文库_实习生实用的范文资料文库站 | 破碎机_上海破碎机_破碎机设备_破碎机厂家-上海山卓重工机械有限公司 | 岛津二手液相色谱仪,岛津10A液相,安捷伦二手液相,安捷伦1100液相-杭州森尼欧科学仪器有限公司 | 科威信洗净科技,碳氢清洗机,超声波清洗机,真空碳氢清洗机 | 药品仓库用除湿机-变电站用防爆空调-油漆房用防爆空调-杭州特奥环保科技有限公司 | 玻璃瓶厂家_酱菜瓶厂家_饮料瓶厂家_酒瓶厂家_玻璃杯厂家_徐州东明玻璃制品有限公司 | 阴离子聚丙烯酰胺价格_PAM_高分子聚丙烯酰胺厂家-河南泰航净水材料有限公司 | 上海地磅秤|电子地上衡|防爆地磅_上海地磅秤厂家–越衡称重 | 成都租车_成都租车公司_成都租车网_众行宝 | 拉力机-拉力试验机-万能试验机-电子拉力机-拉伸试验机-剥离强度试验机-苏州皖仪实验仪器有限公司 | 天津力值检测-天津管道检测-天津天诚工程检测技术有限公司 | uv固化机-丝印uv机-工业烤箱-五金蚀刻机-分拣输送机 - 保定市丰辉机械设备制造有限公司 | 光照全温振荡器(智能型)-恒隆仪器 | 水厂自动化|污水处理中控系统|水利信息化|智慧水务|智慧农业-山东德艾自动化科技有限公司 | 南京交通事故律师-专打交通事故的南京律师 | 水平垂直燃烧试验仪-灼热丝试验仪-漏电起痕试验仪-针焰试验仪-塑料材料燃烧检测设备-IP防水试验机 | 钢板仓,大型钢板仓,钢板库,大型钢板库,粉煤灰钢板仓,螺旋钢板仓,螺旋卷板仓,骨料钢板仓 | 钢绞线万能材料试验机-全自动恒应力两用机-混凝土恒应力压力试验机-北京科达京威科技发展有限公司 | 网站制作优化_网站SEO推广解决方案-无锡首宸信息科技公司 | 数控专用机床,专用机床,自动线,组合机床,动力头,自动化加工生产线,江苏海鑫机床有限公司 | 安徽合肥项目申报咨询公司_安徽合肥高新企业项目申报_安徽省科技项目申报代理 | 金属回收_废铜废铁回收_边角料回收_废不锈钢回收_废旧电缆线回收-广东益夫金属回收公司 | 华中线缆有限公司-电缆厂|电缆厂家|电线电缆厂家| 高通量组织研磨仪-多样品组织研磨仪-全自动组织研磨仪-研磨者科技(广州)有限公司 |