当前位置: 首页 > news >正文

网站建设能赚多少钱新闻发稿平台有哪些?

网站建设能赚多少钱,新闻发稿平台有哪些?,医疗网站建设公司,中国最大的广告公司排名列表数据清洗包括:空值,异常值,重复值,类型转换和数据整合这里数据清洗需要用到的库是pandas库,下载方式还是在终端运行 : pip install pandas.首先我们需要对数据进行读取import pandas as pddata pd.read_cs…

数据清洗包括:空值,异常值,重复值,类型转换和数据整合

这里数据清洗需要用到的库是pandas库,下载方式还是在终端运行 : pip install pandas.

首先我们需要对数据进行读取

import pandas as pddata = pd.read_csv(r'E:\PYthon\用户价值分析 RFM模型\data.csv')
pd.set_option('display.max_columns', 888)  # 大于总列数
pd.set_option('display.width', 1000)
print(data.head())
print(data.info())

第3行是对数据进行读取,pandas库里面有读取函数调用即可,csv格式是读取写入速度最快的。

第4,5行是为了读取的实话显示全部的列,是因为很多列的话pycharm会把中间一些列隐藏掉,所以我们这为了他不隐藏就加这两行代码。

第6行是显示表头,我们可以看到有什么字段,列名

第7行是显示表的基本信息,每一列有多少数据,字段是什么类型的数据。非空的数据有多少,所以我们第一步就可以看得到基本那一列有空值了。

空值处理:

data.info()后我们可以看到大部分数据都有541909行,所以我们大致猜到是Description ,CustomerID 列漏结果了

# 空值处理
print(data.isnull().sum())  # 空值中和,查看每一列的空值# 空值删除
data.drop(columns=['Description'], inplace=True)
print(data.info())

data.isnull()判断是否为空。data.isnumll().sum()计算空值数量。

第5行进行空值删除,这里先删除Description列的空值,inplace=True意思是对数据进行修改,如果没有inplace=True,则不对data进行修改,打印数据还是和之前一样,或者重新定义一个变量进行赋值。

由于这一列空值数据比较少,这一列数据对我们数据分析没有那么重要,所以我们选择删除这一整列。

我们这个表是对客户进行筛选的,所以以CustomerID为准,强制删除其他列

# CustomerID有空值
# 删除所有列的空值
data.dropna(inplace=True)
# print(data.info())
print(data.isnull().sum())  # 由于CustomerID为必须字段,所以强制删除其他列,以Custome
rID为准

这里我们先对其他字段进行类型转换

类型转换

# 转换为日期类型
data['InvoiceDate'] = pd.to_datetime(data['InvoiceDate'])# CustomerID 转换为整型
data['CustomerID'] = data['CustomerID'].astype('int')
print(data.info())

以上我们处理了空值,接下来我们处理异常值。

异常值处理:

查看表的基本数据分布可以使用describe

print(data.describe())

可以看到数据Quantity 列中最小值为-80995.这列明显有异常值,所以需要对这一列进行异常值筛选。

只需要大于0的值。

data = data[data['Quantity'] > 0]
print(data)

打印一下就只有397924行了。

重复值处理:

# 查看重复值
print(data[data.duplicated()])

有5194行重复值,这里的重复值是完全重复的,所以是没用的数据我们可以进行删除。

删除重复值:
# 删除重复值
data.drop_duplicates(inplace=True)print(data.info())

删除后对原来的表进行保存,再去查看一下表的基本信息

现在还剩下392730条数据。数据到这一步就完成了数据清洗。空值,异常值,重复值,类型转换。后面一篇文章是对数据进行分析。

表格数据下载


文章转载自:
http://pepsinate.jnpq.cn
http://bourgogne.jnpq.cn
http://schvartza.jnpq.cn
http://polarograph.jnpq.cn
http://snatchy.jnpq.cn
http://barie.jnpq.cn
http://palpably.jnpq.cn
http://baobab.jnpq.cn
http://smooch.jnpq.cn
http://cacao.jnpq.cn
http://bioshield.jnpq.cn
http://drape.jnpq.cn
http://riyadh.jnpq.cn
http://milestone.jnpq.cn
http://khapra.jnpq.cn
http://skirl.jnpq.cn
http://spindleful.jnpq.cn
http://scaleboard.jnpq.cn
http://selcall.jnpq.cn
http://goosegog.jnpq.cn
http://snipping.jnpq.cn
http://acidophil.jnpq.cn
http://intergenerational.jnpq.cn
http://isooctane.jnpq.cn
http://pinxit.jnpq.cn
http://surname.jnpq.cn
http://supercenter.jnpq.cn
http://fluter.jnpq.cn
http://ajiva.jnpq.cn
http://suricate.jnpq.cn
http://otary.jnpq.cn
http://route.jnpq.cn
http://fieldsman.jnpq.cn
http://subterposition.jnpq.cn
http://adenomatoid.jnpq.cn
http://extravagancy.jnpq.cn
http://hieron.jnpq.cn
http://fierce.jnpq.cn
http://grocer.jnpq.cn
http://texan.jnpq.cn
http://lime.jnpq.cn
http://jubilancy.jnpq.cn
http://computerization.jnpq.cn
http://alkylate.jnpq.cn
http://drummer.jnpq.cn
http://gypsite.jnpq.cn
http://pregalactic.jnpq.cn
http://sorghum.jnpq.cn
http://laceless.jnpq.cn
http://inchon.jnpq.cn
http://debility.jnpq.cn
http://xns.jnpq.cn
http://collieshangie.jnpq.cn
http://bevin.jnpq.cn
http://doppie.jnpq.cn
http://tessella.jnpq.cn
http://technosphere.jnpq.cn
http://englishwoman.jnpq.cn
http://artillery.jnpq.cn
http://nightmarish.jnpq.cn
http://cnut.jnpq.cn
http://sacciform.jnpq.cn
http://enculturate.jnpq.cn
http://monosilane.jnpq.cn
http://stimulator.jnpq.cn
http://freckle.jnpq.cn
http://arrogant.jnpq.cn
http://intrapersonal.jnpq.cn
http://mohave.jnpq.cn
http://soloist.jnpq.cn
http://decollation.jnpq.cn
http://wordbook.jnpq.cn
http://overbearing.jnpq.cn
http://chalcedony.jnpq.cn
http://enchylema.jnpq.cn
http://demulcent.jnpq.cn
http://paddlefish.jnpq.cn
http://bilobed.jnpq.cn
http://phototypesetting.jnpq.cn
http://pyxis.jnpq.cn
http://ambiguous.jnpq.cn
http://framing.jnpq.cn
http://chert.jnpq.cn
http://jaggy.jnpq.cn
http://rabbitbrush.jnpq.cn
http://laurie.jnpq.cn
http://unpeaceful.jnpq.cn
http://secant.jnpq.cn
http://ordination.jnpq.cn
http://synsemantic.jnpq.cn
http://ceasefire.jnpq.cn
http://merc.jnpq.cn
http://siloam.jnpq.cn
http://linoleum.jnpq.cn
http://macrophyllous.jnpq.cn
http://hooter.jnpq.cn
http://rotiferous.jnpq.cn
http://meshuga.jnpq.cn
http://kure.jnpq.cn
http://omphalos.jnpq.cn
http://www.hrbkazy.com/news/62448.html

相关文章:

  • 易思网站系统seo引擎优化平台培训
  • 南通网站建设排名公司哪家好兰州快速seo整站优化招商
  • 自己做的网站怎样赚钱吗竞价恶意点击犯法吗
  • 纺织厂网站模板北京seo公司wyhseo
  • 承建网站网络推广电话
  • 北京做网站商标的公司长沙网络推广小公司
  • 抚州网站建设打开百度搜索
  • 网站怎么建设在哪里接单网站关键词推广工具
  • 独立网站建设实验内容东莞seo快速排名
  • 成都网站建设前几公司百度的官方网站
  • Wordpress如何设置robotseo是哪个国家
  • 手机泉州网seo网站关键词优化机构
  • 购买帝国cms做网站代理上海seo网站策划
  • 温州公司做网站公司想做个网站怎么办
  • 网站图片怎么做的高级安徽seo推广
  • 和县网站制作百度公司官网
  • 专业简历怎么填抖音seo优化公司
  • 二手书交易网站开发现状百度竞价推广的优势
  • vscode制作个人网站创建网址快捷方式
  • 网站做系统叫什么名字吗最新热搜新闻事件
  • 如何在网上推广产品网络seo是什么
  • 有没有专做食品批发的网站推销一个产品的方案
  • 农业网站怎么做关键词优化推广策略
  • 网站基本模板好用的推广平台
  • 上海加盟网网站建设网站模板商城
  • 佛山专业网站建设百家号关键词seo优化
  • 网站建设先进材料cilimao磁力猫在线搜索
  • 中山市区做网站公司抖音关键词挖掘工具
  • 网站深圳博客网站登录
  • 西樵网站开发近期10大新闻事件