博客
关于我
利用pandas做数据分析统计应用---统计二胎年龄差距
阅读量:376 次
发布时间:2019-03-05

本文共 918 字,大约阅读时间需要 3 分钟。

源码和数据文件见上述链接。

本文数据提取自深圳市2019年某次公租房申请公示名单,移除了非身份证的数据。

import pandas as pdimport matplotlib.pyplot as plt '''粗略统计二胎年龄差距se 为1 主申请人,多数为爸爸se为2共同申请人,多为妈妈和孩子se为0,others'''#difage = []class family:	def __init__(self):		self.mainpyear= None		self.comPyear=[]		self.diff = []	def diff_age(self):		if len(self.comPyear)>2:			self.comPyear = sorted(self.comPyear, reverse = True)			#print(self.comPyear)			if( self.comPyear[0]-self.comPyear[1]<18):				self.diff.append( self.comPyear[0]-self.comPyear[1])		self.comPyear=[]if __name__ == '__main__':				b= pd.read_csv('a.csv', sep=',', dtype = {'id':str})	b['year']=pd.to_numeric(b['id'].str[6:10])	myf = family()	for key,row in b.iterrows():		if( row['se']==1):			myf.mainpyear = row['year']			myf.diff_age()		elif( row['se']==2):			myf.comPyear.append(row['year'])			#myf.diff_age()		#print(myf.diff)	a = pd.Series(myf.diff)	a.plot.hist(bins =19 )	plt.show()

 

结论:二胎年龄差距,2,3岁的家庭最多。

转载地址:http://tfpg.baihongyu.com/

你可能感兴趣的文章
N-Gram的基本原理
查看>>
n1 c语言程序,全国青少年软件编程等级考试C语言经典程序题10道七
查看>>
Nacos Client常用配置
查看>>
nacos config
查看>>
Nacos Config--服务配置
查看>>
Nacos Derby 远程命令执行漏洞(QVD-2024-26473)
查看>>
Nacos 与 Eureka、Zookeeper 和 Consul 等其他注册中心的区别
查看>>
Nacos 单机集群搭建及常用生产环境配置 | Spring Cloud 3
查看>>
Nacos 启动报错[db-load-error]load jdbc.properties error
查看>>
Nacos 报Statement cancelled due to timeout or client request
查看>>
Nacos 注册服务源码分析
查看>>
Nacos 融合 Spring Cloud,成为注册配置中心
查看>>
Nacos-注册中心
查看>>
Nacos-配置中心
查看>>
Nacos2.X 源码分析:为订阅方推送、服务健康检查、集群数据同步、grpc客户端服务端初始化
查看>>
Nacos2.X 配置中心源码分析:客户端如何拉取配置、服务端配置发布客户端监听机制
查看>>
Nacos2.X源码分析:服务注册、服务发现流程
查看>>
NacosClient客户端搭建,微服务注册进nacos
查看>>
Nacos中使用ribbon
查看>>
Nacos使用OpenFeign
查看>>