0
点赞
收藏
分享

微信扫一扫

Python数据分析:从0完成一个数据分析实战

三分梦_0bc3 2022-01-24 阅读 127

源地址:

【Python入门系列】用Pandas揭秘美国选民的总统喜好-天池大赛-阿里云天池 https://tianchi.aliyun.com/competition/entrance/531837/information

一、赛题数据

赛题以数据处理、数据分析、数据可视化为任务,数据集可以报名参与比赛后,查看操作指南进行下载使用,该数据来自FEC平台的公开数据集,源数据包含3张数据表,经过baseline数据处理步骤后合并为一张表,总数据量75w+条,包含8列变量信息。

# 安装词云处理包wordcloud
!pip install wordcloud --user

# 读取候选人信息,由于原始数据没有表头,需要添加表头
candidates = pd.read_csv("weball20.txt", sep = '|',names=['CAND_ID','CAND_NAME','CAND_ICI','PTY_CD','CAND_PTY_AFFILIATION','TTL_RECEIPTS',
                                                          'TRANS_FROM_AUTH','TTL_DISB','TRANS_TO_AUTH','COH_BOP','COH_COP','CAND_CONTRIB',
                                                          'CAND_LOANS','OTHER_LOANS','CAND_LOAN_REPAY','OTHER_LOAN_REPAY','DEBTS_OWED_BY',
                                                          'TTL_INDIV_CONTRIB','CAND_OFFICE_ST','CAND_OFFICE_DISTRICT','SPEC_ELECTION','PRIM_ELECTION','RUN_ELECTION'
                                                          ,'GEN_ELECTION','GEN_ELECTION_PRECENT','OTHER_POL_CMTE_CONTRIB','POL_PTY_CONTRIB',
                                                          'CVG_END_DT','INDIV_REFUNDS','CMTE_REFUNDS'])
# 读取候选人和委员会的联系信息
ccl = pd.read_csv("ccl.txt", sep = '|',names=['CAND_ID','CAND_ELECTION_YR','FEC_ELECTION_YR','CMTE_ID','CMTE_TP','CMTE_DSGN','LINKAGE_ID'])

举报

相关推荐

0 条评论