- 1、本文档共29页,可阅读全部内容。
- 2、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
- 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
- 5、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
- 6、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们。
- 7、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
- 8、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
第四章数据处理与应用;一、选择题(本大题共8小题,每小题2分,共16分,在每小题给出的四个选项中,只有一个符合题目要求,多选、少选、不选均不得分)
1.下列关于大数据处理的说法,正确的是()
A.对动态数据无法进行可视化表示
B.在中文文本分析中采用短语或段落作为表示文本的特征项
C.大数据数据类型多,无法分析全体数据,只能分析抽样数据
D.Hadoop面向大规模的批量处理,适用于处理静态数据,不适用于流数据
;B;A;C.;D;D;;D;B;B;二、非选择题(本大题共4小题,共34分)
9.小明设计了一手环,实现对体温的连续监控,4名志愿者的体温检测情况(部分数据隐藏,数据保存在“data.xls”中)如图所示:
;(1)小明需对图所示的数据进行整理,下列说法正确的是。(多选,填字母)?
A.数据整理就是要删除不正确的数据
B.E81单元格的数据存在数据异常
C.“班级”列数据格式不一致,应将数据进行格式转换
D.第4行和第5行存在数据重复,应删除其中一行
E.第4行和第5行存在数据重复,应将数据合并
(注:全部选对的得2分,选对但不全的得1分,不选或有选错的得0分);(2)对第4和第5行数据处理后,用Python对表格数据进行处理,程序代码如下所示,请在划线处填入正确的语句。
importpandasaspd
importmatplotlib.pyplotasplt
df=pd.read_excel(data.xls)
df=①#删除“班级”列数据后处理?
foriinrange(len(df)):#将体温列不正常的数据去除;if②42:#一般人体体温不超过42度?
df=df.drop(i)
df1=df.groupby(③,as_index=False)?
#统计每个人这段时间的平均体温
df1=round(df1.体温.mean(),2)#并保留两位小数
print(df1)
答案(1)BCE(2)①df.drop(班级,axis=1)
②df.at[i,体温]③姓名;10.某学校为规范引导学生合理消费,统计各班的一卡通消费数据。小张收集了2022学年第二学期第6周食堂消费数据保存在文件“student06.xlsx”中,部分界面如图a所示。他利用Python程序从消费数据中找出全校单次消费金额最高的记录,并统计学校各班级数据,最后以图表的形式呈现小卖部消费前五的班级如图b所示。;实现上述功能的Python程序如下,请在划线处填入合适的代码。
importpandasaspd
importmatplotlib.pyplotasplt
plt.rcParams[font.sans-serif]=[SimHei]
df=pd.read_excel(student06.xlsx)
#找出全校单次消费金额最高的记录
max_xf=0
foriindf.index:
if①:?;max_xf=df.at[i,消费金额]
max_bj_name=df.at[i,班级]
max_stu_name=df.at[i,姓名]
print(max_bj_name,的同学,②,单次消费最高。)?
#以图表的形式呈现小卖部消费前五的班级,如图b所示。
df1=df[③]#筛选出小卖部的数据?
df1=df1.groupby(班级,as_index=True).sum()
df1=df1.sort_values(④).head(5)?
x=⑤?;y=df1.消费金额
plt.bar(x,y)
plt.title(第6周小卖部消费前五的班级)
plt.show()
答案①df.at[i,消费金额]max_xf或df.at[i,消费金额]=max_xf②max_stu_name
③df[消费类型]==小卖部或df.消费类型==小卖部
④消费金额,ascending=False⑤df1.index;11.小林收集了2000年-2022年浙江省的GDP数据,并存储于“info.csv”文件,部分数据如图a所示。;defjs(df):
foriinrange(1,len(df)):
m=?
df.at[i,RATE]=round(m/df[GDP][i-1]*100,2)
returndf
(2)统计2000年-2022年期间浙江省GDP增长率在8%及以上的最长持续时间(若有多个长度相同的最大值,输出最新的时间段),并绘制线形图,部分Python程序如下,请在划线处填入合适的代码。;importpandasas
您可能关注的文档
- 第一章 课时2 数据采集与编码(一) 课件(共56张ppt)浙教版(2019)必修1.pptx
- 第一章 课时3 数据采集与编码(二) 课件(共70张ppt)浙教版(2019)必修1.pptx
- 第一章 课时4 数据管理与安全、数据与大数据 课件(共78张ppt)浙教版(2019)必修1.pptx
- 第一章 验收卷(一) 数据与信息 课件(共27张ppt)浙教版(2019)必修1.pptx
- 课时1 Python程序设计语言基础 课件(共64张ppt)浙教版(2019)必修1.pptx
- 课时1 人工智能的概念与发展 课件(共49张ppt)浙教版(2019)必修1.pptx
- 课时1 数据整理与计算 课件(共41张ppt)浙教版(2019)必修1.pptx
- 课时1 算法的概念及描述 课件(共42张ppt)浙教版(2019)必修1.pptx
- 课时2 Python基本数据结构 课件(共74张ppt)浙教版(2019)必修1.pptx
- 课时2 大数据处理的基本思想与架构 课件(共42张ppt)浙教版(2019)必修1.pptx
- 第18讲 第17课 西晋的短暂统一和北方各族的内迁.docx
- 第15讲 第14课 沟通中外文明的“丝绸之路”.docx
- 第13课时 中东 欧洲西部.doc
- 第17讲 第16 课三国鼎立.docx
- 第17讲 第16课 三国鼎立 带解析.docx
- 2024_2025年新教材高中历史课时检测9近代西方的法律与教化含解析新人教版选择性必修1.doc
- 2024_2025学年高二数学下学期期末备考试卷文含解析.docx
- 山西版2024高考政治一轮复习第二单元生产劳动与经营第5课时企业与劳动者教案.docx
- 第16讲 第15课 两汉的科技和文化 带解析.docx
- 第13课 宋元时期的科技与中外交通.docx
文档评论(0)