数据处理与应用 知识点题库

小明使用Excel软件分析2016巴西奥运会奖牌榜前十名国家的奖牌情况如图1,请回答下列问题:

图1

  1. (1) 标题“2016年里约奥运会前十奖牌榜”所在的单元格可以通过(填字母:A.   B.  C.  )实现的,执行完该操作后单元格名称是
  2. (2) C13单元格是通过SUM函数计算得到的前十名国家的金牌合计,则C13单元格中的公式为
  3. (3) 区域G4:G12中的数据是从G3单元格利用自动填充功能得到的,则G12单元格中的公式为,若删除F列,区域G3:G12中将产生的错误是

    (填字母:A.######   B.#DIV/0!  C.0    D.无内容 )

  4. (4) 观察图1,是以金牌为主要关键字,序(填:升/降)排序表中数据,排序区域应选择
  5. (5) 为了更直观地比较奖牌数,小明制作了如图2所示的图表。该图表的数据区域是 ,图表类型为(填:柱形图/条形图/饼图/折线图)。
  6. (6) 若要修改图3所示的图表,使其显示具体的数据值,应选择图2的命令。
想快速找出“成绩表”中成绩最好的前20名学生,合理的方法是(   )
A . 进行分类汇总 B . 只能一条一条看 C . 要求成绩输入人员严格按高低分录入 D . 给成绩表进行排序
某研究小组收集了“浙江省2016年农林牧渔总产值”数据,制作了一张统计表,如下图1所示。

图1

请回答以下问题:

  1. (1) 单元格C4:G4的公式是从B4单元格通过自动填充功能得出,由图1可知F4单元格公式为:
  2. (2) 根据图1制作的图表如图2所示,可知制作该图表的区域为:A3,A5:A10,

    图2

  3. (3) 对图1数据做如下操作,会引起图表变化的是:_______。(单选)
    A . 以农业产值为关键字,对所有浙西南城市进行降序排序; B . 将宁波市的林业产值修改为24.8; C . 选定数据区域 B4:G17 设置单元格格式,保留1位小数; D . 对区域 A3:G17 筛选“农业产值”最大的三项)
  4. (4) 要对浙西南的所有城市,按“渔业产值”进行降序排序,则排序时应选择的数据区域为:
小明用Excel软件处理某次考试中部分同学的语数外成绩,如图a所示。

请回答下列问题:

  1. (1) 如图a所示,F4:F13单元格的数据都是由公式计算得到的,在F4单元格中输入的公式为(提示:总分差值=总分-总分平均分),并从F4单元格自动填充到F13单元格。
  2. (2) 如果现在将“高进”所在行删除,请问F4单元格的值会(单选,填字母:A .变大/B .不变/C .变小)。
  3. (3) 根据表中数据绘制了如图b所示的图表,则建立该图表的数据区域是

  4. (4) 若对数据中的“数学”进行筛选,筛选条件如图c所示,则图表中将显示个学生数据。

数据聚类分析的主要任务是(    )
A . 对数据进行预处理,发现和处理缺失值,异常数据、绘制直方图,观察数据分布的特征,求最大值、最小值、极差等描述性统计量。 B . 分析发现存在于大量数据之间的关联性和相关性,从而描述一个事物的共同规律和模式。 C . 是一种探索性的分析。不必事先给出一个分类标准,而是让其自动分类。 D . 是数据分析中最基本的方法。先基于样本数据构建分类器,然后进行预测。
下列关于分布式数据库HBase的理解,不正确的是(    )
A . HBase是谷歌BigTable数据库的开源实现 B . 建立在HDFS提供的底层存储基础上 C . 采用基于行的存储方式,可管理PB级的大数据 D . 主要用于存储非结构化数据和半结构化数据
某组织将关于春节期间人们主要支出的调查数据进行可视化分析,其结果如图所示,下列分析错误的是(    )

A . 不同年龄段的人群“买年货”的支出都比较多 B . 在“娱乐活动”的支出中,23~30岁人群的花费最多 C . 60岁以上人群支出最多的是“压岁钱”,支出最少的是“交通费” D . 在“走亲访友的礼物”支出中,51岁以上人群的花费比较多
小明收集了一些招聘信息数据,并用Excel软件进行处理,如图a所示。请回答下列问题:

图 a

  1. (1) 如图a小明使用公式计算各专业的收入排名顺序,F4:F19 单元格内容通过对F3单元格公式自动填充获得,但排名产生了错误,要获得正确的收入排名号,F3单元格公式需修改为 。(排名可使用rank 函数,如“=rank(D3,D3:D19)”,功能是计算D3单元格的值在 D3:D19区域中的名次)
  2. (2) 利用图a中数据制作了如图b所示的图表,则该图表的数据区域是

    图 b

  3. (3) 将图a中A2:D19区域的数据复制到新工作表A1:D18区域进行排序,使得类型相同的专业按“薪酬(元)”降序排序,则下列操作正确的是                      (单选:填字母)
    A . 选择数据区域A1:D18,以“薪酬(元)”为主要关键字,按“降序”进行排序 B . 选择数据区域 A1:D18,以“薪酬(元)”为主要关键字,“类型”为次要关键字均按“降序”进行排序 C . 选择数据区域A1:D18,以“类型”为主要关键字进行“降序”排序,再以“薪酬(元)”  为主要关键字进行“降序”排序。 D . 选择数据区域A1:D18,以“薪酬(元)”为主要关键字进行“降序”排序,再以“类型”  为主要关键字进行“降序”排序
  4. (4) 将图a中B2:D19区域的数据复制到新工作表,对“人数”和“薪酬(元)”进行筛选,条件如图c所示,则按此条件筛选出的专业数有个。

    图 c

在Excel中的A1中输入=Int(-75.8),按回车键后显示结果-76。
小王收集了2021年1-2月和2019年1-2月浙江和江苏部分区县地方财政收入的相关数据,并使用Excel软件进行数据处理,如图a所示。

请回答下列问题:

  1. (1) 区域GS:G18中的数据是从G4单元格利用自动填充功能得到的。则G4单元格输入的公式是
  2. (2) 根据图a中数据制作的图表如图b所示,创建该图表的数据区域是D3:F3, 。

  3. (3) 为了更好地分析数据,小李又进行了一系列处理,以下操作方法中正确的是         
    A . 若要对“浙江”省各区县数据按照平均增速降序排序,排序区域为A12:G18 B . 若要通过排序使得“江苏”省相同地市的2021年1-2月数据有序,则排序的主次关键字依次为地市、2021年1-2月 C . 若要筛选出“苏州”平均增速最快的区县信息,应该以地市为“苏州”,“平均增速”为最大1项进行筛选 D . 若要筛选出名以“江”开头的区县信息,筛选条件设置等于“江*”或等于“*江*”效果不同
数据处理的一般过程是(    )。
A . 采集—分析—整理—可视化表达 B . 采集—整理—可视化表达-分析 C . 采集—整理—分析-可视化表达 D . 采集—可视化表达—整理-分析
2020年11月1日,正式开始第七次全国人口普查,普查信息除了普查员登记获取外,还可以通过手机小程序自主填报获取。后者的数据采集方式是(    )
A . 实验数据采集 B . 传感器采集 C . 网络爬虫 D . 系统录入
如图所示,如果将单元格D3中的公式复制到单元格D4~D7,则改变单元格C7的值,数据会产生相应变化的单元格是(    )

A . D4 B . D5 C . D6 D . D7
用户在电商购物网站平台对商品进行搜索、浏览和购买后,下一次再登录相应网站,购物平台会向用户推荐不同商家、风格各异和价格不一的相关商品,请问这些电商购物平台主要采用了大数据分析与预测技术来进行商品推荐。
下列有关Excel数据筛选的叙述,正确的是(   )
A . 筛选后的表格中只含有符合筛选条件的行,其它行被删除 B . 筛选后的表格中只含有符合筛选条件的行,其它行被暂时隐藏 C . 筛选条件只能是一个固定的值 D . 筛选条件不能由用户自定义,只能由系统确定
“百度地图”、“高德地图”、“车来了”都有实时公交的功能,主要是运用了下列哪些技术(      )
A . 大数据分析,无线网络技术、卫星定位等技术 B . 只是使用了app软件 C . 只是使用了离线地图的数据 D . 只是使用了GPS定位
下列设备中,能够实时采集、记录日常生活中的锻炼、睡眠等数据的是(    )
A . 绘图仪 B . 智能手环 C . 数码相机 D . 数码摄像机
在WPS表格中能够很方便的使用公式来计算,创建公式的操作步骤是(     )

①在编辑栏键入“=”

②键入公式

③按Enter键

④选择需要建立公式的单元格

A . ④①②③ B . ①②③④ C . ④②③① D . ①④②③
打开“Y:181”,文件夹中的文件“居民消费商品分类价格指数表.xlsx”进行以下操作并保存。

⑴添加标题为“居民消费商品分类价格指数表”,将A1:E1合并居中,并将标题设置为微软雅黑、加粗、14、蓝色;

⑵将表格数据的列设为最适合的列宽;

⑶在工作sheet1按类别进行分类汇总,汇总方式为“求和”,汇总项为“全国、城市、农村”;

⑷按照“居民消费样张.ipg”样张制作簇状柱形圈,插入到当前工作表中;

⑸保存文档并关闭WPS表格。

小萌通过“问卷星”收集到一些学生数据,如图a所示。在按关键字“用户名”进行排序的过程中,对数据进行整理,删除重复数据,处理结果如图b所示。

  1. (1) 在数据整理时,常见的数据问题有(   )(多选,选填字母)。
    A . 数据缺失 B . 数据重复 C . 逻辑错误 D . 格式不一致
  2. (2) 实现上述功能的Python程序如下,请在划线处填入合适的代码。

    a=[]

    csv_file=open("xuehao.csv", "r", encoding='utf-8')

    flines=csv_file. readlines()  #将文件中所有数据按行读入flines中

    csv_file. close()           #关闭文件

     # 将每个数据行中的各项信息以“,”作为分隔符切割成字符串存入列表a中

    for line in flines:

       tmp=list(line. strip("\n"). split(","))

       a. append(tmp)

    n=len(a)

    i=1; m=n-1    #变量m表示删除重复数据后的实际数据个数

    while i<n:

       for j in range(m, i, -1):

         if :

           tmp=a[j]; a[j]=a[j-1]; a[j-1]=tmp

         elif a[j][4]==a[j-1][4]:

           a[j]=a[m]

          

       i+=1

    for i in range (m+1):

       print (a[i])

最近更新