欢迎来到淘文阁 - 分享文档赚钱的网站! | 帮助中心 好文档才是您的得力助手!
淘文阁 - 分享文档赚钱的网站
全部分类
  • 研究报告>
  • 管理文献>
  • 标准材料>
  • 技术资料>
  • 教育专区>
  • 应用文书>
  • 生活休闲>
  • 考试试题>
  • pptx模板>
  • 工商注册>
  • 期刊短文>
  • 图片设计>
  • ImageVerifierCode 换一换

    (完整版)数据挖掘测试题.pdf

    • 资源ID:71657314       资源大小:149.24KB        全文页数:4页
    • 资源格式: PDF        下载积分:11.9金币
    快捷下载 游客一键下载
    会员登录下载
    微信登录下载
    三方登录下载: 微信开放平台登录   QQ登录  
    二维码
    微信扫一扫登录
    下载资源需要11.9金币
    邮箱/手机:
    温馨提示:
    快捷下载时,用户名和密码都是您填写的邮箱或者手机号,方便查询和重复下载(系统自动生成)。
    如填写123,账号就是123,密码也是123。
    支付方式: 支付宝    微信支付   
    验证码:   换一换

     
    账号:
    密码:
    验证码:   换一换
      忘记密码?
        
    友情提示
    2、PDF文件下载后,可能会被浏览器默认打开,此种情况可以点击浏览器菜单,保存网页到桌面,就可以正常下载了。
    3、本站不支持迅雷下载,请使用电脑自带的IE浏览器,或者360浏览器、谷歌浏览器下载即可。
    4、本站资源下载后的文档和图纸-无水印,预览文档经过压缩,下载后原文更清晰。
    5、试题试卷类文档,如果标题没有明确说明有答案则都视为没有答案,请知晓。

    (完整版)数据挖掘测试题.pdf

    1.某超市研究销售纪录数据后发现,买啤酒的人很大概率也会购买尿布,这种属于数据挖掘的哪类问题?AA.关联规则发现B.聚类C.分类D.自然语言处理2.以下两种描述分别对应哪两种对分类算法的评价标准?A(a)警察抓小偷,描述警察抓的人中有多少个是小偷的标准。(b)描述有多少比例的小偷给警察抓了的标准。A.Precision,RecallB.Recall,PrecisionC.Precision,ROCD.Recall,ROC3.将原始数据进行集成、变换、维度规约、数值规约是在以下哪个步骤的任务?CA.频繁模式挖掘B.分类和预测C.数据预处理D.数据流挖掘4.当不知道数据所带标签时,可以使用哪种技术促使带同类标签的数据与带其他标签的数据相分离?BA.分类B.聚类C.关联分析D.隐马尔可夫链5.什么是 KDD?AA.数据挖掘与知识发现B.领域知识发现C.文档知识发现D.动态知识发现6.使用交互式的和可视化的技术,对数据进行探索属于数据挖掘的哪一类任务?AA.探索性数据分析B.建模描述C.预测建模D.寻找模式和规则7.为数据的总体分布建模;把多维空间划分成组等问题属于数据挖掘的哪一类任务?BA.探索性数据分析B.建模描述C.预测建模D.寻找模式和规则8.建立一个模型,通过这个模型根据已知的变量值来预测其他某个变量值属于数据挖掘的哪一类任务?CA.根据内容检索B.建模描述C.预测建模D.寻找模式和规则9.用户有一种感兴趣的模式并且希望在数据集中找到相似的模式,属于数据挖掘哪一类任务?A.根据内容检索B.建模描述C.预测建模D.寻找模式和规则10.下面哪种不属于数据预处理的方法?DA 变量代换B 离散化C 聚集D 估计遗漏值11.假设 12 个销售价格记录组已经排序如下:5,10,11,13,15,35,50,55,72,92,204,215 使用如下每种方法将它们划分成四个箱。等频(等深)划分时,15 在第几个箱子内?BA 第一个B 第二个C 第三个D 第四个12.上题中,等宽划分时(宽度为50),15 又在哪个箱子里?AA 第一个B 第二个C 第三个D 第四个13.下面哪个不属于数据的属性类型:DA 标称B 序数C 区间D 相异14.在上题中,属于定量的属性类型是:CA 标称B 序数C 区间D 相异15.只有非零值才重要的二元属性被称作:CA 计数属性B 离散属性C 非对称的二元属性D 对称属性16.以下哪种方法不属于特征选择的标准方法:DA 嵌入B 过滤C 包装D 抽样17.下面不属于创建新属性的相关方法的是:BA 特征提取B 特征修改C 映射数据到新的空间D 特征构造18.考虑值集1、2、3、4、5、90,其截断均值(p=20%)是 CA 2B 3C 3.5D 519.下面哪个属于映射数据到新的空间的方法?AA 傅立叶变换B 特征加权C 渐进抽样D 维归约20.熵是为消除不确定性所需要获得的信息量,投掷均匀正六面体骰子的熵是:BA 1 比特B 2.6 比特C 3.2 比特D 3.8 比特21.假设属性 income 的最大最小值分别是 12000 元和 98000 元。利用最大最小规范化的方法将属性的值映射到 0 至 1 的范围内。对属性 income 的 73600 元将被转化为:DA 0.821B 1.224C 1.458D 0.71622.假定用于分析的数据包含属性age。数据元组中 age 的值如下(按递增序):13,15,16,16,19,20,20,21,22,22,25,25,25,30,33,33,35,35,36,40,45,46,52,70,问题:使用按箱平均值平滑方法对上述数据进行平滑,箱的深度为 3。第二个箱子值为:AA 18.3B 22.6C 26.8D 27.923.考虑值集12 24 33 2 4 55 68 26,其四分位数极差是:AA 31B 24C 55D 324.一所大学内的各年纪人数分别为:一年级200 人,二年级160 人,三年级130 人,四年级 110 人。则年级属性的众数是:AA 一年级B 二年级C 三年级D 四年级25.下列哪个不是专门用于可视化时间空间数据的技术:BA 等高线图B 饼图C 曲面图D 矢量场图26.在抽样方法中,当合适的样本容量很难确定时,可以使用的抽样方法是:DA 有放回的简单随机抽样B 无放回的简单随机抽样C 分层抽样D 渐进抽样27.数据仓库是随着时间变化的,下面的描述不正确的是CA.数据仓库随时间的变化不断增加新的数据内容;B.捕捉到的新数据会覆盖原来的快照;C.数据仓库随事件变化不断删去旧的数据内容;D.数据仓库中包含大量的综合数据,这些综合数据会随着时间的变化不断地进行重新综合.28.关于基本数据的元数据是指:DA.基本元数据与数据源,数据仓库,数据集市和应用程序等结构相关的信息;B.基本元数据包括与企业相关的管理方面的数据和信息;C.基本元数据包括日志文件和简历执行处理的时序调度信息;D.基本元数据包括关于装载和更新处理,分析处理以及管理方面的信息.29.下面关于数据粒度的描述不正确的是:CA.粒度是指数据仓库小数据单元的详细程度和级别;B.数据越详细,粒度就越小,级别也就越高;C.数据综合度越高,粒度也就越大,级别也就越高;D.粒度的具体划分将直接影响数据仓库中的数据量以及查询质量.30.有关数据仓库的开发特点,不正确的描述是:AA.数据仓库开发要从数据出发;B.数据仓库使用的需求在开发出去就要明确;C.数据仓库的开发是一个不断循环的过程,是启发式的开发;D.在数据仓库环境中,并不存在操作型环境中所固定的和较确切的处理流,数据仓库中数据分析和处理更灵活,且没有固定的模式

    注意事项

    本文((完整版)数据挖掘测试题.pdf)为本站会员(l***)主动上传,淘文阁 - 分享文档赚钱的网站仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对上载内容本身不做任何修改或编辑。 若此文所含内容侵犯了您的版权或隐私,请立即通知淘文阁 - 分享文档赚钱的网站(点击联系客服),我们立即给予删除!

    温馨提示:如果因为网速或其他原因下载失败请重新下载,重复下载不扣分。




    关于淘文阁 - 版权申诉 - 用户使用规则 - 积分规则 - 联系我们

    本站为文档C TO C交易模式,本站只提供存储空间、用户上传的文档直接被用户下载,本站只是中间服务平台,本站所有文档下载所得的收益归上传人(含作者)所有。本站仅对用户上传内容的表现方式做保护处理,对上载内容本身不做任何修改或编辑。若文档所含内容侵犯了您的版权或隐私,请立即通知淘文阁网,我们立即给予删除!客服QQ:136780468 微信:18945177775 电话:18904686070

    工信部备案号:黑ICP备15003705号 © 2020-2023 www.taowenge.com 淘文阁 

    收起
    展开