6.7 本章练习
教材原题见 P270(5 道选择题 + 5 道思考题,思考题答案教材标注为"略")。以下为知识库自编自测 10 题,覆盖本章全部高频考点,建议闭卷做完再对答案。
教材原题速览
| 题号 | 考点 | 答案 |
|---|---|---|
| 1 | 不属于数据预处理促成因素 → 数据安全 | C |
| 2 | 衡量容灾能力的主要指标 → RTO/RPO | B |
| 3 | 不属于数据质量评价过程 → 确定数据质量评价的第三方组织 | C |
| 4 | 数据集成定义 → 将驻留在不同数据源中的数据进行整合 | D |
| 5 | 敏感程度划分 → L1 公开、L2 保密、L3 机密、L4 绝密、L5 私密 | A |
自测题(10 题 · 知识库自编自测)
1. 下列属于半结构化数据的是( ) A. 关系数据库中的二维表 B. XML 文档 C. 图片 D. 音频
2. 数据预处理的正确流程是( ) A. 数据检测 → 数据分析 → 数据修正 B. 数据分析 → 数据检测 → 数据修正 C. 数据修正 → 数据检测 → 数据分析 D. 数据分析 → 数据修正 → 数据检测
3. 关于三种备份策略,正确的是( ) A. 增量备份每次备份相对上一次完全备份以来变化的数据 B. 差分备份恢复时需要完全备份 + 故障前一天的差分备份两份数据 C. 完全备份最节省存储空间 D. 增量备份的可靠性高于差分备份
4. 关于 RPO 与 RTO,正确的是( ) A. RPO 表示系统恢复所需的时间 B. RTO 表示灾难发生时允许丢失的数据量 C. RPO 表示灾难发生时允许丢失的数据量,RTO 表示系统恢复的时间 D. 两者含义相同
5. 概念模型的基本元素不包括( ) A. 实体 B. 域 C. 外键 D. 键
6. 数据仓库中,基本数据和聚合数据均存放在多维数据库中的 OLAP 实现方式是( ) A. ROLAP B. MOLAP C. HOLAP D. OLTP
7. 数据挖掘中,"找出数据库中隐藏的关联网,描述一组数据项的密切度或关系"属于( ) A. 数据总结 B. 关联分析 C. 聚类分析 D. 孤立点分析
8. Web Services 三要素中,起"目录服务器"作用、集中存放和查找 WSDL 描述文件的是( ) A. WSDL B. SOAP C. UDDI D. XML
9. 关于数据脱敏原则,"为隐藏姓名与病情的对应关系修改了姓名,但住址具有唯一性可反推姓名,于是将住址一并变换",体现的是( ) A. 保持数据特征原则 B. 保留引用完整性原则 C. 规避融合风险原则 D. 脱敏结果可重复原则
10. 从国家数据安全角度,数据分级的基本框架分为( ) A. 公开、内部、秘密、机密、绝密 B. L1~L5 五个等级 C. 一般数据、重要数据、核心数据 D. 资源目录、资产目录、服务目录
答案与解析
| 题号 | 答案 | 一句话解析 |
|---|---|---|
| 1 | B | 半结构化=非关系模型但有基本固定结构(日志、XML、E-mail);图片音频是非结构化 |
| 2 | B | 数据分析(定规则)→ 数据检测(查问题)→ 数据修正(手工/自动改) |
| 3 | B | 增量备份基准是"上一次任何备份",A 错;完全备份最占空间;增量可靠性低于差分 |
| 4 | C | RPO=丢多少数据,RTO=多久恢复,别记反 |
| 5 | C | 概念模型元素:实体、属性、域、键、关联;外键是关系模型(逻辑层)的东西 |
| 6 | B | ROLAP 全存 RDBMS;MOLAP 全存多维库;HOLAP 混合 |
| 7 | B | 关联分析生成带置信度的规则;聚类是无类别时分组;孤立点是找偏差 |
| 8 | C | WSDL 描述服务、SOAP 传消息、UDDI 做目录 |
| 9 | C | 预判多源融合可反推敏感数据 → 规避融合风险原则 |
| 10 | C | 国家层面三档:一般/重要/核心;L1~L5 是组织内部敏感程度划分 |
错题归因
- 错 1、2 题 → 重看 6.1 数据采集和预处理
- 错 3、4 题 → 重看 6.2 数据存储及管理
- 错 5 题 → 重看 6.3 数据治理和建模
- 错 6、10 题 → 重看 6.4 数据仓库和数据资产
- 错 7、8 题 → 重看 6.5 数据分析及应用
- 错 9 题 → 重看 6.6 数据脱敏和分类分级