大数据管理系统原理与技术 / 数据科学与工程技术丛书
定价:¥69.00
作者: 王宏志,何震瀛等
出版时间:2019-11-20
出版社:机械工业出版社
- 机械工业出版社
- 9787111636779
- 1-2
- 47229612-8
- 16开
- 2019-11-20
- 512
- 计算机通信类
- 本科
作者简介
内容简介
本书系统介绍了常用的面向大数据的数据库管理系统的原理和技术,包括关系数据库、非关系型数据库、HIVE、Hbase、Redies等,使读者在了解大数据的数据库管理系统基本原理的基础上,能根据实际的问题和应用场景选择、搭建适合的数据库管理系统。
目录
第1章 大数据管理系统概述
1.1 引言
1.2 数据库发展史
1.2.1 第一阶段数据库
1.2.2 第二阶段数据库
1.2.3 第三阶段数据库
1.2.4 大数据环境下面临的挑战
1.3 关系型数据库
1.3.1 数据库的关系模型
1.3.2 关系运算
1.3.3 数据库的设计
1.3.4 数据库的安全性与完整性
1.4 并行数据库
1.5 数据仓库
1.5.1 决策支持系统
1.5.2 数据仓库成分
1.5.3 数据仓库模式
1.5.4 面向列的存储
1.6 数据库安全性与完整性
1.6.1 数据库安全性
1.6.2 数据库完整性
第2章 关系型数据库MySQL
2.1 SQL语句
2.1.1 DDL 定义数据结构语句
2.1.2 DML 操作数据
2.1.3 DQL 查询数据
2.1.4 DCL 控制用户的权限
2.2 存储过程
2.2.1 概述
2.2.2 建立存储过程
2.2.3 调用存储过程
2.2.4 删除存储过程
2.3 编码设置
2.4 索引和视图
2.4.1 索引
2.4.2 视图
2.5 优化
2.6 案例与实践
第3章 数据仓库Hive
3.1 初识Hive
3.1.1 Hive体系结构
3.1.2 Hive存储结构
3.1.3 Hive执行流程
3.2 数据类型、文件格式和关键字
3.2.1 基本数据类型
3.2.2 数据类型转换
3.2.3 复杂数据类型
3.2.4 文本文件数据编码
3.2.5 数据读取模式
3.2.6 文件格式与压缩
3.2.7 Hive压缩
3.2.8 Hive关键字
3.3 Hive命令
3.3.1 Hive help
3.3.2 Hive命令行界面(CLI)
3.4 Hive DDL(数据定义语言)
3.4.1 数据库操作
3.4.2 表操作
3.4.3 元数据存储(Metastore)
3.4.4 综合举例
3.5 Hive DML(数据操作语言)
3.5.1 向表中加载数据
3.5.2 通过查询语句向表中插入数据
3.5.3 将查询的结果写入文件系统
3.5.4 动态分区插入
3.6 HiveQL基本查询
3.6.1 查询基本语法概述
3.6.2 SELECT---FROM语句
3.6.3 嵌套SELECT
3.6.4 WHERE语句
3.6.5 Hive运算符
3.6.6 Hive函数
3.7 HiveQL高级查询
3.7.1 GROUP BY语句
3.7.2 ORDER BY和SORT BY
3.7.3 DISTRIBUTE BY和CLUSTER BY
3.7.4 JOIN语句
3.7.5 UNION
3.8 分桶
3.9 视图和索引
3.9.1 视图
3.9.2 索引
3.10 模式设计
3.10.1 按天划分的表
3.10.2 关于分区
3.10.3 唯一键和标准化
3.10.4 同一份数据多种处理
3.10.5 对于每个表的分区
3.10.6 分桶表数据存储
3.10.7 使用列存储表
3.11 调优
3.11.1 使用EXPLAIN查看执行计划
3.11.2 Hive配置管理
3.11.3 限制调整
3.11.4 JOIN优化
3.11.5 本地(local)模式
3.11.6 并行执行
3.11.7 严格模式
3.11.8 调整Mapper和Reducer个数
3.11.9 JVM重用
3.11.10 动态分区调整
3.11.11 推测执行
3.11.12 单个MapReduce中多个GROUP BY
3.11.13 虚拟列
3.12 案例与实践
第4章 NoSQL概述
4.1 概述
4.1.1 产生背景
4.1.2 意义
4.1.3 noSQL与非关系型数据库
4.2 NoSQL数据模型
4.3 CAP
4.4 NoSQL工作原理
4.5 NoSQL模型分类
4.5.1 键值数据库
4.5.2 文档型数据库
4.5.3 列族数据库
4.5.4 图关系数据库
4.5.5 四者对比
4.6 内存数据库
4.6.1 特点
4.6.2 应用架构
4.6.3 应用领域
4.6.4 代表性产品
4.7 案例与实践
第5章 键值数据库
5.1 模型结构
5.2 特征
5.2.1 一致性
5.2.2 可扩展性
5.2.3 事务
5.2.4 数据结构
5.3 Redis
5.3.1 Redis数据类型
5.3.2 redis的持久化
5.3.3 Redis的事务
5.3.4 Redis的发布订阅
5.3.5 Redis的主从复制
5.4 Redis的Java客户端Jedis
5.4.1 Jedis常用操作
5.4.2 JedisPool
5.5 案例与实践
第6章 列族数据库
6.1 模型结构
6.1.1 HBase数据模型
6.1.2 HBase体系结构
6.2 特征
6.2.1 一致性
6.2.2 可用性
6.2.3 可扩展性
6.2.4 事务
6.3 HBase应用
6.3.1 HBase基本Shell操作
6.3.2 可用客户端
6.3.3 性能优化
6.3.4 HBase与Hive集成
6.4 案例与实践
第7章 文档数据库
7.1 模型结构
7.2 特征
7.2.1 一致性
7.2.2 可扩展性
7.2.3 事务
7.2.4 可用性
7.3 MongoDB
7.3.1 概述
7.3.2 基本操作
7.3.3 索引
7.3.4 主从复制
7.3.5 副本集
7.3.6 分片
7.4 案例与实践
第8章 图数据库
8.1 模型结构
8.2 特征
8.2.1 一致性
8.2.2 可扩展性
8.2.3 事务
8.2.4 数据结构
8.3 Neo4j
8.4 案例与实践
第9章 综合案例
9.1 场景描述
9.2 问题解决思路
9.3 数据库管理系统选择与搭建
1.1 引言
1.2 数据库发展史
1.2.1 第一阶段数据库
1.2.2 第二阶段数据库
1.2.3 第三阶段数据库
1.2.4 大数据环境下面临的挑战
1.3 关系型数据库
1.3.1 数据库的关系模型
1.3.2 关系运算
1.3.3 数据库的设计
1.3.4 数据库的安全性与完整性
1.4 并行数据库
1.5 数据仓库
1.5.1 决策支持系统
1.5.2 数据仓库成分
1.5.3 数据仓库模式
1.5.4 面向列的存储
1.6 数据库安全性与完整性
1.6.1 数据库安全性
1.6.2 数据库完整性
第2章 关系型数据库MySQL
2.1 SQL语句
2.1.1 DDL 定义数据结构语句
2.1.2 DML 操作数据
2.1.3 DQL 查询数据
2.1.4 DCL 控制用户的权限
2.2 存储过程
2.2.1 概述
2.2.2 建立存储过程
2.2.3 调用存储过程
2.2.4 删除存储过程
2.3 编码设置
2.4 索引和视图
2.4.1 索引
2.4.2 视图
2.5 优化
2.6 案例与实践
第3章 数据仓库Hive
3.1 初识Hive
3.1.1 Hive体系结构
3.1.2 Hive存储结构
3.1.3 Hive执行流程
3.2 数据类型、文件格式和关键字
3.2.1 基本数据类型
3.2.2 数据类型转换
3.2.3 复杂数据类型
3.2.4 文本文件数据编码
3.2.5 数据读取模式
3.2.6 文件格式与压缩
3.2.7 Hive压缩
3.2.8 Hive关键字
3.3 Hive命令
3.3.1 Hive help
3.3.2 Hive命令行界面(CLI)
3.4 Hive DDL(数据定义语言)
3.4.1 数据库操作
3.4.2 表操作
3.4.3 元数据存储(Metastore)
3.4.4 综合举例
3.5 Hive DML(数据操作语言)
3.5.1 向表中加载数据
3.5.2 通过查询语句向表中插入数据
3.5.3 将查询的结果写入文件系统
3.5.4 动态分区插入
3.6 HiveQL基本查询
3.6.1 查询基本语法概述
3.6.2 SELECT---FROM语句
3.6.3 嵌套SELECT
3.6.4 WHERE语句
3.6.5 Hive运算符
3.6.6 Hive函数
3.7 HiveQL高级查询
3.7.1 GROUP BY语句
3.7.2 ORDER BY和SORT BY
3.7.3 DISTRIBUTE BY和CLUSTER BY
3.7.4 JOIN语句
3.7.5 UNION
3.8 分桶
3.9 视图和索引
3.9.1 视图
3.9.2 索引
3.10 模式设计
3.10.1 按天划分的表
3.10.2 关于分区
3.10.3 唯一键和标准化
3.10.4 同一份数据多种处理
3.10.5 对于每个表的分区
3.10.6 分桶表数据存储
3.10.7 使用列存储表
3.11 调优
3.11.1 使用EXPLAIN查看执行计划
3.11.2 Hive配置管理
3.11.3 限制调整
3.11.4 JOIN优化
3.11.5 本地(local)模式
3.11.6 并行执行
3.11.7 严格模式
3.11.8 调整Mapper和Reducer个数
3.11.9 JVM重用
3.11.10 动态分区调整
3.11.11 推测执行
3.11.12 单个MapReduce中多个GROUP BY
3.11.13 虚拟列
3.12 案例与实践
第4章 NoSQL概述
4.1 概述
4.1.1 产生背景
4.1.2 意义
4.1.3 noSQL与非关系型数据库
4.2 NoSQL数据模型
4.3 CAP
4.4 NoSQL工作原理
4.5 NoSQL模型分类
4.5.1 键值数据库
4.5.2 文档型数据库
4.5.3 列族数据库
4.5.4 图关系数据库
4.5.5 四者对比
4.6 内存数据库
4.6.1 特点
4.6.2 应用架构
4.6.3 应用领域
4.6.4 代表性产品
4.7 案例与实践
第5章 键值数据库
5.1 模型结构
5.2 特征
5.2.1 一致性
5.2.2 可扩展性
5.2.3 事务
5.2.4 数据结构
5.3 Redis
5.3.1 Redis数据类型
5.3.2 redis的持久化
5.3.3 Redis的事务
5.3.4 Redis的发布订阅
5.3.5 Redis的主从复制
5.4 Redis的Java客户端Jedis
5.4.1 Jedis常用操作
5.4.2 JedisPool
5.5 案例与实践
第6章 列族数据库
6.1 模型结构
6.1.1 HBase数据模型
6.1.2 HBase体系结构
6.2 特征
6.2.1 一致性
6.2.2 可用性
6.2.3 可扩展性
6.2.4 事务
6.3 HBase应用
6.3.1 HBase基本Shell操作
6.3.2 可用客户端
6.3.3 性能优化
6.3.4 HBase与Hive集成
6.4 案例与实践
第7章 文档数据库
7.1 模型结构
7.2 特征
7.2.1 一致性
7.2.2 可扩展性
7.2.3 事务
7.2.4 可用性
7.3 MongoDB
7.3.1 概述
7.3.2 基本操作
7.3.3 索引
7.3.4 主从复制
7.3.5 副本集
7.3.6 分片
7.4 案例与实践
第8章 图数据库
8.1 模型结构
8.2 特征
8.2.1 一致性
8.2.2 可扩展性
8.2.3 事务
8.2.4 数据结构
8.3 Neo4j
8.4 案例与实践
第9章 综合案例
9.1 场景描述
9.2 问题解决思路
9.3 数据库管理系统选择与搭建













