


本书旨在全面介绍超融合数据库的出现、基本原理、核心技术和应用案例。全书包括三个部分,首先从数据库发展历史的角度讨论超融合数据库出现的必然性;接着,介绍如何打造超融合数据库,重点介绍超融合数据库的核心技术和实现原理,涉及微内核、一体化、高性能、分布式、易用性等方面。书中给出了超融合数据库的典型应用案例,包括新能源制造企业的大数据平台、车企的车机信号系统、装备制造业企业的智能平台的超融合改造。本书还对超融合数据库的未来发展进行了展望。本书内容前沿、理论与实践并重,适合作为数据库、大数据等领域研究人员、技术人员的参考书,也适合作为希望进行数字化转型的企业决策者的参考书。
封面
前折页
书名页
版权
推荐序一
推荐序二
前言
第一部分 超融合数据库的出现
第1章 当前数据库应用存在的困难
1.1 数据库选型困难
1.2 比选型更困难的工作
第2章 从数据库发展史中探寻答案
2.1 漫谈数据库发展史
2.1.1 上古时期
2.1.2 工业化时代
2.1.3 信息化时代
2.1.4 互联网与大数据时代
2.1.5 数智化+物联网时代
2.2 数据库变革的驱动力
2.2.1 系统发展的主要因素
2.2.2 数据库发展的原动力
2.2.3 数据处理平台的进化
第3章 超融合数据库的出现是时代发展的必然
3.1 为什么需要超融合数据库
3.1.1 数智化+物联网时代数据的特点
3.1.2 现代数据库需要具备的能力
3.1.3 超融合数据库能不能实现
3.2 什么是超融合数据库
3.2.1 超融合数据库的定义
3.2.2 超融合数据库的边界
3.3 超融合数据库的落地
3.3.1 复杂数据处理
3.3.2 复杂时序分析
3.3.3 海量泛物联网设备
3.3.4 传统的数仓OLAP
3.3.5 新兴的AI大模型应用场景
第二部分 打造超融合数据库
第4章 微内核——超融合数据库的桥梁
4.1 什么是微内核
4.2 实现一库多核
4.3 为每个场景实现极限性能
4.3.1 微内核的独立性
4.3.2 场景的协作性
4.3.3 优化器和执行器的完美配合
4.3.4 数据存储的统一性
4.4 总结、质疑和挑战
第5章 一体化——超融合数据库的目标
5.1 从数据模型到字段类型的多场景一体化融合
5.1.1 在关系数据模型中使用JSON类型
5.1.2 在关系数据模型中扩展MXKV2类型
5.1.3 在关系数据模型中扩展非结构化数据类型
5.1.4 在关系数据模型中扩展向量类型
5.1.5 在关系数据模型中扩展GIS类型
5.1.6 在关系数据模型中扩展时序类型
5.1.7 在关系数据模型中扩展图类型
5.1.8 从模型到类型的一体化融合总结
5.2 将数据与完备性融为一体的关系模型场景
5.2.1 关系模型场景的数据处理方式1——OLTP
5.2.2 关系模型场景的数据处理方式2——OLAP
5.2.3 OLTP与OLAP的对比
5.2.4 OLTP与OLAP的集成及创新
5.2.5 总结与展望
5.3 将数据与时间融为一体的时序模型场景
5.3.1 时序场景的产生
5.3.2 时序数据概述
5.3.3 时序数据模型
5.3.4 时序场景建模的思路
5.3.5 时序场景下的数据建模示例
5.3.6 时序场景写入特征
5.3.7 时序数据库的挑战与发展趋势
5.4 将数据与空间融为一体的GIS模型
5.4.1 GIS数据库概述
5.4.2 GIS数据库的功能
5.4.3 GIS与关系数据库的融合
5.4.4 GIS与关系数据库融合的实例分析
5.4.5 GIS数据库的发展趋势
5.5 将数据与关联关系融为一体的图模型
5.5.1 图场景说明与需求
5.5.2 社交网络场景探究
5.5.3 溯源/追溯场景剖析
5.6 将无模式设计与列存储融为一体的MXKV2
5.6.1 MXKV2压缩能力测试结果
5.6.2 MXKV2点查测试结果
5.6.3 MXKV2聚集查询测试结果
5.7 为AI大模型搭载知识库的向量模型场景
5.7.1 深度学习与向量数据库
5.7.2 pgvector的作用与原理
5.7.3 使用pgvector
5.8 超融合目标实现的总结
第6章 高性能——超融合数据库的支柱
6.1 存储器
6.1.1 MARS3的原理与应用
6.1.2 合并
6.1.3 MARS3的存储特性
6.1.4 存储策略
6.2 执行器
6.2.1 向量化执行引擎技术
6.2.2 动态过滤机制优化
6.3 优化器
6.3.1 多节点并行
6.3.2 多核并行
6.3.3 快速直接路径访问
6.4 高性能写入
6.4.1 直接INSERT存在的问题
6.4.2 MatrixGate高效写入的原理
6.4.3 MxGate数据加载的过程
6.4.4 MxGate内部的多任务并行机制
6.4.5 MxGate数据加载的优势
6.5 库内机器学习
6.5.1 什么是库内机器学习
6.5.2 PLPython的使用
6.5.3 库内机器学习的优势和不足
6.6 库内持续聚集
6.6.1 持续聚集
6.6.2 滑动窗口
6.6.3 持续聚集的优势和劣势
6.7 库内流计算
6.7.1 流表的概念
6.7.2 库内流计算的实例
6.7.3 库内与库外流计算的对比
6.8 性能总结
第7章 分布式——超融合数据库的基座
7.1 分布式架构
7.2 数据分布
7.2.1 哈希分布
7.2.2 随机分布
7.2.3 复制分布
7.2.4 Master-only分布
7.3 镜像分布
7.3.1 散列镜像分布
7.3.2 组镜像分布
7.3.3 环状镜像分布
7.4 跨节点数据移动操作
7.4.1 数据重分布
7.4.2 数据广播
7.4.3 数据收集
7.5 Motion执行计划的构造与解读
7.5.1 表与记录构造
7.5.2 执行计划解读
7.6 分布式事务
7.6.1 两阶段提交
7.6.2 三阶段提交
7.6.3 基于消息的事务处理
7.7 分区与分布的结合
7.7.1 分布式数据库中的分区技术实践
7.7.2 分区技术的使用场景与注意事项
7.8 分布式总结
第8章 易用性——超融合数据库的保障
8.1 化解场景一体化带来的数据库管理压力
8.1.1 极简安装
8.1.2 资源管控
8.1.3 平滑扩容
8.1.4 便捷写入与迁移
8.1.5 自动分区
8.2 让跨场景融合的数据分析发挥更大的价值
8.2.1 通用表达式
8.2.2 递归调用
8.2.3 窗口函数
8.2.4 数据立方体
8.2.5 UPSERT
8.2.6 CASE WHEN
8.3 有效保障多模数据融合之下的数据安全
8.3.1 快速恢复
8.3.2 故障自愈
8.3.3 权限管控
8.4 规避超融合数据库复杂度带来的风险
第三部分 超融合数据库实战
第9章 行业数据的痛点与超融合数据库的解决之道
9.1 行业数据应用面临的痛点
9.1.1 痛点1:性能需求难以满足
9.1.2 痛点2:稳定性难以保障
9.1.3 痛点3:功能需求难以实现
9.1.4 痛点4:成本过高
9.2 企业应对痛点的三大利器
9.2.1 限制
9.2.2 升级
9.2.3 拆分
9.3 超融合数据库的一站式解决之道
9.3.1 才解决旧痛点又遇到新麻烦
9.3.2 旧痛点卷土重来的原因剖析
9.3.3 超融合数据库解决痛点的方案
9.3.4 超融合数据库迁移的三部曲
第10章 新能源制造企业大数据平台的超融合之路
10.1 企业大数据平台的场景概述
10.1.1 从单一生产业务系统说起
10.1.2 数据汇聚催生出企业大数据平台
10.1.3 企业大数据平台的重要模块与压力
10.2 企业大数据平台面临的痛点与挑战
10.2.1 痛点与挑战1:性能
10.2.2 痛点与挑战2:稳定性
10.2.3 痛点与挑战3:功能
10.2.4 痛点与挑战4:成本
10.3 企业大数据平台的改造及成效
10.3.1 提升性能的改造
10.3.2 保持稳定性的改造
10.3.3 完善功能的改造
10.3.4 节约成本的改造
10.3.5 企业大数据平台超融合改造总结
第11章 某车企的车机信号系统超融合之路
11.1 车机信号系统场景概述
11.2 车机信号系统面临的痛点与挑战
11.2.1 痛点与挑战1:性能
11.2.2 痛点与挑战2:稳定性
11.2.3 痛点与挑战3:功能
11.2.4 痛点与挑战4:成本
11.3 车机信号系统的改造及成效
11.3.1 提升性能的改造
11.3.2 保持稳定性的改造
11.3.3 完善功能的改造
11.3.4 节约成本的改造
11.3.5 车机信号系统的超融合改造总结
第12章 某装备制造业企业的智能平台超融合之路
12.1 装备制造业企业智能平台场景概述
12.2 智能平台面临的痛点与挑战
12.2.1 痛点与挑战1:性能
12.2.2 痛点与挑战2:稳定性
12.2.3 痛点与挑战3:功能
12.2.4 痛点与挑战4:成本
12.3 智能平台的改造与成效
12.3.1 提升性能的改造
12.3.2 保持稳定性的改造
12.3.3 完善功能的改造
12.3.4 节约成本的改造
12.3.5 装备智能平台的超融合改造总结
第13章 超融合数据库的思考与展望
13.1 关于“什么都能做,是否什么都做不好”的讨论
13.2 展望
附录
附录A 术语表
附录B 数据相关概念总结
后折页
封底
机械工业出版社 京icp备14043556号-1 (署)网出证(京)字第214号 Copyright (C) 2001 CmpBook. All Rights Reserved