栏目分类:
子分类:
返回
名师互学网用户登录
快速导航关闭
当前搜索
当前分类
子分类
实用工具
热门搜索
名师互学网 > IT > 前沿技术 > 大数据 > 大数据系统

数仓建模—表设计规范

数仓建模—表设计规范

表设计规范

前面我们介绍了一些数仓的设计规范,主要围绕着数仓整体的设计以及维度建模来的,你可以参考:

  1. 数仓建模—数仓开发规范
  2. 数仓建模—事实表和维度表设计规范

我们知道数仓本质上是一堆表的集合,所以我们今天就来看一些关于表本身的一些设计问题

表的概述

表本身其实就是一组文件的集合,只不过我们赋予了它结构的概念,最终演化成了数据的组织方式。在整个数仓中从数据源到数据集成再到数据开发以及到最后的数据应用,我们都是通过表来完成的,也就是说我们的整个过程都是围绕着表来的。

我们大致有下面几类表

表(Table)是Hive的数据存储单元。它在逻辑上是由行和列组成的二维结构,每行代表一条记录,每列表示相同数据类型的一个字段。一条记录可以包含一个或多个列,各个列的名称和数据类型构成表的Schema。

Hive的表有两种类型:

  • 内部表:
  • 外部表:

关于这个两个概念你可以参考Hive内

转载请注明:文章转载自 www.mshxw.com
本文地址:https://www.mshxw.com/it/674317.html
我们一直用心在做
关于我们 文章归档 网站地图 联系我们

版权所有 (c)2021-2022 MSHXW.COM

ICP备案号:晋ICP备2021003244-6号