惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
T
Tailwind CSS Blog
J
Java Code Geeks
Microsoft Azure Blog
Microsoft Azure Blog
GbyAI
GbyAI
爱范儿
爱范儿
量子位
Martin Fowler
Martin Fowler
V
V2EX
博客园 - 三生石上(FineUI控件)
I
InfoQ
MongoDB | Blog
MongoDB | Blog
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
N
Netflix TechBlog - Medium
D
DataBreaches.Net
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Last Week in AI
Last Week in AI
U
Unit 42
Apple Machine Learning Research
Apple Machine Learning Research
H
Help Net Security
T
The Blog of Author Tim Ferriss
Hugging Face - Blog
Hugging Face - Blog
美团技术团队
Engineering at Meta
Engineering at Meta

Jiajun的技术笔记

你好,2026! TiDB 源码阅读(六):TiDB Coprocessor 源码解析 性能优化的核心思想 TiDB 源码阅读(五):索引 TiDB 源码阅读(四):AST、逻辑计划、物理计划 CockroachDB Serverless Architecture podman 无故退出 Cursor Control-L (CTRL-L) Keyboard Shortcuts in Terminal Replace docker with podman Using xmonad with xfce4 A RC script for freebsd frpc 自己动手写一个k8s controller AI 会取代你的(编程)岗位吗? 自建DERP服务器提升Tailscale连接速度(使用Nginx转发) 自动升级Docker容器 再读《程序员修炼之道-从小工到专家》 让浏览器下载文件 再读《软件随想录》/《黑客与画家》/《软技能》 HTTP 压力测试中的 Coordinated Omission 2的补码 编程语言中的 context 是什么? flutter macOS 构建出错 Flatpak 使用小记 Golang CAS 操作是怎么实现的 PostgreSQL 当MQ来使用 Clash 结合 工作VPN 的网络设计 使用 PostgreSQL 搭建 JuiceFS PostgreSQL 配置优化和日志分析 有GitHub Copilot?那就可以搭建你的ChatGPT4服务 窗口函数的使用(以PG为例)
程序员的MySQL手册(三):数据库设计
Jiajun Huang · 2020-07-26 · via Jiajun的技术笔记

这一篇我们会讲解数据库设计的准则,介绍常见的数据类型,以及数据库范式和反范式,和他们的应用。

数据库设计的准则

  • 小即是美:用可以表示要存储的数据的最小的类型。小的类型可以更快,因为它们会占用更少的磁盘、内存、CPU缓存空间,通常也只需要更少的CPU指令来处理
  • 简单:处理简单的数据类型可以使用更少的CPU指令
  • 尽量避免NULL(仅MyISAM适用)

数据类型

MySQL提供这些数据类型:

  • 布尔
    • BOOL
  • 数字
    • 整数
      • SMALLINT 占用8个bit,表示范围为 -128~127
      • MEDIUMINT 占用26个bit,表示范围为 -8388608 to 8388607
      • INT 占用32个bit,表示范围为 -2147483648 to 2147483647
      • BIGINT 占用64个bit,表示范围为 -9223372036854775808 to 9223372036854775807
    • 浮点数
      • FLOAT 单精度浮点数
      • DOUBLE 双精度浮点数
    • DECIMAL DECIMAL一般用来表示金钱
  • 二进制
    • BLOB 以二进制方式存储,如照片等
      • TINYBLOB
      • SMALLBLOB
      • BLOB
      • MEDIUMBLOB
      • LONGBLOB
  • 字符串
    • VARCHAR 变长的字符串,一般会配合一个最大长度,例如 VARCHAR(32)
    • CHAR 固定长度的字符串
    • TEXT 以纯文本方式存储字符串
      • TINYTEXT
      • SMALLTEXT
      • TEXT
      • MEDIUMTEXT
      • LONGTEXT
  • 时间
    • DATETIME 表示范围是 ‘1000-01-01 00:00:00’ to ‘9999-12-31 23:59:59’
    • TIMESTAMP 表示范围是 ‘1970-01-01 00:00:01’ UTC to ‘2038-01-19 03:14:07’ UTC
  • 其它如BIT

对应的UNSIGNED,就可以把负数可以表示的范围用于表示正数

注意,MySQL中的int往往带有一个数字,例如 INT(11),这不是说INT占11bit,而是表示在交互式命令行中,该列占11个字符长

而日常开发中我们常用的数据类型有这些:

  • INT,比如主键就会用它,更合理的是设置为 UNSIGNED INT
  • VARCHAR,绝大部分的字符串都会用VARCHAR来存储
  • BOOL,布尔值
  • TINYINT,有多个可选值时,会使用TINYINT来存储可选情况
  • TEXT,存储大篇文章时
  • DATETIME,存储时间一般都会用这个

范式和反范式

根据数据库范式来设计,我们的数据库表会有如下特征:

  • 每一列都是不可切分的最小数据
  • 所有表都有主键,其它字段都依赖于主键
  • 没有重复数据,引用的数据通过外键引用

反范式就是说不遵循这个规定。

实际上日常开发工作中,是反范式和范式结合遵循的,两者都没有完全遵循。为什么呢?因为如果完全遵循范式,大量使用外键之后, 当并发一上去,数据库的负载会迅速上升,所以日常开发中,一般会舍弃第三条,选择冗余一部分数据,例如,如果要在某个表中 引用user id,我们不会使用外键,而是建立一个列,专门存储user_id。另外一个原因就是,数据库的几个范式提出时间都比较古老, 那个时候磁盘什么的还很贵,所以要节省,而现在,磁盘已经很便宜了,相比之下,为了节省磁盘而需要付出的性能代价却更高,因此 就不会选择遵循无冗余的范式了。

系列目录:


参考资料: