数据库，主键为何不宜太长长长长长长长长？

摘要：（1）主键索引与记录存储在一起，所以才叫聚集索引 (Clustered Index)。（1）主键索引与记录不存储在一起，因此它是非聚集索引 (Unclustered Index)。

继续回答星球水友提问：

沈老师，我听网上说，MySQL数据表，在数据量比较大的情况下，主键不宜过长，是不是这样呢？ 这又是为什么呢？

这个问题嘛，不能一概而论：

（1）如果是 InnoDB 存储引擎，主键不宜过长；

（2）如果是 MyISAM 存储引擎，影响不大；

先举个简单的栗子说明一下前序知识。

假设有数据表：

t(id PK, name KEY, sex, flag);

其中：

（1）id是主键;

（2）name建了普通索引;

假设表中有四条记录：

1, shenjian, m, A

3, zhangsan, m, A

5, lisi, m, A

9, wangwu, f, B

如果存储引擎是 MyISAM ，其索引与记录的结构是这样的：

（1）有单独的区域存储记录 (record) ；

（2）主键索引与普通索引结构相同，都存储记录的指针（暂且理解为指针）；

画外音：

（1）主键索引与记录不存储在一起，因此它是非聚集索引 (Unclustered Index) ；

（2）MyISAM可以没有PK；

MyISAM使用索引进行检索时，会先从索引树定位到记录指针，再通过记录指针定位到具体的记录。

画外音：不管主键索引，还普通索引，过程相同。

InnoDB 则不同，其索引与记录的结构是这样的：

（1）主键索引与记录存储在一起；

（2）普通索引存储主键（这下不是指针了）；

画外音：

（1）主键索引与记录存储在一起，所以才叫聚集索引 (Clustered Index) ；

（2）InnoDB一定会有聚集索引；

InnoDB通过主键索引查询时，能够直接定位到行记录。

但如果通过普通索引查询时，会先查询出主键，再从主键索引上二次遍历索引树。

回归正题， 为什么InnoDB的主键不宜过长呢？

假设有一个 用户中心 场景，包含身份证号，身份证MD5，姓名，出生年月

等业务属性，这些属性上均有查询需求。

最容易想到的设计方式是：

身份证作为主键
其他属性上建立索引

user( id_code PK
,

id_md5(index),

name(index),

birthday(index));

此时的索引树与行记录结构如上：

id_code聚集索引，关联行记录
其他索引，存储id_code属性值

身份证号id_code是一个比较长的字符串，每个索引都存储这个值，在数据量大，内存珍贵的情况下， MySQL有限的缓冲区，存储的索引与数据会减少，磁盘IO的概率会增加。

画外音：同时，索引占用的磁盘空间也会增加。

此时，应该新增一个无业务含义的 id自增列：

以id自增列为聚集索引，关联行记录
其他索引，存储id值

user( id PK auto inc
,

id_code(index),

id_md5(index),

name(index),

birthday(index));

如此一来，有限的缓冲区，能够缓冲更多的索引与行数据，磁盘IO的频率会降低，整体性能会增加。

总结

（1）MyISAM的索引与数据分开存储，索引叶子存储指针，主键索引与普通索引无太大区别；

（2）InnoDB的聚集索引和数据行统一存储，聚集索引存储数据行本身，普通索引存储主键；

（3）InnoDB不建议使用太长字段作为PK（此时可以加入一个自增键PK），MyISAM则无所谓；

希望解答了这位水友的疑问。

欢迎大家继续提问，有问必答。

数据库，主键为何不宜太长长长长长长长长？

热门新闻

周热门

数据库，主键为何不宜太长长长长长长长长？

中国核心数据对美国的依赖 可能真要结束了

借github上韩国师傅的一个源码实例再次理解.htaccess的功效

深究用户利用.htaccess的原理篡改配置导致的安全问题

mysql中如何减库存

设计MySQL的大叔为何偏爱ref？

基于MySQL 的 SQL 优化总结

mysql-kettle-superset电商可视化数据分析

这一份MySQL书单，可以帮你搞定90%以上的面试题！

从排查端口弱口令研究打造完美防御的思路

mysql调优之利器explain

MySQL 入门（3）：事务隔离

Python Web实战：Python+Django+MySQL实现基于Web版的增删改查

Go 每日一库之 xorm

mysql事务和阶段性回滚点

为你整理了一份 Mysql 的学习笔记，建议收藏学习！

热门新闻

周热门

中国核心数据对美国的依赖可能真要结束了