回答星球水友提问:
沈老师,我听网上说,MySQL数据表,在数据量比较大的情况下,主键不宜过长,是不是这样呢?这又是为什么呢?
t(id PK, name KEY, sex, flag);
1, shenjian, m, A
3, zhangsan, m, A
5, lisi, m, A
9, wangwu, f, B
如果存储引擎是MyISAM,其索引与记录的结构是这样的:
(2)主键索引与普通索引结构相同,都存储记录的指针(暂且理解为指针);
(1)主键索引与记录不存储在一起,因此它是非聚集索引(Unclustered Index);
MyISAM使用索引进行检索时,会先从索引树定位到记录指针,再通过记录指针定位到具体的记录。
(1)主键索引与记录存储在一起,所以才叫聚集索引(Clustered Index);
InnoDB通过主键索引查询时,能够直接定位到行记录。
但如果通过普通索引查询时,会先查询出主键,再从主键索引上二次遍历索引树。
假设有一个用户中心场景,包含身份证号,身份证MD5,姓名,出生年月等业务属性,这些属性上均有查询需求。
最容易想到的设计方式是:
user(id_code PK,
id_md5(index),
name(index),
birthday(index));
-
id_code聚集索引,关联行记录
-
其他索引,存储id_code属性值
身份证号id_code是一个比较长的字符串,每个索引都存储这个值,在数据量大,内存珍贵的情况下,MySQL有限的缓冲区,存储的索引与数据会减少,磁盘IO的概率会增加。
-
以id自增列为聚集索引,关联行记录
-
其他索引,存储id值
user(id PK auto inc,
id_code(index),
id_md5(index),
name(index),
birthday(index));
如此一来,有限的缓冲区,能够缓冲更多的索引与行数据,磁盘IO的频率会降低,整体性能会增加。
(1)MyISAM的索引与数据分开存储,索引叶子存储指针,主键索引与普通索引无太大区别;
(2)InnoDB的聚集索引和数据行统一存储,聚集索引存储数据行本身,普通索引存储主键;
(3)InnoDB不建议使用太长字段作为PK(此时可以加入一个自增键PK),MyISAM则无所谓;
希望解答了这位水友的疑问。
【声明】:本博客不参与任何交易,也非中介,仅记录个人感兴趣的主机测评结果和优惠活动,内容均不作直接、间接、法定、约定的保证。访问本博客请务必遵守有关互联网的相关法律、规定与规则。一旦您访问本博客,即表示您已经知晓并接受了此声明通告。