创建二级索引_技术分享 | InnoDB 排序索引的构建
原創(chuàng): 管長龍 譯 愛可生開源社區(qū) 3天前
作者:Satya Bodapati從 MySQL 5.7 開始,開發(fā)人員改變了 InnoDB 構(gòu)建二級(jí)索引的方式,采用自下而上的方法,而不是早期版本中自上而下的方法了。在這篇文章中,我們將通過一個(gè)示例來說明如何構(gòu)建 InnoDB 索引。最后,我將解釋如何通過為 innodb_fill_factor 設(shè)置更合適的值。
索引構(gòu)建過程
在有數(shù)據(jù)的表上構(gòu)建索引,InnoDB 中有以下幾個(gè)階段:
1.讀取階段(從聚簇索引讀取并構(gòu)建二級(jí)索引條目)
2.合并排序階段
3.插入階段(將排序記錄插入二級(jí)索引)
在 5.6 版本之前,MySQL 通過一次插入一條記錄來構(gòu)建二級(jí)索引。這是一種“自上而下”的方法。搜索插入位置從樹的根部(頂部)開始并達(dá)到葉頁(底部)。該記錄插入光標(biāo)指向的葉頁上。在查找插入位置和進(jìn)行業(yè)面拆分和合并方面開銷很大。從MySQL 5.7開始,添加索引期間的插入階段使用“排序索引構(gòu)建”,也稱為“批量索引加載”。在這種方法中,索引是“自下而上”構(gòu)建的。即葉頁(底部)首先構(gòu)建,然后非葉級(jí)別直到根(頂部)。
示例
在這些情況下使用排序的索引構(gòu)建:
- ALTER TABLE t1 ADD INDEX(or CREATE INDEX)
- ALTER TABLE t1 ADD FULLTEXT INDEX
- ALTER TABLE t1 ADD COLUMN, ALGORITHM = INPLACE
- OPIMIZE t1
對(duì)于最后兩個(gè)用例,ALTER 會(huì)創(chuàng)建一個(gè)中間表。中間表索引(主要和次要)使用“排序索引構(gòu)建”構(gòu)建。
算法
為簡單起見,上述算法跳過了有關(guān)壓縮頁和 BLOB(外部存儲(chǔ)的 BLOB)處理的細(xì)節(jié)。
通過自下而上的方式構(gòu)建索引
為簡單起見,假設(shè)子頁和非子頁中允許的 最大記錄數(shù)為 3
CREATE TABLE t1 (a INT PRIMARY KEY, b INT, c BLOB);INSERT INTO t1 VALUES (1, 11, 'hello111');INSERT INTO t1 VALUES (2, 22, 'hello222');INSERT INTO t1 VALUES (3, 33, 'hello333');INSERT INTO t1 VALUES (4, 44, 'hello444');INSERT INTO t1 VALUES (5, 55, 'hello555');INSERT INTO t1 VALUES (6, 66, 'hello666');INSERT INTO t1 VALUES (7, 77, 'hello777');INSERT INTO t1 VALUES (8, 88, 'hello888');INSERT INTO t1 VALUES (9, 99, 'hello999');INSERT INTO t1 VALUES (10, 1010, 'hello101010');ALTER TABLE t1 ADD INDEX k1(b);InnoDB 將主鍵字段追加到二級(jí)索引。二級(jí)索引 k1 的記錄格式為(b, a)。在排序階段完成后,記錄為:
(11,1), (22,2), (33,3), (44,4), (55,5), (66,6), (77,7), (88,8), (99,9), (1010, 10)
初始插入階段
讓我們從記錄 (11,1) 開始。
箭頭顯示游標(biāo)當(dāng)前指向的位置。它目前位于第 5 頁,下一個(gè)插入將轉(zhuǎn)到此頁面。
還有兩個(gè)空閑插槽,因此插入記錄 (22,2) 和 (33,3) 非常簡單
對(duì)于下一條記錄 (44,4),頁碼 5 已滿(前面提到的假設(shè)最大記錄數(shù)為 3)。這就是步驟。
頁填充時(shí)的索引構(gòu)建
下一個(gè)插入 - (55,5) 和 (66,6) - 很簡單,它們轉(zhuǎn)到第 6 頁。
插入記錄 (77,7) 類似于 (44,4),除了父頁面 (頁面編號(hào) 7) 已經(jīng)存在并且它有兩個(gè)以上記錄的空間。首先將節(jié)點(diǎn)指針 ((44,4),8) 插入第 7 頁,然后將 (77,7) 記錄到同級(jí) 8 頁中。
插入記錄 (88,8) 和 (99,9) 很簡單,因?yàn)榈?8 頁有兩個(gè)空閑插槽。
下一個(gè)插入 (1010,10) 。將節(jié)點(diǎn)指針 ((77,7),8) 插入 1級(jí)別的父頁(頁碼 7)。
MySQL 在 0 級(jí)創(chuàng)建同級(jí)頁碼 9。將記錄 (1010,10) 插入第 9 頁并將光標(biāo)更改為此頁面。
以此類推。在上面的示例中,數(shù)據(jù)庫在 0 級(jí)別提交到第 9 頁,在 1 級(jí)別提交到第 7 頁。
我們現(xiàn)在有了一個(gè)完整的 B+-tree 索引,它是自下至上構(gòu)建的!
索引填充因子
全局變量 innodb_fill_factor 用于設(shè)置插入 B-tree 頁中的空間量。默認(rèn)值為 100,表示使用整個(gè)業(yè)面(不包括頁眉)。聚簇索引具有 innodb_fill_factor=100 的免除項(xiàng)。 在這種情況下,聚簇索引也空間的 1 /16 保持空閑。即 6.25% 的空間用于未來的 DML。
值 80 意味著 MySQL 使用了 80% 的頁空間填充,預(yù)留 20% 于未來的更新。
如果 innodb_fill_factor=100 則沒有剩余空間供未來插入二級(jí)索引。如果在添加索引后,期望表上有更多的 DML,則可能導(dǎo)致業(yè)面拆分并再次合并。在這種情況下,建議使用 80-90 之間的值。此變量還會(huì)影響使用 OPTIMIZE TABLE 和 ALTER TABLE DROP COLUMN, ALGOITHM=INPLACE 重新創(chuàng)建的索引。
也不應(yīng)該設(shè)置太低的值,例如低于 50。因?yàn)樗饕龝?huì)占用浪費(fèi)更多的磁盤空間,值較低時(shí),索引中的頁數(shù)較多,索引統(tǒng)計(jì)信息的采樣可能不是最佳的。優(yōu)化器可以選擇具有次優(yōu)統(tǒng)計(jì)信息的錯(cuò)誤查詢計(jì)劃。
排序索引構(gòu)建的優(yōu)點(diǎn)
缺點(diǎn)
ALTER 正在進(jìn)行時(shí),插入性能降低 Bug#82940,但在后續(xù)版本中計(jì)劃修復(fù)。
總結(jié)
以上是生活随笔為你收集整理的创建二级索引_技术分享 | InnoDB 排序索引的构建的全部內(nèi)容,希望文章能夠幫你解決所遇到的問題。
- 上一篇: opengl 日地月运动模型_MaskF
- 下一篇: 逐渐增高_健身能不能增高?真相原来是这样