最近2018中文字幕在日韩欧美国产成人片_国产日韩精品一区二区在线_在线观看成年美女黄网色视频_国产精品一区三区五区_国产精彩刺激乱对白_看黄色黄大色黄片免费_人人超碰自拍cao_国产高清av在线_亚洲精品电影av_日韩美女尤物视频网站

RELATEED CONSULTING
相關(guān)咨詢
選擇下列產(chǎn)品馬上在線溝通
服務(wù)時(shí)間:8:30-17:00
你可能遇到了下面的問(wèn)題
關(guān)閉右側(cè)工具欄

新聞中心

這里有您想知道的互聯(lián)網(wǎng)營(yíng)銷解決方案
MySQL中的隨機(jī)抽取如何實(shí)現(xiàn)

今天小編給大家分享一下MySQL中的隨機(jī)抽取如何實(shí)現(xiàn)的相關(guān)知識(shí)點(diǎn),內(nèi)容詳細(xì),邏輯清晰,相信大部分人都還太了解這方面的知識(shí),所以分享這篇文章給大家參考一下,希望大家閱讀完這篇文章后有所收獲,下面我們一起來(lái)了解一下吧。

成都創(chuàng)新互聯(lián)公司 - 電信機(jī)房托管,四川服務(wù)器租用,成都服務(wù)器租用,四川網(wǎng)通托管,綿陽(yáng)服務(wù)器托管,德陽(yáng)服務(wù)器托管,遂寧服務(wù)器托管,綿陽(yáng)服務(wù)器托管,四川云主機(jī),成都云主機(jī),西南云主機(jī),電信機(jī)房托管,西南服務(wù)器托管,四川/成都大帶寬,機(jī)柜大帶寬,四川老牌IDC服務(wù)商

1. 引言

現(xiàn)在有一個(gè)需求是從一個(gè)單詞表中每次隨機(jī)選取三個(gè)單詞。

這個(gè)表的建表語(yǔ)句和如下所示:

mysql> Create table 'words'(
    'id' int(11) not null auto_increment;
    'word' varchar(64) default null;
    primary key ('id')
) ENGINE=InnoDB;

然后我們向其中插入10000行數(shù)據(jù)。接下來(lái)我們看看如何從中隨機(jī)選擇3個(gè)單詞。

2. 內(nèi)存臨時(shí)表

首先,我們通常會(huì)想到用order by rand()來(lái)實(shí)現(xiàn)這個(gè)邏輯:

mysql> select word from words order by rand() limit 3;

雖然這句話很簡(jiǎn)單,但是執(zhí)行流程則比較復(fù)雜。我們使用explain來(lái)看看語(yǔ)句的執(zhí)行情況:

MySQL中的隨機(jī)抽取如何實(shí)現(xiàn)

Extra字段中Using temporary表示需要使用臨時(shí)表,Using filesort表示需要進(jìn)行排序。也就是需要進(jìn)行排序操作。

對(duì)于InnoDB表來(lái)說(shuō),執(zhí)行全字段排序能夠減少對(duì)于磁盤的訪問(wèn),所以會(huì)被優(yōu)先選擇。

MySQL中的隨機(jī)抽取如何實(shí)現(xiàn)

而對(duì)于內(nèi)存表來(lái)說(shuō),回表過(guò)程只是簡(jiǎn)單地根據(jù)數(shù)據(jù)行的位置,直接訪問(wèn)內(nèi)存得到數(shù)據(jù),根本不會(huì)導(dǎo)致多訪問(wèn)磁盤。所以這時(shí)MySQL會(huì)優(yōu)選選擇rowid排序。

MySQL中的隨機(jī)抽取如何實(shí)現(xiàn)

我們接下來(lái)再來(lái)梳理下這條語(yǔ)句的執(zhí)行流程:

  • 創(chuàng)建一個(gè)臨時(shí)表,這個(gè)表使用memory引擎,表里有兩個(gè)字段,第一個(gè)字段是double類型,記為R,第二個(gè)字段是varchar(64)類型,記為W。并且這個(gè)表沒(méi)有索引。

  • 從words表中,按主鍵順序取出所有的word。對(duì)于每個(gè)word,調(diào)用rand()函數(shù)隨機(jī)生成一個(gè)大于0小于1的隨機(jī)小數(shù),并把這個(gè)隨機(jī)小數(shù)和word分別存入臨時(shí)表的R和W字段中。

  • 接下來(lái)就是按照字段R進(jìn)行排序

  • 初始化sort_buffer。sort_buffer有兩個(gè)字段,一個(gè)是double類型,另一個(gè)是整型。

  • 從內(nèi)存臨時(shí)表中一行行取出R值和位置信息,分別存入sort_buffer的兩個(gè)字段里。

  • sort_buffer按照R值進(jìn)行排序

  • 排序完成后,取出前三個(gè)結(jié)果的位置信息,到內(nèi)存臨時(shí)表中取出相應(yīng)的word,返回給客戶端。

流程示意圖如下所示:

MySQL中的隨機(jī)抽取如何實(shí)現(xiàn)

上面講的位置信息,其實(shí)就是行所在的位置,也就是我們之前說(shuō)的rowid。

對(duì)于InnoDB引擎來(lái)說(shuō),對(duì)于有沒(méi)有主鍵表來(lái)說(shuō)有兩種處理方式:

  • 對(duì)于有主鍵的InnoDB表來(lái)說(shuō),這個(gè)rowid就是主鍵id

  • 對(duì)于沒(méi)有主鍵的InnoDB表來(lái)說(shuō),這個(gè)rowid是由系統(tǒng)生成的,用來(lái)標(biāo)識(shí)不同行。

因此,order by randn()使用了內(nèi)存臨時(shí)表,內(nèi)存臨時(shí)表的排序方法用的是rowid排序方法。

3. 磁盤臨時(shí)表

不是所有的臨時(shí)表都是內(nèi)存臨時(shí)表。tmp_table_size這個(gè)配置限制了內(nèi)存臨時(shí)表的大小,如果超過(guò)了這個(gè)大小,就會(huì)使用磁盤臨時(shí)表。InnoDB引擎就是默認(rèn)使用磁盤臨時(shí)表。

4. 優(yōu)先隊(duì)列排序算法

在MySQL5.6之后,引入了優(yōu)先隊(duì)列排序算法,這種算法是不需要使用臨時(shí)文件的。而原本的歸并排序算法則是需要使用臨時(shí)文件。

因?yàn)楫?dāng)你使用歸并算法的時(shí)候,其實(shí)你只需要得到前3,但是你是用完歸并排序,那已經(jīng)整體有序了,造成了資源的浪費(fèi)。

而優(yōu)先隊(duì)列排序算法則可以只取到前三,執(zhí)行流程如下:

  • 對(duì)于這10000個(gè)準(zhǔn)備排序的(R,rowid),先取前三行,構(gòu)造成一個(gè)堆,并且將最大的值放在堆頂;

  • 取下一行(R’,rowid’),跟當(dāng)前堆里面最大的R比較,如果R’小于R,則把(R,rowid)從堆中去掉,換成(R’,rowid’)。

  • 不斷重復(fù)上面的過(guò)程。

流程如下圖所示:

MySQL中的隨機(jī)抽取如何實(shí)現(xiàn)

但是當(dāng)limit的數(shù)比較大時(shí),維護(hù)堆比較困難,所以又會(huì)使用歸并排序算法。

以上就是“MySQL中的隨機(jī)抽取如何實(shí)現(xiàn)”這篇文章的所有內(nèi)容,感謝各位的閱讀!相信大家閱讀完這篇文章都有很大的收獲,小編每天都會(huì)為大家更新不同的知識(shí),如果還想學(xué)習(xí)更多的知識(shí),請(qǐng)關(guān)注創(chuàng)新互聯(lián)行業(yè)資訊頻道。


分享標(biāo)題:MySQL中的隨機(jī)抽取如何實(shí)現(xiàn)
鏈接分享:http://fisionsoft.com.cn/article/jjcocj.html