激情婷婷丁香色五月综合深爱野花_婷婷伊人五月天色综合激情网_丁香开心婷婷伊人_狠狠五月激情丁香六月_丁香花在线电影小说观看_丁香花在线视频观看免费_丁香花视频资源在线观看免费_狠狠色丁婷婷日日_伊人激情综合网,久久狠狠干,狠狠干2018_狠狠干天天草,综合五月天天干狠狠干,狠狠干在线观看,狠狠干最新网址,狠狠干狠狠做,狠狠操狠狠干,日韩亚洲狠狠丁香婷婷综合久久久,欧美精品夜夜橾天天橾天天色,中文精品久久中文字幕伊人小说小说

您(nín)現在的(dí)位置(zhì):首頁(yè) >> SEO優(yōu)化 >> 內容

搜索引擎(qíng)工作原理

時間:2013/12/18 15:31:08 點擊:4127

摘要:在(zài)正式學(xué)習(xí)SEO之前,你還需(xū)要(yào)學習一(yī)下搜索引擎(qíng)的工(gōng)作原理(lǐ),畢竟(jìng)SEO是(shì)針(zhēn)對搜(sōu)索(suǒ)引擎進行(háng)操作的,那麼(mó)弄明(míng)白搜(sōu)索引擎的(dí)工作原理,那麼遇到(dào)一(yī)些問題(tí)的時(shí)候,你就可(kě)以(yǐ)知道(dào)問(wèn)題產生的原因了(liǎo)。一個搜(sōu)索引(yǐn)擎,一般由...

在正(zhèng)式學習(xí)SEO之(zhī)前,你(nǐ)還需要(yào)學(xué)習一下搜(sōu)索(suǒ)引擎(qíng)的工作(zuò)原(yuán)理,畢(bì)竟(jìng)SEO是(shì)針(zhēn)對搜索引擎(qíng)進(jìn)行操作的(dí),那麼弄明(míng)白(bái)搜索(suǒ)引(yǐn)擎的(dí)工(gōng)作原(yuán)理(lǐ),那麼遇到一些問題的時候,你(nǐ)就(jiù)可以(yǐ)知(zhī)道問題(tí)產生的(dí)原(yuán)因了。一(yī)個(gè)搜(sōu)索(suǒ)引擎(qíng),一(yī)般由下(xià)麵(miàn)幾個(gè)模(mó)塊組成:
1,抓取模塊
2,過濾模(mó)塊
3,收(shōu)錄(lù)模塊
4,排序(xù)模塊

抓(zhuā)取模(mó)塊(kuài)
搜索(suǒ)引擎在(zài)運(yùn)作的(dí)時候,第一個工作(zuò)就是要去(qù)互(hù)聯網上(shàng)麵抓取頁麵(miàn),而實現這個工(gōng)作的(dí)模塊,我(wǒ)們(mén)稱為抓取(qǔ)模(mó)塊。學(xué)習(xí)抓(zhuā)取模塊(kuài),我們需要先了(liǎo)解(jiě)下(xià)麵幾個(gè)知(zhī)識點(diǎn):
1,搜(sōu)索(suǒ)引擎(qíng)抓取(qǔ)程序:蜘蛛
搜索引(yǐn)擎(qíng)為了可以(yǐ)自動(dòng)抓取(qǔ)互聯網上麵數(shù)以(yǐ)萬(wàn)計的網(wǎng)頁(yè),必須有(yǒu)一個(gè)全(quán)自(zì)動的(dí)頁(yè)麵抓取程序。而這個程序我們一(yī)般稱之為“蜘蛛”(也可(kě)以(yǐ)叫做(zuò)“機器(qì)人”)。那麼不(bù)同的搜索(suǒ)引擎的蜘蛛(zhū),叫法(fǎ)也就不(bù)同(tóng)了(liǎo)。百(bǎi)度(dù)的抓(zhuā)取程(chéng)序,一般稱為百(bǎi)度(dù)蜘(zhī)蛛(zhū)。
穀(gǔ)歌的(dí)抓(zhuā)取(qǔ)程(chéng)序,一般(bān)稱(chēng)為(wéi)穀歌機器(qì)人。
360的抓(zhuā)取程(chéng)序,一般(bān)稱(chēng)為360蜘蛛(zhū)。
其實(shí),不管叫(jiào)做蜘(zhī)蛛,還是機器人,你隻要(yào)知(zhī)道這個指的是搜(sōu)索引擎(qíng)的(dí)抓取程(chéng)序,就(jiù)可以了。蜘蛛(zhū)的(dí)任(rèn)務(wù)很簡單,就是順著(zhuó)鏈(liàn)接不斷的抓(zhuā)取(qǔ)互聯網(wǎng)上(shàng),自己還沒(méi)有(yǒu)收(shōu)錄過的(dí)網頁(yè)和鏈接,然(rán)後將抓(zhuā)取(qǔ)到的網頁信(xìn)息和(hé)鏈接信息(xī)存儲到自己的網(wǎng)頁(yè)數(shù)據(jù)庫(kù)中(zhōng)。而(ér)這些抓取(qǔ)到的網(wǎng)頁,將(jiāng)有機(jī)會(huì)出現在(zài)最(zuì)終的(dí)搜索結果中。
2,怎(zěn)麼讓(ràng)蜘(zhī)蛛來(lái)抓取(qǔ)我們的(dí)網(wǎng)站(zhàn)
通過上麵(miàn)對(duì)蜘(zhī)蛛的(dí)解釋,我們能(néng)夠知(zhī)道(dào):要想自己(jǐ)的(dí)頁麵(miàn)最終出現(xiàn)在搜(sōu)索(suǒ)結果中(zhōng),首(shǒu)先(xiān)得讓蜘蛛(zhū)抓(zhuā)取到我們(mén)的網站(zhàn)。通(tōng)過(guò)下麵三(sān)種(zhǒng)方法(fǎ)可以(yǐ)讓(ràng)蜘蛛(zhū)來(lái)抓(zhuā)取我(wǒ)們的網站
外(wài)部(bù)鏈接:我(wǒ)們可(kě)以(yǐ)在一(yī)些(xiē)已經(jīng)被搜索(suǒ)引擎(qíng)收(shōu)錄(lù)的(dí)網站上麵(miàn)發(fā)布(bù)自己(jǐ)網站(zhàn)的(dí)鏈接(jiē),以此(cǐ)吸引(yǐn)蜘(zhī)蛛,或者交換友(yǒu)情(qíng)鏈接也(yě)是一個常(cháng)用的方法(fǎ)。
提交鏈接:百度為站長們(mén)提(tí)供了(liǎo)鏈(liàn)接提(tí)交的(dí)工具,通過這個(gè)工(gōng)具,我(wǒ)們(mén)隻需要通過這(zhè)個工(gōng)具(jù)提(tí)交(jiāo)給(gěi)百度(dù),那麼(mó)百度就(jiù)會派出蜘(zhī)蛛(zhū)來抓取(qǔ)我(wǒ)們網(wǎng)頁了。
百度網址提(tí)交工具網(wǎng)址(zhǐ)(如圖所示):
http://zhanzhang.baidu.com/linksubmit/URL
搜索引擎工(gōng)作原(yuán)理

蜘蛛(zhū)自己來抓取(qǔ):如果你希(xī)望蜘蛛(zhū)能(néng)夠(gòu)定(dìng)期(qī)主(zhǔ)動來自(zì)己的(dí)網(wǎng)站(zhàn)抓(zhuā)取網頁,那麼你就必(bì)須(xū)提供優(yōu)質的(dí)網站內容(róng)。隻有蜘蛛發(fā)現(xiàn)你的網站的(dí)內(nèi)容質量很(hěn)好,那麼(mó)蜘蛛就(jiù)會(huì)特(tè)別關(guān)照(zhào)你(nǐ)的網站,定時(shí)會來你的網站(zhàn)看(kàn)看(kàn)是(shì)不是(shì)新的內(nèi)容產(chǎn)生(shēng)。如何(hé)才能夠確保自(zì)己的網站(zhàn)能(néng)夠提(tí)供(gōng)優勢的(dí)內容(róng),這(zhè)個話(huà)題我們(mén)在(zài)之後的章節(jié)再做(zuò)闡述(shù)。
3,怎(zěn)麼(mó)知(zhī)道蜘蛛(zhū)來(lái)過我們(mén)網站
通過(guò)下麵2個方(fāng)式(shì)可以(yǐ)知(zhī)道蜘蛛(zhū)是否(fǒu)來過我(wǒ)們(mén)的(dí)網站。
(1)百度抓(zhuā)取頻(pín)次工具(jù)
該(gāi)工(gōng)具網址為:http://zhanzhang.baidu.com/pressure/index
搜索引(yǐn)擎工(gōng)作(zuò)原理
(2)服(fú)務器IIS日誌(zhì)
如(rú)果你(nǐ)的服(fú)務器開啟(qǐ)了(liǎo)IIS日(rì)誌功能(néng),那麼(mó)也(yě)可(kě)以(yǐ)通(tōng)過IIS日誌文件看(kàn)到(dào)蜘(zhī)蛛來(lái)過的痕跡。通過IIS日誌(zhì)我們(mén)可(kě)以發(fā)現百度蜘蛛(zhū)抓取我們那(nà)些頁(yè)麵(miàn)。
4,影響蜘(zhī)蛛抓(zhuā)取的因素
好了,我(wǒ)們知道了(liǎo)網站想要(yào)有排(pái)名,第一步就是必須(xū)能夠被(bèi)蜘蛛抓取(qǔ)到。那(nà)麼(mó)那些(xiē)因素(sù)有可(kě)能造成蜘(zhī)蛛無法(fǎ)正(zhèng)常抓取我們網頁(yè)呢(ní),我(wǒ)們應(yīng)該注意下麵幾個(gè)要點:
(1)網址不能(néng)過長:百度建議(yì)網址的長(cháng)度不要超過(guò)256個(gè)字節(jié)(一(yī)個(gè)英文字(zì)母(不(bù)分(fēn)大小寫))占一個(gè)字節的(dí)空間(jiān),一(yī)個中文(wén)漢字(zì)占(zhān)兩個(gè)字節(jié)的空間)。
(2)網址中不(bù)要(yào)包(bāo)含中文:百(bǎi)度對於中文網(wǎng)址(zhǐ)的(dí)抓取效果都(dū)是(shì)比(bǐ)較(jiào)差的(dí),所(suǒ)以在網(wǎng)址內(nèi)千(qiān)萬不要(yào)帶有(yǒu)中文。
(3)服務(wù)器(qì)問(wèn)題:如果(guǒ)你的(dí)服務器質量太差(chà),總(zǒng)是打不開(kāi),那麼也會影響蜘(zhī)蛛的抓取(qǔ)效果。
(4)Robots.txt屏蔽:有的(dí)SEO人員由於(yú)疏(shū)忽(hū)。在(zài)Robots.txt文件裏(lǐ)麵屏(píng)蔽了(liǎo)想要被(bèi)百(bǎi)度抓取(qǔ)的路徑或(huò)者(zhě)頁麵(miàn)。這也會(huì)影響(xiǎng)到百度對於我們網站的(dí)抓取效果。
(5)避免出現蜘(zhī)蛛(zhū)難(nán)以解析的字符,比(bǐ)如/abc/123456;;;;;;;%B9&CE%EDDS$GHWF%.html這種(zhǒng)URL蜘(zhī)蛛無(wú)法理解(jiě)會放棄(qì)抓(zhuā)取。
(6)注(zhù)意動(dòng)態參(cān)數不要(yào)太多太復雜(zá),目前百(bǎi)度(dù)對(duì)動態(tài)URL已(yǐ)經有(yǒu)了很好的(dí)處理(lǐ),但(dàn)是(shì)參數過多且復(fù)雜的(dí)url有可能(néng)被蜘(zhī)蛛認為不重要(yào)而(ér)拋棄(qì)。這(zhè)點尤(yóu)為(wéi)重(zhòng)要,一定(dìng)注意。

過(guò)濾(lǜ)模塊
由(yóu)於互聯網上(shàng)充斥著(zhuó)大量的垃圾頁(yè)麵和(hé)無(wú)內容(róng)頁麵,而(ér)這(zhè)些頁麵不(bù)管對於搜索(suǒ)引擎,還(huán)是(shì)搜索用戶來說,都是(shì)不需要(yào)的。所(suǒ)以搜(sōu)索搜索(suǒ)引(yǐn)擎(qíng)為了(liǎo)避(bì)免這些(xiē)垃(lā)圾頁(yè)麵占(zhān)用自己(jǐ)寶貴的(dí)存儲資源(yuán),所以會(huì)對(duì)蜘(zhī)蛛(zhū)抓取回(huí)來的(dí)內容進行過濾。完成這(zhè)個功能的(dí)模(mó)塊,我(wǒ)們就稱為(wéi)過濾模(mó)塊。那麼那些因(yīn)素(sù)會(huì)影響(xiǎng)到過濾模(mó)塊(kuài)呢(ní),有下麵(miàn)2點(diǎn):
(1)識(shí)別
由(yóu)於(yú)搜(sōu)索引(yǐn)擎的蜘(zhī)蛛目前最擅(shàn)長的還是分(fēn)析(xī)文字和鏈接,對(duì)於(yú)圖片和視頻的識別還是(shì)比(bǐ)較困(kùn)難的(dí)。所(suǒ)以假如一個頁(yè)麵(miàn)主(zhǔ)要都(dū)是(shì)圖片(piàn)和視(shì)頻話,那(nà)麼搜索(suǒ)引擎很(hěn)難(nán)識(shí)別出該頁(yè)麵的(dí)內容(róng)。而對(duì)於這(zhè)種頁麵(miàn),搜(sōu)索引(yǐn)擎(qíng)有(yǒu)可(kě)能(néng)當(dāng)作(zuò)垃(lā)圾(jī)網(wǎng)站進(jìn)行過濾掉(diào)。所(suǒ)以(yǐ),我們(mén)在編(biān)輯網站(zhàn)內容的(dí)時候,應該多添(tiān)加一(yī)些(xiē)文字描述,這(zhè)樣(yàng)才不(bù)容易(yì)被過濾(lǜ)模塊(kuài)過濾(lǜ)掉。
(2)內容質量(liáng)
在可以識(shí)別內(nèi)容的基(jī)礎(chǔ)之上,搜(sōu)索引擎還會將(jiāng)抓(zhuā)取到的網(wǎng)頁(yè)內容(róng),與已(yǐ)經(jīng)存到數(shù)據(jù)庫(kù)中的(dí)內容(róng)進行對(duì)比(bǐ)。如(rú)果搜(sōu)索引(yǐn)擎發(fā)現(xiàn)你的(dí)頁麵內容(róng)質量與數據庫(kù)中的內(nèi)容(róng)大部分都(dū)是重復(fù)的,或者(zhě)相比之下(xià)質(zhì)量更差的(dí)話,那(nà)麼這(zhè)個頁麵也(yě)會被(bèi)過(guò)濾(lǜ)掉(diào)。

收錄模塊
將(jiāng)通過(guò)了過濾(lǜ)模(mó)塊“考(kǎo)核”的網頁,進(jìn)行分詞,數(shù)據(jù)格(gé)式標準化,然後(hòu)將(jiāng)其(qí)存(cún)儲到(dào)索(suǒ)引(yǐn)數據(jù)庫中(zhōng)程序(xù)模塊(kuài),我(wǒ)們稱之為收(shōu)錄模塊。如果你(nǐ)的網站有(yǒu)幸(xìng)通(tōng)過(guò)收錄(lù)模(mó)塊,那(nà)麼(mó)就(jiù)有(yǒu)機(jī)會獲(huò)得排名了。
1,如何查看某(mǒu)個(gè)網頁是否被收(shōu)錄
最(zuì)簡(jiǎn)單的辦(bàn)法(fǎ),就(jiù)是(shì)把(bǎ)該網頁的(dí)網(wǎng)址(zhǐ)復(fù)製到百(bǎi)度(dù)搜索框中(zhōng)進行搜索,如果能(néng)夠(gòu)出現(xiàn)該頁(yè)麵(miàn)的(dí)搜(sōu)索結果(guǒ),那麼(mó)就說明(míng)該網(wǎng)址(zhǐ)已(yǐ)經(jīng)被收錄了(liǎo)。
圖(tú)片(piàn)

2,如何(hé)查看一(yī)個(gè)網站(zhàn)的收錄量(liáng)
有2個方法(fǎ):
(1)site命令
通過“site:域名”的命(mìng)令,我們(mén)可(kě)以(yǐ)看(kàn)到搜索引擎(qíng)抓取(qǔ)了(liǎo)某(mǒu)個(gè)域(yù)名(míng)下的(dí)頁(yè)麵收錄量:
圖片(piàn)

(2)百度(dù)“索引量(liáng)”查詢(xún)工具
通(tōng)過百(bǎi)度官方提(tí)供(gōng)的(dí)“索(suǒ)引量”查(chá)詢(xún)工具,也可(kě)以查詢(xún)到我們(mén)網站的收錄(lù)量(liáng)。
收(shōu)錄量少(shǎo)怎麼辦?
這個(gè)分(fēn)兩種情況:
(1)新(xīn)站
一般來說,新(xīn)站(zhàn)剛(gāng)上(shàng)綫(xiàn),起碼要(yào)1~2個月才會(huì)開始收錄(lù)。前期一般隻(zhī)是(shì)收(shōu)錄一(yī)個(gè)首頁而已。對於這個(gè)情(qíng)況,沒有(yǒu)別的辦法,因(yīn)為百度為了(liǎo)防(fáng)止**的泛(fàn)濫(làn),特(tè)地把新站的(dí)審(shěn)核時間(jiān)拉長。所以(yǐ),如(rú)果(guǒ)你(nǐ)操作(zuò)的是新站(zhàn),那麼收(shōu)錄(lù)量少(shǎo)不(bù)用緊張,隻要你(nǐ)老老實實的提供(gōng)優質(zhì)內(nèi)容,那麼2個(gè)月(yuè)之後百度就(jiù)會開始(shǐ)收錄你的內頁了(liǎo)。
(2)老站(zhàn)
有的老(lǎo)站(zhàn)會出現收錄(lù)量(liáng)少,甚(shèn)至(zhì)是收(shōu)錄量(liáng)開始減少(shǎo)的時候(hòu)。一般都是因(yīn)為(wéi)該網(wǎng)站的內頁(yè)內(nèi)容質量太差導(dǎo)致(zhì)的。
這(zhè)個時候站長應(yīng)該(gāi)趕(gǎn)緊(jǐn)調(tiáo)整整(zhěng)站(zhàn)的(dí)內(nèi)容質量,提(tí)供優(yōu)質的內(nèi)容才(cái)有(yǒu)可能(néng)確(què)保(bǎo)自(zì)己的網(wǎng)站排(pái)名(míng)不會變動(dòng)。

排序(xù)模(mó)塊
對(duì)存(cún)入索引(yǐn)數(shù)據(jù)庫中(zhōng)的頁麵(miàn),通(tōng)過一係列算(suàn)法後得到(dào)每(měi)個頁(yè)麵的(dí)權重,並且將其進行(háng)排序處理的程序,稱(chēng)之(zhī)為(wéi)排(pái)序(xù)模(mó)塊。
如果你的頁(yè)麵(miàn)通過(guò)排序模塊的(dí)計算,排(pái)在(zài)了(liǎo)某(mǒu)個關(guān)鍵詞(cí)的(dí)前幾(jī)位的(dí)話,那(nà)麼當搜索用戶(hù)搜索該關(guān)鍵詞(cí)的時候(hòu),你的(dí)頁(yè)麵就(jiù)可以(yǐ)展現在用戶的(dí)麵(miàn)前了。想(xiǎng)要(yào)讓自(zì)己(jǐ)的網站(zhàn)能(néng)夠(gòu)獲得(dé)良好的(dí)排名(míng),需要(yào)做(zuò)到(dào)下(xià)麵2點(diǎn):
1,完善(shàn)基(jī)礎(chǔ)優(yōu)化(huà)
想要獲(huò)得良(liáng)好的排名(míng),那麼你的(dí)網(wǎng)頁(yè)首(shǒu)先(xiān)要做(zuò)好基礎優(yōu)化,這包括(kuò)網(wǎng)站(zhàn)定(dìng)位(wèi),網站結(jié)構,網站布局(jú),網(wǎng)站(zhàn)內容等幾(jī)個(gè)部分。這些基礎(chǔ)優化(huà)的(dí)內(nèi)容(róng),我們(mén)將在後麵(miàn)詳(xiáng)細闡(chǎn)述。隻(zhī)有把這(zhè)些(xiē)基礎部分完(wán)善優化好(hǎo)了,才(cái)算是及格了(liǎo)。
2,綜合數(shù)據良(liáng)好(hǎo)
在(zài)基礎優化做(zuò)好(hǎo)的(dí)基(jī)礎上,假如(rú)你(nǐ)的百(bǎi)度統計後台(tái)數據(jù)表現(xiàn)良好,用戶(hù)的(dí)忠(zhōng)誠(chéng)度(dù)以及(jí)站外推廣(guǎng)的(dí)效(xiào)果(guǒ)顯(xiǎn)著的話,就會在及格綫(xiàn)上加分(fēn)。隻(zhī)要你(nǐ)的加分(fēn)超過(guò)了(liǎo)所(suǒ)有的競(jìng)爭(zhēng)對(duì)手(shǒu),那麼你(nǐ)的(dí)網站就可(kě)以(yǐ)排在(zài)所有對手的(dí)前麵了(liǎo)。

總結
本(běn)文為你(nǐ)講解(jiě)了搜索引(yǐn)擎的工(gōng)作(zuò)原理,那(nà)麼掌(zhǎng)握這一原理(lǐ)對於(yú)你(nǐ)學習SEO有什麼(mó)幫(bāng)助呢(ní)?
幫助就在(zài)於當你遇到一(yī)些(xiē)SEO技術問題的(dí)時候,可以(yǐ)通過搜(sōu)索引擎的工作(zuò)原理(lǐ)找到(dào)原(yuán)因(yīn)。
比如(rú)你是一個(gè)新站(zhàn),做了1個月發現隻(zhī)收錄(lù)了首頁。這個(gè)時候你(nǐ)可(kě)以(yǐ)知道那是因為收(shōu)錄模塊對(duì)於新(xīn)站有(yǒu)一(yī)個(gè)考核(hé)期,所以這屬於(yú)正(zhèng)常現象(xiàng)。
有或者你發現自己網站的(dí)文(wén)章收錄(lù)正常,但(dàn)是沒有(yǒu)排名,這(zhè)個時(shí)候你(nǐ)就知道你(nǐ)的文章雖(suī)然被(bèi)收(shōu)錄(lù)模(mó)塊收錄(lù)了,但是由於基(jī)礎優化和綜合(hé)數據(jù)不夠(gòu)良好,所以排(pái)序模(mó)塊沒有(yǒu)給出良好的(dí)排(pái)名。因此你(nǐ)可以(yǐ)知道(dào)接(jiē)下來的(dí)工作(zuò)應該是提升網(wǎng)站(zhàn)的(dí)內(nèi)容質量(liáng)。
所(suǒ)以,掌握(wò)搜索引(yǐn)擎的工(gōng)作原理(lǐ),對於我(wǒ)們(mén)學習(xí)SEO是(shì)至關重要(yào)的(dí)。

轉載(zǎi)請保留原(yuán)文地(dì)址: https://antelcom.cn/show-762.html

責編(biān):王麗(lì) 作(zuò)者:不詳(xiáng) 來源(yuán):網絡