- 簡(jiǎn)體
- 簡(jiǎn)體中文 English
搜索引擎收錄原理
搜索引擎收錄原理
1.頁(yè)面收錄流程
在互聯(lián)網(wǎng)中,URL是每個(gè)頁(yè)面的入口地址,搜索引擎蜘蛛程序就是通過(guò)URL抓取到頁(yè)面的。搜索引擎蜘蛛程序從URL列表出發(fā),通過(guò)URL抓取并存儲(chǔ)頁(yè)面;同時(shí),提取原始頁(yè)面中的URL資源并加入到URL列表中。如此不斷地循環(huán),就可以從互聯(lián)網(wǎng)中獲取足夠多的頁(yè)面。
URL是頁(yè)面的入口,而域名則是網(wǎng)站的入口。搜索引擎蜘蛛程序通過(guò)域名進(jìn)入網(wǎng)站,從而展開(kāi)對(duì)網(wǎng)站頁(yè)面的抓取。換而言之,搜索引擎要在互聯(lián)網(wǎng)上抓取到頁(yè)面的首要任務(wù)就是建立一個(gè)足夠大的域名列表,再通過(guò)域名進(jìn)入相應(yīng)的網(wǎng)站,從而抓取網(wǎng)站中的頁(yè)面。
而對(duì)于網(wǎng)站來(lái)說(shuō),如果想要被搜索引擎收錄,首要條件就是加入搜索引擎的域名列表。下面向讀者介紹兩種常用的加入搜索引擎域名列表的方法。
第一,利用搜索引擎提供的網(wǎng)站登錄入口,向搜索引擎提交網(wǎng)站域名,例如Google的網(wǎng)站登錄地址是https://www.google.com/intl/zh-CN/webmasters/#?modal_active=none,可在此提交自己的網(wǎng)站域名。對(duì)于提交的域名列表,搜索引擎只會(huì)定期進(jìn)行更新。因此,這種做法比較被動(dòng),從域名提交到網(wǎng)站被收錄花費(fèi)的時(shí)間也比較長(zhǎng)。
第二,通過(guò)與外部網(wǎng)站建立鏈接關(guān)系,使搜索引擎可以通過(guò)外部網(wǎng)站發(fā)現(xiàn)我們的網(wǎng)站,從而實(shí)現(xiàn)對(duì)網(wǎng)站的收錄。這種做法的主動(dòng)權(quán)掌握在我們自己的手里(只要我們擁有足夠多高質(zhì)量的鏈接即可),縣域收錄速度也比向搜索引擎主動(dòng)提交要快得多。根據(jù)外部鏈接的數(shù)量、質(zhì)量及相關(guān)性,一般情況下,2-7天左右就會(huì)被搜索引擎收錄。
2.頁(yè)面收錄原理
通過(guò)上面的介紹,相信讀者已經(jīng)掌握了網(wǎng)站被搜索引擎收錄的方法。然而,怎樣才能提高網(wǎng)站中頁(yè)面被收錄的數(shù)量呢?要回答這個(gè)問(wèn)題,就要先了解搜索引擎收錄頁(yè)面的工作原理。
如果把網(wǎng)站頁(yè)面組成的集合看作是一個(gè)有向圖,從指定的頁(yè)面出發(fā),沿著頁(yè)面中的鏈接,按照某種特定的策略對(duì)網(wǎng)站中的頁(yè)面進(jìn)行遍歷。不停地從URL列表中移出已經(jīng)訪問(wèn)過(guò)的URL,并存儲(chǔ)原始頁(yè)面,同時(shí)提取原始頁(yè)面中的URL信息;再將URL分為域名及部URL兩大類,同時(shí)判斷資源為止。經(jīng)過(guò)這些工作,搜索引擎就可以建立龐大的域名列表、頁(yè)面URL列表并存儲(chǔ)足夠多的原始頁(yè)面。
3.頁(yè)面收錄方式
上面已經(jīng)介紹了搜索引擎收錄頁(yè)面的流程及原理。然而,在互聯(lián)網(wǎng)數(shù)以億計(jì)的頁(yè)面中,搜索引擎怎樣才能從中抓取到相對(duì)重要的頁(yè)面呢?這就是涉及搜索引擎的頁(yè)面收錄方式。
頁(yè)面收錄方式是指搜索引擎抓取頁(yè)面時(shí)所使用的策略,是為了能在互聯(lián)網(wǎng)中篩選出相對(duì)重要的信息。頁(yè)面收錄方式的制定取決于搜索引擎對(duì)網(wǎng)站結(jié)構(gòu)的理解。如果使用相冊(cè)的抓取策略,搜索引擎在同樣的時(shí)間內(nèi)可以在某一網(wǎng)站中抓取到更多的頁(yè)面資源,則會(huì)在該網(wǎng)站上停留更長(zhǎng)的時(shí)間,收錄的頁(yè)面數(shù)自然也就更多。因此,加深對(duì)搜索引擎頁(yè)面收錄方式的認(rèn)識(shí),有利于為網(wǎng)站建立友好的結(jié)構(gòu),提高頁(yè)面被收錄的數(shù)量。
>>廣度優(yōu)先
如果把整個(gè)網(wǎng)站看作是一棵樹(shù),首頁(yè)就是根,每個(gè)頁(yè)面就是葉子。廣度優(yōu)先是一種橫向的頁(yè)面抓取方式,先從樹(shù)的較淺層開(kāi)始抓取頁(yè)面,直至抓取完同層次的所有頁(yè)面后才進(jìn)入下一層。因此,在對(duì)網(wǎng)站進(jìn)行優(yōu)化時(shí),我們應(yīng)該把網(wǎng)站中相對(duì)重要的信息展示在層次較淺的頁(yè)面上(例如,在首頁(yè)上推薦一些熱門產(chǎn)品或者內(nèi)容)。反過(guò)來(lái),通過(guò)廣度優(yōu)先的抓取方式,搜索引擎就可以優(yōu)先抓取到網(wǎng)站中相對(duì)重要的頁(yè)面。(高端網(wǎng)站建設(shè))
首先,搜索引擎從網(wǎng)站首頁(yè)出發(fā),抓取首頁(yè)上所有鏈接指向的頁(yè)面,形成頁(yè)面集合A,并解析出集合A中所有頁(yè)面的鏈接;再跟蹤這些鏈接抓取下一層的頁(yè)面,形成頁(yè)面集合B;就這樣遞歸地從線層頁(yè)面中解析出鏈接,從而抓取深層頁(yè)面,直至滿足了某個(gè)設(shè)定的條件才停止抓取進(jìn)程。
>>深度優(yōu)先
與廣度優(yōu)先的抓取方式相反,深度優(yōu)先首先跟蹤線層頁(yè)面中的某一鏈接逐步抓取深層頁(yè)面,直至抓取完最深層的頁(yè)面后才返回淺層頁(yè)面再跟蹤其另一鏈接,繼續(xù)向深層頁(yè)面抓取,這是一種頁(yè)面,這樣就能滿足更多用戶的需求。
建站流程
-
網(wǎng)站需求
-
網(wǎng)站策劃方案
-
頁(yè)面設(shè)計(jì)風(fēng)格
-
確認(rèn)交付使用
-
資料錄入優(yōu)化
-
程序設(shè)計(jì)開(kāi)發(fā)
-
后續(xù)跟蹤服務(wù)
-
聯(lián)系電話
010-60259772
熱門標(biāo)簽
- 網(wǎng)站建設(shè)
- 食品網(wǎng)站建設(shè)
- 微信小程序開(kāi)發(fā)
- 小程序開(kāi)發(fā)
- 無(wú)錫網(wǎng)站建設(shè)
- 研究所網(wǎng)站建設(shè)
- 沈陽(yáng)網(wǎng)站建設(shè)
- 廊坊網(wǎng)站建設(shè)
- 鄭州網(wǎng)站建設(shè)
- 婚紗攝影網(wǎng)站建設(shè)
- 手機(jī)端網(wǎng)站建設(shè)
- 高校網(wǎng)站制作
- 天津網(wǎng)站建設(shè)
- 教育網(wǎng)站建設(shè)
- 品牌網(wǎng)站建設(shè)
- 政府網(wǎng)站建設(shè)
- 北京網(wǎng)站建設(shè)
- 網(wǎng)站設(shè)計(jì)
- 網(wǎng)站制作
最新文章
推薦新聞
更多行業(yè)-
如何做好公司網(wǎng)站?
明確網(wǎng)站目標(biāo):在開(kāi)始制作公司網(wǎng)站之前,明確網(wǎng)站的目標(biāo)和定位非常重要???..
2023-08-07 -
在做SEO優(yōu)化之前如何選擇關(guān)鍵詞
關(guān)鍵詞是做SEO優(yōu)化最關(guān)注的東西,通過(guò)它可以體現(xiàn)我們自己的價(jià)值,因?yàn)橛?..
2015-11-29 -
公益中國(guó):財(cái)富取之于社會(huì),更應(yīng)用之于社會(huì)
現(xiàn)代的公益,是人人參與的公益,不管是個(gè)人還是集體,人們通過(guò)各種公益活動(dòng)...
2017-12-28 -
研究所網(wǎng)站建設(shè)解決方案
本文旨在為研究所提供一套完整的網(wǎng)站建設(shè)解決方案,旨在構(gòu)建一個(gè)專業(yè)、高效...
2023-06-20 -
如何才能穩(wěn)定排名的要素
尚品中國(guó)網(wǎng)站建設(shè)公司:在搜索引擎不斷變更,行業(yè)競(jìng)爭(zhēng)越來(lái)越激烈的今天,很...
2013-12-24 -
網(wǎng)絡(luò)政治參與的概念
正如人類社會(huì)發(fā)展歷史所展示的基本規(guī)律那樣,每當(dāng)科學(xué)技術(shù)取得重大突破和進(jìn)...
2014-10-23
預(yù)約專業(yè)咨詢顧問(wèn)溝通!
免責(zé)聲明
非常感謝您訪問(wèn)我們的網(wǎng)站。在您使用本網(wǎng)站之前,請(qǐng)您仔細(xì)閱讀本聲明的所有條款。
1、本站部分內(nèi)容來(lái)源自網(wǎng)絡(luò),涉及到的部分文章和圖片版權(quán)屬于原作者,本站轉(zhuǎn)載僅供大家學(xué)習(xí)和交流,切勿用于任何商業(yè)活動(dòng)。
2、本站不承擔(dān)用戶因使用這些資源對(duì)自己和他人造成任何形式的損失或傷害。
3、本聲明未涉及的問(wèn)題參見(jiàn)國(guó)家有關(guān)法律法規(guī),當(dāng)本聲明與國(guó)家法律法規(guī)沖突時(shí),以國(guó)家法律法規(guī)為準(zhǔn)。
4、如果侵害了您的合法權(quán)益,請(qǐng)您及時(shí)與我們,我們會(huì)在第一時(shí)間刪除相關(guān)內(nèi)容!
聯(lián)系方式:010-60259772
電子郵件:394588593@qq.com