搜索引擎的工作流程是什么?

2014-07-05    分類: 網(wǎng)站建設(shè)

正所謂磨刀不誤砍柴工,做好工作之前的準(zhǔn)備工作也是十分重要的,那么對(duì)于搜索排名工作來說,了解搜索引擎是如何工作是一件比較重要的事,所以今天創(chuàng)新互聯(lián)就為大家分析一下這方面的內(nèi)容。

搜索引擎的工作流程是什么?

一、搜索引擎工作流程

搜索引擎的工作流程大致上可以分為四個(gè)步驟。

二、爬行和抓取

搜索引擎派出一個(gè)能夠在網(wǎng)上發(fā)現(xiàn)新網(wǎng)頁(yè)并抓取文件的程序,這個(gè)程序通常被稱為蜘蛛(Spider)。搜索引擎蜘蛛從數(shù)據(jù)庫(kù)中已知的網(wǎng)頁(yè)開始出發(fā),就像正常用戶的瀏覽器一樣訪問這些網(wǎng)頁(yè)并抓取文件。并且搜索引擎蜘蛛會(huì)跟蹤網(wǎng)頁(yè)上的鏈接,訪問更多網(wǎng)頁(yè),這個(gè)過程就叫爬行。

當(dāng)通過鏈接發(fā)現(xiàn)有新的網(wǎng)址時(shí),蜘蛛將把新網(wǎng)址記錄入數(shù)據(jù)庫(kù)等待抓取。跟蹤網(wǎng)頁(yè)鏈接是搜索引擎蜘蛛發(fā)現(xiàn)新網(wǎng)址的最基本方法。搜索引擎蜘蛛抓取的頁(yè)面文件與用戶瀏覽器得到的完全一樣,抓取的文件存入數(shù)據(jù)庫(kù)。

搜索引擎的工作流程是什么?

三、建立索引

搜索引擎索引程序把蜘蛛抓取的網(wǎng)頁(yè)文件分解、分析,并以巨大表格的形式存入數(shù)據(jù)庫(kù),這個(gè)過程就是索引。在索引數(shù)據(jù)庫(kù)中,網(wǎng)頁(yè)文字內(nèi)容,關(guān)鍵詞出現(xiàn)的位置、字體、顏色、加粗、斜體等相關(guān)信息都有相應(yīng)記錄。

搜索引擎索引數(shù)據(jù)庫(kù)存儲(chǔ)巨量數(shù)據(jù),主流搜索引擎通常都存有幾十億級(jí)別的網(wǎng)頁(yè)。

四、搜索詞處理

用戶在搜索引擎界面輸入關(guān)鍵詞,單擊“搜索”按鈕后,搜索引擎程序即對(duì)輸入的搜索詞進(jìn)行處理,如中文特有的分詞處理、對(duì)關(guān)鍵詞詞序的分別、去除停止詞、判斷是否需要啟動(dòng)整合搜索、判斷是否有拼寫錯(cuò)誤或錯(cuò)別字等情況。搜索詞的處理必須十分快速。

搜索引擎的工作流程是什么?

五、排序

對(duì)搜索詞進(jìn)行處理后,搜索引擎排序程序開始工作,從索引數(shù)據(jù)庫(kù)中找出所有包含搜索詞的網(wǎng)頁(yè),并且根據(jù)排名計(jì)算法計(jì)算出哪些網(wǎng)頁(yè)應(yīng)該排在前面,然后按一定格式返回“搜索”頁(yè)面。

排序過程雖然在一兩秒之內(nèi)就完成返回用戶所要的搜索結(jié)果,實(shí)際上這是一個(gè)非常復(fù)雜的過程。排名算法需要實(shí)時(shí)從索引數(shù)據(jù)庫(kù)中找出所有相關(guān)頁(yè)面,實(shí)時(shí)計(jì)算相關(guān)性,加入過濾算法,其復(fù)雜程度是外人無法想象的。搜索引擎是當(dāng)今規(guī)模大、最復(fù)雜的計(jì)算系統(tǒng)之一。

分享名稱:搜索引擎的工作流程是什么?
網(wǎng)頁(yè)地址:http://www.muchs.cn/news8/27558.html

成都網(wǎng)站建設(shè)公司_創(chuàng)新互聯(lián),為您提供外貿(mào)建站、Google網(wǎng)站排名、移動(dòng)網(wǎng)站建設(shè)網(wǎng)站內(nèi)鏈、手機(jī)網(wǎng)站建設(shè)

廣告

聲明:本網(wǎng)站發(fā)布的內(nèi)容(圖片、視頻和文字)以用戶投稿、用戶轉(zhuǎn)載內(nèi)容為主,如果涉及侵權(quán)請(qǐng)盡快告知,我們將會(huì)在第一時(shí)間刪除。文章觀點(diǎn)不代表本網(wǎng)站立場(chǎng),如需處理請(qǐng)聯(lián)系客服。電話:028-86922220;郵箱:631063699@qq.com。內(nèi)容未經(jīng)允許不得轉(zhuǎn)載,或轉(zhuǎn)載時(shí)需注明來源: 創(chuàng)新互聯(lián)

成都網(wǎng)站建設(shè)公司