歡迎您來到潮人地東莞seo博客,本站專業免費分享多元化的seo網站優化技術干貨以及解答seo各種常見問題的博客網站

熱門關鍵詞: seo優化 seo推廣 seo技術 seo博客 seo網站推廣怎么做 seo怎么做 新手做seo怎么做
當前位置:seo博客首頁 > seo技術分享 >

seo技術博客分享:爬行、抓取、索引、收錄,指的都是怎樣?

發布時間:2023-03-16 07:45:01 文章出處:潮人地東莞seo博客 作者:東莞seo博客 閱讀數量:

潮人地東莞seo博客小編下面跟大家分享關于seo技術博客分享:爬行、抓取、索引、收錄,指的都是怎樣?等問題,希望seo專員在做seo優化的過程中有所幫助,內容僅供參考。

看SEO有關博客和論壇時能感覺到,很多SEO并沒有理解爬行、抓取、索引、收錄這些概念到底指的是什么,區別在哪,noindex、nofollow、robots文件的功能又是什么。對這些概念沒有精準理解,處理大型網站結構,決定什么頁面需要被抓取,什么需要被索引,哪些頁面需要禁止抓取、索引等等情況時,就石家莊seo顧問技術很難明白該怎么做。甚至就像抓取配額那篇帖子的很多留言說的,提到這些情況的處理時,根本看不懂在說什么。

這么基本、重要,又比較容易混淆的SEO概念,我以為以前在博客里寫過了,看了留言,翻翻以前帖子才知道,原來以前沒寫過。SEO實戰密碼書里是有寫的,但SEO每天一貼里并沒有寫過。今天補上。

爬行是什么?

爬行指的是搜索引擎蜘蛛從已知頁面上解析出鏈接指向的URL,然后沿著鏈接發現新頁面(也就是鏈接指向的URL)的過程。當然,蜘蛛并不是發現新URL馬上就爬過去抓取新頁面,而是把發現的URL存放到待抓地址庫中,蜘蛛按照一定順序從地址庫中提取要抓取的URL。

seo博客相關推薦閱讀:seo心得體會:seo技術的發展思路(seo技術的發展思路是怎樣)

seo技術博客分享:爬行、抓取、索引、收錄,指的都是怎樣?

抓取是什么?

抓取是搜索引擎蜘蛛從待抓地址庫中提取要抓的URL,訪問這個URL,把讀取的HTML代碼存入數據庫。蜘蛛的抓取就是像瀏覽器一樣打開這個頁面,和用戶瀏覽器訪問一樣,也會在服務器原始日志中留下記錄。

索引是什么?

索引指的是將一個URL的信息進行整理,存入數據庫,也就是索引庫,用戶搜索時,搜索引擎從索引庫中提取URL信息并排序展現出來。索引的英文是index。索引庫是用于搜索的,所以被索引的URL是可以被用戶搜索到的,沒有被索引的URL用戶在搜索結果中是看不到的。

要注意的是,所謂“一個URL的信息“,并不限于蜘蛛從URL上抓取來的內容,還有來自其它來源的信息,如外部鏈接、鏈接的錨文字等。有的時候,索引庫中關于這北京seo優化技術廠家個URL的的信息,根本沒有從這個URL抓取來的內容,但搜索引擎知道這個URL的存在,并且有一些其它信息。

抓取和索引不是一回事。

收錄是什么?

我個人覺得收錄和索引沒有區別。只不過收錄是從搜索用戶角度看的,搜索時能找到這個URL,就是這個URL被收錄了。從搜索引擎角度看,URL被收錄了,也就是這個URL的信息在索引庫中存在。英文并沒有收錄這個詞,和索引用的是同一個詞index。

noindex的作用是什么?

頁面頭信息中放上meta noindex標簽是告訴搜索引擎不要索引這個URL,也就是用戶搜索時找不到這個URL的信息,這個URL不會返回在搜索結果列表中。

noindex不是告訴搜索引擎不要抓取這個URL,實際上,noindex要起作用,這個URL是必須先被抓取的,不然搜索引擎怎么看到頁面HTML代碼中有noindex標簽呢?

robots文件的作用是什么?

robots文件是告訴搜索引擎,某些URL不要抓取。注意,這里說的是不要抓取,沒說不要索引。和noindex是正相反的。

nofollow的作用是什么?

給鏈接加上nofollow屬性是告訴搜索引擎,不要沿著這個鏈接爬行,就當這個鏈接不存在。注意,nofollow只是告訴蜘蛛不要爬這個鏈接,沒有說不要抓取鏈接指向的URL,也沒有說不要索引鏈接指向的URL,nofollow既沒禁止抓取,也沒禁止索引。

概念說過后,指出幾個SEO們經常弄不明白的情況:

沒有被抓取的頁面是可以被索引的

也就是說,蜘蛛沒有訪問和抓取這個頁面(比如被robots文件禁止抓取),這個頁面卻有信息存在索引庫中,用戶搜索時還能看到。

比如,淘寶整個網站用robots文件禁止百度蜘蛛抓取,但沒有用noindex禁止索引(如上面說的,禁止抓取后,就沒辦法禁止索引了,不抓取,就看不到noindex標簽了),所以即使百度沒有訪問和抓取淘寶頁面,但淘寶很多頁面是被百度索引的,用戶可以搜到的:

淘寶禁止百度抓取,但沒有禁止索引

百度從網上那么多鏈接知道淘寶首頁的存在,通過鏈接的錨文字也知道這個頁面標題大概是淘寶之類的,當然更知道百度口碑里的評價數。所以即使百度蜘蛛沒有抓取淘寶首頁,用戶還是能搜到,并且顯示一些百度知道的信息。

要想百度不能返回淘寶首頁該怎么辦呢?取消robots文件的禁止抓取,頁面上用noindex禁止索引。

被抓取的頁面是可以不被索引的

最常見的就是上面說過的,頁面頭信息使用noindex禁止索引,頁面被抓取,讀到noindex后,不被索引,不會在搜索結果中返回。

還有可能是因為頁面內容是抄襲、轉載、低質量的,搜索引擎雖然抓取了頁面,索引過程中檢測出這些內容問題,被丟棄,沒有被索引。所以頁面沒有被收錄,通常要先檢查原始日志,看看是否被抓取過,如果被抓取過,可能是內容質量問題,如果根本沒被抓取,建議先看看網站結構是否有問題。

加了nofollow的鏈接目標頁面可以被抓取和索引

前面說了,nofollow既不禁止抓取,也不禁止索引。nofollow的作用是告訴蜘蛛不要跟著這個鏈接爬,就當這個鏈接不存在,但nofollow只對這個鏈接起作用,對別的鏈接沒作用,這個鏈接加了nofollow,不意味著別的地方就沒有正常的指向這個URL的鏈接,只要別的地方出現了沒加nofollow的鏈接,目標URL還是會被發現、抓取(假設沒被robotx文件禁止)、索引(假設沒加noindex )。

上面這些概念和應用在SEO中是很重要的,如果還沒看懂,我也不知道該怎么再解釋了,只能建議再多讀幾遍。

以上是潮人地東莞seo博客跟大家分享關于seo技術博客分享:爬行、抓取、索引、收錄,指的都是怎樣?等問題,希望能對大家有所幫助,若有不足之處,請諒解,我們大家可以一起討論關于網站seo優化排名的技巧,一起學習,以上內容僅供參考。

閱讀全文
本文標題"seo技術博客分享:爬行、抓取、索引、收錄,指的都是怎樣?":http://www.420113.com/jsfx_10557.html
本文版權歸潮人地seo博客所有,歡迎轉載,但未經作者同意必須在文章頁面給出原文連接,否則保留追究法律責任的權利。
標簽:
合作伙伴
主站蜘蛛池模板: 国产成人无码AV麻豆| 亚洲AV永久纯肉无码精品动漫 | 无码人妻丰满熟妇区五十路 | 亚洲人成国产精品无码| 人妻系列无码专区久久五月天 | 黄色成人网站免费无码av | 亚洲欧洲美洲无码精品VA| 中日精品无码一本二本三本| 亚洲AV中文无码字幕色三| 无码人妻丰满熟妇区96| 一本无码中文字幕在线观| 人妻少妇看A偷人无码精品| 三上悠亚ssⅰn939无码播放| 白嫩少妇激情无码| 国产亚洲AV无码AV男人的天堂 | 无码视频在线播放一二三区| 无码日韩精品一区二区免费暖暖| 国产av永久精品无码| 无码免费一区二区三区免费播放| 精品乱码一区内射人妻无码| 伊人无码精品久久一区二区| 久久精品国产亚洲AV无码麻豆| 久久国产精品无码网站| 日韩精品人妻系列无码av东京 | 国产成人无码区免费A∨视频网站 国产成人无码午夜视频在线观看 国产成人无码精品一区不卡 | 免费无码一区二区三区蜜桃| 精品久久久久久中文字幕无码| 亚洲的天堂av无码| 亚洲AV永久青草无码精品| 国产99久久九九精品无码| 无码免费午夜福利片在线| 亚洲av午夜精品无码专区| 少妇人妻无码专区视频| 无码国产福利av私拍| 国产v亚洲v天堂无码网站| 亚洲国产精品无码中文字| 国模GOGO无码人体啪啪| 伊人久久精品无码av一区| 免费无码av片在线观看| 国产精品无码午夜福利| 久久青青草原亚洲AV无码麻豆|