網站優(yōu)化必看 蜘蛛陷阱 不利于蜘蛛爬取的網頁
1、搜索引擎能不能找到網頁。
1)要讓搜搜引擎發(fā)現網站首頁,網站推廣就必須有良好的外部鏈接鏈接到首頁,就找到了首頁,然后蜘蛛會沿著鏈接爬的更深。
讓蜘蛛通過簡單的html頁面的鏈接到達,javascript鏈接,flash鏈接都是蜘蛛的陷阱。這點要注意。
2)找到網頁后能不能抓去內容。
被發(fā)現的蜘蛛是可以被爬取的,數據庫動態(tài)生成,帶過很多的參數url、sessionID、整個頁面都是flash、框架結構、大量的轉向,和大量的復制內容都可能把蜘蛛攔截在門外。這也也是要注意的
2、flash
1)在網頁某一個部分使用flash來增強視覺效果很正常網絡推廣,比如現在很多的flash廣告、圖標等。但是這是一個html頁面的一部分。不會有太大的影響
2)但是有的網站就是一個很大的flash文件,這就構成了蜘蛛的陷阱,這時候蜘蛛爬取的只有一個flash鏈接,沒有其他的內容,所以這點盡量要避免。
3、sessionID
1)有些網站使用sessionID(會話ID)跟蹤用戶的訪問,用戶的沒一次訪問都會生成一個獨立的ID,然后加在url里,這是蜘蛛每一次抓取網站都會把蜘蛛當作一個新的用戶網絡營銷,造成蜘蛛不能正常爬取,這也是蜘蛛的一大陷阱。
2)通常建議跟蹤用戶訪問應該使用cookies而不要生存sessionID 。
4、各種的跳轉
1)除了大家熟悉的301轉向之外,其他的轉向對搜索蜘蛛都比較敏感的,比如302暫時轉向,javascript轉向,flash轉向,meta refresh跳轉,所以建議大家不要做其他不利于網頁的轉向,301也包括,不到萬不得已的時候也不要用301轉向。這是個建議。謝謝閱讀,希望能幫到大家,請繼續(xù)關注腳本之家,我們會努力分享更多優(yōu)秀的文章。
相關文章
- 在我的既有觀念中,搜索引擎的網頁爬蟲/蜘蛛/機器人(Crawler/Spider/Robot)只抓取頁面的 HTML 代碼,對于內部或外部的 JS 與 CSS 代碼是一律無視的。2010-01-01
- 百度蜘蛛日志抓取解讀 教你如何提高百度收錄:百度的收錄是關心的重中之重,了解百度蜘蛛的爬行規(guī)律從而更好的改善收錄情況也是必須要掌握的。2010-06-29
- 如何讓搜索引擎蜘蛛喜歡上你的網站,以下幾點大家都注意下2012-03-23
- 做網站的都希望被搜索引擎所收錄.就是希望網絡蜘蛛能爬到自己的網站里收錄信息2012-07-05
- 網站被百度的蜘蛛抓取時返回304狀態(tài)碼是什么意思呢2012-08-29
- 搜索引擎蜘蛛每天是怎么樣去爬取我們的網的呢?針對這些你有多少的了解?那搜索引擎蜘蛛的爬取過程又是怎么樣的呢?2013-04-01
SEO優(yōu)化 蜘蛛的爬行規(guī)則以及讓蜘蛛爬行的快速辦法
想要提高網站的排名首先要了解蜘蛛的爬行規(guī)則,下面我們來看看解蜘蛛最喜歡的是什么?當蜘蛛爬行一個網站的時候,它需要爬行的信息首先就是站內的結構,查看站內結構是否是2014-10-14- 作為一名編輯乃至站長,在關注網站在搜索引擎排名的時候,最重要的就是蜘蛛(spider)。搜索引擎蜘蛛是一個自動抓取互聯網上網頁內容的程序,每個搜索引擎都有自己的蜘蛛,那2016-05-27

