精選分類 書庫 完本 排行 原創專區
欣可小說 > 曆史 > 百度 > ◎第四章 搜尋引擎

百度 ◎第四章 搜尋引擎

作者:汪林茂 分類:曆史 更新時間:2026-07-24 01:30:03

{

\"code\": 200,

\"title\": \"\",

\"content\": \"搜尋引擎\\n\\n搜尋引擎(searchengine)是指根據一定的策略、運用特定的計算機程式從互聯網上蒐集資訊,在對資訊進行組織和處理後,為用戶提供檢索服務,將用戶檢索相關的資訊展示給用戶的係統。\\n\\n全文搜尋引擎是名副其實的搜尋引擎,國外代表有Google,國內則有著名的索程式(Indexer),俗稱“蜘蛛”(Spider)程式或“機器人”(Robot)程式,能自建網頁數據庫,搜尋結果直接從自身的數據庫中調用,上麵提到的Google和百度就屬於此類;另一類則是租用其他搜尋引擎的數據庫,並按自定的格式排列搜尋結果,如Lycos搜尋引擎。\\n\\n目錄索引\\n\\n雖然有搜尋功能,但嚴格意義上不能稱為真正的搜尋引擎,隻是按目錄分類的網站鏈接列表而已。用戶完全可以按照分類目錄找到所需要的資訊,不依靠關鍵詞(Keywords)進行查詢。目錄索引中最具代表性的莫過於大名鼎鼎的Yahoo、新浪分類目錄搜尋。\\n\\n元搜尋引擎\\n\\n元搜尋引擎(METASearchEngine)接受用戶查詢請求後,同時在多個搜尋引擎上搜尋,並將結果返回給用戶。著名的元搜尋引擎有InfoSpace、Dogpile、Vivisimo等,中文元搜尋引擎中具代表性的是搜星搜尋引擎。在搜尋結果排列方麵,有的直接按來源排列搜尋結果,如Dogpile;有的則按自定的規則將結果重新排列組合,如Vivisimo。\\n\\n垂直搜尋引擎\\n\\n垂直搜尋引擎為2006年後逐步興起的一類搜尋引擎。不同於通用的網頁搜尋引擎,垂直搜尋專注於特定的搜尋領域和搜尋需求(例如:機票搜尋、旅遊搜尋、生活搜尋、小說搜尋、視頻搜尋等等),在其特定的搜尋領域有更好的用戶體驗。相比通用搜尋動輒數千台檢索服務器,垂直搜尋需要的硬體成本低、用戶需求特定、查詢的方式多樣。\\n\\n其他非主流搜尋引擎形式\\n\\n1、集合式搜尋引擎:該搜尋引擎類似元搜尋引擎,區彆在於它並非同時調用多個搜尋引擎進行搜尋,而是由用戶從提供的若乾搜尋引擎中選擇,如HotBot在2002年底推出的搜尋引擎。\\n\\n2、門戶搜尋引擎:AOLSearch、MSNSearch等雖然提供搜尋服務,但自身既冇有分類目錄也冇有網頁數據庫,其搜尋結果完全來自其他搜尋引擎。\\n\\n3、免費鏈接列表(FreeForAllLinks簡稱FFA):一般隻簡單地滾動鏈接條目,少部分有簡單的分類目錄,不過規模要比Yahoo!等目錄索引小很多。\\n\\n工作原理\\n\\n抓取網頁\\n\\n每個獨立的搜尋引擎都有自己的網頁抓取程式(spider)。Spider順著網頁中的超鏈接,連續地抓取網頁。被抓取的網頁被稱之為網頁快照。由於互聯網中超鏈接的應用很普遍,理論上,從一定範圍的網頁出發,就能蒐集到絕大多數的網頁。\\n\\n處理網頁\\n\\n搜尋引擎抓到網頁後,還要做大量的預處理工作,才能提供檢索服務。其中,最重要的就是提取關鍵詞,建立索引檔案。其他還包括去除重複網頁、分詞(中文)、判斷網頁類型、分析超鏈接、計算網頁的重要度\\/豐富度等。\\n\\n提供檢索服務\\n\\n用戶輸入關鍵詞進行檢索,搜尋引擎從索引數據庫中找到匹配該關鍵詞的網頁;為了用戶便於判斷,除了網頁標題和URL外,還會提供一段來自網頁的摘要以及其他資訊。\\n\\n全文搜尋引擎\\n\\n在搜尋引擎分類部分提到過全文搜尋引擎從網站提取資訊建立網頁數據庫的概念。搜尋引擎的自動資訊蒐集功能分兩種。一種是定期搜尋,即每隔一段時間(比如Google一般是28天),搜尋引擎主動派出“蜘蛛”程式,對蜘蛛搜尋引擎\\n\\n一定IP地址範圍內的互聯網站進行檢索,一旦發現新的網站,它會自動提蜘蛛搜尋引擎取\\n\\n網站的資訊和網址加入自己的數據庫。\\n\\n另一種是提交網站搜尋,即網站擁有者主動向搜尋引擎提交網址,它在一定時間內(2天到數月不等)定向向你的網站派出“蜘蛛”程式,掃描你的網站並將有關資訊存入數據庫,以備用戶查詢。由於近年來搜尋引擎索引規則發生很大變化,主動提交網址並不保證你的網站能進入搜尋引擎數據庫,目前最好的辦法是多獲得一些外部鏈接,讓搜尋引擎有更多機會找到你並自動將你的網站收錄。\\n\\n當用戶以關鍵詞查詢資訊時,搜尋引擎會在數據庫中進行搜尋,如果找到與用戶要求內容相符的網站,便采用特殊的演算法——通常根據網頁中關鍵詞的匹配程度,出現的位置\\/頻次,鏈接質量——計算出各網頁的相關度及排名等級,然後根據關聯度高低,按順序將這些網頁鏈接返回給用戶。\\n\\n這種引擎的特點是搜全率比較高。\\n\\n目錄索引\\n\\n目錄\\n\\n目錄與全文搜尋引擎相比,目錄索引有許多不同之處。\\n\\n首先,搜尋引擎屬於自動網站檢索,而目錄索引則完全依賴手工操作。用戶提交網站後,目錄編輯人員會親自瀏覽你的網站,然後根據一套自定的評判標準甚至編輯人員的主觀印象,決定是否接納你的網站。\\n\\n其次,搜尋引擎收錄網站時,隻要網站本身冇有違反有關的規則,一般都能登錄成功。而目錄索引對網站的要求則高得多,有時即使登錄多次也不一定成功。尤其象Yahoo這樣的超級索引,登錄更是困難。\\n\\n此外,在登錄搜尋引擎時,我們一般不用考慮網站的分類問題,而登錄目錄索引時則必須將網站放在一個最合適的目錄(Directory)。\\n\\n最後,搜尋引擎中各網站的有關資訊都是從用戶網頁中自動提取的,所以用戶的角度看,我們擁有更多的自主權;而目錄索引則要求必須手工另外填寫網站資訊,而且還有各種各樣的限製。更有甚者,如果工作人員認為你提交網站的目錄、網站資訊不合適,他可以隨時對其進行調整,當然事先是不會和你商量的。\\n\\n目錄索引,顧名思義就是將網站分門彆類地存放在相應的目錄中,因此用戶在查詢資訊時,可選擇關鍵詞搜尋,也可按分類目錄逐層查詢。如以關鍵詞搜尋,返回的結果跟搜尋引擎一樣,也是根據資訊關聯程度排列網站,隻不過其中人為因素要多一些。如果按分層目錄查詢,某一目錄中網站的排名則是由標題字母的先後順序決定(也有例外)。\\n\\n目前,搜尋引擎與目錄索引有相互融合滲透的趨勢。原來一些純粹的全文搜尋引擎現在也提供目錄搜尋,如Google就借用OpenDirectory目錄提供分類查詢。而象Yahoo!這些老牌目錄索引則通過與Google等搜尋引擎合作擴大搜尋範圍(注)。在默認搜尋模式下,一些目錄類搜尋引擎首先返回的是自己目錄中匹配的網站,如國內搜狐、新浪、網易等;而另外一些則默認的是網頁搜尋,如Yahoo。\\n\\n這種引擎的特點是找的準確率比較高。\\n\\n搜尋引擎的發展史\\n\\n互聯網發展早期,以雅虎為代表的網站分類目錄查詢非常流行。網站分類目錄由人工整理維護,精選互聯網上的優秀網站,並簡要描述,分類放置到不同目錄下。用戶查詢時,通過一層層的點擊來查詢自己想找的網站。也有人把這種基於目錄的檢索服務網站稱為搜尋引擎,但從嚴格意義上講,它並不是搜尋引擎。\\n\\n1990年,加拿大麥吉爾大學(UniversityofMcGill)計算機學院的師生開發出Archie。當時,萬維網(WorldWideWeb)還冇有出現,人們通過FTP來共享交流資源。Archie能定期蒐集並分析FTP服務器上的檔名資訊,提供查詢分彆在各個FTP主機中的檔案。用戶必須輸入精確的檔名進行搜尋,Archie告訴用戶哪個FTP服務器能下載該檔案。雖然Archie蒐集的資訊資源不是網頁(HTML檔案),但和搜尋引擎的基本工作方式是一樣的:自動蒐集資訊資源、建立索引、提供檢索服務。所以,Archie被公認為現代搜尋引擎的鼻祖。\\n\\n搜尋引擎的起源\\n\\n所有搜尋引擎的祖先,是1990年由Montreal的McGillUniversity三名學生(AlanEmtage、PeterDeutsch、BillWheelan)發明的Archie(ArchieFAQ)。AlanEmtage等想到了開發一個可以用檔名查詢檔案的係統,於是便有了Archie。Archie是第一個自動索引互聯網上匿名FTP網站檔案的程式,但它還不是真正的搜尋引擎。Archie是一個可搜尋的FTP檔名列表,用戶必須輸入精確的檔名搜尋,然後Archie會告訴用戶哪一個FTP地址可以下載該檔案。由於Archie深受歡迎,受其啟發,NevadaSystemComputingServices大學於1993年開發了一個Gopher(GopherFAQ)搜尋工具Veronica(VeronicaFAQ)。Jughead是後來另一個Gopher搜尋工具。\\n\\n搜尋引擎的發展\\n\\n發展(1)\\n\\nExcite的曆史可以上溯到1993年2月,6個StanfordUniversity(斯坦福大學)大學生的想法是分析字詞關係,以對互聯網上的大量資訊作更有效的檢索。到1993年中,這已是一個完全投資項目,他們還釋出了一個供webmasters在自己網站上使用的搜尋軟件版本,後來被叫做ExciteforWebServers。\\n\\n注:Excite後來曾以概念搜尋聞名,2002年5月,被Infospace收購的Excite停止自己的搜尋引擎,改用元搜尋引擎Dogpile 發展(2)\\n\\n1994年4月,斯坦福大學的兩名博士生,美籍華人楊致遠和DavidFilo共同創辦了Yahoo!。隨著訪問量和收錄鏈接數的增長,Yahoo目錄開始支援簡單的數據庫搜尋。因為Yahoo!的數據是手工輸入的,所以不能真正被歸為搜尋引擎,事實上隻是一個可搜尋的目錄。Yahoo!中收錄的網站,因為都附有簡介資訊,所以搜尋效率明顯提高。\\n\\n注:Yahoo以後陸續有Altavista、Inktomi、Google提供搜尋引擎服務Yahoo!--幾乎成為20世紀90年代的因特網的代名詞。\\n\\n發展(3)\\n\\n1995年,一種新的搜尋引擎形式出現了——元搜尋引擎(MetaSearchEngine)。用戶隻需提交一次搜尋請求,由元搜尋引擎負責轉換處理後提交給多個預先選定的獨立搜尋引擎,並將從各獨立搜尋引擎返回的所有查詢結果,集中起來處理後再返回給用戶。\\n\\n第一個元搜尋引擎,是Washington大學碩士生EricSelberg和OrenEtzioni的Metacrawler。元搜尋引擎概念上非常好聽,但搜尋效果始終不理想,所以冇有哪個元搜尋引擎有過強勢地位。\\n\\n發展(4)\\n\\n智慧檢索的產生:它利用分詞詞典、同義詞典,同音詞典改善檢索效果,進一步還可在知識層麵或者說概念層麵上輔助查詢,通過主題詞典、上下位詞典、相關同級詞典檢索處理形成一個知識體係或概念網絡,給予用戶智慧知識提示,最終幫助用戶獲得最佳的檢索效果。\\n\\n例:\\n\\n(1)查詢“計算機”,與“電腦”相關的資訊也能檢索出來;(2)可以進一步縮小查詢範圍至“微機”、“服務器”或擴大查詢至“資訊技術”或查詢相關的“電子技術”、“軟件”、“計算機應用”等範疇;(3)還包括歧義資訊和檢索處理,如“蘋果”,究竟是指水果還是電腦品牌,“華人”與“中華人民共和國”的區分,將通過歧義知識描述庫、全文索引、用戶檢索上下文分析以及用戶相關性反饋等技術結合處理,高效、準確地反饋給用戶最需要的資訊。\\n\\n發展(5)\\n\\n個性化趨勢是搜尋引擎的一個未來發展的重要特征和必然趨勢之一。一種方式通過搜尋引擎的社區化產品(即對註冊用戶提供服務)的方式來組織個人資訊,然後在搜尋引擎基礎資訊庫的檢索中引入個人因素進行分析,獲得針對個人不同的搜尋結果。自2004年10月yahoo推出myweb測試版,到11月a9推出個性化功能,到2005年Googlesearchhistory基本上都沿著一條路子走,分析特定用戶的搜尋需求限定的範圍,然後按照用戶需求範圍擴展到互聯網上其他的同類網站給出最相關的結果。另外一種是針對大眾化的,Google個性化搜尋引擎,或者yahooMindSet,或者我們都知道的前台聚類的vivisimo。但是無論其中的哪一種實現方式,即Google的主動選擇搜尋範圍,還是yahoo,vivisimo的在結果中重新組織自己需要的資訊,都是一種實驗或者創想,短期內無法成為主流的搜尋引擎應用產品。\\n\\n發展(6)\\n\\n網格技術(greatglobalgrid):由於冇有統一的資訊組織標準對網絡資訊資源進行加工處理,難以對無序的網絡資訊資源進行檢索、交接和共享乃至深層次的開發利用,形成資訊孤島。網格技術就是要消除資訊孤島實現互聯網上所有資源的全麵連通。\\n\\n國全球資訊網格(GlobalInformationGrid)Robot(機器人)一詞對編程者有特殊的意義。ComputerRobot是指某個能以人類無法達到的速度不斷重複執行某項任務的自動程式。由於專門用於檢索資訊的Robot程式像蜘蛛(spider)一樣在網絡間爬來爬去,因此,搜尋引擎的Robot程式被稱為spider程式。\\n\\n1993年MatthewGray開發了WorldWideWebWanderer,這是第一個利用HTML網頁之間的鏈接關係來檢測萬維網規模的“機器人(Robot)”程式。開始,它僅僅用來統計互聯網上的服務器數量,後來也能夠捕獲網址(URL)。\\n\\n1994年4月,斯坦福大學(StanfordUniversity)的兩名博士生,美籍華人JerryYang(楊致遠)和DavidFilo共同創辦了Yahoo。隨著訪問量和收錄鏈接數的增長,Yahoo目錄開始支援簡單的數據庫搜尋。因為Yahoo!的數據是手工輸入的,所以不能真正被歸為搜尋引擎,事實上隻是一個可搜尋的目錄。雅虎於2002年12月23日收購inktomi,2003年7月14日收購包括Fast和Altavista在內的Overture,2003年11月,Yahoo全資收購3721公司。\\n\\n1994年初,華盛頓大學(UniversityofWashington)的學生BrianPinkerton開始了他的小項目WebCrawler。1994年4月20日,WebCrawler正式亮相時僅包含來自6000個服務器的內容。WebCrawler是互聯網上第一個支援搜尋檔案全部文字的全文搜尋引擎,在它之前,用戶隻能通過URL和摘要搜尋,摘要一般來自人工評論或程式自動取正文的前100個字。\\n\\n1994年7月,卡內基·梅隆大學(CarnegieMellonUniversity)的MichaelMauldin將JohnLeavitt的spider程式接入到其索引程式中,創建了Lycos。除了相關性排序外,Lycos還提供了前綴匹配和字元相近限製,Lycos第一個在搜尋結果中使用了網頁自動摘要,而最大的優勢還是它遠勝過其它搜尋引擎的數據量。\\n\\n1994年底,Infoseek正式亮相。其友善的介麵,大量的附加功能,使之和Lycos一樣成為搜尋引擎的重要代表。\\n\\n1995年,一種新的搜尋引擎形式出現了——元搜尋引擎(AMetaSearchEngineRoundup)。用戶隻需提交一次搜尋請求,由元搜尋引擎負責轉換處理,提交給多個預先選定的獨立搜尋引擎,並將從各獨立搜尋引擎返回的所有查詢結果,集中起來處理後再返回給用戶。第一個元搜尋引擎,是Washington大學碩士生EricSelberg和OrenEtzioni的Metacrawler。\\n\\n1995年12月,DEC的正式釋出AltaVista。AltaVista是第一個支援自然語言搜尋的搜尋引擎,第一個實現高級搜尋語法的搜尋引擎(如AND、OR、NOT等)。用戶可以用AltaVista搜尋新聞組(Newsgroups)的內容並從互聯網上獲得文章,還可以搜尋圖片名稱中的文字、搜尋Titles、搜尋Javaapplets、搜尋ActiveXobjects。AltaVista也聲稱是第一個支援用戶自己向網頁索引庫提交或刪除URL的搜尋引擎,並能在24小時內上線。AltaVista最有趣的新功能之一,是搜尋有鏈接指向某個URL的所有網站。在麵向用戶的介麵上,AltaVista也作了大量革新。它在搜尋框區域下放了“tips”以幫助用戶更好的表達搜尋式,這些小tip經常更新,這樣,在搜尋過幾次以後,用戶會看到很多他們可能從來不知道的的有趣功能。這係列功能,逐漸被其它搜尋引擎廣泛采用。1997年,AltaVista釋出了一個圖形演示係統LiveTopics,幫助用戶從成千上萬的搜尋結果中找到想要的。\\n\\n1995年9月26日,加州伯克利分校助教EricBrewer、博士生PaulGauthier創立了Inktomi,1996年5月20日,Inktomi公司成立,強大的HotBot出現在世人麵前。聲稱每天能抓取索引1千萬頁以上,所以有遠超過其它搜尋引擎的新內容。HotBot也大量運用cookie儲存用戶的個人搜尋喜好設置。\\n\\n1997年8月,Northernlight搜尋引擎正式現身。它曾是擁有最大數據庫的搜尋引擎之一,它冇有StopWords,它有出色的CurrentNews、7100多出版物組成的SpecialCollection、良好的高級搜尋語法,第一個支援對搜尋結果進行簡單的自動分類。\\n\\n1998年10月之前,Google隻是斯坦福大學(StanfordUniversity)的一個小項目BackRub。1995年博士生LarryPage開始學習搜尋引擎設計,於1997年9月15日註冊了域名,1997年底,在SergeyBrin和ScottHassan、AlanSteremberg的共同參與下,BachRub開始提供Demo。1999年2月,Google完成了從Alpha版到Beta版的蛻變。Google公司則把1998年9月27日認作自己的生日。Google以網頁級彆(Pagerank)為基礎,判斷網頁的重要性,使得搜尋結果的相關性大大增強。Google公司的奇客(Geek)文化氛圍、不作惡(Don’tbeevil)的理念,為Google贏得了極高的口碑和品牌美譽。2006年4月,Google宣佈其中文名稱“穀歌”,這是Google第一個在非英語國家起的名字。\\n\\nFast(Alltheweb)公司創立於1997年,是挪威科技大學(NTNU)學術研究的副產品。1999年5月,釋出了自己的搜尋引擎AllTheWeb。Fast創立的目標是做世界上最大和最快的搜尋引擎,幾年來庶幾近之。Fast(Alltheweb)的網頁搜尋可利用ODP自動分類,支援Flash和pdf搜尋,支援多語言搜尋,還提供新聞搜尋、圖像搜尋、視頻、MP3、和FTP搜尋,擁有極其強大的高級搜尋功能。(2003年2月25日,Fast的互聯網搜尋部門被Overture收購)。\\n\\n1996年8月,sohu公司成立,製作中文網站分類目錄,曾有“出門找地圖,上網找搜狐”的美譽。隨著互聯網網站的急劇增加,這種人工編輯的分類目錄已經不適應。sohu於2004年8月獨立域名的搜尋網站“搜狗”,自稱“第三代搜尋引擎”。\\n\\nOpenfind創立於1998年1月,其技術源自台灣中正大學吳升教授所領導的GAIS實驗室。Openfind起先隻做中文搜尋引擎,鼎盛時期同時為三大著名門戶新浪、奇摩、雅虎提供中文搜尋引擎,但2000年後市場逐漸被Baidu和Google瓜分。2002年6月,Openfind重新釋出基於GAIS30Project的Openfind搜尋引擎Beta版,推出多元排序(PolyRankTM),宣佈累計抓取網頁35億,開始進入英文搜尋領域。\\n\\n2000年1月,兩位北大校友,超鏈分析專利發明人、前Infoseek資深工程師李彥宏與好友徐勇(加州伯克利分校博士後)在北京中關村創立了百度(Baidu)公司。2001年8月釋出預覽\\/預覽全部網頁、相關搜尋詞、錯彆字糾正提示、mp3搜尋、Flash搜尋。2002年3月閃電計劃(BlitzenProject)開始後,技術升級明顯加快。後推出貼吧、知道、地圖、國學、百科、文檔、視頻、部落格等一係列產品,深受網民歡迎。2005年8月5日在納斯達克上市,發行價為USD27.00,代號為BIDU。開盤價USD66.00,以USD122.54收盤,漲幅353.85%,創下了5年以來美國股市上市新股當日漲幅最高紀錄。\\n\\n2003年12月23日,原慧聰搜尋正式獨立運做,成立了中國搜尋。2004年2月,中國搜尋釋出桌麵搜尋引擎網絡豬1.0,2006年3月中搜將網絡豬更名為IG(InternetGateway)。\\n\\n2005年6月,新浪正式推出自主研發的搜尋引擎“愛問”。2007年起,新浪愛問使用google搜尋引擎。\\n\\n2007年7月1日全麵采用網易自主研發的有道搜尋技術,並且合併了原來的綜合搜尋和網頁搜尋。有道網頁搜尋、圖片搜尋和部落格搜尋為網易搜尋提供服務。其中網頁搜尋使用了其自主研發的自然語言處理、分散式存儲及計算技術;圖片搜尋首創根據拍攝相機品牌、型號,甚至季節等高級搜尋功能;部落格搜尋相比同類產品具有抓取全麵、更新及時的優勢,提供“文章預覽”,“部落格檔案”等創新功能。\\n\\n搜尋引擎的影響\\n\\n搜尋引擎給網吧行業帶來的影響\\n\\n走進網吧,不難發現各個網吧內的電腦瀏覽器首頁或工具條上都會有google或百度的標誌。百度甚至還推出了網吧聯盟,可見搜尋引擎們對網吧行業都格外的青睞。現在我們常用的搜尋引擎無非就是百度和google兩種。從百度方麵來看,百度聯盟可以算是目前唯一一個能夠覆蓋所有網吧並和幾乎所有主流網吧軟件締結合作關係的媒體運營平台。而google方麵也不甘示弱,穀歌已經注意到了網吧市場,網吧已經成為了穀歌的新型合作夥伴。網吧的首頁和工具條上都會出現穀歌的標誌,相應地會給穀歌帶去流量。穀歌對網吧市場的關注,表明穀歌注意到網吧作為中國互聯網市場的特色之一。由於我國PC擁有量遠落後於美國等西方國家,網吧作為網民主要上網地點的比例逐年在上升,我國網民在網吧上網的比例偏高。據CNNIC第20次中國互聯網絡發展狀況統計報告顯示,超過1\\/3(37.2%)的網民表示經常去網吧上網,比2006年12月的32.3%高了5個百分點,第一次超過網民在工作單位上網的比例而成為第二大上網場所。\\n\\n搜尋引擎對網站的影響\\n\\n一個網站的命脈就是流量,而網站的流量可以分為兩類。一類是自然流量,一類就是通過搜尋引擎而來的流量。如果搜尋引擎能夠更多更有效的抓取網站內容,那麼對於網站的好處是不言而喻的。所以,SEO也應運而生了。\\n\\n在百度和穀歌兩大搜尋引擎的工作中,百度的工作週期相對來說短一些,百度大約在10天左右重新訪問網站一次,Google大約在15天左右重新訪問一次網站。由於一天之內不能遊曆全球所有的網站,如果推廣網站時,能到更多的網站上提交相應的網站資訊,也是加快蜘蛛收錄網站內容的重要環節。\\n\\n所搜引擎目標層次\\n\\n搜尋引擎營銷可分為四個層次,可分彆簡單描述為:存在層、表現層、關注層和轉化層。\\n\\n第一層是搜尋引擎營銷的存在層,其目標是在主要的搜尋引擎\\/分類目錄中獲得被收錄的機會,這是搜尋引擎營銷的基礎,離開這個層次,搜尋引擎營銷的其他目標也就不可能實現。。\\n\\n第二層的目標則是在被搜尋引擎收錄的基礎上儘可能獲得好的排名,即在搜尋結果中有良好的表現,因而可稱為表現層。。\\n\\n搜尋引擎營銷的第三個目標則直接表現為網站訪問量指標方麵,也就是通過搜尋結果點擊率的增加來達到提高網站訪問量的目的。由於隻有受到用戶關注,經過用戶選擇後的資訊纔可能被點擊,因此可稱為關注層。\\n\\n搜尋引擎營銷的第四個目標,即通過訪問量的增加轉化為企業最終實現收益的提高,可稱為轉化層。轉化層是前麵三個目標層次的進一步提升,是各種搜尋引擎方法所實現效果的集中體現,但並不是搜尋引擎營銷的直接效果。\\n\\n搜尋引擎作用\\n\\n搜尋引擎是網站建設中針對“用戶使用網站的便利性”所提供的必要功能,同時也是“研究網站用戶行為的一個有效工具”。高效的站內檢索可以讓用戶快速準確地找到目標資訊,從而更有效地促進產品\\/服務的銷售,而且通過對網站訪問者搜尋行為的深度分析,對於進一步製定更為有效的網絡營銷策略具有重要價值。\\n\\n1、從網絡營銷的環境看,搜尋引擎營銷的環境發展為網絡營銷的推動起到舉足輕重的作用2、從效果營銷看,很多公司之所以可以應用網絡營銷是利用了搜尋引擎營銷3、就完整型電子商務概念組成部分來看,網絡營銷是其中最重要的組成部分,是向終端客戶傳遞資訊的重要環節商務模式\\n\\n在搜尋引擎發展早期,多是作為技術提供商為其他網站提供搜尋服務,網站付錢給搜尋引擎。後來,隨著2001年互聯網泡沫的破滅,大多轉向為競價排名方式。\\n\\n現在搜尋引擎的主流商務模式(百度的競價排名、Google的AdWords)都是在搜尋結果頁麵放置廣告,通過用戶的點擊向廣告主收費。這種模式最早是比爾·格羅斯(BillGross)提出的。他於1998年6月創立GoTo公司(後於2001年9月更名為Overture),實施這種模式,取得了很大的成功,並且申請了專利。這種模式有兩個特點,一是點擊付費(PayPerClick),用戶不點擊則廣告主不用付費。二是競價排序,根據廣告主的付費多少排列結果。2001年10月,Google推出AdWords,也采用點擊付費和競價的方式。2002年,Overture起訴Google侵犯了其專利。2004年8月,和Yahoo!(Yahoo!於2003年7月收購Overture)達成和解,向後者支付了270萬普通股(合3億美元不到)作為和解費。\\n\\nAdSense是Google於2003年推出的一種新的廣告方式。AdSense使各種規模的的第三方網頁釋出者進入Google龐大的廣告商網絡。Google在這些第三方網頁放置跟網頁內容相關的廣告,當瀏覽者點擊這些廣告時,網頁釋出者能獲得收入。AdSense在blogger中很受歡迎。同時,Google武斷地刪除一些帳號,引起部分人的不滿。類似的廣告方式,其他搜尋引擎也先後推出。雅虎的廣告方式是YPN(YahooPublisherNetwork),YPN除了可以在網頁上顯示與內容相關的廣告以外,還可以通過在RSS訂閱中來顯示廣告。微軟的廣告計劃叫AdCenter。百度也推出主題推廣。\\n\\n組成\\n\\n搜尋引擎一般由搜尋器、索引器、檢索器和用戶介麵四個部分組成:搜尋器\\n\\n其功能是在互聯網中漫遊,發現和蒐集資訊;索引器\\n\\n其功能是理解搜尋器所搜尋到的資訊,從中抽取出索引項,用於表示文檔以及生成文檔庫的索引表;檢索器\\n\\n其功能是根據用戶的查詢在索引庫中快速檢索文檔,進行相關度評價,對將要輸出的結果排序,並能按用戶的查詢需求合理反饋資訊;用戶介麵\\n\\n其作用是接納用戶查詢、顯示查詢結果、提供個性化查詢項。\\n\\n搜尋引擎市場和競爭格局\\n\\n市場概述\\n\\n2010年4月12日,艾瑞谘詢今日釋出的中國搜尋引擎市場份額報告顯示,2009年全球搜尋引擎市場規模達339.0億美元。中國搜尋引擎市場規模達69.6億元(約合10.2億美元),相比2008年的50.3億元年同比增長38.5%。預計2010年中國搜尋引擎市場規模將呈現45%左右的增幅。\\n\\n2009年中國網頁搜尋請求量規模為2033.8億次,年同比增長35.7%。自2007年中國列於全球搜尋請求量首位以來,其在全球市場的領先優勢持續強化:2007年至2009年,中國搜尋請求量規模在全球請求量規模中占比分彆為15.6%、19.7%和20.6%。\\n\\n競爭格局\\n\\n雙寡頭特征依舊,建議運營商外延競爭邊界2009年中國搜尋引擎市場雙寡頭特征加劇,營收方麵,百度、穀歌二者營收份額之和為96.2%;流量方麵,百度穀歌網頁搜尋請求量份額之和達94.9%,基本壟斷中國搜尋引擎市場。艾瑞建議領先通用搜尋引擎運營商,在維持通用搜尋市場的既得優勢的同時,重視來自廣義搜尋市場的潛在競爭。\\n\\n搜尋引擎怎樣判斷網頁所使用的語言人們喜歡以他們所知道的語言列出的搜尋結果,這對搜尋營銷人員是十分重要的。當一個搜尋者輸入上麵圖中的搜尋請求時,隻有用中文寫的網頁將被顯示在搜尋結果裡麵。\\n\\n在有些國家,例如日本和中國,大部分搜尋者想要結果限製在母語上。但是在其他地方例如瑞典,搜尋可以采用瑞典語和英語來進行。不同國家的搜尋者有不同的語言偏好。\\n\\n對搜尋營銷人員而言,重要的是搜尋引擎知道網頁所使用的語言,如果網頁冇能被正確地識彆,可能就會從本應發現它的搜尋者麵前消失,從而降低你的引薦訪問。\\n\\n那麼搜尋引擎是怎樣判斷網頁所使用的語言呢?這裡有很多不同的方法:語言meta標簽\\n\\n很多網頁通過一個HTML標簽來表明網頁使用的語言,例如表示使用的是日語,看起來簡單,搜尋蜘蛛程式讀取標簽,於是搜尋引擎知道是什麼語言了。但是相對多的語言meta標簽是完全錯誤的,冇有標簽,句法錯誤,以及語言編碼錯誤等等。搜尋引擎確實檢視這些標簽,但是它們很少隻從這些標簽來判定網頁的語言。\\n\\n字元編碼\\n\\n計算機檔案(包括HTML網頁)需要“對譯本(Key)”正確翻譯檔案中的字元(字母,數字等等)。這種對譯本被稱為字元編碼。由網頁中meta標簽裡聲明,例如。\\n\\n網站瀏覽器和搜尋蜘蛛程式假定網頁按照西方語言編碼,因此使用這些語言寫的網頁不需要這個標簽。為了瀏覽器顯示正確,亞洲、阿拉伯和古代斯拉夫語的文字確實需要這個標簽。因此,當搜尋引擎看到針對這些語言的表情,它對正確顯示網頁的語言有了很高的保證。\\n\\n內容分析\\n\\n搜尋引擎通過研究內容中的字元模式來最終判定網頁的語言,哪怕是短到隻有兩句話的網頁,內容分析的精確度也非常高。Meta標簽隻有在內容分析後還不確定的情況下才被使用。\\n\\n多數情況下,搜尋引擎會自行正確地判斷網頁的內容,對於隻有很少幾個詞的網頁,要保證網頁被正確識彆,正確的編碼語言和meta語言標簽很重要。\\n\\n搜尋引擎的技術發展趨勢\\n\\n未來搜尋引擎\\n\\n搜尋引擎經過幾年的發展和摸索,越來越貼近人們的需求,搜尋引擎的技術也得到了很大的發展。搜未來搜尋引擎索引擎\\n\\n的最新技術發展包括以下幾個方麵:提高搜尋引擎對用戶檢索提問的理解為了提高搜尋引擎對用戶檢索提問的理解,就必須有一個好的檢索提問語言,為了克服關鍵詞檢索和目錄查詢的缺點,現在已經出現了自然語言智慧答詢。用戶可以輸入簡單的疑問句,比如“howcankillvirusofcomputer?”。搜尋引擎在對提問進行結構和內容的分析之後,或直接給出提問的答案,或引導用戶從幾個可選擇的問題中進行再選擇。自然語言的優勢在於,一是使網絡交流更加人性化,二是使查詢變得更加方便、直接、有效。就以上麵的例子來講,如果用關鍵詞查詢,多半人會用“virus”這個詞來檢索,結果中必然會包括各類病毒的介紹、病毒是怎樣產生的等等許多無效資訊,而用“howcankillvirusofcomputer?”,搜尋引擎會將怎樣殺病毒的資訊提供給用戶,提高了檢索效率。\\n\\n對檢索結果進行處理\\n\\n1、基於鏈接評價的搜尋引擎\\n\\n基於鏈接評價的搜尋引擎的優秀代表是Google,它獨創的“鏈接評價體係”是基於這樣一種認識,一個網頁的重要性取決於它被其它網頁鏈接的數量,特彆是一些已經被認定是“重要”的網頁的鏈接數量。這種評價體製與《科技引文索引》的思路非常相似,但是由於互聯網是在一個商業化的環境中發展起來的,一個網站的被鏈接數量還與它的商業推廣有著密切的聯絡,因此這種評價體製在某種程度上缺乏客觀性。\\n\\n2、基於訪問大眾性的搜尋引擎\\n\\n基於訪問大眾性的搜尋引擎的代表是directhit,它的基本理念是多數人選擇訪問的網站就是最重要的網站。根據以前成千上萬的網絡用戶在檢索結果中實際所挑選並訪問的網站和他們在這些網站上花費的時間來統計確定有關網站的重要性排名,並以此來確定哪些網站最符合用戶的檢索要求。因此具有典型的趨眾性特點。這種評價體製與基於鏈接評價的搜尋引擎有著同樣的缺點。\\n\\n3、去掉檢索結果中附加的多餘資訊有調查指出,過多的附加資訊加重了用戶的資訊負擔,為了去掉這些過多的附加資訊,可以采用用戶定製、內容過濾等檢索技術。\\n\\n確定搜尋引擎資訊蒐集範圍\\n\\n1、垂直主題搜尋引擎\\n\\n網上的資訊浩如煙海,網絡資源以十倍速的增長,一個搜尋引擎很難收集全所有主題的網絡資訊,即使資訊主題收集得比較全麵,由於主題範圍太寬,很難將各主題都做得精確而又專業,使得檢索結果垃圾太多。這樣以來,垂直主題的搜尋引擎以其高度的目標化和專業化在各類搜尋引擎中占據了一係席之地,比如象股票、天氣、新聞等類的搜尋引擎,具有很高的針對性,用戶對查詢結果的滿意度較高。作者認為,垂直主題有著極大的發展空間。\\n\\n2、非www資訊的搜尋\\n\\n提供FTP等類資訊的檢索\\n\\n3、多媒體搜尋引擎\\n\\n多媒體檢索主要包括聲音、圖像、視頻的檢索。關於圖片搜尋引擎的原理,《淺談圖片搜尋引擎的實現》中提出了具有跨時代意義設計思路。\\n\\n提供更優化的檢索結果\\n\\n1、純淨搜尋引擎\\n\\n這類搜尋引擎冇有自己的資訊采集係統,利用彆人現有的索引數據庫,主要關注檢索的理念、技術和機製等。\\n\\n2、元搜尋引擎\\n\\n現在出現了許多的搜尋引擎,其收集資訊的範圍、搜尋機製、演算法等都不同,用戶不得不去學習多個搜尋引擎的用法。每個搜尋引擎平均隻能涉及到整個www資源的30-50%(searchenginewatch數據),這樣導致同一個搜尋請求在不同搜尋引擎中獲得的查詢結果的重複率不足34%,而每一個搜尋引擎的查準率不到45%。\\n\\n元搜尋引擎(metasearchengining)是將用戶提交的檢索請求到多個獨立的搜尋引擎上去搜尋,並將檢索結果集中統一處理,以統一的格式提供給用戶,因此有搜尋引擎之上的搜尋引擎之稱。它的主要精力放在提高搜尋速度、智慧化處理搜尋結果、個性搜尋功能的設置和用戶檢索介麵的友好性上,查全率和查準率都比較高。目前比較成功的元搜尋引擎有metacrawler、dopile、ixquick、搜客等。\\n\\n3、整合搜尋引擎\\n\\n整合搜尋引擎(All-in-OneSearchPage),亦稱為“多引擎同步檢索係統”(如百度)是在一個WWW頁麵上鍊接若乾種獨立的搜尋引擎,檢索時需點選或指定搜尋引擎,一次檢索輸入,多引擎同時搜尋,用起來相當方便。\\n\\n整合搜尋引擎無自建數據庫,不需研發支援技術,當然也不能控製和優化檢索結果。但整合搜尋引擎製作與維護技術簡單,可隨時對所鏈接的搜尋引擎進行增刪調整和及時更新,尤其大規模專業(如FLASH、MP3等)搜尋引擎整合鏈接,深受特定用戶群歡迎。\\n\\n4、垂直搜尋引擎\\n\\n垂直搜尋引擎是相對通用搜尋引擎的資訊量大、查詢不準確、深度不夠等提出來的新的搜尋引擎服務模式,通過針對某一特定領域、某一特定人群或某一特定需求提供的有一定價值的資訊和相關服務。其特點就是“專、精、深”,且具有行業色彩,相比較通用搜尋引擎的海量資訊無序化,垂直搜尋引擎則顯得更加專注、具體和深入。\\n\\n搜尋引擎的分類\\n\\n網頁音樂(翻唱MP3)影視(電影電視)視頻播客軟件BT下載硬體圖片壁紙相冊小說文學文檔(論文述職報告思想彙報演講稿入黨申請書作文個人簡曆畢業論文法律論文經濟論文教育論文會計論文計算機論文畢業論文集情書調查報告求職信商業計劃書實習報告就職演說自薦信企劃方案企業管理年終總結)新聞(資訊)百科(知識經驗)教育人物學校專業論壇社區部落格詞典翻譯地圖動漫Flash遊戲娛樂笑話汽車家電手機廣告購物商業黃頁房產招聘財經股票基金法律國學圖書政府目錄學術代碼公交實用查詢等幾十個分類。\\n\\n搜尋引擎的最後一步\\n\\n10年前我們要查閱資料,請教問題,更多想到的是請教專家,圖書管查閱等傳統方式。常常為了一個簡單的問題而到處尋師,在圖書館翻著類似我的電腦桌抽屜裡的檢索卡片,苦苦尋找。曾幾何時,互聯網的普及與興起,搜尋引擎的出現,逐漸改變著我們的生活習慣和思維方式。很多問題“baidu一下,你就知道。”就像這裡用的“曾幾何時”這一詞,中文不好的我隻有模糊的理解,還以為有“曾經”的意思,想用為第一句。於是百度知道搜尋了一下,出自宋\\\"王安石《祭盛侍郎文》:“補官揚州,公得謝歸。曾幾何時,訃者來門。”才知是才過了不久的意思。\\n\\n搜尋引擎(searchengine)是一個係統,能從大量資訊中找到所需的資訊,提供給用戶。互聯網出現到現今,資訊量可以說成密指數的增長,大量資訊就像Google的原本含義一樣“1的後麵跟著100個0”,這個數比宇宙所有的基本粒子的數量總和還要大。在這浩如煙海的資訊中怎麼才能找到自己需要的資訊呢?搜尋引擎就像一隻神奇的手,從雜亂的資訊中抽出一條清晰的檢索路徑。\\n\\n事物的發展往往遵循著合久必分,分久必合的規律,每一次的合與分都是代表著更高級更先進。同樣搜尋引擎從最初的Archie可以用檔名查詢整個互聯網中FTP檔案的係統,發展到Yahoo早期一種手工錄入的分行業的目錄檢索。隨著搜尋技術的發展,元標記搜尋、全文搜尋重新又把整個互連網的資訊整合起來提供給用戶,目前的Baidu、Google提供的就是一種整個互聯網的全文搜尋,這種整合資訊的搜尋也稱為水平搜尋。這種水平全文搜尋固然可以把網絡中的所有相關資訊提供給用,但這種“所有”不代表著是用戶所需的“所有”,往往夾雜著許多垃圾資訊。問題出現就伴隨著去解決,如果平常使用搜尋引擎比較全麵,你會發現Baidu、Goolge都有了“更多”的選項,其中出現了大學搜尋、新聞搜尋、圖書搜尋、圖片搜尋等等這些專業化,行業化的搜尋,也稱為垂直搜尋。當前垂直搜尋正在逐漸走向豐富化、專業化、行業化,將越來越滿足人們的搜尋需求。比如很多人在搜尋問題時會到百度知道裡搜尋,因為那裡更有針對性;搜尋天氣會到天氣搜尋中等等。\\n\\n那麼搜尋引擎的下一步發展是什麼呢?讓我們回想一下搜尋引擎的定義:一個係統,能從大量資訊中找到所需的資訊,提供給用戶。根據技術的不斷髮展和事物規律暢想一下,垂直搜尋發展到一定程度會出現資訊的單一專業化太強,整體資訊綜合化不好,而人們需要的不但要有專業資訊,同樣也要有整體聯想資訊。隨著人工智慧、神經網絡、網格計算等搜尋技術的發展,我們又將有一個能整合互聯網資訊,智慧的提供用戶確實所“需”的資訊,而不簡單隻是所“要”的資訊,因為很多時候搜尋時,自己都不知道要什麼。\\n\\n再回的現在的搜尋引擎,它就像一隻神奇的手,從雜亂的資訊中抽出一條清晰的檢索路徑。這個引擎提供給用戶的最後一步是什麼?是一條清晰的檢索路徑。好的,注意這是一條檢索路徑,在這條路徑的上的檢索和資訊提取是什麼呢,是我們的閱讀和大腦的判斷。也就是做搜尋引擎的最後一步是我們的大腦。得到的這條路徑清晰但也並不簡短,需要我們進行快速的瀏覽,嗬嗬,繞來繞去,得出一個結論,快速閱讀也是搜尋引擎中的一部分。\\n\\n隨著搜尋市場競爭的白熱化,搜尋引擎不僅開始深挖自己的戰壕,還開始打起了口水戰,而山寨搜尋引擎在高舉著“整合”的大旗,開始大搖大擺地進入這個本來隻有巨頭壟斷的市場。國人充分發揮著其無比的想象力,準備讓國內的互聯網“步入搜尋新時代”。\\n\\n下麵就讓我們看看什麼是山寨搜尋引擎“百google度”-baigoogledu\\n\\n最早的山寨搜尋引擎,曾經名噪一時。最早確定了山寨搜尋引擎的模式,而且訪問量很高,但功能簡單,而且讓用戶需要不停的兩邊拖拉才能看到完整的結果。\\n\\n“百穀虎”-baigoohoo\\n\\n由於某家新聞媒體的報道,最近聲名大振,高舉著“山寨”大旗,讓國人開始瞭解什麼是山寨搜尋引擎,名字極富創意。可惜由於搜尋結果被並排擠在一起,似乎冇有什麼實際使用價值。\\n\\n“山寨文化”在每個人的心目中可能都有著不同的感覺,但隨著這股風越刮越烈,可見草根對“山寨”的內涵還是有相當的認同,百度和穀歌的嘴仗打的不亦熱乎,都指責對方結果不公正,山寨搜尋卻硬要把這兩個冤家放在一起。也許很多人對“山寨搜尋”嗤之以鼻,但是對於普通網民來說,是誰的搜尋並不重要,是我們需要的結果纔是最重要的麼。如果是你,你會選擇誰呢?\\n\\n搜尋引擎優化(SearchEngineOptimization,簡稱SEO)搜尋引擎優化即SearchEngineOptimization,用英文描述是tousesometechnicstomakeyourwebsiteinthetopplacesinSearchEnginewhensomebodyisusingSearchEnginetofindsomething,翻譯成中文就是“搜尋引擎優化”,一般可簡稱為搜尋優化。與之相關的搜尋知識還有SearchEngineMarketing(搜尋引擎營銷),SearchEnginePositioning(搜尋引擎定位)、SearchEngineRanking(搜尋引擎排名)等。\\n\\n搜尋引擎的未來展望\\n\\n隨著互聯網的發展,網上可以搜尋的網頁變得愈來愈多,而網頁內容的質素亦變得良莠不齊,冇有保證。所以,未來的搜尋引擎將會朝著知識型搜尋引擎的方向發展,期以為搜尋者提供更準確及適用的資料。目前,網上的百科全書如雨後春筍般發展起來;另一方麵,近年來亦有不少公司嘗試在搜尋方麵改進,務求更符合用戶的要求。當中諸如CopernicAgent之類的搜尋代理就是其中之一。\\n\\n在台灣,威知資訊(WebGenie)是利用文字探勘(TextMining)技術發展搜尋引擎產品的公司,利用人工智慧演算法,可達成目前搜尋引擎所缺乏的簡易人機互動模式,諸如關聯字提示、動態分類字提示等,算是較另類的搜尋引擎產品。\\n\\n搜尋關鍵詞提煉\\n\\n選擇搜尋關鍵詞的原則是,首先確定你所要達到的目標,在腦子裡要形成一個比較清晰概念,即我要找的到底是什麼?是資料性的文檔?還是某種產品或服務?然後再分析這些資訊都有些什麼共性,以及區彆於其他同類資訊的特性,最後從這些方向性的概念中提煉出此類資訊最具代表性的關鍵詞。如果這一步做好了,往往就能迅速的定位你要找的東西,而且多數時候你根本不需要用到其他更複雜的搜尋技巧。\\n\\n細化搜尋條件\\n\\n你給出的搜尋條件越具體,搜尋引擎返回的結果也會越精確。\\n\\n比方說你想查詢有關電腦冒險遊戲方麵的資料,輸入game是無濟於事的。computergame範圍就小一些,當然最好是敲入computeradventuregame,返回的結果會精確得多。\\n\\n此外一些功能詞彙和太常用的名詞,如對英文中的“and”、“how”、“what”、“web”、“homepage”和中文中的“的”、“地”、“和”等等搜尋引擎是不支援的。這些詞被稱為停用詞(StopWords)或過濾詞(FilterWords),在搜尋時這些詞都將被搜尋引擎忽略。\\n\\n用好搜尋邏輯命令\\n\\n搜尋引擎基本上都支援附加邏輯命令查詢,常用的是“ ”號和“-”號,或與之相對應的布爾(Boolean)邏輯命令AND、OR和NOT。用好這些命令符號可以大幅提高我們的搜尋精度。\\n\\n精確匹配搜尋\\n\\n除利用前麵提到的邏輯命令來縮小查詢範圍外,還可使用\\\"\\\"引號(注意為英文字元。雖然現在一些搜尋引擎已支援中文標點符號,但顧及到其他引擎,最好養成使用英文字元的習慣)來進行精確匹配查詢(也稱短語搜尋)。\\n\\n特殊搜尋命令\\n\\n標題搜尋\\n\\n多數搜尋引擎都支援針對網頁標題的搜尋,命令是“title:”,在進行標題搜尋時,前麵提到的邏輯符號和精確匹配原則同樣適用。\\n\\n網站搜尋\\n\\n此外我們還可以針對網站進行搜尋,命令是“site:”(Google)、“host:”(AltaVista)、“url:”(Infoseek)或“domain:”(HotBot)。\\n\\n鏈接搜尋\\n\\n在Google和AltaVista中,用戶均可通過“link:”命令來查詢某網站的外部導入鏈接(inboundlinks)。其他一些引擎也有同樣的功能,隻不過命令格式稍有區彆。你可以用這個命令來檢視是誰以及有多少網站與你做了鏈接。\\n\\nseoer\\n\\nSEO,中文意思是搜尋引擎優化。指通過瞭解各類搜尋引擎如何抓取互聯網頁麵,如何進行索引以及如何確定其對某一特定關鍵詞的搜尋結果排名等技術,來對網頁進行相關的優化,使其提高搜尋引擎排名。\\n\\n搜尋引擎註冊九大秘法\\n\\n1、所有網頁都被索引\\n\\n你的網頁被搜尋引擎索引的越多,網站被用戶訪問的機會就越多。多數搜尋引擎“拒絕”所遞交URL的第二級或第三級以下層次網頁的索引,如果你的網站有4-5級層次,spider就不帶回網站的所有網頁,解決的辦法之一就是做一個“通道頁”(hallwaypage),“通道頁”放置你網站的所有鏈接。\\n\\n下麵解釋一下搜尋引擎如何spider你的網站,假如你有一個網站—Chinesefood,並向搜尋引擎註冊了網站的首頁,首頁即為樹狀結構的根部,如果首頁包含兩個鏈接,分彆指向sichuan-food.htm和guangdong-food.htm,則這兩個網頁就是第二級,在sichuan-food.htm有鏈接指向chengdu-food.htm,則chengdu-food.htm為第三級,在chengdu-food.htm有鏈接指向special-food.htm,則special-food.htm為第四級,如此類推。\\n\\n第一級index.htm\\n\\n第二級sichuan-food.htm和guangdong-food.htm 第三級chengdu-food.htm\\n\\n第四級special-food.htm\\n\\n多數搜尋引擎“拒絕”索引第二級或第三級以下的層次,也就是說,第四級的所有網頁(對某些搜尋引擎包括第三級的所有網頁),將不能被搜尋引擎發現,除非你直接註冊這些網頁,但不建議直接註冊這些網頁,因為這樣將降低你的排名位置,並且容易超過搜尋引擎規定的每日註冊限製。這就是為什麼要專門製作一個“通道頁”的原因。\\n\\n2、“論資排輩”\\n\\n對於同一域名,某些搜尋引擎限製接收的網頁數,所以建議你在“通道頁”中按網頁的重要程度排序鏈接,而且每個“通道頁”中的鏈接數應控製在50個以內。\\n\\n3、耐心\\n\\n搜尋引擎需要1天到6周的時間,以便把你的網頁加入到其數據庫中。在註冊網站的首頁或“通道頁”後,對第二級和第三級的網頁,還需要多等待1到2周,並且隨著網頁級彆的降低,多數搜尋引擎對網頁的訪問優先權也降低,然而有趣的是,一旦搜尋引擎把低級彆的網頁加入其索引數據庫中,這些網頁排名位置常常比直接註冊高。\\n\\n4、考慮多個域名\\n\\n對於同一域名,很多搜尋引擎限製加入到其數據庫中的網頁數量,每個搜尋引擎限製數不一樣,一般地講,在400個左右,但也有例外。如果你的網站有很多的網頁,可以考慮申請不同的域名,以便在搜尋引擎中加進更多的網頁。\\n\\n5、避免CGI程式產生網頁\\n\\n大多數搜尋引擎拒絕索引由CGI程式產生的網頁,這種網頁的URL地址通常包括問號“?”和連接號“&”,這些符號的作用是用來分隔參數的。\\n\\n6、檢查你的網頁的有效性\\n\\n要經常檢查網頁在搜尋引擎中的情況,也許你的競爭對手排在了你的前麵,也許你的網頁莫明其妙地消失,你可利用某些網站提供的排名監測服務來進行監控,也可親自到搜尋引擎中查詢你的網站。\\n\\n7、經常更新\\n\\n為鼓勵網頁更新,搜尋引擎將清除長期冇有更新的網頁,所以,你應週期性地更新你的主頁內容,但對已在搜尋引擎排名很高的網頁來說,你應仔細考慮更新是否危機已有“地位”。\\n\\n8、重新註冊\\n\\n每次重新註冊都應有原因,或排名降低,或網頁更新,間隔時間可一週一次,或一月一次,但不能向目錄引擎(如Yahoo!)重新註冊。\\n\\n9、位置是最重要的\\n\\n把你的網頁加入到搜尋引擎數據庫並不困難,但多數人錯誤地認為網站加入到數據庫就萬事大吉了,你還得繼續非常重要的下一步,爭取你的網站排在搜尋引擎前十名到二十名。\\n\\n搜尋引擎註冊的過程\\n\\n搜尋引擎註冊通常有軟件自動註冊和人工註冊兩種方式。軟件自動註冊,即一次輸入註冊所需資料,然後由程式自動加註冊搜尋引擎,其特點是速度快,但準確度低,而且大部分小型搜尋引擎對網站增加訪問量幾乎冇有作用。在人工註冊之前,應該做好充分的準備,包括:關鍵詞、網站描述、網站名稱、URL、聯絡人資訊等。在進行人工註冊的準備和註冊過程中,下列幾方麵的問題需要給予足夠的關注。\\n\\n1.網頁標題和META標簽\\n\\n(1)網頁標題(TTTLE)。這裡說的標題是指網頁中的HTML。\\n\\n(2)META標簽。此標簽的重要作用就是為搜尋引擎的蜘蛛或機械手檢索網頁做準備,一些搜尋引擎就是根據源代碼中META標簽所設定的關鍵詞來檢索和排序的。\\n\\n2.網頁主體(BODY)。網頁主體是瀏覽器可以看到的全部內容,在HTML代碼中位於標簽之下,即網頁的全部內容。\\n\\n(1)統一資源定位(URL)。URL即通常所說的網址,因此可以構造一個含有關鍵詞的網址,並將這個網址提交給搜尋引擎。\\n\\n(2)構造關鍵詞。META標簽中的關鍵詞對搜尋引擎產生直接作用,一般來說,可以在兩類關鍵詞中選擇:一類是簡短、有力的,排列位置可以稍微靠前,但詞彙數量少:另一類是範圍較寬、數量較多的關鍵詞,排列順序可能稍後靠。\\n\\n(3)對網站的描述。需要描述的是自己的網站而不是公司,目的是為了讓訪問者對網站有進一步的瞭解,已決定是否繼續到你的網站獲取進一步的資訊。\\n\\n3.提交你的網站\\n\\n當上述準備工作就緒,就可以正式註冊了。註冊時進入搜尋引擎登錄頁麵,按照網站要求填寫相應內容提交即可。\\n\\n4.網站註冊後的跟蹤管理\\n\\n在向搜尋引擎提交登錄檔單之後,如果超過了搜尋引擎正常的更新週期,你的網站仍然冇有被收錄,應再一次註冊。\\n\\n搜尋引擎使用技巧\\n\\n1、簡單查詢\\n\\n在搜尋引擎中輸入關鍵詞,然後點擊“搜尋”就行了,係統很快會返回查詢結果,這是最簡單的查詢方法,使用方便,但是查詢的結果卻不準確,可能包含著許多無用的資訊。\\n\\n2、使用雙引號用(\\\"\\\")\\n\\n給要查詢的關鍵詞加上雙引號(半形,以下要加的其它符號同此),可以實現精確的查詢,這種方法要求查詢結果要精確匹配,不包括演變形式。例如在搜尋引擎的文字框中輸入“電傳”,它就會返回網頁中有“電傳”這個關鍵字的網址,而不會返回諸如“電話傳真”之類網頁。\\n\\n3、使用加號( )\\n\\n在關鍵詞的前麵使用加號,也就等於告訴搜尋引擎該單詞必須出現在搜尋結果中的網頁上,例如,在搜尋引擎中輸入“ 電腦 電話 傳真”就表示要查詢的內容必須要同時包含“電腦、電話、傳真”這三個關鍵詞。\\n\\n4、使用減號(-)\\n\\n在關鍵詞的前麵使用減號,也就意味著在查詢結果中不能出現該關鍵詞,例如,在搜尋引擎中輸入“電視台-中央電視台”,它就表示最後的查詢結果中一定不包含“中央電視台”。\\n\\n5、使用萬用字元(*和?)\\n\\n萬用字元包括星號(*)和問號(?),前者表示匹配的數量不受限製,後者匹配的字元數要受到限製,主要用在英文搜尋引擎中。例如輸入“computer*”,就可以找到“computer、computers、computerised、computerized”等單詞,而輸入“comp?ter”,則隻能找到“computer、compater、competer”等單詞。\\n\\n6、使用布爾檢索\\n\\n所謂布爾檢索,是指通過標準的布爾邏輯關係來表達關鍵詞與關鍵詞之間邏輯關係的一種查詢方法,這種查詢方法允許我們輸入多個關鍵詞,各個關鍵詞之間的關係可以用邏輯關係詞來表示。\\n\\nand,稱為邏輯“與”,用and進行連接,表示它所連接的兩個詞必須同時出現在查詢結果中,例如,輸入“computerandbook”,它要求查詢結果中必須同時包含computer和book。\\n\\nor,稱為邏輯“或”,它表示所連接的兩個關鍵詞中任意一個出現在查詢結果中就可以,例如,輸入“computerorbook”,就要求查詢結果中可以隻有computer,或隻有book,或同時包含computer和book。\\n\\nnot,稱為邏輯“非”,它表示所連接的兩個關鍵詞中應從第一個關鍵詞概念中排除第二個關鍵詞,例如輸入“automobilenotcar”,就要求查詢的結果中包含automobile(汽車),但同時不能包含car(小汽車)。\\n\\nnear,它表示兩個關鍵詞之間的詞距不能超過n個單詞。\\n\\n在實際的使用過程中,你可以將各種邏輯關係綜合運用,靈活搭配,以便進行更加複雜的查詢。\\n\\n7、使用括號\\n\\n當兩個關鍵詞用另外一種操作符連在一起,而你又想把它們列為一組時,就可以對這兩個詞加上圓括號。\\n\\n8、使用元詞檢索\\n\\n大多數搜尋引擎都支援“元詞”(metawords)功能,依據這類功能用戶把元詞放在關鍵詞的前麵,這樣就可以告訴搜尋引擎你想要檢索的內容具有哪些明確的特征。例如,你在搜尋引擎中輸入“title:清華大學”,就可以查到網頁標題中帶有清華大學的網頁。在鍵入的關鍵詞後加上“domainrg”,就可以查到所有以org為後綴的網站。\\n\\n其他元詞還包括:image:用於檢索圖片,link:用於檢索鏈接到某個選定網站的頁麵,URL:用於檢索地址中帶有某個關鍵詞的網頁。\\n\\n9、區分大小寫\\n\\n這是檢索英文資訊時要注意的一個問題,許多英文搜尋引擎可以讓用戶選擇是否要求區分關鍵詞的大小寫,這一功能對查詢專有名詞有很大的幫助,例如:Web專指萬維網或環球網,而web則表示蜘蛛網.\\n\\n\"

}

目錄
設置
設置
閱讀主題
字體風格
雅黑 宋體 楷書 卡通
字體風格
適中 偏大 超大
儲存設置
恢複默認
手機
手機閱讀
掃碼獲取鏈接,使用瀏覽器打開
書架同步,隨時隨地,手機閱讀
收藏
聽書
聽書
發聲
男聲 女生 逍遙 軟萌
語速
適中 超快
音量
適中
開始播放
推薦
反饋
章節報錯
當前章節
報錯內容
提交
加入收藏 < 上一章 章節列表 下一章 > 錯誤舉報