Robots.txt
robots.txt(统一小写)是一种存放于网站根目录下的ASCII编码的文本文件,它通常告诉网络搜索引擎的漫游器(又称网络蜘蛛),此网站中的哪些内容是不应被搜索引擎的漫游器获取的,哪些是可以被漫游器获取的。因为一些系统中的URL是大小写敏感的,所以robots.txt的文件名应统一为小写。robots.txt应放置于网站的根目录下。如果想单独定义搜索引擎的漫游器访问子目录时的行为,那么可以将自定的设置合并到根目录下的robots.tx…
共 24 篇文章
robots.txt(统一小写)是一种存放于网站根目录下的ASCII编码的文本文件,它通常告诉网络搜索引擎的漫游器(又称网络蜘蛛),此网站中的哪些内容是不应被搜索引擎的漫游器获取的,哪些是可以被漫游器获取的。因为一些系统中的URL是大小写敏感的,所以robots.txt的文件名应统一为小写。robots.txt应放置于网站的根目录下。如果想单独定义搜索引擎的漫游器访问子目录时的行为,那么可以将自定的设置合并到根目录下的robots.tx…
Teoma(源自苏格兰盖尔语teòma,意为“专家”)是一款于2000年4月创立的互联网搜索引擎,由新泽西州罗格斯大学的阿波斯托洛斯·杰拉苏利斯(Apostolos Gerasoulis)教授及其同事开发。加利福尼亚大学圣塔芭芭拉分校的杨涛(Tao Yang)教授共同领导了该项目的技术研发工作。Teoma的研究起源于1998年的DiscoWeb项目,其核心成果发表在题为《DiscoWeb:将链接分析应用于网络搜索》(DiscoWeb: …
Brave Search 為Brave軟體公司推出的搜尋引擎,配合Brave瀏覽器使用。 歷史 2021年3月,Brave使用Tailcat,開始構建其搜索引擎,是於當年早些時候從德國公司的子公司Cliqz收購。Tailcat旨在提供搜索結果,無需記錄用戶活動或創建配置文件。 2021年6月,Brave Software宣佈即將推出Brave Search,允许用户自訂规则和过滤器,並將其应用于搜索查询。 參考資料
搜索引擎最优化策略分析师 (Search Engine Optimization Strategy Analyst,简称SEO分析师)是一项新兴信息技术职业,主要关注搜索引擎动态,修建网站,拓展网络营销渠道,网站内部优化,流量数据分析,策划外链执行方案,负责竞价推广。 SEO分析师需要精通商业搜索引擎相关知识与市场运作。了解认识各个SEO因素对排名的影响力。分析万维网各种网站模式结构目录。关注研究搜索引擎发展动向。通过编程,HTML,C…
搜索引擎()是一种信息检索系统,旨在协助搜索存储在计算机系统中的信息。搜索结果一般被称为“hits”,通常会以表单的形式列出。网络搜索引擎是最常见、公开的一种搜索引擎,其功能为搜索万维网上储存的信息。 工作方式 搜索引擎为一组项目提供了一个接口,使用户能够指定关于感兴趣的项目的标准,并让引擎找到匹配的项目,这些标准称为搜索查询。在文本搜索引擎的情况下,搜索查询通常表示为识别一个或多个文档可能包含的期望概念的一组单词。有多种样式的搜索查询…
Startpage為一荷蘭公司Startpage B.V.所推出的搜尋引擎服務,其前身為元搜尋引擎Ixquick,Startpage當時Ixquick旗下之服務,兩者於2016年改為合併並改為現名。Startpage以強調對使用者隱私的保護聞名。 Startpage后台使用Google搜索API,所以具有跟Google相同的搜索品質。但是其傳送到Google服务器的內容僅包含搜索关键字,Google不会获取到除此以外的头字段和cooki…
网络爬虫(),也叫網路蜘蛛(),是一种用来自动浏览万维网的网络机器人。其目的一般为编纂网络索引。 網路搜索引擎等站点通过爬蟲軟體更新自身的或其對其他網站的索引。網路爬蟲可以將自己所訪問的頁面保存下來,以便搜索引擎事後生成供用戶搜索。 爬蟲访问网站的过程会消耗目标系统资源。不少网络系统并不默许爬虫工作。因此在访问大量页面时,爬虫需要考虑到规划、负载,还需要讲“礼貌”。 不愿意被爬虫访问、被爬虫主人知晓的公开站点可以使用robots.txt…
Yandex(,)是一家俄罗斯互联网企业,旗下的搜索引擎曾在俄国内拥有逾60%的市场占有率,同时也提供其他互联网产品和服务。数据显示,Yandex是目前世界第五大搜索引擎:在2012年4月,平均每日的搜索量超过1.5亿次;5月份,每日访客(包括搜索以外的业务)超过2550万。公司的企业使命是为有着任何(明确的或含蓄的)问题的用户提供答案。 Yandex的主页Ya.ru是俄罗斯访问量最高的网址,同时也在白俄罗斯、哈萨克斯坦、乌克兰和土耳其…
{{Infobox website | name = Kayak | logo = Kayak Logo.svg | logo_size = 200px | type = 子公司 | language = 18 | foundation = | location = 美国康涅狄格州斯坦福德 | area_served = 全球 | founder = Steve Hafner Paul M. English | key_people =…
百度指数()是以百度众多网民检索行为数据为基础的数据分享平台。通过百度指数可以研究关键词搜索趋势、洞察网民兴趣和需求、监测舆情动向以及定位受众特征等,是中国互联网行业颇为重要的统计分析平台之一。百度指数取决于用户的主动检索行为记录,每一个用户在百度搜索引擎中的检索行为都是主动意愿的展示,每一次的检索行为都可能成为该消费者消费意愿的表达,百度指数的需求图谱正是基于语义挖掘技术向用户呈现关键词隐藏的关注焦点、消费欲望。 基本功能 百度指数的…
Rambler()是一个来自俄罗斯的搜索引擎,也是俄罗斯最大的门户网站之一。自2006年起,该公司归属于Prof-Media与Rambler传媒集团管辖。1996年,迪米特里·克里尤科夫与谢尔盖·里萨科夫和弗拉基米尔·萨莫伊洛夫一行人共同创建了这一门户。 历史 Rambler创办于1996年。2005年,Rambler公开上市,第二年即被Prof-Media收购。 截止到2013年7月13日,,Rambler在全俄所有网站中的用户受欢迎…
维罗妮卡()是一个基于Gopher协议的搜索引擎系统,由内华达大学里诺分校的史蒂芬·福斯特(Steven Foster)和弗雷德·巴里(Fred Barrie)于1992年开发创建。 维罗妮卡持续更新的数据库收录了成千上万台Gopher服务器上几乎所有的菜单名录。维罗尼卡的数据库可以从最主要的Gopher菜单中搜索。 虽然这个名字的正式解释是"Very Easy Rodent-Oriented Net-wide Index to Com…
搜索结果页(,SERP)是指搜索引擎对某个搜索请求反馈的结果页面。根据搜索类型的不同,可以有图片、视频、新闻资讯、博客等不同的结果页。现在随着搜索引擎技术的进一步发展,搜索结果页包含的信息也越来越丰富,某些搜索引擎的搜索结果页可能会同时包含几种不同类型的搜索结果,各大搜索引擎都在致力于提供更丰富和方便的搜索结果页。搜索结果列表中的页面通常已按搜索引擎的算法(比如Google的PageRank)排序,越靠前的页面相关性最越高。因为搜索引擎…
微軟學術搜索()是微軟亞洲研究院開發的線上免費學術搜索引擎。它為研究員、學生、圖書館員和其他用戶查找學術論文、國際會議、權威期刊、作者和學術興趣圈提供了更加智能、新穎的獲取方式。微軟學術搜索比前一次發佈的學術搜索的數據庫更小,但在內容和軟件功能方面更加優化。與傳統的頁面級搜索引擎比較,微軟學術搜索使用對象級別的信息查詢方式,它可以幫助用戶找到一個學術領域內的頂尖科學家、會議和期刊;獲得一個學術興趣圈興起與發展的詳細信息;使用戶準確找到感…
搜尋引擎列表是一個綜合性的搜尋引擎目錄,涵蓋了各種類型的搜尋技術和平台。搜尋引擎是現代資訊檢索的核心工具,用於在大量數據中快速找到相關資訊。 本列表主要分為兩大類別:網頁搜尋引擎和桌面搜尋引擎。網頁搜尋引擎通過網際網路提供服務,搜尋範圍涵蓋全球網頁內容;桌面搜尋引擎則專注於本地電腦檔案和資料的檢索。 以Web為基礎的搜尋引擎 其他 Brave Search Alexa Internet ElgooG Exalead Firmily Ga…
Google搜尋趨勢(),舊稱Google搜索解析(),是Google开发的一款服务,该索引显示了与不同语言和地区在Google的搜索查询的频率。 计算方法 搜索兴趣由 Google 搜索兴趣计算,意思是关键字的查询次数/Google搜索查询总数。然后通过将关键字的所有兴趣数据除以该日期范围内的最高兴趣点,对结果进行索引并标准化为范围从 0 到 100 的相对值。在区域分析方面,它是每个国家/地区内搜索兴趣的标准化指示。例如,如果澳大利…
中国搜索是中国搜索信息科技股份有限公司创办运营的搜索引擎,由即刻搜索、盘古搜索合并而来。 历史 2010年6月20日,由人民日报社和人民网合资组建的人民搜索网络股份公司负责运营的搜索引擎人民搜索正式上线测试。2011年6月20日,人民搜索更名为即刻搜索(www.jike.com)。2010年9月25日,由邓亚萍担任人民搜索网络股份公司总经理。2012年6月19日全新改版,使用全新商标,突出字母“i”与“即刻”两个字。网站旗下产品包括“新…
Shodan是一个包含数十亿个公开IP地址的数据库以及搜索引擎,人們可以通過該數據庫搜索到接入互联网的设备,例如路由器、服务器以及物联网设备。Shodan於2009年由约翰·马瑟利发布。 参考资料
Swoogle是一个针对互联网上的语义网文档、术语以及数据的搜索引擎。Swoogle利用一种搜索器系统来发现资源描述框架(RDF)文档以及内置有RDF内容的HTML文档。Swoogle会针对这些文档及其组成部分(如术语和三元组)进行推理,并在其数据库之中记录和索引具有实际意义的,关于这些文档及其组成部分的元数据。 参见 本体 (信息科学) 和 OWL 参考资料 [http://ebiquity.umbc.edu/paper/html/i…
中国政府公开信息整合服务平台(),是由中国国家图书馆等单位共同建设的中国政府信息公开领域的第一个垂直搜索引擎。 简介 2007年4月,中华人民共和国国务院总理温家宝签署第492号国务院令,公布《中华人民共和国政府信息公开条例》,自2008年5月1日起施行。该条例第十六条规定:“各级人民政府应当在国家档案馆、公共图书馆设置政府信息查阅场所,并配备相应的设施、设备,为公民、法人或者其他组织获取政府信息提供便利。……行政机关应当及时向国家档案…