可检索性

可检索性()是一个与信息在信息系统(特别是搜索引擎或信息检索系统)中被查找或检索的难易程度相关的术语。

若一份文档(或信息对象)能被大量查询通过搜索引擎检索到,且在检索结果中排名足够靠前、使用户能够接触到该文档,则该文档具有较高的可检索性。反之,若能检索到该文档的查询很少,或文档虽被检索到但排名过低而难以被用户发现,则该文档的可检索性较低。

可检索性可被视为可发现性的一个方面。

可检索性的应用包括检测搜索引擎偏见、衡量算法偏见、评估搜索技术的影响力、调优信息检索系统,以及评价语料集合中文档的质量。

可检索性也是检索增强生成(RAG)流程中的关键要素——RAG是一种使大语言模型(LLM)能够检索并整合新信息的技术。当人工智能需要从私有语料库或任何未经训练的数据源中选择信息时,都会用到RAG。AI智能体的网页浏览应用同样高度依赖网站内容的可检索性。

参见

  • 信息检索
  • 数据挖掘
  • 搜索引擎优化
  • 可发现性
  • 检索增强生成

参考文献
*
*

评论 (0)

  • 还没有评论,来抢沙发吧。