应用介绍
数据库的 LIKE 查询撑到十万条就开始慢,再想要分词、高亮、按分类统计数量,基本只能靠硬写。Apache Solr 就是专门解决这类问题的搜索服务器:把文档喂给它建索引,之后用 HTTP 请求就能做全文检索、过滤和分面统计,结果几毫秒返回。
它建在 Lucene 之上,数据量大了可以分片、加副本做分布式部署,节点挂掉也不影响查询。自带的管理后台能直接在浏览器里试查询、看核心状态和 JVM 指标,调试搜索效果不用写一行代码。
全文检索:支持分词、相关度排序、高亮、拼写纠错和同义词,搜索框里该有的体验基本都有。
分面与过滤:按字段统计各取值的命中数,做商品筛选、分类计数这类页面不用额外查一遍。
向量与地理搜索:除了关键词,也能做向量相似度检索和基于坐标的地理范围查询。
REST 接口:索引和查询都走 HTTP,返回 JSON 或 XML,任何语言都能直接接入。
分布式与容错:集合可以分片并保留多个副本,索引复制、故障转移由集群自己处理。
管理后台与监控:Web 管理界面能执行查询、查看核心和集合状态,还暴露 JMX 指标方便接入监控。
它建在 Lucene 之上,数据量大了可以分片、加副本做分布式部署,节点挂掉也不影响查询。自带的管理后台能直接在浏览器里试查询、看核心状态和 JVM 指标,调试搜索效果不用写一行代码。
软件功能
全文检索:支持分词、相关度排序、高亮、拼写纠错和同义词,搜索框里该有的体验基本都有。
分面与过滤:按字段统计各取值的命中数,做商品筛选、分类计数这类页面不用额外查一遍。
向量与地理搜索:除了关键词,也能做向量相似度检索和基于坐标的地理范围查询。
REST 接口:索引和查询都走 HTTP,返回 JSON 或 XML,任何语言都能直接接入。
分布式与容错:集合可以分片并保留多个副本,索引复制、故障转移由集群自己处理。
管理后台与监控:Web 管理界面能执行查询、查看核心和集合状态,还暴露 JMX 指标方便接入监控。
标签:搜索引擎


