跳到主要内容

关键词检索通道的执行流程

上一篇讲了向量检索通道,这篇来看关键词检索通道。两者结构类似,但关键词检索有自己的特点:ES 优先 + SQL fallback 的双路策略,以及一套动态打分机制。

KeywordRetrievalChannel.retrieve 源码

@Override
public RetrievalChannelResult retrieve(String subQuestion, ConversationExecutionPlan plan) {
// 调用 DocumentKnowledgeService 的关键词检索方法,topK 从配置中读取。
List<Document> documentList = documentKnowledgeService.keywordSearch(
documentRetrieveRequestFactory.build(subQuestion, plan, properties.getKeywordTopK())
);
// 返回通道结果,包含通道名称和检索到的文档列表。
return new RetrievalChannelResult(channelName(), documentList);
}

结构和向量通道一模一样,区别只是调的是 keywordSearch,topK 用的是 keywordTopK 配置。

keywordSearch 方法完整流程

@Override
public List<Document> keywordSearch(DocumentRetrieveRequest request) {
// 关键词检索同样要求问题、检索 query、文档范围和任务范围都有效。
if (!isSearchableRequest(request)) {
return List.of();
}

List<Long> documentIds = request.resolvedDocumentIds();
List<Long> taskIds = request.resolvedTaskIds();

// 文档描述信息用于给最终 Document 补充来源元数据。
Map<Long, KnowledgeDocumentDescriptor> descriptorMap = listDescriptorMap(documentIds);

// 统一解析结构化过滤条件,供 ES 分支和 SQL fallback 分支共用。
ResolvedMetadataScope resolvedScope = resolveMetadataScope(request);
if (resolvedScope.documentIds().isEmpty() || resolvedScope.taskIds().isEmpty()) {
return List.of();
}

// 构造一个带 resolved 范围的新请求,确保 ES 网关拿到的是最终过滤后的范围。
DocumentRetrieveRequest filteredRequest = new DocumentRetrieveRequest(
request.getQuestion(),
request.getRetrievalQuery(),
resolvedScope.documentIds().isEmpty() ? null : resolvedScope.documentIds().get(0),
resolvedScope.taskIds().isEmpty() ? null : resolvedScope.taskIds().get(0),
request.getTopK(),
resolvedScope.filters(),
request.getQueryContextHints()
);
filteredRequest.setDocumentIds(resolvedScope.documentIds());
filteredRequest.setTaskIds(resolvedScope.taskIds());

// 如果项目启用了 Elasticsearch 且对应网关可用,则优先使用 ES 关键词检索。
DocumentKeywordSearchGateway keywordSearchGateway = keywordSearchGatewayProvider.getIfAvailable();
if (Boolean.TRUE.equals(properties.getElasticsearch().getEnabled()) && keywordSearchGateway != null) {
return keywordSearchGateway.search(filteredRequest);
}

这里有一个关键的分支判断:ES 优先策略

如果满足两个条件:

  1. 配置中启用了 Elasticsearch(properties.getElasticsearch().getEnabled() == true
  2. ES 网关可用(keywordSearchGateway != null

就会优先使用 ES 进行关键词检索,否则降级到 SQL LIKE fallback。

付费内容提示

该文档的全部内容仅对「码力全开」项目实战&技术讲解 知识星球用户开放

加入星球,一次获得完整项目资料、全栈技术知识库和长期答疑服务。

100万+字全栈技术知识库深入讲解技术核心、数据库、中间件和分布式等内容
8套热门的实战项目持续更新的企业级项目覆盖高并发、微服务、数据中台 和 AI Agent 等方向
AI 技术知识大模型面试详解覆盖 AI 模型原理、Agent、RAG、MCP、Skills、Harness 等核心知识点
文档 + 视频两种讲解形式既能系统阅读,也能跟随视频理解核心业务

完整项目实战资料

每套项目均包含从 0 到 1 讲解文档核心业务讲解视频

从基础项目到复杂业务场景,项目资料会持续更新。

8 套项目
  • 01Nexus Agent AI 智能体
  • 02Nexus Agent Pro 完全版
  • 03黑马点评Plus
  • 04大麦
  • 05大麦Pro
  • 06大麦AI
  • 07流量切换
  • 08数据中台

加入后还能获得

进入星球后,即可享受上述所有服务,保证不会再有其他隐藏费用。

从学习、面试到项目启动,都可以继续获得支持。

  • 1 对 1 解答项目和技术问题都可以提问
  • 针对性补充没有讲清楚的内容会继续补充
  • 面试与简历指导梳理回答技巧和项目亮点
  • 中间件云环境项目依赖可以直接接入使用
  • 面试后复盘被问住的问题可以继续交流
  • 远程问题解决项目启动问题可协助排查
知识星球二维码

扫码进入知识星球

  1. 打开微信,扫描左侧二维码,加入「码力全开」项目实战&技术讲解 知识星球
  2. 查看星球使用指导,获取完整项目讲解资料索引
解锁全部付费内容
🎁优惠