检索增强生成的瓶颈通常不在生成侧,而在召回侧。我们对比了三种混合检索策略:BM25 稀疏召回、向量稠密召回、以及二者的倒数排序融合(RRF)。在 1.2 万条内部语料的评测集上,RRF 融合把 Top-5 命中率从单路向量检索的 61% 提升到 78%,而纯 BM25 只有 54%。分块策略的影响同样显著:固定 512 token 切分会让跨段落的论证断裂,改为按标题层级切分后再做 128 token 的重叠窗口,命中率再涨 6 个百分点。重排序(rerank)是第二阶段的杠杆,用交叉编码器对 Top-50 重新打分,能把 Top-3 精度推到 85% 以上,代价是单次查询增加约 180ms。