检索系统

Lucene 倒排索引深度实战:从 FST 词典、Block-Max WAND 剪枝到 BM25 相关性与 Doc Values 列存的工程全解

拆开 Lucene 索引文件与查询执行路径:FST 词典为何优于 HashMap、PForDelta 如何压缩倒排表、Block-Max WAND 如何在不全量打分的前提下保证 top-K 精确、BM25 的词频饱和与长度归一化机制、Doc Values 列存与 segment merge 的写放大本质,并给出稀疏检索与向量检索融合的实战结论。