RAG(检索增强生成)
v1.0.2
io.clawhub.ivangdavila/rag
设计、调优并调试检索增强生成(RAG)管道:分块、嵌入、混合检索、重排序与有据可依的回答。当系统召回了错误的段落、漏检已索引的文档、给不出引用,或在优质上下文上产生幻觉;当需要选择向量库、嵌入模型、分块尺寸或重排序器;当更换模型后相似度分数骤然塌陷;当元数据过滤把结果集清空;当回答忽略了位于上下文中段的事实;当追问检索到了错误内容;当索引 PDF、扫描件、表格、代码或转录稿;当问题涉及 GDPR 删除、租户隔离或来自索引文档的提示注入;当需要压低单次查询成本或 p95 延迟时使用。覆盖重建索引迁移、语料新鲜度、评测集,以及智能体式检索与图检索。不适用于分块器内部实现(rag-chunking)、打分细则(rag-evaluation)或 LangChain API(langchain)。