中文

超越相似搜索:面向生产RAG系统的统一数据层

信息检索 2026-05-06 v1 数据库

摘要

检索增强生成(RAG)系统已成为 grounding 大型语言模型于组织知识的标准架构。然而,生产部署始终暴露出干净原型性能与真实可靠性之间的差距。本文识别了该差距的三个根本原因:数据陈旧、租户数据泄露以及查询组合爆炸。所有三个问题都溯源于常规的分离系统数据层。我们提出并评估了一个构建于PostgreSQL的统一数据层,集成原生向量搜索(pgvector)和HNSW索引。对50,000个文档的受控基准测试显示,日期筛选查询延迟降低92%,租户范围查询延迟降低74%,零同步不一致,同时以93%更少的同步代码实现了完全消除跨租户数据泄露。我们另外讨论了推荐的混合tier架构。

关键词

引用

@article{arxiv.2605.03275,
  title  = {Beyond Similarity Search: A Unified Data Layer for Production RAG Systems},
  author = {Venkata Krishna Prasanth Budigi and Siri Chandana Sirigiri},
  journal= {arXiv preprint arXiv:2605.03275},
  year   = {2026}
}

备注

8 pages, 1 figure, 4 tables