📋 编辑总结
LightRAG 是由香港大学(HKU)数据智能实验室(HKUDS)开发的开源轻量级检索增强生成(RAG)框架,基于知识图谱实现高效的双层级文档检索,MIT 协议可商用自托管;最新 v1.5.6(2026-08-06)新增原生 PostgreSQL 图存储 PGTableGraphStorage(摆脱 Apache AGE 依赖,PostgreSQL 一库覆盖全部存储类型),并修复上传文件名路径遍历安全漏洞。 定价:免费开源(MIT)。编辑评分:⭐ 4.5。

LightRAG是什么?

简单说,LightRAG就是一个帮你快速搭建文档问答系统的开源工具。想象一下,你需要让AI能回答"根据这份合同/手册/报告,某个问题该怎么处理"——这类需求在过去需要不少技术门槛,但LightRAG把它变得更简单了。

它由香港大学(HKU)数据智能实验室(HKUDS)团队开发,专注于轻量级、高效这两个点,并有 EMNLP 2025 论文支撑。2026年迭代明显提速:5月合并多模态 RAG 系统 RAG-Anything,8月初发布 v1.5.6,新增原生 PostgreSQL 图存储(PGTableGraphStorage)等能力,在开源 RAG 圈子里属于活跃项目。

核心功能

1. 多文档/多模态格式支持

PDF、Word、TXT、图片、表格、公式等都能直接处理,不用自己先做格式转换。v1.5.5 起内置 DOCX 解析器新增 Smart Heading 智能标题识别:即使文档缺少规范的 Word 大纲级别,也能自动恢复标题结构,让按标题分块更贴合文档真实语义,减少错误切块。据社区反馈,处理过程比较顺畅,对中文文档的支持也做得不错。

2. 多向量数据库集成

Milvus、Qdrant、Chroma、Neo4j、PostgreSQL、MongoDB、OpenSearch 等主流存储都能接入,你可以根据已有技术栈或项目规模选合适的数据库,不被绑定。

3. 原生 PostgreSQL 图存储(v1.5.6 新增)

v1.5.6(2026-08-06 发布)引入 PGTableGraphStorage:基于原生 PostgreSQL 表构建图存储,不再依赖 Apache AGE 扩展,部署更简单、图存储性能更高、占用更小,并将取代基于 AGE 的 PGGraphStorage 成为 PostgreSQL 的首选方案。升级后 PostgreSQL 一个数据库即可覆盖四种存储类型,成为 LightRAG 的全能后端数据库。

4. 高效语义检索

这是RAG的核心能力——能把用户的自然语言问题和文档内容匹配上。实际使用中,检索速度和准确度在同级别开源方案里属于主流水平。

5. 灵活的分块与解析策略

v1.5.x 引入四种可选分块策略(Fix/Recursive/Vector/Paragraph),并支持按 EXTRACT、QUERY、KEYWORDS、VLM 四类角色分别配置不同 LLM;解析环节可接入 MinerU、Docling 等外部服务。

6. 插件化架构与 WebUI

插件化设计便于按需扩展;自带 WebUI,支持文档插入、查询与知识图谱可视化。

7. 流式输出支持

回答能一个字一个字蹦出来,不用等完整结果生成完,体验上更接近和真人对话。

版本/套餐对比

LightRAG 为纯开源项目(MIT),无付费商业版:

版本定位适合场景
社区版(MIT)免费开源、可商用个人项目、原型验证、中小规模应用

如需官方技术支持或商业保障,可关注 HKUDS 生态内的相关服务,具体以官方发布为准。

值不值得用?

优点:

  • 完全开源免费(MIT),可商用
  • 部署确实轻量,上手速度快
  • 多文档格式和多向量库的支持灵活性不错
  • 插件化设计给二次开发留了空间
  • 社区活跃(HKUDS 持续维护,迭代快)

缺点:

  • 文档和教程相对商业方案偏少,遇到问题需要多靠社区
  • 企业级功能比如权限管理这些,需要自己动手实现
  • 大规模部署时需要手动调优,不是开箱即用
  • GUI比较基础,界面功能不算丰富

我的看法: 如果你预算有限、想快速做个原型或者中小规模部署,LightRAG是个值得考虑的选择。但如果你是大企业、对稳定性和支持要求很高,或者图省事,那可能还是商业方案更稳妥。

使用建议

  • 从小规模开始验证:先拿少量文档测试流程,确认效果再扩大规模
  • 选合适的向量数据库:根据数据量和对性能的要求,Milvus适合大规模、Chroma适合轻量场景
  • PostgreSQL 用户升级到 v1.5.6 优先用 PGTableGraphStorage:原生表图存储摆脱 Apache AGE 依赖,性能更高、占用更小,一个库搞定全部存储
  • DOCX 文档多用 Smart Heading:解析时开启智能标题识别,能明显改善分块质量
  • 关注社区动态:官方文档不全的问题可以靠看社区的讨论和案例来弥补
  • 提前规划企业功能:如果要用在生产环境,权限管理、日志审计这些最好一开始就想清楚怎么做

适合谁用?

推荐:

  • 个人开发者或小团队做原型
  • 需要快速验证RAG方案可行性的技术选型阶段
  • 中小规模(几千到几万篇文档量级)的知识库场景

可考虑:

  • 对多模态检索有需求的团队(已合并 RAG-Anything,支持图文表格公式)
  • 已有一定技术实力、愿意投入时间做二次开发的公司

不推荐:

  • 大规模企业级应用、对SLA要求严格的场景
  • 完全没有技术团队、指望开箱即用不用操心的
  • 需要完整权限管理和审计功能的(目前需要自己实现)