LightRAG 是由香港大学(HKU)数据智能实验室(HKUDS)开发的开源轻量级检索增强生成(RAG)框架,基于知识图谱实现高效的双层级文档检索,MIT 协议可商用自托管;最新 v1.5.6(2026-08-06)新增原生 PostgreSQL 图存储 PGTableGraphStorage(摆脱 Apache AGE 依赖,PostgreSQL 一库覆盖全部存储类型),并修复上传文件名路径遍历安全漏洞。 定价:免费开源(MIT)。编辑评分:⭐ 4.5。
LightRAG是什么?
简单说,LightRAG就是一个帮你快速搭建文档问答系统的开源工具。想象一下,你需要让AI能回答"根据这份合同/手册/报告,某个问题该怎么处理"——这类需求在过去需要不少技术门槛,但LightRAG把它变得更简单了。
它由香港大学(HKU)数据智能实验室(HKUDS)团队开发,专注于轻量级、高效这两个点,并有 EMNLP 2025 论文支撑。2026年迭代明显提速:5月合并多模态 RAG 系统 RAG-Anything,8月初发布 v1.5.6,新增原生 PostgreSQL 图存储(PGTableGraphStorage)等能力,在开源 RAG 圈子里属于活跃项目。
核心功能
1. 多文档/多模态格式支持
PDF、Word、TXT、图片、表格、公式等都能直接处理,不用自己先做格式转换。v1.5.5 起内置 DOCX 解析器新增 Smart Heading 智能标题识别:即使文档缺少规范的 Word 大纲级别,也能自动恢复标题结构,让按标题分块更贴合文档真实语义,减少错误切块。据社区反馈,处理过程比较顺畅,对中文文档的支持也做得不错。
2. 多向量数据库集成
Milvus、Qdrant、Chroma、Neo4j、PostgreSQL、MongoDB、OpenSearch 等主流存储都能接入,你可以根据已有技术栈或项目规模选合适的数据库,不被绑定。
3. 原生 PostgreSQL 图存储(v1.5.6 新增)
v1.5.6(2026-08-06 发布)引入 PGTableGraphStorage:基于原生 PostgreSQL 表构建图存储,不再依赖 Apache AGE 扩展,部署更简单、图存储性能更高、占用更小,并将取代基于 AGE 的 PGGraphStorage 成为 PostgreSQL 的首选方案。升级后 PostgreSQL 一个数据库即可覆盖四种存储类型,成为 LightRAG 的全能后端数据库。
4. 高效语义检索
这是RAG的核心能力——能把用户的自然语言问题和文档内容匹配上。实际使用中,检索速度和准确度在同级别开源方案里属于主流水平。
5. 灵活的分块与解析策略
v1.5.x 引入四种可选分块策略(Fix/Recursive/Vector/Paragraph),并支持按 EXTRACT、QUERY、KEYWORDS、VLM 四类角色分别配置不同 LLM;解析环节可接入 MinerU、Docling 等外部服务。
6. 插件化架构与 WebUI
插件化设计便于按需扩展;自带 WebUI,支持文档插入、查询与知识图谱可视化。
7. 流式输出支持
回答能一个字一个字蹦出来,不用等完整结果生成完,体验上更接近和真人对话。
版本/套餐对比
LightRAG 为纯开源项目(MIT),无付费商业版:
| 版本 | 定位 | 适合场景 |
|---|---|---|
| 社区版(MIT) | 免费开源、可商用 | 个人项目、原型验证、中小规模应用 |
如需官方技术支持或商业保障,可关注 HKUDS 生态内的相关服务,具体以官方发布为准。
值不值得用?
优点:
- 完全开源免费(MIT),可商用
- 部署确实轻量,上手速度快
- 多文档格式和多向量库的支持灵活性不错
- 插件化设计给二次开发留了空间
- 社区活跃(HKUDS 持续维护,迭代快)
缺点:
- 文档和教程相对商业方案偏少,遇到问题需要多靠社区
- 企业级功能比如权限管理这些,需要自己动手实现
- 大规模部署时需要手动调优,不是开箱即用
- GUI比较基础,界面功能不算丰富
我的看法: 如果你预算有限、想快速做个原型或者中小规模部署,LightRAG是个值得考虑的选择。但如果你是大企业、对稳定性和支持要求很高,或者图省事,那可能还是商业方案更稳妥。
使用建议
- 从小规模开始验证:先拿少量文档测试流程,确认效果再扩大规模
- 选合适的向量数据库:根据数据量和对性能的要求,Milvus适合大规模、Chroma适合轻量场景
- PostgreSQL 用户升级到 v1.5.6 优先用 PGTableGraphStorage:原生表图存储摆脱 Apache AGE 依赖,性能更高、占用更小,一个库搞定全部存储
- DOCX 文档多用 Smart Heading:解析时开启智能标题识别,能明显改善分块质量
- 关注社区动态:官方文档不全的问题可以靠看社区的讨论和案例来弥补
- 提前规划企业功能:如果要用在生产环境,权限管理、日志审计这些最好一开始就想清楚怎么做
适合谁用?
推荐:
- 个人开发者或小团队做原型
- 需要快速验证RAG方案可行性的技术选型阶段
- 中小规模(几千到几万篇文档量级)的知识库场景
可考虑:
- 对多模态检索有需求的团队(已合并 RAG-Anything,支持图文表格公式)
- 已有一定技术实力、愿意投入时间做二次开发的公司
不推荐:
- 大规模企业级应用、对SLA要求严格的场景
- 完全没有技术团队、指望开箱即用不用操心的
- 需要完整权限管理和审计功能的(目前需要自己实现)