LightRAG 知识图谱 RAG 部署指南:3 步搭建自己的知识库问答系统
LightRAG 知识图谱 RAG 部署指南3 步搭建自己的知识库问答系统【免费下载链接】LightRAG[EMNLP2025] LightRAG: Simple and Fast Retrieval-Augmented Generation项目地址: https://gitcode.com/GitHub_Trending/li/LightRAGLightRAG 是一个开源的 RAGRetrieval-Augmented Generation检索增强生成系统它把上传的文档拆成知识图谱再结合向量检索来回答问题回答比纯文本检索更准、更有上下文。这篇指南带新手走最短路径拉代码、改配置、起容器三步在本地跑起一个能用的知识问答系统跟着做完你就拥有自己的知识库和 Web 管理界面。部署前先自检机器和软件够不够 开始之前对照下面这张表确认环境检查项要求系统Windows、macOS、Linux 均可软件已安装 Docker 和 Docker Compose硬件内存 ≥ 8GBSSD 体验更佳网络能访问网络用于拉取镜像和模型两条命令确认 Docker 环境可用docker --version docker compose version都能输出版本号就可以动手了。五分钟完成 LightRAG 部署 第 1 步拉取项目代码git clone https://gitcode.com/GitHub_Trending/li/LightRAG cd LightRAG把仓库克隆到本地后面的命令都在 LightRAG 目录里执行。第 2 步写配置cp env.example .env复制出一份 .env这是所有配置的入口。打开它至少改掉这几项HOST0.0.0.0 PORT9621 LIGHTRAG_API_KEYyour_secure_api_key_here LLM_BINDINGollama LLM_BINDING_HOSThttp://host.docker.internal:11434 LLM_MODELqwen3:8b EMBEDDING_BINDINGollama EMBEDDING_BINDING_HOSThttp://host.docker.internal:11434 EMBEDDING_MODELbge-m3HOST/PORT 是服务监听地址LIGHTRAG_API_KEY 是 Web 界面的登录密钥用强密码LLM_BINDING 和 EMBEDDING_BINDING 指定回答问题和计算向量分别用哪个模型。不想手改的话项目也提供了交互式配置向导可看 交互配置向导。第 3 步启动服务docker compose up -d后台启动容器首次运行要拉镜像稍等几分钟。接着确认服务活着docker compose ps全部显示 Up 后浏览器打开http://localhost:9621输入刚才设的 API Key 登录。启动后的第一次实战 文档页先喂文档图 1文档管理界面列出了每份文档的解析状态、块数和更新时间点 Upload 上传文档或点 Scan 扫描输入目录。系统自动解析、分块、提取实体和关系状态列走到 Completed 才算入库。数据落在本地data/目录想清空重来就用右上角的 Clear。建议先传一两份自己熟悉的文档方便后面验证问答效果。知识图谱页点开看看它记住了什么图 2知识图谱界面节点是实体连线是实体间的关系右侧展示节点详情点任意节点右侧会显示它的类型、摘要描述和相邻实体。左侧菜单可切换 Force Atlas、Circular 等布局算法。建议挑一个文档里的主角实体点开来确认它关联到了预期的概念这是图谱质量的第一道体检。检索页问第一个问题图 3检索问答界面输入问题右侧调节查询参数回答附带引用来源输入问题点 Send。默认查询模式是 mix它同时走实体检索、主题检索和原文向量检索答案最全面。右侧面板可以调 Top K Results、各部分 token 上限、历史轮数等参数。建议先用默认参数问一个你刚上传文档里的事实性问题看看答案和引用是否符合预期。挑一套适合你的配置 ⚙️场景 A纯本地 Ollama离线、零花费适合谁不想花钱、数据要留在本机。改哪几个配置LLM_BINDINGollama、EMBEDDING_BINDINGollama两个*_BINDING_HOST都填http://host.docker.internal:11434LLM_MODEL、EMBEDDING_MODEL填本地模型名如qwen3:8b、bge-m3另外设OLLAMA_LLM_NUM_CTX32768。效果如何完全离线、无调用费本地模型要自己先拉好提取质量取决于模型大小。场景 BOpenAI 云端效果优先适合谁有 OpenAI Key、图省事要质量。改哪几个配置LLM_BINDINGopenai、LLM_MODELgpt-5.4-mini、EMBEDDING_BINDINGopenai、EMBEDDING_MODELtext-embedding-3-largeAPI Key 填LLM_BINDING_API_KEY。效果如何配置最少、效果最好按 token 计费文档量大时成本上升。场景 C混合云端 LLM 本地嵌入适合谁既要回答质量又要控制成本。改哪几个配置LLM 三项按场景 B 走云端EMBEDDING_BINDING和EMBEDDING_MODEL保留 Ollama 本地配置。效果如何向量计算不花钱最终回答质量由云端模型兜底。三个场景里嵌入模型只能选一次——索引和查询必须用同一个模型见后面坑点 3。看看它内部怎么跑 流程拆开看很简单。文档进来后解析 → 切成文本块 → LLM 从每个块里提取实体和关系拼成知识图谱同时文本块、实体、关系各自算出向量存进向量库。所以一份文档最终留下两样东西一张关系图和一堆向量。查询时先从问题里提取关键词然后在图谱里做两级检索——低层找具体实体高层找主题模式——再补一路原文向量检索把三路结果合在一起交给 LLM生成带引用的回答。图 4LightRAG 架构文档经 LLM 提取实体与关系建立索引查询走低层/高层双级检索这也是它比纯向量 RAG 多出来的价值跨文档的关系问题靠图谱连线找靠逐块向量找是找不全的。踩坑手册 ️Q服务起来了但浏览器打不开A依次查docker compose ps容器是否 Up、端口是否被占用、.env 里LIGHTRAG_API_KEY是否设置——没设密钥的 0.0.0.0 服务拒绝认证请求。日志看docker compose logs -f。Q容器里连不上本机 OllamaA容器内localhost指向容器自己。把LLM_BINDING_HOST和EMBEDDING_BINDING_HOST都写成http://host.docker.internal:11434先确认宿主机 Ollama 已启动且模型已拉取。Q换嵌入模型后检索全乱了A嵌入模型定下后不能再换换了等于全库失效需要清掉数据目录重建索引。第一次配EMBEDDING_MODEL前想清楚。Q文档处理卡在提取阶段、超时失败A多半是 LLM 太慢。调大LLM_TIMEOUT或限制输出长度例如OPENAI_LLM_MAX_TOKENS9000间歇性失败直接重试该文档即可。Q上传大文件被拒A上传上限默认 100MBMAX_UPLOAD_SIZE文档过大或格式不支持都会在日志里写明原因按需调整上限或拆分文档。Q回答质量不理想A先检查SUMMARY_LANGUAGE是否和文档语言一致中文文档建议设Chinese再试着在 .env 里配置RERANK_BINDING启用重排代价是每次查询多 1~2 秒。更多 API 与界面细节见 LightRAG 服务文档。接下来干什么先给知识图谱页多喂几份文档用 mix 模式把问答跑顺觉得答案排序不够准就配一个重排模型要对外开放服务前把 API Key 换成强密码并只绑定本机地址。【免费下载链接】LightRAG[EMNLP2025] LightRAG: Simple and Fast Retrieval-Augmented Generation项目地址: https://gitcode.com/GitHub_Trending/li/LightRAG创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

Beyond开源项目:渐进式架构演进,平滑实现单体到微服务的无痛迁移

Beyond开源项目:渐进式架构演进,平滑实现单体到微服务的无痛迁移

如果你在技术社区搜索“励志歌曲”,大概率会得到一堆与代码无关的歌单。但今天要聊的,是另一种“励志”——一个名为Beyond的开源项目,它如何用一套全新的架构思想,激励着开发者去超越单体应用的局限,构建更灵活、更强…

2026/8/24 1:56:29 阅读更多 →
List-Formatting完整指南:用JSON为SharePoint列表重新定义外观与行为,面向初学者快速上手

List-Formatting完整指南:用JSON为SharePoint列表重新定义外观与行为,面向初学者快速上手

List-Formatting完整指南:用JSON为SharePoint列表重新定义外观与行为,面向初学者快速上手 【免费下载链接】List-Formatting List Formatting Samples for use in SharePoint and Microsoft Lists 项目地址: https://gitcode.com/gh_mirrors/li/List-F…

2026/8/24 1:56:29 阅读更多 →
具身智能:从感知到行动的闭环,如何让机器人真正“能想会干”?

具身智能:从感知到行动的闭环,如何让机器人真正“能想会干”?

那天在展馆里,我站在一个正在执行“从杂乱桌面识别并抓取指定螺丝”任务的机械臂前,看了足足十分钟。它动作流畅,识别准确,从一堆形状、颜色相近的物件中精准地挑出了目标。旁边的工作人员告诉我,这背后是“具身智能”…

2026/8/24 1:56:29 阅读更多 →

最新新闻

AI智能体安全协同设计:可微分仿真与全栈优化实践

AI智能体安全协同设计:可微分仿真与全栈优化实践

1. 项目概述:当AI学会“思考”,我们如何为它设计“质检员”?最近在AI圈子里,一个概念火得不行,那就是“智能体”(Agentic AI)。这不再是过去那种你问一句、它答一句的聊天机器人,而是…

2026/8/24 6:43:20 阅读更多 →
SpecHop:基于连续推测机制加速多跳检索智能体的工程实践

SpecHop:基于连续推测机制加速多跳检索智能体的工程实践

1. 项目概述:为什么“连续推测”是检索智能体的下一个突破口最近在跟几个做RAG(检索增强生成)和智能体(Agent)的朋友聊天,大家普遍有个痛点:多跳检索(Multi-Hop Retrieval&#xff0…

2026/8/24 6:43:20 阅读更多 →
如何 5 分钟抓到抖音直播间的实时弹幕?抖音直播数据抓取实操

如何 5 分钟抓到抖音直播间的实时弹幕?抖音直播数据抓取实操

如何 5 分钟抓到抖音直播间的实时弹幕?抖音直播数据抓取实操 【免费下载链接】DouyinLiveWebFetcher 抖音直播间网页版的弹幕数据抓取(2025最新版本) 项目地址: https://gitcode.com/gh_mirrors/do/DouyinLiveWebFetcher DouyinLiveWe…

2026/8/24 6:43:20 阅读更多 →
如何快速上手MiroFish:用多智能体预测引擎推演未来走向的完整指南

如何快速上手MiroFish:用多智能体预测引擎推演未来走向的完整指南

如何快速上手MiroFish:用多智能体预测引擎推演未来走向的完整指南 【免费下载链接】MiroFish A Simple and Universal Swarm Intelligence Engine, Predicting Anything. 简洁通用的群体智能引擎,预测万物 项目地址: https://gitcode.com/GitHub_Trend…

2026/8/24 6:43:20 阅读更多 →
CyberStrikeAI:把自然语言变成受控安全执行的AI原生测试框架,内置90+工具配方与13个测试角色

CyberStrikeAI:把自然语言变成受控安全执行的AI原生测试框架,内置90+工具配方与13个测试角色

CyberStrikeAI:把自然语言变成受控安全执行的AI原生测试框架,内置90工具配方与13个测试角色 【免费下载链接】CyberStrikeAI The system of action for AI-native cybersecurity—where intent becomes governed execution, evidence becomes operationa…

2026/8/24 6:43:20 阅读更多 →
智能体模型生产评估:超越基准测试的RAMP框架实战指南

智能体模型生产评估:超越基准测试的RAMP框架实战指南

1. 项目概述:为什么生产系统中的智能体模型评估不能只靠基准测试在智能体模型(Agentic Models)如火如荼地进入生产系统的今天,一个普遍的误区正在悄然蔓延:许多团队认为,只要模型在离线基准测试&#xff08…

2026/8/24 6:42:20 阅读更多 →

日新闻

前端内容安全与依赖审计实践

前端内容安全与依赖审计实践

前端内容安全与依赖审计实践 前端安全依赖分层防护。没有任何单一配置能替代输出编码、权限校验和依赖更新。 把不可信内容当作数据 默认使用框架的转义能力;确需渲染 HTML 时,先在服务端或可信的客户端库中进行白名单过滤。避免把用户输入直接赋给 inne…

2026/8/24 1:08:15 阅读更多 →
Windows登录密码存储机制全解析:从哈希算法到安全加固实战

Windows登录密码存储机制全解析:从哈希算法到安全加固实战

1. 项目概述:Windows登录密码的“黑匣子”每次你按下CtrlAltDel,输入密码,然后看到那个熟悉的桌面,这背后发生了一系列复杂而精密的操作。作为一名长期与Windows系统打交道的从业者,我经常被问到:“我的密码…

2026/8/24 1:08:15 阅读更多 →
AI面试系统安全挑战与解决方案

AI面试系统安全挑战与解决方案

1. 项目概述:AI面试系统的安全挑战去年参与某跨国企业AI面试系统部署时,遇到一个典型案例:候选人在视频面试中无意提到竞争对手产品名称,系统竟自动将该信息关联到企业知识库并生成竞品分析报告。这个看似"智能"的功能&…

2026/8/24 1:08:15 阅读更多 →

周新闻

[光学原理与应用-521]:对光的错误理解与纠偏

[光学原理与应用-521]:对光的错误理解与纠偏

首先光是一种能量的载体和形态,宏观上观察到的光是由无数个微观的光量子组成的,每个光子在产生的瞬间,其在真空的空间中以确定不变的速度沿着一个初始的方向一直向前,在微观层面,每个光量子的运动轨迹是以波函数所展现…

2026/8/24 0:06:02 阅读更多 →
SIP通话转接原理与REFER方法实战解析

SIP通话转接原理与REFER方法实战解析

1. 通话转接不是“挂断再拨号”,而是SIP会话的动态重定向你有没有遇到过这样的场景:客服坐席A正在和客户通电话,突然需要把这通对话无缝转给专家坐席B,客户完全感知不到中间的断连——既没听到忙音,也没被要求重新拨号…

2026/8/24 0:20:20 阅读更多 →
Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

1. 为什么选择Kolla-ansible来部署单节点OpenStack?如果你正在寻找一种能把OpenStack从“概念”快速变成“可用的实验环境”的方法,那么Kolla-ansible几乎是当前最主流、最省心的选择。我见过太多人卡在手动编译依赖、配置服务、处理版本冲突的泥潭里&am…

2026/8/24 0:14:11 阅读更多 →

月新闻

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南 【免费下载链接】BaiduNetdiskPlugin-macOS For macOS.百度网盘 破解SVIP、下载速度限制~ 项目地址: https://gitcode.com/gh_mirrors/ba/BaiduNetdiskPlugin-macOS 还在为百度网盘macOS版的龟速下…

2026/8/23 18:47:06 阅读更多 →
终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换 【免费下载链接】ncmdump 项目地址: https://gitcode.com/gh_mirrors/ncmd/ncmdump 还在为网易云音乐下载的NCM格式文件无法在其他播放器播放而烦恼吗?ncmdump解密工具帮你轻松解决这个困…

2026/8/23 12:10:44 阅读更多 →
HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

AgentCard 智能体卡片:为英语学习 App 打造桌面级学习助手适用平台:HarmonyOS 7.0 (API 26 Beta)一、引言 HarmonyOS 7.0(API 26 Beta)新增了 AgentCard 智能体卡片能力,这是继 HMAF(鸿蒙智能体框架&#x…

2026/8/22 3:22:48 阅读更多 →