从0到1部署LaunchStack:Docker Compose与PostgreSQL+pgvector配置教程
从0到1部署LaunchStackDocker Compose与PostgreSQLpgvector配置教程【免费下载链接】LaunchStackAI-powered StartUp Accelerator Engine built with Next.js, LangChain, PostgreSQL pgvector. Upload, organize, and chat with documents. Includes predictive missing-document detection, role-based workflows, and page-level insight extraction.项目地址: https://gitcode.com/gh_mirrors/pd/LaunchStackLaunchStack是一款基于Next.js、LangChain、PostgreSQL和pgvector构建的AI驱动创业加速引擎支持文档上传、组织和智能对话具备预测性缺失文档检测、基于角色的工作流和页面级洞察提取功能。本教程将详细介绍如何使用Docker Compose快速部署LaunchStack并正确配置PostgreSQL与pgvector扩展以实现高效的语义检索。准备工作环境与依赖检查在开始部署前请确保您的系统满足以下要求Docker Engine 20.10 和 Docker Compose v2Git 版本控制工具至少4GB可用内存推荐8GB以上以支持AI服务网络连接用于拉取Docker镜像和项目代码首先克隆项目仓库git clone https://gitcode.com/gh_mirrors/pd/LaunchStack cd LaunchStack项目的Docker配置文件位于根目录主要包括docker-compose.yml- 主部署配置docker-compose.ocr.yml- OCR服务扩展配置docker-compose.test.yml- 测试环境配置核心架构解析Docker Compose服务组成LaunchStack的Docker Compose配置包含多个协同工作的服务其中核心组件包括LaunchStack服务架构示意图展示各组件协同工作流程关键服务组件说明PostgreSQL pgvector(db服务)镜像pgvector/pgvector:pg16已预安装pgvector扩展端口映射5433:5432避免与本地PostgreSQL冲突数据持久化通过postgres_data卷保存数据库文件初始化脚本./docker/init-db.sql自动启用pgvector扩展应用服务(app服务)基于Next.js构建的主应用依赖数据库、迁移服务、Sidecar服务等端口3000Web访问端口数据库迁移(migrate服务)自动执行数据库模式迁移依赖PostgreSQL服务健康检查通过文件存储(seaweedfs服务)轻量级分布式文件系统用于存储上传的文档和媒体文件AI辅助服务(sidecar服务)提供嵌入、重新排序和转录等AI功能健康检查通过/health端点监控服务状态快速部署使用Docker Compose一键启动基础部署不含OCR功能执行以下命令启动核心服务docker compose up -d该命令会启动PostgreSQL数据库含pgvectorNext.js应用服务器SeaweedFS文件存储Inngest工作流引擎必要的辅助服务完整部署含OCR功能如需启用文档OCR处理能力支持DOCX、PPTX等格式添加ocr配置文件docker compose -f docker-compose.yml -f docker-compose.ocr.yml up -d完整部署会额外启动docling-serve文档解析服务ocr-workerOCR处理工作节点ocr-routerOCR请求路由服务验证部署状态检查所有服务是否正常运行docker compose ps正常情况下所有服务应显示为running或healthy状态。PostgreSQL与pgvector配置详解数据库连接配置应用通过环境变量DATABASE_URL连接PostgreSQL默认配置为postgresql://postgres:passworddb:5432/pdr_ai_v2如需自定义数据库凭据创建.env文件设置POSTGRES_PASSWORDyour_secure_password DATABASE_URLpostgresql://postgres:your_secure_passworddb:5432/pdr_ai_v2pgvector扩展验证pgvector扩展在数据库初始化时自动启用可通过以下步骤验证进入PostgreSQL容器docker exec -it pdr_ai_v2-postgres psql -U postgres -d pdr_ai_v2在PostgreSQL终端执行SELECT * FROM pg_extension WHERE extname vector;若返回结果包含vector扩展则表示配置成功。向量索引优化项目已预设高效的向量索引定义在以下文件中apps/web/drizzle/0009_embeddings_hnsw_indexes.sql该文件创建了HNSW索引使用默认参数m16, ef_construction64平衡检索速度和精度-- 示例索引定义来自0009_embeddings_hnsw_indexes.sql CREATE INDEX IF NOT EXISTS document_embeddings_hnsw_idx ON document_embeddings USING hnsw (embedding vector_cosine_ops);环境变量配置解锁全部功能LaunchStack需要一些关键环境变量才能启用完整功能主要配置在docker-compose.yml的app服务部分LaunchStack环境变量配置示意图展示关键AI服务参数必要环境变量变量名说明示例值OPENAI_API_KEYOpenAI API密钥sk-xxxxCLERK_SECRET_KEYClerk身份验证密钥sk_test_xxxxNEXT_PUBLIC_CLERK_PUBLISHABLE_KEYClerk客户端密钥pk_test_xxxx配置方法创建项目根目录下的.env文件添加所需变量# AI服务配置 OPENAI_API_KEYsk-your_openai_key CHAT_MODELgpt-4o-mini EMBEDDING_MODELtext-embedding-3-small # 身份验证配置 CLERK_SECRET_KEYsk_test_your_clerk_key NEXT_PUBLIC_CLERK_PUBLISHABLE_KEYpk_test_your_clerk_key # 存储配置 S3_ACCESS_KEYyour_custom_access_key S3_SECRET_KEYyour_custom_secret_key修改后需重启服务使配置生效docker compose down docker compose up -d访问与验证确认部署成功访问Web界面在浏览器中访问以下地址http://localhost:3000您应该能看到LaunchStack的登录界面。首次使用需注册账号系统会自动创建管理员账户。验证核心功能文档上传测试导航至Documents页面上传一个PDF或DOCX文件确认文件状态变为Processed语义搜索测试在搜索框输入与上传文档相关的关键词验证系统返回相关文档片段向量检索验证 查看数据库中的嵌入向量docker exec -it pdr_ai_v2-postgres psql -U postgres -d pdr_ai_v2 -c SELECT id, embedding FROM document_embeddings LIMIT 1;常见问题解决数据库连接失败若应用无法连接PostgreSQL检查db服务是否健康运行docker compose logs db数据库凭据是否正确检查.env文件中的DATABASE_URL网络连通性使用docker network inspect launchstack_default确认网络配置pgvector扩展未加载若向量功能不工作执行以下命令手动启用扩展docker exec -it pdr_ai_v2-postgres psql -U postgres -d pdr_ai_v2 -c CREATE EXTENSION vector;内存不足问题若服务频繁崩溃可能是内存不足增加Docker可用内存推荐至少8GB禁用非必要服务如OCR相关组件进阶操作服务管理与维护查看服务日志查看特定服务日志# 查看应用日志 docker compose logs -f app # 查看数据库日志 docker compose logs -f db数据库备份执行以下命令备份PostgreSQL数据./scripts/backup-db.sh备份文件将保存至./backups目录。版本更新更新LaunchStack至最新版本git pull docker compose down docker compose up -d --build总结通过Docker Compose部署LaunchStack是快速搭建AI驱动文档管理系统的理想方式。本教程涵盖了从环境准备到完整部署的全过程重点介绍了PostgreSQL与pgvector的配置要点。现在您已拥有一个功能完备的创业加速引擎可用于文档管理、智能检索和团队协作。如需深入了解项目架构可参考官方文档docs/Architechture/Overall.md。对于生产环境部署建议查看详细部署指南docs/deployment.md。【免费下载链接】LaunchStackAI-powered StartUp Accelerator Engine built with Next.js, LangChain, PostgreSQL pgvector. Upload, organize, and chat with documents. Includes predictive missing-document detection, role-based workflows, and page-level insight extraction.项目地址: https://gitcode.com/gh_mirrors/pd/LaunchStack创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

蚂蚁开源操作视频数据集,让机器人学习人类动作的门槛大幅降低

蚂蚁开源操作视频数据集,让机器人学习人类动作的门槛大幅降低

这项由蚂蚁数字科技、蚂蚁集团联合浙江大学、香港大学、香港科技大学(广州)、新加坡国立大学、北京智源人工智能研究院、中国科学院大学、香港科技大学及西安交通大学共同完成的研究,于2026年7月以arXiv预印本形式公开发布,论文编…

2026/7/31 23:00:13 阅读更多 →
VQEngine环境映射技术:从HDRI加载到实时渲染

VQEngine环境映射技术:从HDRI加载到实时渲染

VQEngine环境映射技术:从HDRI加载到实时渲染 【免费下载链接】VQEngine Multi-threaded DirectX12 renderer w/ HDR, PBR & Multi-monitor support 项目地址: https://gitcode.com/gh_mirrors/vq/VQEngine VQEngine是一款支持HDR、PBR和多显示器的多线程…

2026/7/31 23:00:13 阅读更多 →
Python实现垃圾邮件分类系统:从理论到实践

Python实现垃圾邮件分类系统:从理论到实践

1. 项目概述"垃圾邮件分类系统"是计算机科学与人工智能领域一个经典且实用的毕业设计选题。作为一名带过数十个毕业设计的导师,我认为这个选题之所以经久不衰,主要因为它完美融合了理论深度与实践价值——既需要理解机器学习的基础算法&#x…

2026/7/31 22:59:13 阅读更多 →

最新新闻

如何3分钟掌握Zotero-OCR:免费PDF文字识别终极教程

如何3分钟掌握Zotero-OCR:免费PDF文字识别终极教程

如何3分钟掌握Zotero-OCR:免费PDF文字识别终极教程 【免费下载链接】zotero-ocr Zotero Plugin for OCR 项目地址: https://gitcode.com/gh_mirrors/zo/zotero-ocr 还在为扫描版PDF无法搜索而烦恼吗?Zotero-OCR这款免费开源插件能彻底改变你的文献…

2026/7/31 23:45:29 阅读更多 →
ng-ant-admin开发实战:从零构建企业级数据表格与表单组件

ng-ant-admin开发实战:从零构建企业级数据表格与表单组件

ng-ant-admin开发实战:从零构建企业级数据表格与表单组件 【免费下载链接】ng-ant-admin Angular22 nestjs 中后台管理系统模板,移动端适配 Mobile adaptation ng-zorro ant-design-pro front-end framework 项目地址: https://gitcode.com/gh_mirror…

2026/7/31 23:45:29 阅读更多 →
IEA-15-240-RWT:15MW海上风机开源模型的终极使用指南

IEA-15-240-RWT:15MW海上风机开源模型的终极使用指南

IEA-15-240-RWT:15MW海上风机开源模型的终极使用指南 【免费下载链接】IEA-15-240-RWT 15MW reference wind turbine repository developed in conjunction with IEA Wind 项目地址: https://gitcode.com/gh_mirrors/ie/IEA-15-240-RWT IEA-15-240-RWT是由国…

2026/7/31 23:45:28 阅读更多 →
如何快速部署F5-TTS语音合成系统:5个实用技巧解决网络限制难题

如何快速部署F5-TTS语音合成系统:5个实用技巧解决网络限制难题

如何快速部署F5-TTS语音合成系统:5个实用技巧解决网络限制难题 【免费下载链接】F5-TTS Official code for "F5-TTS: A Fairytaler that Fakes Fluent and Faithful Speech with Flow Matching" 项目地址: https://gitcode.com/gh_mirrors/f5/F5-TTS …

2026/7/31 23:44:28 阅读更多 →
高校校园外卖系统开发:Python+Django+MySQL技术实践

高校校园外卖系统开发:Python+Django+MySQL技术实践

1. 项目概述:高校校园外卖点餐系统的技术实现校园外卖点餐系统是当前高校信息化建设的重要组成部分。这个基于PythonMySQL的解决方案,主要解决校园内师生订餐效率低、配送管理混乱的问题。系统采用B/S架构,前端使用HTMLCSSJavaScript&#xf…

2026/7/31 23:44:28 阅读更多 →
企业架构设计中的核心:企业模型的价值与实践

企业架构设计中的核心:企业模型的价值与实践

1. 企业模型在企业架构设计中的核心价值第一次接触企业架构设计时,我被各种方法论和框架搞得晕头转向。直到一位资深架构师告诉我:"把企业模型当作你的导航仪,其他都是地图上的标注。"这句话让我恍然大悟。企业模型确实就像X光机&a…

2026/7/31 23:44:28 阅读更多 →

日新闻

物理复制比逻辑复制好在哪?数据库复制原理详解

物理复制比逻辑复制好在哪?数据库复制原理详解

数据库复制是把主库数据同步到备库的机制,分为逻辑复制和物理复制两种。逻辑复制传输的是 SQL 语句或行变更事件,物理复制传输的是存储引擎底层的物理日志。阿里云 PolarDB(云原生数据库)采用物理复制,在同步延迟、数据…

2026/7/31 0:00:34 阅读更多 →
BilibiliDown:3分钟学会B站视频下载的终极指南

BilibiliDown:3分钟学会B站视频下载的终极指南

BilibiliDown:3分钟学会B站视频下载的终极指南 【免费下载链接】BilibiliDown (GUI-多平台支持) B站 哔哩哔哩 视频下载器。支持稍后再看、收藏夹、UP主视频批量下载|Bilibili Video Downloader 😳 项目地址: https://gitcode.com/gh_mirrors/bi/Bilib…

2026/7/31 0:00:34 阅读更多 →
有哪些游戏数据AI平台?游戏行业Data+AI融合方案盘点

有哪些游戏数据AI平台?游戏行业Data+AI融合方案盘点

当前,游戏行业的“DataAI融合”已从概念验证进入价值落地阶段。根据IDC 2025年数据,中国AI游戏云市场规模已达18.6亿元;同时,游戏研发环节AI渗透率高达86%,生成式AI内容普及率超过50%。面对庞大的市场,游戏…

2026/7/31 0:00:34 阅读更多 →

周新闻

深度学习道路桥梁裂缝检测系统 道路桥梁裂缝检测数据集 道路桥梁病害识别检测数据集

深度学习道路桥梁裂缝检测系统 道路桥梁裂缝检测数据集 道路桥梁病害识别检测数据集

深度学习道路桥梁裂缝检测系统 数据集6000张 完整源码已标注数据集训练好的模型环境配置教程程序运行说明文档,可以直接使用!系统支持图片、视频、摄像头等多种方式检测裂缝,功能强大实用。 1数据集6000张 8各类别

2026/7/31 1:03:03 阅读更多 →
深度学习YOLO模型如何训练 PUBG 绝地求生目标检测数据集

深度学习YOLO模型如何训练 PUBG 绝地求生目标检测数据集

pubg数据集 精选原图1.42万数据 1.49万标签 无任何重复、算法增强或冗余图像! pubg绝地求生目标检测数据集 1分类:e_body,14905个标签,txt格式 共计14244张图,99%为640*640尺寸图像 适合yolo目标检测、AI训练关键词&am…

2026/7/29 14:34:28 阅读更多 →
Apex英雄目标检测数据集 深度学习框架YOLO如何训练APEX数据集

Apex英雄目标检测数据集 深度学习框架YOLO如何训练APEX数据集

Apex检测数据集数据集详情检测类别: allies enemy tag图片总量:7247张训练集:5139张验证集:1425张测试集:683张标注状态:全部已标注,即拿即用数据格式:支持YOLO格式及其他格式&#…

2026/7/31 4:19:39 阅读更多 →

月新闻