Spring AI(12) :ChatPDF-实现ChatPDF应用
本章代码已分享至Gitee:https://gitee.com/lengcz/ai-study.git文章目录ChatPDF 介绍什么是 ChatPDFChatPDF 的核心工作原理一个简单的技术栈示例ChatPDF 的应用场景如何实现chatpdf呢分析准备工作(文件上传下载向量写入)PDF处理如何配置QuestionAnswerAdvisor依赖配置 RAG Advisor对话和检索日志分析ChatPDF 介绍什么是 ChatPDFChatPDF 是一种基于大型语言模型如 ChatGPT构建的智能文档交互应用。它的核心功能是允许用户像与人对话一样与 PDF、Word、TXT 等格式的文档进行问答交流。用户上传文档后系统会提取并理解文档内容然后用户可以用自然语言提问ChatPDF 会从文档中找出相关信息并生成清晰、准确的回答。简单来说ChatPDF 让静态文档“活”了起来变成了一个可以随时咨询的“知识专家”。ChatPDF 的核心工作原理ChatPDF 的实现通常包含以下几个关键步骤文档解析与文本提取首先应用需要解析上传的 PDF 文件提取出其中的纯文本、表格和图片中的文字信息。常用的工具有 PyPDF2、pdfplumber、Tika 或专门的 OCR 服务。文本分割与向量化由于大语言模型有上下文长度限制不能一次性处理整本书。因此需要将提取的长文本分割成语义连贯的“块”Chunks。然后使用嵌入模型如 OpenAI 的text-embedding-ada-002将这些文本块转换为高维向量Embeddings并存入向量数据库。语义检索RAG当用户提出一个问题时系统会先将问题也转换为向量然后在向量数据库中搜索与问题向量最相似的文本块。这个过程称为“检索增强生成”Retrieval-Augmented Generation, RAG它能确保回答严格基于文档内容减少模型“幻觉”。提示工程与答案生成将检索到的相关文本块和用户问题一起组合成一个精心设计的提示Prompt发送给大语言模型如 GPT-4。模型基于这些上下文信息生成一个连贯、准确的答案。交互界面最后需要一个友好的前端界面如 Web 应用供用户上传文档和进行对话。一个简单的技术栈示例要快速搭建一个 ChatPDF 应用可以参考以下技术组合后端框架FastAPIPython文档解析PyPDF2 或 pdfplumber文本分割与向量化LangChain提供便捷的文本分割器和多种嵌入模型接口向量数据库ChromaDB轻量级易于集成或 Pinecone云服务大语言模型 APIOpenAI GPT 系列、 Anthropic Claude 或开源模型通过 Ollama 本地部署前端Streamlit快速构建原型或 Next.js ReactChatPDF 的应用场景学术研究快速阅读论文询问研究方法、核心结论。法律与合同解析冗长的合同条款快速定位关键责任与权利。企业知识库将公司手册、产品文档转化为可对话的智能助手。个人学习与电子书、学习资料互动加深理解。如何实现chatpdf呢分析根据前面的内容我们知道需要实现chatpdf功能首先需要个人文档管理功能文件上传导入向量数据库文件下载AI对话准备工作(文件上传下载向量写入)实现基础的非对话部分的准备工作实现上传下载写入向量数据库等基础代码和接口。文件的上传和下载以及与chatId的关系importorg.springframework.core.io.Resource;publicinterfaceFileRepository{/** * 保存文件还要记录chatId与文件的映射关系 * param chatId 会话id * param resource 文件 * return 上传成功返回true否则返回false */booleansave(StringchatId,Resourceresource);/** * 根据chatId获取文件 * param chatId 会话id * return 找到的文件 */ResourcegetFile(StringchatId);}importjakarta.annotation.PostConstruct;importjakarta.annotation.PreDestroy;importlombok.RequiredArgsConstructor;importlombok.extern.slf4j.Slf4j;importorg.springframework.ai.vectorstore.SimpleVectorStore;importorg.springframework.ai.vectorstore.VectorStore;importorg.springframework.core.io.FileSystemResource;importorg.springframework.core.io.Resource;importorg.springframework.stereotype.Component;importjava.io.*;importjava.nio.file.Files;importjava.time.LocalDateTime;importjava.util.Objects;importjava.util.Properties;Slf4jComponentRequiredArgsConstructorpublicclassLocalPdfFileRepositoryimplementsFileRepository{privatefinalVectorStorevectorStore;// 会话id与文件名的对应关系方便查询会话历史时重新加载文件privatefinalPropertieschatFilesnewProperties();Overridepublicbooleansave(StringchatId,Resourceresource){// 2. 保存到本地磁盘Stringfilenameresource.getFilename();FiletargetnewFile(Objects.requireNonNull(filename));if(!target.exists()){try{Files.copy(resource.getInputStream(),target.toPath());}catch(IOExceptione){log.error(Failed to save PDF resource.,e);returnfalse;}}// 3. 保存映射关系chatFiles.put(chatId,filename);returntrue;}OverridepublicResourcegetFile(StringchatId){returnnewFileSystemResource(chatFiles.getProperty(chatId));}PostConstruct//启动时从磁盘加载向量数据privatevoidinit(){// 加载持久化的 chatId 与文件名的映射FileSystemResourcepdfResourcenewFileSystemResource(chat-pdf.properties);if(pdfResource.exists()){try{chatFiles.load(newBufferedReader(newInputStreamReader(pdfResource.getInputStream())));}catch(IOExceptione){thrownewRuntimeException(e);}}// 加载向量存储数据FileSystemResourcevectorResourcenewFileSystemResource(chat-pdf.json);if(vectorResource.exists()){SimpleVectorStoresimpleVectorStore(SimpleVectorStore)vectorStore;simpleVectorStore.load(vectorResource);}}PreDestroy//停机时持久化privatevoidpersistent(){try{// 保存映射关系chatFiles.store(newFileWriter(chat-pdf.properties),LocalDateTime.now().toString());// 保存向量存储SimpleVectorStoresimpleVectorStore(SimpleVectorStore)vectorStore;simpleVectorStore.save(newFile(chat-pdf.json));}catch(IOExceptione){thrownewRuntimeException(e);}}}api接口importcom.lengcz.ai.entity.vo.Result;importcom.lengcz.ai.repository.ChatHistoryRepository;importcom.lengcz.ai.repository.FileRepository;importlombok.RequiredArgsConstructor;importlombok.extern.slf4j.Slf4j;importorg.springframework.ai.chat.client.ChatClient;importorg.springframework.ai.document.Document;importorg.springframework.ai.reader.ExtractedTextFormatter;importorg.springframework.ai.reader.pdf.PagePdfDocumentReader;importorg.springframework.ai.reader.pdf.config.PdfDocumentReaderConfig;importorg.springframework.ai.vectorstore.VectorStore;importorg.springframework.core.io.Resource;importorg.springframework.http.HttpHeaders;importorg.springframework.http.MediaType;importorg.springframework.http.ResponseEntity;importorg.springframework.web.bind.annotation.*;importorg.springframework.web.multipart.MultipartFile;importreactor.core.publisher.Flux;importjava.io.IOException;importjava.net.URLEncoder;importjava.nio.charset.StandardCharsets;importjava.util.List;importjava.util.Objects;importstaticorg.springframework.ai.chat.client.advisor.AbstractChatMemoryAdvisor.CHAT_MEMORY_CONVERSATION_ID_KEY;importstaticorg.springframework.ai.chat.client.advisor.vectorstore.QuestionAnswerAdvisor.FILTER_EXPRESSION;RestControllerRequestMapping(/ai/pdf)RequiredArgsConstructorSlf4jpublicclassPdfController{privatefinalFileRepositoryfileRepository;privatefinalChatHistoryRepositorychatHistoryRepository;privatefinalVectorStorevectorStore;privatefinalChatClientpdfChatClient;/** * 上传 PDF 文件并绑定到指定的会话 ID * * param chatId 会话 ID * param multipartFile 上传的文件 * return 操作结果 */PostMapping(/upload/{chatId})publicResultuploadFile(PathVariableStringchatId,RequestParam(file)MultipartFilemultipartFile){// 1. 检查文件是否为空if(multipartFile.isEmpty()){returnResult.fail(上传文件不能为空);}// 2. 校验文件是否为 PDF扩展名 MIME 类型StringoriginalFilenamemultipartFile.getOriginalFilename();StringcontentTypemultipartFile.getContentType();if(!isPdfFile(originalFilename,contentType)){returnResult.fail(只允许上传 PDF 格式的文件);}try{booleansavedfileRepository.save(chatId,multipartFile.getResource());if(saved){log.info(文件上传成功: chatId{}, fileName{},chatId,originalFilename);}else{log.error(文件保存失败: chatId{},chatId);returnResult.fail(文件保存失败请稍后重试);}this.writeToVectorStore(multipartFile.getResource());returnResult.ok();}catch(Exceptione){log.error(上传文件发生异常,e);returnResult.fail(上传异常: e.getMessage());}}/** * 根据会话 ID 下载对应的 PDF 文件 */GetMapping(/file/{chatId})publicResponseEntityResourcedownload(PathVariable(chatId)StringchatId)throwsIOException{// 1. 读取文件ResourceresourcefileRepository.getFile(chatId);if(resourcenull||!resource.exists()){returnResponseEntity.notFound().build();}// 2. 文件名编码写入响应头StringfilenameURLEncoder.encode(Objects.requireNonNull(resource.getFilename()),StandardCharsets.UTF_8.name());// // 3. 返回文件使用通用二进制流避免浏览器直接打开// return ResponseEntity.ok()// .contentType(MediaType.APPLICATION_OCTET_STREAM)// .header(HttpHeaders.CONTENT_DISPOSITION, attachment; filename\ filename \)// .body(resource);returnResponseEntity.ok().header(HttpHeaders.CONTENT_TYPE,application/pdf).header(HttpHeaders.CONTENT_DISPOSITION,inline; filename\filename\).body(resource);}// ----- 辅助方法校验文件是否为 PDF -----privatebooleanisPdfFile(Stringfilename,StringcontentType){// 检查扩展名忽略大小写if(filenamenull||!filename.toLowerCase().endsWith(.pdf)){returnfalse;}// 检查 MIME 类型允许常见值if(contentTypenull){returnfalse;}returncontentType.equals(MediaType.APPLICATION_PDF_VALUE)||contentType.equals(application/x-pdf)||contentType.equals(application/pdf);}privatevoidwriteToVectorStore(Resourceresource){// 1 usage// 1. 创建PDF的读取器PagePdfDocumentReaderreadernewPagePdfDocumentReader(resource,// 文件源PdfDocumentReaderConfig.builder().withPageExtractedTextFormatter(ExtractedTextFormatter.defaults()).withPagesPerDocument(1)// 每1页PDF作为一个Document.build());// 2. 读取PDF文档拆分为DocumentListDocumentdocumentsreader.read();// 3. 写入向量库vectorStore.add(documents);}}importlombok.AllArgsConstructor;importlombok.Data;importlombok.NoArgsConstructor;DataNoArgsConstructorAllArgsConstructorpublicclassResult{privateIntegerok;privateStringmsg;publicstaticResultok(){returnnewResult(1,ok);}publicstaticResultfail(Stringmsg){returnnewResult(0,msg);}}PDF处理如下图为chatPDF的业务流程逻辑流程比较冗长但是实际上spring ai已经帮我们完成了流程简化。spring ai已经将向量模型和向量库以及问题线管片段帮我们简化了。其通过advisor 的封装实现了QuestionAnswerAdvisor。如何配置QuestionAnswerAdvisor依赖dependencygroupIdorg.springframework.ai/groupIdartifactIdspring-ai-advisors-vector-store/artifactId/dependency配置 RAG Advisor配置pdfChatClient 的QuestionAnswerAdvisorBeanpublicChatClientpdfChatClient(OpenAiChatModelmodel,ChatMemorychatMemory,VectorStorevectorStore){returnChatClient.builder(model).defaultSystem(请根据上下文回答问题遇到上下文没有的问题不要随意编造。).defaultAdvisors(newSimpleLoggerAdvisor(),newMessageChatMemoryAdvisor(chatMemory)//配置会话记忆Advisor,newSimpleLoggerAdvisor(),newQuestionAnswerAdvisor(vectorStore,SearchRequest.builder().similarityThreshold(0.6)//温度.topK(2)//头部几条记录.build())).build();}对话和检索编写对话检索接口RestControllerRequestMapping(/ai/pdf)RequiredArgsConstructorSlf4jpublicclassPdfController{privatefinalFileRepositoryfileRepository;privatefinalChatHistoryRepositorychatHistoryRepository;privatefinalVectorStorevectorStore;privatefinalChatClientpdfChatClient;RequestMapping(value/chat,producestext/html;charsetutf-8;)publicFluxStringchat(Stringprompt,StringchatId){ResourcefilefileRepository.getFile(chatId);if(!file.exists()){thrownewRuntimeException(会话文件不存在!);}//1.保存会话idchatHistoryRepository.save(pdf,chatId);//2.请求模型returnpdfChatClient.prompt().user(prompt).advisors(a-a.param(CHAT_MEMORY_CONVERSATION_ID_KEY,chatId)).advisors(a-a.param(FILTER_EXPRESSION,file_name file.getFilename())).stream().content();//stream() 表示流式输出}}打开前端页面测试前端资源已提交至Gitee日志分析从日志中我们可以看出它的输入词是要搜索的内容 预设置的提示词和替换关键词然后question_answer_context 是通过ChatOptions的userParams设置进去的。查看QuestionAnswerAdvisor 的源代码可以看到原来它的实现过程和实现逻辑是对向量搜索documents结果拼接以及再次交给大模型进行内容组织处理从而完成思考过程。

相关新闻

LlamaIndex结构化输出实战:从RAG到智能体工作流的数据自动化

LlamaIndex结构化输出实战:从RAG到智能体工作流的数据自动化

1. 从“大海捞针”到“按图索骥”:为什么我们需要结构化输出?如果你用过早期的RAG(检索增强生成)系统,或者尝试过直接向大语言模型(LLM)提问,你大概率经历过这种“抓狂”时刻&#x…

2026/9/23 12:33:41 阅读更多 →
MCP协议:AI Agent的TCP/IP时刻,从单机智能到网络智能

MCP协议:AI Agent的TCP/IP时刻,从单机智能到网络智能

1. 从“单机智能”到“网络智能”:为什么我们需要MCP? 最近在折腾AI Agent开发的朋友,可能都听过一个词:MCP。它被一些人称为“AI Agent的TCP/IP时刻”,这个类比听起来很宏大,甚至有点唬人。我第一次听到时…

2026/9/23 23:43:46 阅读更多 →
【AVDTP】规范精讲[8-4]: 流状态机全生命周期控制:从就绪启动到暂停关闭全拆解

【AVDTP】规范精讲[8-4]: 流状态机全生命周期控制:从就绪启动到暂停关闭全拆解

上一篇我们讲透了流配置的三条核心信令,完成了参数对齐和端点绑定。但配置完成只是流的第一步,就像车辆组装调试完毕,还停在车库里,既没有打火待命,也没有上路行驶。真正驱动一条音频流完成从就绪到播放、从暂停到销毁…

2026/9/23 23:43:48 阅读更多 →

最新新闻

排列技术:解决心理内耗的高效方法

排列技术:解决心理内耗的高效方法

1. 理解"内耗"的本质与表现生活中我们常遇到这样的状态:明明没做什么体力劳动,却感觉精疲力尽;面对选择时反复纠结无法行动;脑海中不断上演自我否定的对话...这些都是典型的内耗表现。从心理学角度看,内耗是…

2026/9/23 23:44:01 阅读更多 →
Apache Doris Web 管理控制台(ui)开发指南:从环境搭建到构建部署

Apache Doris Web 管理控制台(ui)开发指南:从环境搭建到构建部署

Apache Doris Web 管理控制台(ui)开发指南:从环境搭建到构建部署 【免费下载链接】doris Apache Doris is an easy-to-use, high performance and unified analytics database. 项目地址: https://gitcode.com/gh_mirrors/dori/doris …

2026/9/23 23:44:01 阅读更多 →
dom-to-image 完整使用指南:用 JavaScript 把任意 DOM 节点渲染成 SVG/PNG/JPEG 图片

dom-to-image 完整使用指南:用 JavaScript 把任意 DOM 节点渲染成 SVG/PNG/JPEG 图片

前端 【免费下载链接】dom-to-image Generates an image from a DOM node using HTML5 canvas 项目地址: https://gitcode.com/gh_mirrors/do/dom-to-image 点击查看 免费下载 本指南以仓库根目录的 README.md 为主体,结合 src/dom-to-image.js 源码与 …

2026/9/23 23:44:01 阅读更多 →
游戏美术本质:视觉决策系统与交互翻译

游戏美术本质:视觉决策系统与交互翻译

1. 游戏美术到底是什么?——不是画图,而是用视觉语言讲清楚“玩家该往哪走、该信什么、该怕什么”很多人第一次听说“游戏美术”这个词,下意识反应是:“哦,就是画游戏里那些角色和场景的吧?”——这就像说“…

2026/9/23 23:44:01 阅读更多 →
Anki-Android 模块化架构中的 `:anki-common`:打破循环依赖的共享层设计详解

Anki-Android 模块化架构中的 `:anki-common`:打破循环依赖的共享层设计详解

移动开发教育 【免费下载链接】Anki-Android AnkiDroid: Anki flashcards on Android. Your secret trick to achieve superhuman information retention. 项目地址: https://gitcode.com/gh_mirrors/an/Anki-Android 点击查看 免费下载 导读 本文以 Anki-Android…

2026/9/23 23:44:01 阅读更多 →
Vega 可视化语法:用声明式 JSON 构建交互式可视化图表

Vega 可视化语法:用声明式 JSON 构建交互式可视化图表

Vega 可视化语法:用声明式 JSON 构建交互式可视化图表 【免费下载链接】vega A visualization grammar. 项目地址: https://gitcode.com/gh_mirrors/ve/vega Vega 是一个面向可视化领域的声明式语法(visualization grammar)&#xff1…

2026/9/23 23:43:01 阅读更多 →

日新闻

3招搞定手机怎么下载微信面试难题实战项目解析

3招搞定手机怎么下载微信面试难题实战项目解析

3招搞定手机怎么下载微信面试难题实战项目解析 面试被问“手机怎么下载微信”背后的原理,90%的人答不上来。别笑,这看似弱智的问题,实则是考察你对移动应用分发机制、安全校验及网络协议理解的试金石。我带过不少校招新人,他们背了八股文,却连一个A…

2026/9/23 0:00:23 阅读更多 →
2k显示屏性能优化踩坑:版本升级后API全变了,这份源码解析救了我

2k显示屏性能优化踩坑:版本升级后API全变了,这份源码解析救了我

2k显示屏性能优化踩坑:版本升级后API全变了,这份源码解析救了我 刚把开发环境的显示器从1080P换到2K,跑老项目直接报错,版本升级后 API…

2026/9/23 0:01:25 阅读更多 →
3步搞定美眉图实战项目,告别官方文档抓不住重点

3步搞定美眉图实战项目,告别官方文档抓不住重点

3步搞定美眉图实战项目,告别官方文档抓不住重点 官方文档翻了三遍还是云里雾里?别急,美眉图在实战项目中常被用来做数据可视化,但它的原理比你想的简单。今天咱们直接上手,用一个完整的小项目把美眉图跑通,不再死磕那些冗长的理论说明。…

2026/9/23 0:01:25 阅读更多 →

周新闻

Flutter for OpenHarmony游戏卡片渐变背景实战:从原理到性能优化

Flutter for OpenHarmony游戏卡片渐变背景实战:从原理到性能优化

直接铺开项目本身吧。这几个月我一直在折腾一件事:用Flutter给OpenHarmony做一款游戏集合类的App,说白了就是把若干小游戏塞进一个壳里,用统一入口分发。这个方向本身不算新鲜,真正让我花了不少心思的,是首页那堆游戏卡…

2026/9/23 4:55:02 阅读更多 →
Word表格编号全攻略:从列表编号到题注交叉引用

Word表格编号全攻略:从列表编号到题注交叉引用

写Word文档,最让人头疼的往往是那些“看起来不起眼”的小问题。比如表格编号这事:今天在表后面多加了两个空白行,明天给客户交稿前发现整个章节的编号全部错位,光是挨个改序号就能耗掉大半个下午。我前阵子帮人整理一份上百页的技…

2026/9/23 4:49:06 阅读更多 →
从第一个站到第二个站:独立开发者的静态网站选型与落地实践

从第一个站到第二个站:独立开发者的静态网站选型与落地实践

1. 项目概述1.1 核心需求解析做独立开发者这几年,说实话,第一个网站上线的那天晚上我兴奋得没睡着。但等它跑了半年,流量惨淡、功能臃肿、代码自己都懒得看第二遍之后,我才慢慢琢磨明白一个道理:第一个网站是练手&…

2026/9/23 9:53:41 阅读更多 →

月新闻

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能分类:[AI/大模型]细分主题:AI 增强型 CI/CD 流水线自动化与 GitOps 实践:Agent 工作流、工具调用与任务拆解:从原型到生产的验收清单很多团队在尝试用大…

2026/9/23 9:53:40 阅读更多 →
容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场

容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场

容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场分类:[工程技术]细分主题:Kubernetes 生产环境运维与排障实战:可复制的项目复盘模板与决策记录大部分团队的事故复盘报告,最后都变成了躺在 Confluence 或钉…

2026/9/23 9:53:40 阅读更多 →
容器 容器化技术与镜像安全管理:核心链路应该先拆哪一步

容器 容器化技术与镜像安全管理:核心链路应该先拆哪一步

容器 容器化技术与镜像安全管理:核心链路应该先拆哪一步分类:[工程技术]细分主题:Docker 容器化技术与镜像安全管理:核心链路的逐步实现与关键代码取舍面对一个积累了五六年历史包袱的单体架构应用(包含 Web 接口、后台…

2026/9/23 9:53:40 阅读更多 →