从能跑到好用:构建生产级RAG系统的深度检查清单与实战优化
1. 项目概述从“能跑”到“好用”的鸿沟最近在折腾一个基于 LangChain 的 PDF 问答系统这几乎是每个学习 RAG 框架的开发者都会做的“Hello World”项目。一开始你可能跟我一样跟着教程很快就能搭出一个原型上传 PDF切分文本扔进向量库然后提问大模型LLM似乎也能给出一些沾边的答案。但当你真的想把这个系统拿给别人用或者处理一些稍微复杂、专业的文档时问题就接踵而至了。你会发现用户问“这个合同里的违约责任具体是怎么规定的”系统可能给你扯到另一页的“双方权利与义务”或者你上传一份几十页的技术手册问一个具体的参数它要么答非所问要么干脆说“文档里没有相关信息”。这时候你才意识到一个“能跑起来”的 PDF 问答系统和一个“真正好用”的生产级应用中间隔着一道需要仔细检查每一个环节的鸿沟。这个项目笔记就是记录我在填平这道鸿沟时反复检查、调试和优化的那些关键环节。它不仅仅是关于 LangChain 的 API 调用更是关于如何构建一个可靠、准确、高效的智能文档交互核心。无论你是想快速验证一个想法还是打算将其集成到更复杂的业务流中这些检查点都能帮你避开大多数坑。2. 核心环节深度检查清单构建一个 RAG 系统就像组装一台精密仪器任何一个部件的微小偏差都可能导致最终结果的巨大误差。我们不能只满足于流水线通了更要确保每个环节的输出质量都经得起推敲。下面这个检查清单是我从多次失败和迭代中总结出来的涵盖了从文档摄入到答案生成的完整链条。2.1 文档加载与解析源头活水必须清这是整个流程的第一步也是最容易埋下隐患的一步。很多问题看似出在后面的检索或生成但根子却在文档解析时就已经种下了。1. 格式兼容性与内容保真度检查首先PDF 本身就是一个复杂的格式。它可能包含纯文本、扫描图像、表格、复杂排版如多栏、数学公式、特殊字符等。使用PyPDFLoader或UnstructuredPDFLoader时你必须检查文本提取是否完整打开解析后的文本文件随机浏览几页看看是否有大段的空白、乱码或“□□□”这样的替代字符。特别是对于扫描版 PDF本质是图片必须集成 OCR 功能比如使用UnstructuredPDFLoader并配置 OCR 相关参数。结构信息是否保留对于有章节标题、列表的项目文档解析器是否能识别出这些结构Unstructured库在这方面通常比PyPDF做得更好它能返回带有关联元数据如标题级别的文本元素。表格和公式如何处理这是重灾区。标准的文本提取往往会将表格拆得支离破碎公式变成无法理解的字符序列。对于表格密集的文档可能需要专门的处理库如camelot或tabula将表格提取为结构化数据如 Markdown 或 CSV 字符串再作为特殊文本块嵌入。对于公式可以尝试使用pdfplumber进行更精细的定位和提取。实操心得不要相信任何一个解析器能通吃所有 PDF。对于关键项目我通常会准备一个包含纯文本、扫描页、表格和公式的“测试 PDF 套件”用不同的加载器PyPDF,Unstructured,pdfplumber跑一遍对比输出结果选择综合表现最好的那个或者写一个简单的路由逻辑根据 PDF 特征选择加载器。2. 元数据抽取与关联解析时不仅要拿到文本还要尽可能多地抽取元数据这对于后续的检索排序和答案溯源至关重要。需要检查基础元数据如source文件名、page页码是否准确附着到了每个文本块上页码错位是导致答案引用不准的常见原因。高级元数据能否解析出文档标题、作者、章节标题Unstructured库可以尝试识别“Title”, “Header”等类别将这些作为元数据能极大提升后续检索的相关性。例如当用户问“第三章讲了什么”系统可以直接检索metadata[“category”]”Header”且text包含“第三章”的块。2.2 文本分割把握信息粒度的艺术文本分割Text Splitting直接决定了检索的精度和上下文的完整性是 RAG 系统的“心脏手术”。1. 分割策略与参数调优LangChain 提供了多种TextSplitter最常用的是RecursiveCharacterTextSplitter。这里要检查的核心是“块大小”和“块重叠度”。块大小chunk_size这是最重要的参数。太小如 100一个完整的句子或概念会被拆散检索到的块可能缺乏回答问题的完整上下文太大如 2000会引入大量无关噪声稀释核心信息同时增加 LLM 的上下文窗口负担和成本。通常对于通用文档256-512 是一个不错的起点对于技术文档或法律合同可能需要 512-1024 以保持概念的完整性。块重叠度chunk_overlap用于避免在句子或段落中间被生硬切断导致语义断裂。重叠度通常设置为块大小的 10%-20%。例如块大小为 500重叠度可以设为 50-100。必须检查重叠的部分是否真的起到了连接上下文的作用还是只是简单重复了文本可以通过查看分割后的前几个块来验证。分割依据RecursiveCharacterTextSplitter默认按[\n\n, \n, , ]的顺序递归分割。对于中文文档这个列表可能需要调整优先考虑句号、分号等中文标点。可以自定义separators参数。2. 语义完整性验证分割后绝不能直接丢进向量库。你需要进行抽样检查随机选取 10-20 个文本块人工阅读。检查块的开头和结尾是否在一个完整的语义单元内如一个完整的句子、一个列表项、一个段落。如果经常在半句话或半个公式处切断就需要调整分割器参数或策略。思考如果用户的问题恰好需要这个块末尾和下一个块开头的信息才能回答现有的重叠度能否保证检索到足够的信息这就是为什么有时需要基于语义如句子的分割器或者更复杂的滑动窗口策略。踩坑记录我曾处理一份 API 文档默认分割导致很多“请求示例”的代码块被拦腰截断前半部分是代码后半部分是对参数的说明。这导致检索时永远找不到完整的示例。后来我改用MarkdownHeaderTextSplitter先按标题分割大章节再在章节内用较小的块进行二次分割问题才得以解决。2.3 向量化与检索寻找最相关的记忆这是 RAG 中“R”Retrieval的核心目标是从海量文本块中精准找到最相关的几个。1. Embedding 模型选型与测试Embedding 模型将文本转换为向量其质量直接决定了检索的相关性。需要检查模型适配性你用的 Embedding 模型如text-embedding-ada-002,BGE,M3E是否适合你的文档语言和领域例如处理中文法律文档BGE-zh或M3E通常比通用的ada-002表现更好。处理专业医学文献可能需要领域微调过的模型。向量维度与性能模型的输出维度如 768, 1024, 1536会影响向量数据库的存储和查询速度。更高的维度通常能捕捉更细粒度的语义但也需要更多计算资源。需要在精度和性能间权衡。相似度计算方式大多数向量库使用余弦相似度cosine similarity这通常没问题。但要确认你的 Embedding 模型训练时使用的损失函数与余弦相似度是兼容的。有些模型可能更适合点积dot product。2. 向量数据库配置与索引构建索引类型如果你使用Chroma、FAISS这类轻量级库通常使用简单的扁平索引IndexFlatL2就够了。但如果文档块数量巨大例如超过 10 万就需要考虑HNSW或IVF这类近似最近邻索引来加速查询同时要检查其带来的精度损失是否在可接受范围内。元数据过滤这是提升检索精度的利器。你的向量数据库是否支持在检索时基于元数据如page,chapter,doc_type进行过滤例如用户可以问“在用户手册的‘故障排除’章节里关于错误代码 505 说了什么”。在检索时先过滤section故障排除的块再进行向量相似度搜索结果会准确得多。检查你的Retriever是否正确地集成了元数据过滤功能。3. 检索策略优化检索数量kRetriever默认返回 top-k 个相关块。k 值太小可能遗漏关键信息k 值太大会给 LLM 带来噪声并增加成本。通常需要根据文档长度和问题复杂度进行测试4-8 是一个常见的范围。重排序Re-ranking这是高级但极其有效的技巧。第一阶段的向量检索可能返回 20 个相关块然后使用一个更小、更快的重排序模型如BGE-Reranker对这 20 个块基于问题进行精排只取前 3-5 个给 LLM。重排序模型专门做“相关性判别”能显著提升最终答案的质量。检查你的流程是否需要引入这一环节。混合检索除了向量检索是否可以结合关键词检索如 BM25对于包含特定名称、日期、代码等精确术语的问题关键词检索有时更有效。LangChain的EnsembleRetriever可以融合多种检索器的结果。2.4 提示工程与大模型交互引导模型生成精准答案检索到相关上下文后如何有效地交给 LLM 并让它给出好答案是最后一道关卡。1. 提示模板设计检查你的提示模板是否包含以下关键元素并确保它们被正确填充系统指令明确告诉模型扮演的角色和任务例如“你是一个专业的文档分析助手严格根据提供的上下文信息回答问题。”。上下文占位符{context}。检查上下文是否被正确、完整地拼接进来。过长的上下文是否会被截断问题占位符{question}。严格的回答指令这是减少“幻觉”的关键。必须包含“如果上下文中的信息不足以回答问题请直接说‘根据提供的文档我无法回答这个问题’不要编造信息。”以及“请用中文回答。”答案格式要求可选如果需要点列式回答、包含引用等也需在提示中说明。2. 上下文管理与压缩当检索到的多个文本块总长度超过 LLM 的上下文窗口限制时怎么办检查上下文长度在将context填入提示词前计算其总 token 数。如果接近模型上限需预留答案的空间就需要压缩。上下文压缩策略可以使用LangChain的ContextualCompressionRetriever。它会在检索后用一个更小的 LLM如GPT-3.5-turbo或专门的模型基于问题对每个检索到的文档块进行摘要或相关性提取只保留最核心的句子从而缩短上下文。这是一个非常实用的高级技巧。3. 大模型参数调优温度temperature对于事实性问答通常设置为较低值如 0.1 或 0以增加答案的确定性和一致性减少随机性。最大生成长度max_tokens根据你期望的答案长度合理设置避免生成不完整或过于冗长的答案。2.5 评估与迭代没有度量就没有优化系统搭建完成后必须有一套评估方法来衡量其好坏并指导迭代。1. 构建测试集不要凭感觉。准备一个包含 20-50 个“问题-答案”对的测试集。问题应覆盖简单事实型“文档的作者是谁”复杂推理型“根据文档中的实验数据可以得出什么结论”多跳检索型“方案 A 和方案 B 各自的优缺点是什么”信息可能分散在不同页面否定型“文档中是否提到了 XXX”期望回答“未提及”边界测试问一些文档中绝对没有的内容测试模型是否会产生幻觉。2. 选择评估指标忠实度模型答案中的事实是否全部来源于提供的上下文这是对抗“幻觉”的核心指标。可以人工评估或用一些事实一致性检查模型辅助。答案相关性答案是否直接、完整地解决了问题可以用另一个 LLM如 GPT-4作为裁判对比标准答案和模型生成答案的相关性。检索相关性检索到的文档块是否真的与问题高度相关这可以通过人工标注或重排序模型的打分来评估。3. 可解释性与溯源一个可信的系统必须能“自证清白”。检查你的系统是否能为每个答案提供引用来源。引用格式答案中是否以“【页码】”或“来源第 X 页”的形式注明了信息出处引用准确性点击引用是否能准确跳转到原文的对应位置这需要元数据特别是页码在流程中完美传递。3. 一个可落地的检查与调试流程理论说完了我们来看一个具体的、可操作的检查流程。假设我们正在构建一个针对技术产品手册的问答系统。3.1 第一阶段单元测试逐个环节验证加载解析测试上传一份包含文本、表格和图片的复杂 PDF。运行加载器将输出保存为文本文件。人工对比原 PDF 和输出文本重点检查表格区域、图表标题、页眉页脚是否被正确提取或标记为缺失。记录错误率和错误类型。分割效果测试从解析出的文本中选取几个典型章节如概述、参数列表、故障代码表。用不同的chunk_size(256, 512, 1024) 和chunk_overlap(50, 100) 进行分割。直观地检查分割边界判断语义完整性。可以编写一个简单脚本打印每个块的前后20个字符快速浏览分割点是否合理。Embedding 相似度测试准备几组测试句对同义句“如何开机” vs “启动设备的步骤”相关句“电池续航时间” vs “充电需要两小时”不相关句“如何开机” vs “产品的保修政策”用你选定的 Embedding 模型计算它们的余弦相似度。同义句应得分最高相关句次之不相关句最低。如果排序不符合直觉就要考虑换模型。3.2 第二阶段集成测试端到端流程验证构建一个最小可行管道使用一小部分文档如手册的前10页完成从加载、分割、向量化到存储的全流程。设计5个关键问题涵盖不同难度。手动问答与溯源检查运行系统回答问题。不仅看答案更要检查检索到的源文本块。对于每个问题记录检索到的前k个块是否相关答案是否严格来源于这些块答案中的引用页码是否正确这个步骤能暴露出检索不准、上下文不足或提示词缺陷等集成问题。3.3 第三阶段评估与基准测试自动化评估循环使用准备好的测试集QA对。编写脚本自动运行系统回答所有问题。计算关键指标检索命中率标准答案中的关键事实有多少百分比出现在检索到的 top-k 个块中答案准确率人工或使用 LLM-as-a-judge 判断答案是否正确。幻觉率答案中出现了多少文档中不存在的信息性能与压力测试延迟从用户提问到收到答案平均耗时是多少区分检索时间和 LLM 生成时间。吞吐量系统能同时处理多少并发请求成本处理一个平均长度的问题Embedding 和 LLM API 调用的花费是多少4. 常见问题排查与实战技巧在实际操作中你一定会遇到各种奇怪的问题。下面这个表格整理了一些典型症状、可能的原因和排查思路。问题症状可能原因排查步骤与解决方案答案完全胡编乱造幻觉严重1. 检索到的上下文完全不相关。2. 提示词中没有强制要求“基于上下文”。3. LLM 温度参数过高。1.检查检索结果打印出retriever.get_relevant_documents(question)的结果看是否相关。2.强化提示词在系统指令中加入“你必须且只能根据以下上下文信息来回答问题。”3.降低温度将temperature设为 0 或 0.1。答案部分正确部分虚构1. 检索到的上下文信息不完整不足以回答整个问题。2. 模型在上下文不足的部分进行了外推。1.增加检索数量k尝试将k从 4 增加到 8 或更多。2.优化分割增大chunk_size确保关键信息不被割裂。3.引入重排序用重排序模型确保给 LLM 的是最精华、最相关的部分。答案正确但无法提供引用来源1. 分割时丢失或未正确传递元数据如页码。2. 最终生成答案的步骤未设计引用格式。1.检查元数据流确保从DocumentLoader到TextSplitter再到VectorStoremetadata字段尤其是page一路保留。2.修改提示词在提示词末尾加入“请在答案中为每个关键事实注明来源页码格式如【页码】。”3. 使用LangChain的RetrievalQAWithSourcesChain这类自带溯源功能的链。系统回答“不知道”但文档中明明有答案1. 检索失败没找到相关块。2. Embedding 模型不匹配语义搜索失效。3. 关键词不匹配且未使用混合检索。1.检查向量搜索相似度阈值可能最相关的块相似度得分低于某个默认阈值被过滤了可以调低阈值或取消过滤。2.测试 Embedding 模型用第 3.1 节的方法测试模型对领域术语的捕捉能力。3.启用混合检索结合BM25等关键词检索方法。处理长文档时速度很慢1. Embedding 模型本地推理慢或网络请求慢。2. 向量索引未优化如海量数据仍用扁平索引。3. LLM 生成速度慢。1.异步与批处理对文档分割后的块进行批处理 Embedding如一批 100 个。2.使用近似索引文档数量大时使用HNSW索引。3.考虑模型轻量化在保证效果的前提下尝试更小的 Embedding 模型和更快的 LLM如GPT-3.5-Turbo比GPT-4快。对于多栏排版PDF解析后文本顺序错乱PDF 解析器按绝对坐标读取文本打乱了阅读顺序。1.换用更智能的解析器Unstructured库有一些启发式算法来尝试恢复阅读顺序。2.预处理 PDF使用pdftotextpoppler工具的一部分配合-layout参数有时效果更好。3.作为最后手段考虑使用 OCR 将整个页面视为图像再识别文字但这会损失文本样式信息。最后再分享一个我个人的调试习惯建立一个“问题-答案-溯源”的调试日志。每次遇到一个坏案例bad case就把它详细记录下来原始问题、检索到的所有块及其相似度分数、最终生成的答案、以及正确答案和出处。定期分析这些日志你会发现模式——是某个类型的文档总出问题还是某种问法容易导致检索失败这种基于真实失败案例的分析是优化系统最直接、最有效的方法。构建一个健壮的 PDF 问答系统没有一劳永逸的银弹它更像是一个持续监控、评估和调整的运维过程。

相关新闻

Ubuntu 22.04双系统安装与配置全指南

Ubuntu 22.04双系统安装与配置全指南

1. 为什么选择Ubuntu 22.04双系统?在Windows主导的PC生态中,Linux发行版始终保持着独特的价值。Ubuntu 22.04 LTS(Jammy Jellyfish)作为长期支持版本,提供了5年的安全更新支持周期,这使其成为开发者、科研人…

2026/8/11 3:13:18 阅读更多 →
SpringBoot+Vue构建企业级售后管理系统实战

SpringBoot+Vue构建企业级售后管理系统实战

1. 项目概述与核心价值 这个基于SpringBootVue的Nuct产品售后管理系统,是一个典型的Java Web全栈项目解决方案。它不仅仅是一套毕业设计模板,更是一个完整的企业级应用原型。我在实际开发中发现,这类系统在中小型制造企业和电子产品服务商中有…

2026/8/11 3:13:18 阅读更多 →
虚拟机克隆完整指南:从原理到实践,解决环境部署难题

虚拟机克隆完整指南:从原理到实践,解决环境部署难题

如果你在开发、测试或学习过程中需要快速部署多个相同配置的虚拟机,还在手动重复安装系统、配置环境吗?这不仅耗时费力,而且难以保证环境的一致性,稍有不慎就会导致“在我机器上是好的”这类经典问题。今天要讨论的“克隆虚拟机”…

2026/8/11 3:12:18 阅读更多 →

最新新闻

m4s-converter:打破B站缓存限制的智能视频格式转换方案

m4s-converter:打破B站缓存限制的智能视频格式转换方案

m4s-converter:打破B站缓存限制的智能视频格式转换方案 【免费下载链接】m4s-converter 一个跨平台小工具,将bilibili缓存的m4s格式音视频文件合并成mp4 项目地址: https://gitcode.com/gh_mirrors/m4/m4s-converter 你是否曾经面对这样的困境&am…

2026/8/11 3:58:42 阅读更多 →
Python为何成为AI框架首选语言:历史、生态与设计哲学解析

Python为何成为AI框架首选语言:历史、生态与设计哲学解析

1. 从一次技术选型的争论说起几年前,我和团队在为一个全新的机器学习平台做技术选型,核心争论点就落在了编程语言上。当时,团队里一位资深的C#工程师据理力争,认为C#性能卓越、类型安全、工具链成熟,完全有能力作为AI框…

2026/8/11 3:58:42 阅读更多 →
毕业论文神器!2026最新AI论文网站测评与推荐

毕业论文神器!2026最新AI论文网站测评与推荐

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

2026/8/11 3:58:42 阅读更多 →
3秒完成网页图片格式转换:Save Image as Type浏览器扩展终极指南

3秒完成网页图片格式转换:Save Image as Type浏览器扩展终极指南

3秒完成网页图片格式转换:Save Image as Type浏览器扩展终极指南 【免费下载链接】Save-Image-as-Type Save Image as Type is an chrome extension which add Save as PNG / JPG / WebP to the context menu of image. 项目地址: https://gitcode.com/gh_mirrors…

2026/8/11 3:58:42 阅读更多 →
SAP混合架构下Fiori Launchpad内容整合技术解析

SAP混合架构下Fiori Launchpad内容整合技术解析

1. 项目概述:混合架构下的内容整合挑战在数字化转型浪潮中,企业系统架构往往呈现混合形态——既有本地部署的SAP ERP系统,又有基于SAP Business Technology Platform (BTP)的云端应用。这种架构虽然灵活,却带来了用户体验碎片化的…

2026/8/11 3:58:42 阅读更多 →
Linux进程间通信(IPC)原理与实战指南

Linux进程间通信(IPC)原理与实战指南

1. 进程间通信的本质与价值当我们在Linux系统下同时运行多个程序时,这些程序就像一个个独立的"孤岛"。比如浏览器和音乐播放器同时运行,它们如何知道对方的存在?如何交换数据?这就是进程间通信(IPC&#xff…

2026/8/11 3:57:42 阅读更多 →

日新闻

如何用Video2X实现专业级视频画质提升:AI视频增强完整指南

如何用Video2X实现专业级视频画质提升:AI视频增强完整指南

如何用Video2X实现专业级视频画质提升:AI视频增强完整指南 【免费下载链接】video2x A machine learning-based video super resolution and frame interpolation framework. Est. Hack the Valley II, 2018. 项目地址: https://gitcode.com/GitHub_Trending/vi/v…

2026/8/11 0:00:02 阅读更多 →
前后端分离项目中控制台与接口工具数据差异排查指南

前后端分离项目中控制台与接口工具数据差异排查指南

1. 问题现象解析:控制台与Apifox的数据差异 最近在调试一个前后端分离项目时,遇到了一个典型问题:后端服务在本地开发环境控制台能正常输出查询数据,但通过Apifox测试时却返回空结果。这种"控制台有数据,接口工具…

2026/8/11 0:00:03 阅读更多 →
AI编程实战:从Claude Code踩坑到游戏开发入门

AI编程实战:从Claude Code踩坑到游戏开发入门

1. 从“AI能帮我做游戏”到“AI让我重新学编程”最近身边不少朋友,尤其是一些非技术背景、但对游戏开发有浓厚兴趣的朋友,都在问我同一个问题:“听说现在用Claude Code这种AI编程工具,小白也能做游戏了,是真的吗&#…

2026/8/11 0:00:03 阅读更多 →

周新闻

5分钟告别提取码焦虑:baidupankey如何智能破解百度网盘资源锁

5分钟告别提取码焦虑:baidupankey如何智能破解百度网盘资源锁

5分钟告别提取码焦虑:baidupankey如何智能破解百度网盘资源锁 【免费下载链接】baidupankey 在线查询网盘提取码(维护中 rm repo) 项目地址: https://gitcode.com/gh_mirrors/ba/baidupankey 你是否曾经在深夜寻找一份重要资料&#x…

2026/8/11 1:08:05 阅读更多 →
如何快速生成中国车牌图片:Python开源工具完整指南

如何快速生成中国车牌图片:Python开源工具完整指南

如何快速生成中国车牌图片:Python开源工具完整指南 【免费下载链接】chinese_license_plate_generator 中国车牌生成器 项目地址: https://gitcode.com/gh_mirrors/ch/chinese_license_plate_generator 中国车牌生成器是一个基于Python的开源项目&#xff0c…

2026/8/11 1:08:05 阅读更多 →
收藏!小白程序员轻松入门大模型,从Harness工程开始实践

收藏!小白程序员轻松入门大模型,从Harness工程开始实践

文章强调学习大模型不应只关注模型本身,而应重视模型外的系统搭建,即Harness。提出AgentModelHarness的实用公式,详细介绍Harness的四个层次:持久化层、执行层、控制层和观察与验证层。文章还探讨了上下文工程、工具设计、AGENTS.…

2026/8/11 1:08:05 阅读更多 →

月新闻

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南 【免费下载链接】BaiduNetdiskPlugin-macOS For macOS.百度网盘 破解SVIP、下载速度限制~ 项目地址: https://gitcode.com/gh_mirrors/ba/BaiduNetdiskPlugin-macOS 还在为百度网盘macOS版的龟速下…

2026/8/10 17:07:33 阅读更多 →
终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换 【免费下载链接】ncmdump 项目地址: https://gitcode.com/gh_mirrors/ncmd/ncmdump 还在为网易云音乐下载的NCM格式文件无法在其他播放器播放而烦恼吗?ncmdump解密工具帮你轻松解决这个困…

2026/8/11 1:08:06 阅读更多 →
HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

AgentCard 智能体卡片:为英语学习 App 打造桌面级学习助手适用平台:HarmonyOS 7.0 (API 26 Beta)一、引言 HarmonyOS 7.0(API 26 Beta)新增了 AgentCard 智能体卡片能力,这是继 HMAF(鸿蒙智能体框架&#x…

2026/8/10 17:07:33 阅读更多 →