实战|基于LoRA构建领域知识库大模型,对比RAG优劣
实战基于LoRA构建领域知识库大模型对比RAG优劣摘要随着开源大模型快速发展行业落地垂直知识库大模型主要有两条主流技术路线检索增强生成RAG与低秩适配LoRA参数高效微调。RAG依靠外部知识库检索不修改模型权重LoRA通过低秩矩阵微调把领域知识嵌入模型参数内部。在实际工程开发中很多开发者会纠结垂直场景到底选RAG还是LoRA两者能不能组合使用本文从原理、数据集构建、完整可运行LoRA微调代码、模型部署、实验评测多个维度展开实战对比两种方案的优势、缺陷、适用场景同时分析LoRARAG混合方案的落地价值为垂直领域大模型毕业设计、小型项目落地提供完整参考。关键词大语言模型LoRAQLoRARAG参数高效微调知识库PEFT1 引言通用大模型具备强大的通用对话、逻辑推理能力但面对企业内部文档、专业行业资料、私有知识库时会暴露明显短板模型存在幻觉问题无法记忆私有领域知识训练截止时间之后的新知识完全无法获取。解决私有知识库问答行业形成两大技术路线。第一种RAGRetrieval‑Augmented Generation检索增强生成原理是把知识库文档切分、向量化存入向量数据库用户提问时检索向量库获取相关片段把检索片段拼接进Prompt交给大模型生成答案全程不改动大模型任何权重。第二种LoRALow‑Rank Adaptation低秩适配属于参数高效微调PEFT的一种冻结基础大模型全部权重仅训练少量低秩分解适配器权重将领域知识编码进适配器参数模型推理直接依靠自身参数输出领域答案。RAG上手简单开发周期短LoRA需要准备高质量训练数据集需要显卡算力但是知识内化进模型不需要依赖检索模块。很多初学者会陷入误区认为LoRA可以完全替代RAG或者RAG可以解决所有垂直知识库场景。事实上二者各有短板没有绝对最优解。本文将完整复现LoRA微调7B开源大模型实现领域知识库模型结合实验数据对比两者优劣同时探讨混合架构。硬件环境说明本文实验环境GPUNVIDIA RTX3090 24GCUDA12.1框架版本Transformers 4.41.0PEFT 0.10.0BitsAndBytes 0.43.1AccelerateAuto‑GPTQ基础模型选用开源Qwen‑7B‑Chat通义千问7B对话模型。如果使用16G显存显卡可以开启4bit量化QLoRA完成训练。2 技术原理剖析2.1 LoRA低秩适配核心原理传统全参数微调需要更新大模型全部权重7B模型参数量70亿需要数百GB显存硬件成本极高。LoRA核心思想Transformer的注意力模块中权重矩阵可以做低秩分解原始权重矩阵W∈Rd×kW\in R^{d\times k}W∈Rd×k不改动原始W新增两个小矩阵A、B。A是降维矩阵B是升维矩阵。ΔWBA\Delta WBAΔWBA训练的时候只更新A和B两个低秩矩阵原始大模型权重完全冻结。推理阶段WΔW\boldsymbol W\Delta WWΔW直接合并到原始权重推理不会带来额外延迟。超参数r代表秩r越大适配器参数量越大拟合领域知识能力越强但更容易过拟合同时训练消耗显存上升r越小参数量越少拟合能力弱。通常领域知识库微调r取8‑64区间。QLoRA在LoRA基础之上使用4bit/8bit量化加载基础模型极大降低显存占用普通消费级显卡就可以完成7B模型微调是个人开发者、毕设项目最常用方案。LoRA仅训练注意力层Feed‑Forward层可以选择是否加入训练大部分场景只训练q、v投影矩阵即可。2.2 RAG检索增强生成原理RAG工作流程分为两大阶段文档预处理阶段、推理问答阶段。1.预处理领域PDF、Markdown、Word文档读取文本分块文本向量化存入ChromaDB、FAISS等向量数据库。2.用户提问用户问题向量化向量数据库相似度检索取出Top‑N最相关文档片段将用户问题检索到的上下文片段组装Prompt送入大模型大模型基于传入的参考资料输出答案。RAG不需要训练模型新增知识直接更新向量库不需要重新训练。但是RAG效果高度依赖文档切分策略、embedding模型质量、检索召回准确率。一旦检索没有拿到正确文档片段大模型就会产生幻觉输出错误答案。2.3 LoRA与RAG本质区别LoRA知识存储位置→模型参数内部需要训练新增知识必须重新微调LoRA知识量大容易过拟合不依赖外部检索组件。RAG知识存储位置→外部向量数据库不需要训练大模型新增文档直接入库更新受检索质量约束需要维护向量库、文档切片。3 数据集构建领域知识库微调数据集LoRA微调效果上限由数据集质量决定这是很多项目踩坑点。针对知识库问答我们采用对话格式数据集jsonl格式每一条样本包含instruction、input、output。instruction任务指令例如“请基于领域知识库回答用户问题”input用户提问output标准答案来自领域知识库注意LoRA不能直接把原始大段文档喂进去训练不能直接把PDF文本当训练集。必须构造问题‑答案配对。如果直接喂原始文档模型会学习文档续写无法完成问答任务。示例data.jsonl样本{instruction:请根据知识库内容回答用户问题,input:XX系统如何配置日志模块,output:日志模块配置步骤1....2....3....}{instruction:请根据知识库内容回答用户问题,input:产品支持哪些接口协议,output:产品支持HTTP、WebSocket协议不支持RPC协议......}数据集规模建议垂直知识库场景几百到几千条高质量问答样本即可少于100条样本极易过拟合。数据集划分90%训练集train.jsonl10%验证集val.jsonl。4 完整LoRAQLoRA微调代码依赖安装pipinstalltorch transformers datasets peft bitsandbytes accelerate sentencepiece protobuf完整训练脚本train_lora.py采用4bit量化QLoRA加载Qwen‑7B‑ChatLoRA配置训练循环保存LoRA适配器。importtorchfromdatasetsimportload_datasetfromtransformersimport(AutoModelForCausalLM,AutoTokenizer,BitsAndBytesConfig,TrainingArguments,pipeline,)frompeftimportLoraConfig,PeftModel,get_peft_modelfromtrlimportSFTTrainer# --------------------------配置参数--------------------------model_nameQwen/Qwen‑7B‑Chattrain_data_path./data/train.jsonleval_data_path./data/val.jsonloutput_dir./qwen7b‑lora‑adapter# 4bit量化配置bnb_configBitsAndBytesConfig(load_in_4bitTrue,bnb_4bit_use_double_quantTrue,bnb_4bit_quant_typenf4,bnb_4bit_compute_dtypetorch.bfloat16)# LoRA超参数lora_configLoraConfig(r16,# 秩知识库微调常用16lora_alpha32,target_modules[q_proj,v_proj],# 训练注意力q v层lora_dropout0.05,biasnone,task_typeCAUSAL_LM)# 训练参数training_argsTrainingArguments(output_diroutput_dir,per_device_train_batch_size4,per_device_eval_batch_size4,gradient_accumulation_steps2,learning_rate2e‑4,num_train_epochs3,logging_steps10,evaluation_strategysteps,eval_steps50,save_strategysteps,save_steps100,fp16True,optimpaged_adamw_8bit,report_tonone)# 加载tokenizertokenizerAutoTokenizer.from_pretrained(model_name,trust_remote_codeTrue)tokenizer.pad_tokentokenizer.eos_token tokenizer.padding_sideright# 加载4bit量化基础模型base_modelAutoModelForCausalLM.from_pretrained(model_name,quantization_configbnb_config,device_mapauto,trust_remote_codeTrue,torch_dtypetorch.bfloat16)base_model.config.use_cacheFalsebase_model.config.pretraining_tp1# 加载LoRAmodelget_peft_model(base_model,lora_config)model.print_trainable_parameters()# 输出示例trainable params: 0.21% of all params只有极少参数参与训练# 加载数据集datasetload_dataset(json,data_files{train:train_data_path,eval:eval_data_path})# SFTTrainer监督微调训练器trainerSFTTrainer(modelmodel,train_datasetdataset[train],eval_datasetdataset[eval],peft_configlora_config,dataset_text_fieldtext,max_seq_length1024,tokenizertokenizer,argstraining_args,formatting_funclambdaexample:[f|im_start|system{ex[instruction]}|im_end| |im_start|user{ex[input]}|im_end| |im_start|assistant{ex[output]}|im_end|forexinexample])# 启动训练trainer.train()# 保存LoRA适配器权重trainer.model.save_pretrained(output_dir)tokenizer.save_pretrained(output_dir)print(LoRA适配器训练完成保存至,output_dir)运行训练python train_lora.py。训练完成后得到LoRA适配器文件夹体积几十MB不是完整大模型权重。4.1 LoRA适配器推理代码infer_lora.py加载基础模型LoRA适配器做领域问答importtorchfrompeftimportPeftModelfromtransformersimportAutoModelForCausalLM,AutoTokenizer base_model_nameQwen/Qwen‑7B‑Chatlora_adapter_path./qwen7b‑lora‑adaptertokenizerAutoTokenizer.from_pretrained(base_model_name,trust_remote_codeTrue)base_modelAutoModelForCausalLM.from_pretrained(base_model_name,torch_dtypetorch.bfloat16,device_mapauto,trust_remote_codeTrue)modelPeftModel.from_pretrained(base_model,lora_adapter_path)defask(question):promptf|im_start|system 请基于领域知识库回答用户问题 |im_end| |im_start|user{question}|im_end| |im_start|assistant inputstokenizer(prompt,return_tensorspt).to(cuda)outputsmodel.generate(**inputs,max_new_tokens512,temperature0.3,top_p0.7)restokenizer.decode(outputs[0],skip_special_tokensTrue)returnresif__name____main__:print(ask(XX系统如何配置日志模块))4.2 LoRA权重合并导出完整模型可选如果需要把LoRA适配器合并进基础模型生成独立完整模型方便部署frompeftimportPeftModelfromtransformersimportAutoModelForCausalLM,AutoTokenizer base_modelAutoModelForCausalLM.from_pretrained(Qwen/Qwen‑7B‑Chat,torch_dtypetorch.bfloat16,device_mapauto,trust_remote_codeTrue)lora_modelPeftModel.from_pretrained(base_model,./qwen7b‑lora‑adapter)merged_modellora_model.merge_and_unload()tokenizerAutoTokenizer.from_pretrained(Qwen/Qwen‑7B‑Chat,trust_remote_codeTrue)merged_model.save_pretrained(./qwen7b‑lora‑merged)tokenizer.save_pretrained(./qwen7b‑lora‑merged)合并之后得到完整模型不需要PEFT库就可以直接加载部署。5 RAG最简参考实现代码下面实现极简RAG使用Chroma向量库实现知识库检索问答用来和LoRA做对照实验。fromlangchain_community.document_loadersimportTextLoaderfromlangchain_text_splittersimportRecursiveCharacterTextSplitterfromlangchain_community.vectorstoresimportChromafromlangchain_community.embeddingsimportHuggingFaceEmbeddingsfromlangchain_community.llms.huggingface_pipelineimportHuggingFacePipelinefromlangchain.chainsimportRetrievalQAfromtransformersimportpipeline,AutoTokenizer,AutoModelForCausalLM# 加载embeddingembeddingHuggingFaceEmbeddings(model_nameBAAI/bge‑small‑zh‑v1.5)# 加载领域文档loaderTextLoader(./knowledge.txt,encodingutf‑8)docsloader.load()# 文档切分splitterRecursiveCharacterTextSplitter(chunk_size300,chunk_overlap50)split_docssplitter.split_documents(docs)# 构建向量数据库dbChroma.from_documents(split_docs,embedding,persist_directory./chroma_db)retrieverdb.as_retriever(search_kwargs{k:3})# 加载基础大模型model_nameQwen/Qwen‑7B‑ChattokenizerAutoTokenizer.from_pretrained(model_name,trust_remote_codeTrue)modelAutoModelForCausalLM.from_pretrained(model_name,device_mapauto,torch_dtypetorch.bfloat16,trust_remote_codeTrue)generation_pipepipeline(text‑generation,modelmodel,tokenizertokenizer,max_new_tokens512,temperature0.3)llmHuggingFacePipeline(pipelinegeneration_pipe)qa_chainRetrievalQA.from_chain_type(llmllm,chain_typestuff,retrieverretriever,return_source_documentsTrue)if__name____main__:resultqa_chain.invoke({query:XX系统如何配置日志模块})print(result[result])6 实验评测LoRA微调 vs RAG对比分析本实验使用同一套领域测试集一共80条测试问题分别测试原始基座模型、LoRA微调后模型、RAG基座向量检索三个方案。评测维度答案准确率、幻觉发生率、响应速度、更新知识库成本、显存资源消耗。6.1 LoRAQLoRA方案表现优势1.推理阶段没有检索环节不需要向量数据库系统架构简单没有检索召回失败问题。只要知识已经充分学习进LoRA适配器提问直接输出答案。2.对话连贯性更好模型输出风格统一不会出现RAG因为检索片段混乱答案逻辑割裂。3.适合知识体量不大、固定领域、知识不频繁变更的场景。内部业务规则、固定流程、产品手册几百‑几千条问答样本效果很好。缺点1.数据集成本高不能直接导入原始文档必须人工整理问答对。如果没有高质量问答样本LoRA效果很差。2.知识更新麻烦文档新增、修改之后必须重新制作数据集、重新训练LoRA适配器无法热更新。3.知识容量上限当领域知识体量巨大上万条知识点单纯依靠LoRA会发生灾难性遗忘模型混淆不同知识点出现过拟合训练损失下降但是实际问答效果变差。4.容易过拟合训练epoch过高、r参数过大模型死记硬背训练集样本遇到同义改写问题回答出错。5.无法处理训练截止之后新增知识。6.2 RAG方案表现优势1.无需训练大模型不需要GPU训练算力开发周期短。只需要处理原始文档不需要构建问答样本。2.知识库支持热更新新增文档直接切片入库即可不需要重新训练模型。适合知识频繁更新场景。3.不会发生模型遗忘不改动权重原始大模型通用能力完整保留。支持海量知识库十万级文档都可以处理。缺点1.效果高度依赖检索质量。检索不到正确片段大模型直接幻觉。存在检索噪声无关片段混入Prompt干扰输出。2.系统链路复杂多了文档解析、切片、向量化、向量库维护模块工程运维成本上升。3.上下文窗口限制如果检索回来片段太多会超过大模型上下文长度。4.输出受检索文本质量影响文档写的差生成答案质量随之变差。6.3 详细对比表格对比维度LoRA(QLoRA微调)RAG检索增强生成是否修改模型权重是训练适配器完全不修改基座权重知识存储位置LoRA适配器参数外部向量数据库训练算力需求需要GPU训练7B模型24G显卡训练阶段不需要GPU推理可GPU知识库更新需要重新训练LoRA直接新增文档入库热更新依赖组件仅大模型向量数据库、Embedding模型、文档解析器海量知识支持差容易遗忘过拟合优秀支持大规模知识库小体量固定知识优秀中等受检索影响幻觉来源过拟合、训练集缺陷检索召回失败、检索噪声工程开发周期长数据集调参训练短快速搭建原型推理速度较快无额外检索开销略慢增加检索耗时6.4 什么时候选LoRA什么时候选RAG✅优先选择LoRA场景1.领域知识总量不大几百‑几千条知识点知识很少变动2.希望简化部署架构不想维护向量库3.需要模型学习输出格式、语气、特定输出范式4.业务是固定规则、固定流程、产品手册不需要频繁更新文档。✅优先选择RAG场景1.知识库文档量大上万篇文档2.知识持续迭代更新经常新增修改资料3.没有人力构造大量高质量问答微调数据集4.希望保留基座模型全部通用能力。很多人误区LoRA用来做知识库用大量原始文档直接训练。LoRA不是用来“背诵文档”是学习问答映射关系。原始文档直接训练效果极差。7 最优落地方案LoRARAG混合架构单纯LoRA和单纯RAG都存在短板工业项目中大量使用混合架构。架构逻辑1.使用LoRA微调基座大模型教会模型领域输出风格、业务术语、回答范式2.保留RAG检索模块用来承载海量原始知识库3.用户提问向量库检索参考片段送入经过LoRA微调后的模型生成答案。LoRA负责解决模型不懂行业术语、输出格式不对的问题RAG负责提供实时、海量外部参考资料解决LoRA无法更新知识、知识容量有限的痛点。既利用LoRA带来领域适配又利用RAG解决知识更新与大容量知识库。混合架构可以规避两者缺陷LoRA不用强行背诵海量全部知识只学习领域风格RAG部分减轻检索噪声带来的格式混乱微调后的模型更懂得怎么阅读行业文档输出规范答案。8 LoRA项目常见踩坑总结毕设实战高频问题1.损失下降但是问答效果很差数据集质量低不要直接喂原始文档必须问答配对检查prompt模板是否和训练、推理完全一致。训练和推理prompt不一致效果直接崩塌。2.过拟合现象训练集问题回答完美陌生同义问题效果很差。降低epoch减小r增大lora_dropout扩充数据集样本多样性。3.训练loss不收敛学习率设置错误LoRA常用学习率1e‑4 ~3e‑4不要用全参数微调的学习率检查文本格式化函数样本拼接错误。4.幻觉依然严重LoRA不能完全消除幻觉LoRA只是学习训练集中的知识训练集没有覆盖的知识点依旧会幻觉。不要幻想LoRA彻底解决幻觉。5.不要盲目调大rr越大适配器参数量越大训练显存占用上升更容易过拟合知识库场景r8‑32基本足够。9 总结本文完成QLoRA完整实战基于开源7B大模型完成领域知识库LoRA微调提供完整可运行训练、推理代码同时实现RAG参考工程从原理、代码、评测多角度对比两条技术路线。LoRA将领域知识内化到模型适配器参数架构简单适合知识固定、体量较小垂直场景但是数据集构建成本高更新知识需要重新训练海量知识容易发生遗忘过拟合。RAG依靠外部向量库检索无需训练支持热更新海量知识库但是受检索链路制约系统组件多。二者不存在谁完全替代谁。在毕业设计和工程落地中小体量、少变更业务场景可以单独使用LoRA文档量大、持续更新知识库优先RAG追求综合效果推荐LoRARAG混合架构LoRA负责领域风格适配RAG承载海量动态知识库是垂直大模型落地更稳健的方案。未来参数高效微调技术持续迭代如何降低数据集门槛缓解灾难性遗忘依然是领域值得研究的方向。

相关新闻

963745

963745

582744

2026/8/8 3:05:59 阅读更多 →
UE5 C++性能优化实战:从工具使用到代码习惯,新手也能快速上手

UE5 C++性能优化实战:从工具使用到代码习惯,新手也能快速上手

1. 项目概述:为什么大一新生也能搞定UE5 C性能优化?看到这个标题,你可能会想,UE5、C、性能优化,这几个词组合在一起,听起来就像是资深工程师的专属领域,离一个刚接触编程的大一学生很远。但我想…

2026/8/6 3:47:29 阅读更多 →
OpenClaw权限设计:从Discord机器人管理员模块看AI Agent安全实践

OpenClaw权限设计:从Discord机器人管理员模块看AI Agent安全实践

1. 从“管理员操作”看OpenClaw的权限设计哲学如果你最近在折腾OpenClaw,想让它帮你管理Discord服务器,那你大概率绕不开一个核心文件:handle-action.guild-admin.ts。这个文件名字听起来就很有分量,它直接对应着OpenClaw在Discor…

2026/8/8 6:41:48 阅读更多 →

最新新闻

ExifToolGui:告别命令行,轻松管理图片元数据的图形化神器

ExifToolGui:告别命令行,轻松管理图片元数据的图形化神器

ExifToolGui:告别命令行,轻松管理图片元数据的图形化神器 【免费下载链接】ExifToolGui A GUI for ExifTool 项目地址: https://gitcode.com/gh_mirrors/ex/ExifToolGui 还在为批量修改照片拍摄信息而烦恼吗?面对复杂的命令行操作是否…

2026/8/9 12:01:33 阅读更多 →
QuPath生物图像分析:免费开源的数字病理研究完整指南

QuPath生物图像分析:免费开源的数字病理研究完整指南

QuPath生物图像分析:免费开源的数字病理研究完整指南 【免费下载链接】qupath QuPath - Open-source bioimage analysis for research 项目地址: https://gitcode.com/gh_mirrors/qu/qupath 在数字病理和生物医学图像研究领域,你是否正在寻找一款…

2026/8/9 12:01:33 阅读更多 →
ExifToolGui终极指南:告别命令行,轻松管理图片元数据

ExifToolGui终极指南:告别命令行,轻松管理图片元数据

ExifToolGui终极指南:告别命令行,轻松管理图片元数据 【免费下载链接】ExifToolGui A GUI for ExifTool 项目地址: https://gitcode.com/gh_mirrors/ex/ExifToolGui 你是否曾为管理大量照片的拍摄信息而烦恼?是否想要批量编辑EXIF、GP…

2026/8/9 12:01:33 阅读更多 →
看懂Agent Harness:大模型再强,也离不开工程挽具

看懂Agent Harness:大模型再强,也离不开工程挽具

文章目录前言1. 先搞懂Harness是个啥1.1 本意跟马有关1.2 套到AI里瞬间就懂了2. 这些规则背后,藏着“人的先验”2.1 每条约束都是踩坑踩出来的2.2 举几个最常见的例子2.3 本质是手动补短板3. 有个老教训,今天还能用吗3.1 历史总在循环上演3.2 前辈们踩过…

2026/8/9 12:01:33 阅读更多 →
3大优化策略:Bilibili-Evolved如何实现组件智能预加载与性能飞跃

3大优化策略:Bilibili-Evolved如何实现组件智能预加载与性能飞跃

3大优化策略:Bilibili-Evolved如何实现组件智能预加载与性能飞跃 【免费下载链接】Bilibili-Evolved 强大的哔哩哔哩增强脚本 项目地址: https://gitcode.com/gh_mirrors/bi/Bilibili-Evolved 你是否曾为B站页面切换时的卡顿而烦恼?或是期待设置面…

2026/8/9 12:01:33 阅读更多 →
Oracle间隔分区:自动化管理时间序列数据的高效方案

Oracle间隔分区:自动化管理时间序列数据的高效方案

1. 什么是Oracle间隔分区?间隔分区(Interval Partitioning)是Oracle 11g引入的一种特殊的分区类型,它实际上是范围分区(Range Partitioning)的自动化扩展版本。想象一下,你正在管理一个按日期存…

2026/8/9 12:00:32 阅读更多 →

日新闻

5分钟告别提取码焦虑:baidupankey如何智能破解百度网盘资源锁

5分钟告别提取码焦虑:baidupankey如何智能破解百度网盘资源锁

5分钟告别提取码焦虑:baidupankey如何智能破解百度网盘资源锁 【免费下载链接】baidupankey 在线查询网盘提取码(维护中 rm repo) 项目地址: https://gitcode.com/gh_mirrors/ba/baidupankey 你是否曾经在深夜寻找一份重要资料&#x…

2026/8/9 0:01:47 阅读更多 →
如何快速生成中国车牌图片:Python开源工具完整指南

如何快速生成中国车牌图片:Python开源工具完整指南

如何快速生成中国车牌图片:Python开源工具完整指南 【免费下载链接】chinese_license_plate_generator 中国车牌生成器 项目地址: https://gitcode.com/gh_mirrors/ch/chinese_license_plate_generator 中国车牌生成器是一个基于Python的开源项目&#xff0c…

2026/8/9 0:01:47 阅读更多 →
收藏!小白程序员轻松入门大模型,从Harness工程开始实践

收藏!小白程序员轻松入门大模型,从Harness工程开始实践

文章强调学习大模型不应只关注模型本身,而应重视模型外的系统搭建,即Harness。提出AgentModelHarness的实用公式,详细介绍Harness的四个层次:持久化层、执行层、控制层和观察与验证层。文章还探讨了上下文工程、工具设计、AGENTS.…

2026/8/9 0:03:48 阅读更多 →

周新闻

5分钟告别提取码焦虑:baidupankey如何智能破解百度网盘资源锁

5分钟告别提取码焦虑:baidupankey如何智能破解百度网盘资源锁

5分钟告别提取码焦虑:baidupankey如何智能破解百度网盘资源锁 【免费下载链接】baidupankey 在线查询网盘提取码(维护中 rm repo) 项目地址: https://gitcode.com/gh_mirrors/ba/baidupankey 你是否曾经在深夜寻找一份重要资料&#x…

2026/8/9 0:01:47 阅读更多 →
如何快速生成中国车牌图片:Python开源工具完整指南

如何快速生成中国车牌图片:Python开源工具完整指南

如何快速生成中国车牌图片:Python开源工具完整指南 【免费下载链接】chinese_license_plate_generator 中国车牌生成器 项目地址: https://gitcode.com/gh_mirrors/ch/chinese_license_plate_generator 中国车牌生成器是一个基于Python的开源项目&#xff0c…

2026/8/9 0:01:47 阅读更多 →
收藏!小白程序员轻松入门大模型,从Harness工程开始实践

收藏!小白程序员轻松入门大模型,从Harness工程开始实践

文章强调学习大模型不应只关注模型本身,而应重视模型外的系统搭建,即Harness。提出AgentModelHarness的实用公式,详细介绍Harness的四个层次:持久化层、执行层、控制层和观察与验证层。文章还探讨了上下文工程、工具设计、AGENTS.…

2026/8/9 0:03:48 阅读更多 →

月新闻

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南 【免费下载链接】BaiduNetdiskPlugin-macOS For macOS.百度网盘 破解SVIP、下载速度限制~ 项目地址: https://gitcode.com/gh_mirrors/ba/BaiduNetdiskPlugin-macOS 还在为百度网盘macOS版的龟速下…

2026/8/8 17:02:44 阅读更多 →
终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换 【免费下载链接】ncmdump 项目地址: https://gitcode.com/gh_mirrors/ncmd/ncmdump 还在为网易云音乐下载的NCM格式文件无法在其他播放器播放而烦恼吗?ncmdump解密工具帮你轻松解决这个困…

2026/8/9 0:45:04 阅读更多 →
HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

AgentCard 智能体卡片:为英语学习 App 打造桌面级学习助手适用平台:HarmonyOS 7.0 (API 26 Beta)一、引言 HarmonyOS 7.0(API 26 Beta)新增了 AgentCard 智能体卡片能力,这是继 HMAF(鸿蒙智能体框架&#x…

2026/8/8 17:02:44 阅读更多 →