大模型入门到实战:从原理、本地部署到RAG与微调的全路线指南
想系统入门大模型的人我观察下来大部分卡在同一个地方想学的东西太多真正该学的东西没人讲网上的资料要么太理论、要么纯报菜名。这篇东西就是把我自己整理和验证过的“大模型系统性入门资料”沉淀成一条能直接执行的路线从最底层的工作原理讲到本地部署、应用开发、常见坑点一条线走下来。不管你是做后端的、做硬件的、做数据分析的还是想在企业内部做私有化部署的技术决策者这套路线你都用得上。我会用比较直接的话把概念讲清楚不给一堆玄学名词堆砌。大模型没那么神秘它的核心逻辑就几件事预测下一个词、训练三阶段、上下文窗口、微调与RAG。把这几个东西搞明白后面所有工具选型、部署方案、报错排查你都能自己拿主意了。1. 先把大模型这件事拆明白它到底在“思考”什么1.1 预测下一个词没那么玄乎大模型LLMLarge Language Model的本质其实就是“根据前文预测下一个词”的概率模型。你给它一句话它往后一个字一个字地“猜”猜出来的词再接回去再继续猜下一个最后形成一整段回复。这个“预测下一个动作”的思路和输入法联想有点像但规模完全不是一个量级输入法可能在几万个词里猜大模型在几十万种词元里猜而且它猜的每个词都带着海量的上下文推理逻辑。这里有几个基础概念必须先立住Token词元模型眼里文本的最小单位。一个Token不一定是完整单词可能是半个词、一个汉字、一个标点。模型每次预测输出的是下一个Token。你可以把Token理解成“模型读字的粒度”粒度太粗会丧失表达力粒度太细计算量会爆炸所以不同模型会自己权衡。上下文窗口模型一次能“看到”的前文长度比如4K、8K、128K。窗口越大它能记住的对话历史越多。这直接影响你能喂给它的资料长度。Temperature温度控制输出的随机性。温度调低模型倾向于选最确定的词输出稳定调高输出更发散、更有创造性。做代码或数据提取要低温度做文案创意可以稍微调高。理解了“预测下一个Token”你就明白为什么大模型有时候会一本正经地胡说八道——它只是在“猜”而不是在“查”。所谓幻觉就是因为它的训练目标从来不是保证事实正确而是保证句子概率合理。1.2 训练三阶段预训练、指令微调、偏好对齐大模型不是“一小步训练”出来的它有三个阶段每个阶段改的东西完全不一样。预训练给模型灌入海量文本让它在“预测下一个词”的过程中学语法、学知识、学逻辑关系。这个阶段决定了模型的“底子”有多厚。这也是为什么语料质量如此重要语料里有什么模型就吸收什么。指令微调SFT预训练阶段模型只会“续写”不会“听话”。指令微调就是用一堆“问题→标准答案”的样本教模型学会回答用户问题。这一步决定模型“好不好用”。偏好对齐RLHF/DPO指令微调之后模型会回答但可能回答得很敷衍、很啰嗦、甚至很有毒。对齐阶段引入人类反馈让模型学会“什么样的回答更受欢迎”。这一步决定模型“招不招人喜欢”。作为入门者你不需要亲手做这三个阶段但你得知道你在网上拿到的每个开源模型权重都已经是走完这三个阶段的产品了。你要做的是在这个基础上做“增量调整”而不是从零训练。1.3 参数量、效果与成本的三角博弈大模型圈子里天天在说参数的“B”Billion十亿7B、13B、70B、405B指的就是模型的参数量。参数量大通常代表模型的记忆容量和复杂推理能力更强但也代表你需要更多的显存才能跑得动。有个粗略的估算公式可以参考推理时模型加载到显存光是权重本身就需要“参数量 × 每个参数占用的字节数”。如果用FP16精度加载每个参数占2字节一个7B模型光权重就需要约14GB显存这还没算KV Cache等额外开销。所以很多人不会直接加载16位权重而是用量化把参数压到4位甚至更低模型体积能直接缩掉60%以上这就是后面要重点讲的部署优化手段。这里先说结论入门阶段选模型不要一味追大。70B以上的模型本地基本跑不动7B~14B的量化模型在消费级显卡上就能流畅跑日常问答、代码辅助、简单的文档分析足够用。适合自己的硬件、适合自己任务的模型才是好模型。1.4 入门学习路线和资料建议我整理资料的时候把学习路线分成四个台阶按顺序走完基本就具备了独立做项目的能力原理认知先看Transformer架构的基本原理明白“注意力机制”是让模型能关联上下文的关键。推荐阅读《Attention Is All You Need》原文不需要逐行推公式理解核心思想即可。B站和各大平台的图解文章也很多可以搭配着看。工程基础学会用Python调用OpenAI、各家云厂商的大模型API理解HTTP请求、Token计费、温度参数、流式输出这些基本概念。这个阶段能让你快速建立“用模型干活”的手感。本地部署下载开源模型权重在自己电脑上跑起来。重点掌握Ollama、llama.cpp这类推理工具理解GGUF量化文件是怎么回事。这个阶段做完你对模型的“运行形态”会非常清晰。应用开发把大模型接进真实业务。这一步的核心是三个方向Prompt Engineering、RAG检索增强生成、微调。三者的定位完全不同后面我会单独展开讲。资料方面我真正推荐的其实没多少公开的论文列表、模型卡的README、几家大厂的官方文档再加上一两个你顺手能跑通的部署工具。真正有价值的不是收藏夹里的100个链接而是你自己动手跑通的第一个模型。2. 硬件选型与工具链不买错设备、不装错工具2.1 先搞清楚瓶颈在哪儿做本地大模型部署最大的门槛其实不是“懂代码”而是“懂硬件约束”。很多人的第一反应是“我得买个好显卡”但实际跑起来你会发现显存决定你放得下多大的模型内存带宽决定你的出字速度CPU负责解码整条链路。先说显存。模型加载进来是放在显存里的显存不够模型根本起不来。这里有一个常用近似一个7B模型量化到4位后大概需要4~6GB显存13B量化后需要8~10GB70B量化后大概需要40GB以上。所以你在选显卡或者云服务器时先想清楚自己到底要跑多大的模型。再说内存带宽。显卡推理速度不只是看算力更看显存带宽。比如Apple Silicon的统一内存架构虽然算力不如旗舰显卡但带宽很高所以能跑大模型相反一些老显卡算力不错但显存带宽低跑起来就会一卡一卡的。CPU推理就更慢因为普通内存的带宽比显存低一个数量级这也是为什么“纯CPU跑大模型”大多只适合低版本量化模型和实验场景。2.2 消费级显卡、Mac与纯CPU各自怎么选我把常见选择分成三类按你的实际情况对号入座NVIDIA显卡大模型生态兼容性最好。显存8GB可以跑7B量化模型16GB可以跑13B到14B量化还能比较从容地做LoRA微调。需要注意消费级显卡一般不支持NVLink多卡之间通讯走PCIe速度有瓶颈所以“双卡跑70B”听起来很美实际体验未必好。Apple SiliconMac统一内存设计带宽高特别适合跑大模型大内存版本甚至可以跑几十B的量化模型。如果你是Mac用户入门成本很低推荐直接用Ollama和LM Studio。纯CPU机器可以跑但只推荐用来做功能验证。用llama.cpp配合GGUF量化模型7B模型的生成速度大概也就是每秒几个Token偶尔聊天可以接受生产环境就别想了。没有本地显卡、又想正经做开发的人直接用云GPU或者各大厂商提供的免费API配额。很多平台都提供免费额度足够你把接口调用、SDK使用这些基本功练熟。2.3 推理工具对比Ollama、llama.cpp、LM Studio、vLLM工具这块是新手最容易迷惑的地方。我直接做一张常用工具对照表你自己按场景选工具主要用途上手难度适合场景Ollama本地模型安装与运行极低初学者、日常使用、快速验证llama.cpp底层推理引擎中等需要精细控制、造轮子、嵌入式设备LM StudioOllama的图形化替代品极低不爱命令行、纯桌面用户vLLM高性能推理服务较高生产环境、高并发API服务Transformers微调与训练较高要做微调、要看模型内部我给你的建议是入门先用Ollama一条命令就能把模型拉下来跑起来进阶之后要学llama.cpp因为它能让你理解模型文件、量化格式、推理参数这些底层概念如果将来要做生产环境服务再学vLLM。不要一上来就折腾vLLM那玩意儿对显存规划和并发参数的配置要求很高只会打击自信心。2.4 模型文件格式GGUF、Safetensors、bin 到底什么区别很多人的第一个疑问是“Ollama安装的大模型到底是一个什么文件”答案是它在本地存放的核心文件通常就是GGUF格式的模型权重文件。GGUF是llama.cpp项目定义的量化模型格式把权重、分词器、特殊Token等打包到一个文件里方便分发和加载。另一个常见格式是Safetensors它是HuggingFace生态的标准格式适合训练和微调场景但如果你要部署推理还需要额外的运行框架。还有一个老旧的.bin格式已经被前两者逐步取代看到可以绕路。简单理解Safetensors模型训练和微调的“工作态”文件。GGUF模型部署和推理的“运行态”文件。两者之间可以互相转换但通常你不需要自己转直接去模型仓库下载对应的格式即可。3. 本地部署实操从零到能聊天的完整流程3.1 去哪儿找模型、怎么选模型模型下载渠道主要有两个HuggingFace是全球最大的模型仓库ModelScope是国内的镜像平台速度更友好。入门阶段推荐从ModelScope下载网络稳定性更好速度也快。选模型的标准我建议看三点任务匹配你偏代码就选Code系列偏中文就选Qwen、DeepSeek、Yi系列偏通用对话就选Llama系列。没有全能的模型选最匹配的。参数规模消费级显卡先锁定7B~14B的范围太高跑不动太低效果差。量化程度优先看Q4_K_M这种名字里带着量化等级的GGUF版本它在体积和效果之间平衡最好。Q2~Q3太激进效果损失明显Q8体积偏大但效果更接近原始模型。3.2 用Ollama一键部署五条命令跑通Ollama是本地部署领域最友好的工具没有之一。它几乎帮你把“下载、转换、优化、启动服务”全部封装好了。Windows用户直接去官网下载安装包装了之后命令行里就能用。然后执行ollama run qwen2.5:7b它会自动拉取模型然后进入一个交互式聊天界面。就这么简单。第一次启动需要下载几个GB的模型文件时间取决于你的网速。下载完成后后续每次启动模型都会秒进。跑起来之后你还可以启动一个兼容OpenAI格式的本地API服务这样就能用脚本调用ollama serve服务默认跑在http://localhost:11434上。你在Python里可以用openai库把base_url改到这个地址所有原来的调用逻辑都不用变非常方便。3.3 进阶玩法手动用llama.cpp部署GGUF模型Ollama封装得太好好到你把底层全忘了。想真正理解推理是怎么回事建议自己手动部署一次llama.cpp。步骤大概是到模型仓库下载一份Q4_K_M的GGUF文件。克隆llama.cpp项目源码按照官方文档编译出main这个可执行文件。运行./main -m /path/to/model.gguf -p 你好帮我介绍一下大模型 -n 256 -t 8这里-n 256表示生成256个Token-t 8表示用8个CPU线程。如果用的是GPU加速版本你会看到运行时会加载到GPU显存速度明显快很多。手动部署一遍之后你会理解Ollama背后做的事情拉GGUF文件、调推理参数、管理KV Cache、优化上下文。之后再回去用Ollama心态完全不一样。3.4 加一个本地Web界面把模型变成聊天窗口命令行聊天总归不够直观尤其是想给别人演示或者给团队用的场景。这里推荐装Open WebUI它是一个开源的本地Web聊天界面带对话历史、文件上传、模型切换等功能。用Ollama的模型做后端的话只需要一条命令启动docker run -d -p 3000:8080 --add-hosthost.docker.internal:host-gateway -v open-webui:/app/backend/data --name open-webui --restart always ghcr.io/open-webui/open-webui:main没有Docker环境的话也可以用pip直接安装启动。启动之后浏览器访问http://localhost:3000注册一个管理员账号再在设置里把后端服务地址指到http://localhost:11434就能看到你本地安装的所有模型直接在网页里和它们对话了。如果你只是自己在家里用这个Web界面不是必须的但它绝对能提升体验。尤其当你需要上传文档让模型分析的时候有个图形界面会舒服很多。4. 应用开发三板斧提示词、RAG与微调4.1 提示词工程先把基本功练扎实提示词Prompt是人和模型打交道的接口。写提示词不是“玄学”它是有章法的。我总结四个必备要素角色告诉模型它是什么身份比如“你是一位资深的前端工程师”。任务明确说明要做什么比如“帮我审查这段代码”。输入内容把原始材料给足不要让人家猜。输出格式限定结构比如“用Markdown表格输出包含风险和修改建议”。举个实际例子一个劣质的提示词是“帮我分析一下这段日志”而一个高质量的提示词是“你是一位资深SRE工程师。以下是一段生产环境的应用日志请帮我找出所有异常级别的事件并按照时间、错误码、可能原因、建议处理方式四列整理成表格。如果存在关联性错误请在表格下方单独说明。日志内容如下……”区别很明显后者把角色、任务、材料、格式全说清楚了模型输出的可用度会大幅提升。4.2 让模型“读懂”你的文档RAG实战思路很多人问“大模型如何理解文档”其实答案不是“重新训练”而是RAG检索增强生成。原理很简单当用户提问时先从你准备好的文档库里检索出最相关的内容片段拼进提示词再让模型基于这些片段作答。这样做的好处是不需要训练、不改变模型权重、也不会产生大量训练费用文档更新后只要重新切分入库就行。对企业来说这几乎是性价比最高的私有知识库落地方式。简单流程是文档加载 → 文本切分 → 向量化 → 存入向量数据库 → 用户提问时检索 → 拼接提示词 → 让模型生成回答。工具方面可以用LangChain或LlamaIndex快速搭建也可以直接用Dify这种低代码平台拖拽完成。需要注意RAG最关键的环节不是模型本身而是检索质量。如果切分策略不对或者向量化模型选得不好检索出来的片段文不对题再强的LLM也答不好。所以做RAG的时候要把大部分精力花在数据清洗、切分策略、检索召回调优上。4.3 什么时候才需要微调以及LoRA是什么热词里“大模型微调”出现频率极高很多人一上来就问“我要不要微调”。我的回答通常是绝大多数场景不需要微调先做提示词工程再做RAG最后才考虑微调。那什么时候该微调呢典型情况是这几种模型在特定领域的术语风格完全不对模型的回复格式不符合业务规范你需要模型学会一套私有指令体系比如固定的客服话术。微调的主流做法是LoRA低秩适配。它不是在全部权重上重新训练而是冻结原模型在旁边加一组轻量参数只训练这组参数。这样训练显存占用小很多普通消费级显卡也能跑训练完产出一个很小的适配文件跑推理时合并进去即可。如果你想真正动手做一次微调最快速的路径是准备几百到几千条“问题→答案”的JSONL数据。用LlamaFactory或者Unsloth这类工具几分钟就能完成数据格式转换和训练配置。在Lora参数里设置rank8到64之间学习率选1e-4左右跑1~3个epoch。训练完成导出LoRA权重用Ollama或llama.cpp加载合并后的模型。第一次跑通微调你会对“模型是怎么被改写的”有非常直观的感受。但我还是那句话能RAG解决的事不要轻易上微调省心省钱。4.4 Agent与多模态兼容热词的扩展视野系统学习大模型的路上你一定会碰到Agent和多模态这两个概念。Agent智能体可以理解成“给大模型配上工具和行动计划”。原始的大模型只会生成文本而Agent框架让模型可以调用外部工具比如查数据库、调用Python、访问网页然后根据工具的结果决定下一步动作。目前主流的Agent框架有LangChain、LlamaIndex、Dify、Coze、AutoGen、n8n等。它们的能力边界不太一样LangChain偏开发库Dify偏低代码平台Coze偏商业化部署。入门阶段建议先在Dify里拖一个简单Agent出来感受一下工具调用和任务拆分是怎么回事再深入到LangChain。多模态模型则是把文字、图像、音频、视频统一进来。现在很多模型天生就是多模态的通义千问VL系列、GPT-4o、Gemini等都能“看图说话”。你用本地部署的纯文本模型做不了“图片里的文字提取”这类任务但换一个多模态模型就能直接解决。这两块内容不需要一上来就深挖了解它们的存在和基本使用姿势等实际项目需要再系统学。入门阶段优先把纯文本LLM的链路跑通这个基础打得越牢后面学Agent和多模态越轻松。5. 常见问题与排查技巧实录5.1 一张速查表跑本地模型最常见的坑症状可能原因解决方案显存不足OOM模型太大或量化精度过高换更小模型、降低量化等级、缩短上下文长度生成速度很慢没有用GPU加速或带宽不足确认GPU已启用、检查量化等级、关闭超长上下文输出中文乱码模型没有中文调优或编码异常换中文预训练模型、检查终端编码对话总记不住上文上下文长度受限或没启用历史消息确认服务端上下文参数、客户端传参时带上完整对话记录模型下载特别慢没有走国内镜像使用ModelScope或配置HuggingFace加速镜像加载模型到一半卡死磁盘空间不足或权限问题检查模型存放目录的可用空间和权限微调后模型效果变差LoRA参数不合适或数据质量差降低学习率、清洗数据、回归原始模型对比5.2 排查思路先看日志再动手很多人一遇到模型报错就慌其实排查思路很简单。第一步永远是把报错信息完整读一遍大部分问题在报错里已经明说了。第二步是看资源占用确认显存和内存是否够用这可以用nvidia-smi监视GPU状态。第三步是确认版本兼容性Ollama、llama.cpp、Python库这几个组件的版本不一致都会导致奇怪的异常。我再分享一个大坑不要一上来就追求超长上下文。很多入门者把上下文窗口调到128K结果显存瞬间吃满速度掉到没法用。在实际业务里大多数文档分析任务根本用不到128K的上下文4K~8K已经能覆盖绝大多数场景更长的上下文意味着更大的KV Cache开销和更慢的推理速度。按需设置才是聪明的做法。5.3 省心避坑清单别一上来就微调。先把提示词调好再用RAG最后才微调。顺序反了后面要返工的量非常大。模型文件下载后先校验。很多模型仓库提供SHA256哈希值下载完对一下避免文件损坏后排查半天。别乱改系统环境变量。尤其是Python相关配置新手改坏了会连锁报错。能用虚拟环境就坚决用虚拟环境。注意磁盘空间。一个14B量化模型大概9GB多个模型换着玩200GB的剩余空间很快也会被吃光。别被“参数越大越好”带偏。对入门来说能流畅跑起来的7B模型比跑不动的70B模型有用得多。这些坑我都踩过写出来是想让你少走点弯路。大模型这个领域看起来信息爆炸但真正核心的知识就那么几块学习路径完全可以骨架化。我个人的实操体会是先跑通一次本地部署再把这套部署接到业务里完成一个真实需求你对大模型的理解深度会超过看一百篇科普文章。6. 下一步从入门到能用还差什么如果你已经顺着前面的步骤把本地模型跑通了、也接进了自己的脚本里下一步真正值得投入的方向是两个一是把RAG做完做扎实二是把Agent的“工具调用”跑通。这两个方向落地一个真实的小项目你的大模型实战能力就算立住了。后续我可能会单独开坑写“从零做一个RAG知识库问答机器人”和“用LoRA给大模型灌行业语感”这两个主题它们是从入门到能交付之间的最后两级台阶。这一篇先把地基给你打牢不贪多。

相关新闻

YOLOv9+Flask目标检测Web应用实战:从模型部署到接口优化

YOLOv9+Flask目标检测Web应用实战:从模型部署到接口优化

简介:一份基于YOLOv9与Flask框架构建的目标检测Web应用完整项目源码,面向具备一定Python基础、希望将深度学习模型落地为Web服务的开发者。项目完整展示了从模型调用、后端接口设计到前端交互展示的链路,可直接运行体验,也可作为课…

2026/10/2 15:07:20 阅读更多 →
深入解析 golang.org/x/net/http2:Go 1.27 双实现架构、wrapping 模式与 http2legacy 构建标签

深入解析 golang.org/x/net/http2:Go 1.27 双实现架构、wrapping 模式与 http2legacy 构建标签

后端即时通讯社交游戏开发 【免费下载链接】nakama Scalable open-source game backend server: multiplayer, matchmaking, leaderboards, chat, and social features for games. 项目地址: https://gitcode.com/GitHub_Trending/na/nakama 点击查看 免费下载 本文…

2026/10/2 15:07:20 阅读更多 →
从零构建AI工程:手写微型Transformer到部署完整复盘

从零构建AI工程:手写微型Transformer到部署完整复盘

如果你点进这篇博文,大概率是跟我一样有过这样的困惑:AI 领域看起来热火朝天,网上教程一搜一大把,但真让自己从零上手做点什么,又觉得全是“api调用”和“别人写好的轮子”。我去年做了一个名为 “ai-engineering-from…

2026/10/2 15:07:20 阅读更多 →

最新新闻

多引擎搜索优化Agent:流量运营的意图驱动工作流

多引擎搜索优化Agent:流量运营的意图驱动工作流

1. 这不是“AI营销课”,而是流量运营者正在悄悄升级的底层工作流 最近帮一家做ToB SaaS服务的客户做季度复盘,他们市场部负责人盯着后台数据发了半小时呆——自然搜索流量涨了37%,但来自百度、微信搜一搜、小红书、知乎、甚至淘宝搜索的用户行…

2026/10/3 21:45:41 阅读更多 →
MindSpore monitor_config 深度配置与可观测性实践

MindSpore monitor_config 深度配置与可观测性实践

1. 为什么 config.monitor_config 不是“配个参数就完事”的功能模块在 MindSpore 的实际训练项目中,我见过太多团队把config.monitor_config当成一个“开关式”配置项——改几行 YAML、加个enableTrue、指定个log_dir,就以为监控系统已经上线。结果模型…

2026/10/3 21:45:41 阅读更多 →
Qt 5.15.0在线安装失败根本原因与离线解决方案

Qt 5.15.0在线安装失败根本原因与离线解决方案

简介:本资源是一份针对Qt 5.15.0及以上版本在线安装失败问题的原创技术解决方案,面向Qt初学者、嵌入式开发工程师及高校教学实践者。文档深入剖析了官方在线安装器因连接境外服务器导致的下载缓慢、内存溢出崩溃(常卡在29%)、镜像…

2026/10/3 21:45:41 阅读更多 →
Agent Skill治理指南:从裸奔到可审计的技能组合

Agent Skill治理指南:从裸奔到可审计的技能组合

先说明一个现状:Agent Skill 生态最近热得发烫,codex、claude、hermes 这些工具都在支持自定义 skill,GitHub 上的 skill 仓库、教程和合集一天能冒出十几个。但很多人,包括我自己早期,都在“无脑装机”:看…

2026/10/3 21:45:41 阅读更多 →
大模型Agent实战入门:从ReAct架构到工具调用与记忆管理

大模型Agent实战入门:从ReAct架构到工具调用与记忆管理

1. 为什么现在都在聊大模型Agent这段时间“大模型Agent”这个词几乎霸屏了技术社区和朋友圈,GitHub上相关项目一个接一个冒出来,吴恩达的Agent教程被反复转发,各种Agent框架的讨论从早刷到晚。我身边的开发者朋友,不管是写后端的、…

2026/10/3 21:45:41 阅读更多 →
ESP32-S3驱动GC6133摄像头SPI调试硬核指南

ESP32-S3驱动GC6133摄像头SPI调试硬核指南

1. 项目概述:为什么GC6133在ESP32-S3上SPI调试会卡在“黑屏/花屏/初始化失败”这一步 你手头有一块ESP32-S3开发板,买了颗标称支持SPI接口的GC6133摄像头模组,接线照着原理图走了一遍,烧录了官方示例代码——结果串口打印出一串“…

2026/10/3 21:44:40 阅读更多 →

日新闻

把回忆蒸馏成 AI 的浪漫实验:为什么你需要前任.skill 完整指南

把回忆蒸馏成 AI 的浪漫实验:为什么你需要前任.skill 完整指南

把回忆蒸馏成 AI 的浪漫实验:为什么你需要前任.skill 完整指南 【免费下载链接】ex-skill 前任 skill 项目地址: https://gitcode.com/gh_mirrors/exsk/ex-skill 前任.skill 是一个运行在 Claude Code 上的开源 Skill:导入微信、iMessage、短信、…

2026/10/3 0:00:27 阅读更多 →
45个经典Linux面试题:从命令到网络排障的完整考点解析

45个经典Linux面试题:从命令到网络排障的完整考点解析

刚开始带应届生的时候,我最头疼的就是他们拿着一摞Linux面试题背得滚瓜烂熟,一上机全露馅。后来自己从被面的人变成面别人的人,才慢慢摸清楚:Linux面试题考的根本不是答案本身,而是你面对一个不确定的系统问题时&#…

2026/10/3 0:01:28 阅读更多 →
SAP生产预留实战指南:MB21/MB23/MB25协同与MRP集成

SAP生产预留实战指南:MB21/MB23/MB25协同与MRP集成

简介:本资源是一份面向SAP ABAP开发人员、生产计划专员及ERP实施顾问的实操型操作指南,聚焦SAP生产预留核心业务场景,系统解决物料预留创建、查询、校验与批量处理等高频问题。文档以结构化方式覆盖预留背景原理、OMC2编码规则、工厂级参数配…

2026/10/3 0:01:28 阅读更多 →

周新闻

如何划分训练/验证集:Spirula Studio五种eval_mode策略详解

如何划分训练/验证集:Spirula Studio五种eval_mode策略详解

如何划分训练/验证集:Spirula Studio五种eval_mode策略详解 【免费下载链接】spirula-studio Cross-vendor 3D Gaussian Splatting trainer - video to splat to mesh, Vulkan or CUDA. 项目地址: https://gitcode.com/GitHub_Trending/sp/spirula-studio Sp…

2026/10/3 9:14:33 阅读更多 →
SEO怎么推广速查手册新手避坑实战指南

SEO怎么推广速查手册新手避坑实战指南

SEO怎么推广速查手册新手避坑实战指南 模板网站太丑不够用?别急着加滤镜,那是治标不治本。很多老板盯着后台流量掉得眼红,却还在纠结首页Banner的圆角是不是3像素。这就像穿着西装去挖土,姿势不对,努力白费。我整理这份 速查手册…

2026/10/3 9:47:50 阅读更多 →
FireRed-OpenStoryline少样本仿写深度解析:AI Agent如何复刻你的独特文案风格与节奏

FireRed-OpenStoryline少样本仿写深度解析:AI Agent如何复刻你的独特文案风格与节奏

FireRed-OpenStoryline少样本仿写深度解析:AI Agent如何复刻你的独特文案风格与节奏 【免费下载链接】FireRed-OpenStoryline FireRed-OpenStoryline is an AI video editing agent that transforms manual editing into intention-driven directing through natural language …

2026/10/3 9:42:31 阅读更多 →

月新闻

我发现了一个新思路:用 Remotion + Claude Code 像写代码一样自动化生成短视频

我发现了一个新思路:用 Remotion + Claude Code 像写代码一样自动化生成短视频

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/2 10:36:31 阅读更多 →
Windows下 Codex 中 Chrome 和 Computer Use 插件不可用问题排查及解决参考方式:TaoToken 统一 Key 配置与验证

Windows下 Codex 中 Chrome 和 Computer Use 插件不可用问题排查及解决参考方式:TaoToken 统一 Key 配置与验证

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/3 9:42:35 阅读更多 →
黑夜航拍船只数据集训练YOLOV5模型全流程解析

黑夜航拍船只数据集训练YOLOV5模型全流程解析

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/3 9:42:36 阅读更多 →