前言ollama 是模型管理器可以通过他 pull\create 创建ai模型然后 通过run 跑 ai模型 进行对话命令行pull会很慢可以 自己去下载 模型需要下载资源1.ollama 2. 需要的模型 我这里下载的DeepSeek-R1-Distill-Qwen-7B-Q4_K_M.gguf然后 openweb-ui是 openai可视化工具 启动后 是 浏览器 访问 localhost:8080 进行管理一模型安装、使用下载ollama和 模型之后 安装 ollama命令行ollama 命令生效就行然后 在模型gguf 文件所在目录下创建 Modelfile 内容如下FROM ./DeepSeek-R1-Distill-Qwen-7B-Q4_K_M.ggufPARAMETER num_ctx 4096然后 通过命令 ollama create deepseek-r1:7b -f Modelfile 加载模型 - 会很大加载的路径 可以指定设置环境变量 OLLAMA_MODELS 值是你想存放的路径然后 可以 通过 ollama list 查看 已有的模型我这里装了三个deepseek\qwen-coder\nomic-embed-text其中前两个是 通过下载文件 创建的(因为很大pull会经常断丢失) nomic-embed-text是通过pull安装的因为他很小注nomic-embed-text 是使用知识库需要的向量模型当然 openweb-ui 会自动下载一个默认的模型可以改用 ollama的这个 nomic-embed-text 模型完了之后 通过 ollama run 模型名 来启动测试二openWeb UI1.安装 python nodejspython 3.11 版本 nodejs 20.20版本2.github上下载openweb ui 源码然后 进入目录 进行前端页面编译 (npm install 后面 加 --registyhttps://registry.npmmirror.com 可以加速 )npm installnpm run build然后进入 backend目录 进行 后端代码编译py -i https://pypi.tuna.tsinghua.edu.cn/simple 可以加速py -m pip install -r requirements.txt然后 启动 openweb-uibackend有个 start_windows.bat 启动批处理直接命令行 start_windows.bat启动如果提示 uvicorn 命令没有 改bat文件 找到 uvicorn 这个 前面加 py -m原本uvicorn xxxxx改成py -m uvicorn xxxxxx注需要 py -m pip install uvicorn (加速 加 -i https://pypi.tuna.tsinghua.edu.cn/simple)在启动 前 可以设置环境变量或者直接配置系统环境变量set HF_ENDPOINThttps://hf-mirror.comset OFFLINE_MODE1set RAG_EMBEDDING_ENGINEollamaset RAG_EMBEDDING_MODELnomic-embed-text显示 started 就成功了然后 浏览器 访问 http://localhost:8080 注册 管理员 登录找到左下角管理员面板 点击 然后点设置在弹窗左侧下滑找到文档 使用 ollama模型然后嵌入模型就是写前面pull 很小的 向量模型名字然后点击左下角保存然后关闭设置弹窗点新对话选择模型然后对话