Ollama开源的大型语言模型(LLM)平台
Ollama简介Ollama 是一个开源的大型语言模型LLM平台旨在让用户能够轻松地在本地运行、管理和与大型语言模型进行交互。Ollama 提供了一个简单的方式来加载和使用各种预训练的语言模型支持文本生成、翻译、代码编写、问答等多种自然语言处理任务。Ollama 的特点在于它不仅仅提供了现成的模型和工具集还提供了方便的界面和 API使得从文本生成、对话系统到语义分析等任务都能快速实现。与其他 NLP 框架不同Ollama 旨在简化用户的工作流程使得机器学习不再是只有深度技术背景的开发者才能触及的领域。Ollama 支持多种硬件加速选项包括纯 CPU 推理和各类底层计算架构如 Apple Silicon能够更好地利用不同类型的硬件资源。官方网站https://ollama.com/downloadOllama安装Windows 系统安装访问官网下载安装包打开浏览器访问 Ollama 官方网站https://ollama.com/download下载适用于 Windows 的安装程序。下载地址为https://ollama.com/download/OllamaSetup.exe。下载完成后双击安装程序并按照提示完成安装。更改安装路径可选如果需要将 Ollama 安装到非默认路径可以在安装时通过命令行指定路径例如OllamaSetup.exe /DIRd:\some\location这样可以将 Ollama 安装到指定的目录。验证安装打开命令提示符或 PowerShell输入以下命令验证安装是否成功ollama --version如果显示版本号则说明安装成功。macOS 系统安装访问官网下载安装包打开浏览器访问 Ollama 官方网站https://ollama.com/download下载适用于 macOS 的安装程序。下载地址为https://ollama.com/download/Ollama-darwin.zip。下载完成后双击安装包并按照提示完成安装。安装完成后通过以下命令验证ollama --version如果显示版本号则说明安装成功。Linux 系统安装Linux 下可以使用一键安装脚本我们打开终端运行以下命令curl -fsSL https://ollama.com/install.sh | bash安装完成后通过以下命令验证ollama --version如果显示版本号则说明安装成功。Docker 安装如果你熟悉 Docker也可以通过 Docker 安装 Ollama。官方 Docker 镜像 ollama/ollama 可在 Docker Hub 上获取https://hub.docker.com/r/ollama/ollama。拉取 Docker 镜像docker pull ollama/ollama运行容器docker run -p 11434:11434 ollama/ollama访问 http://localhost:11434 即可使用 Ollama。Ollama 运行模型命令行运行Ollama 运行模型使用 ollama run 命令。ollama run deepseek-r1:671bOllama 支持的模型可以访问https://ollama.com/librarypython SDK运行安装 Python SDK首先需要安装 Ollama 的 Python SDK打开终端执行以下命令pip install ollama编写 Python 脚本接下来你可以使用 Python 代码来加载和与模型交互。以下是一个简单的 Python 脚本示例演示如何使用 LLama3.2 模型来生成文本实例import ollamaresponse ollama.generate(model“llama3.2”, # 模型名称prompt“你是谁。” # 提示文本)print(response)运行 Python 脚本在终端中运行你的 Python 脚本python test.py你会看到模型根据你的输入返回的回答。对话模式实例from ollama import chat response chat( modelllama3.2, messages[ {role: user, content: 为什么天空是蓝色的} ] ) print(response.message.content)此代码会与模型进行对话并打印模型的回复。流式响应实例from ollama import chat stream chat( modelllama3.2, messages[{role: user, content: 为什么天空是蓝色的}], streamTrue ) for chunk in stream: print(chunk[message][content], end, flushTrue)此代码会以流式方式接收模型的响应适用于处理大数据。Ollama相关命令模型管理拉取模型从模型库中下载模型ollama pull model-name例如ollama pull llama2运行模型运行已下载的模型ollama run model-name例如ollama run llama2列出本地模型查看已下载的模型列表ollama list删除模型删除本地模型ollama rm model-name例如ollama rm llama2自定义模型创建自定义模型基于现有模型创建自定义模型ollama create custom-model-name -f Modelfile例如ollama create my-llama2 -f ./Modelfile复制模型复制一个已存在的模型ollama cp source-model-name new-model-name例如ollama cp llama2 my-llama2-copy推送自定义模型将自定义模型推送到模型库ollama push model-name例如ollama push my-llama2服务管理启动 Ollama 服务启动 Ollama 服务以在后台运行ollama serve停止 Ollama 服务停止正在运行的 Ollama 服务ollama stop重启 Ollama 服务重启 Ollama 服务ollama restart其他常用命令查看帮助查看所有可用命令ollama --help查看版本信息查看当前安装的 Ollama 版本ollama version更新 Ollama更新 Ollama 到最新版本ollama update查看日志查看 Ollama 的日志信息ollama logs清理缓存清理 Ollama 的缓存ollama clean模型信息查看模型详细信息查看指定模型的详细信息ollama show model-name例如ollama show llama2查看模型依赖查看模型的依赖关系ollama deps model-name例如ollama deps llama2查看模型配置查看模型的配置文件ollama config model-name例如ollama config llama2导入与导出导出模型将模型导出为文件ollama export model-name output-file例如ollama export llama2 llama2.tar导入模型从文件导入模型ollama import input-file例如ollama import llama2.tar系统信息查看系统信息查看 Ollama 的系统信息ollama system查看资源使用情况查看模型的资源使用情况ollama resources model-name例如ollama resources llama2模型性能查看模型性能查看模型的性能指标ollama perf model-name例如ollama perf llama2模型历史查看模型历史记录查看模型的历史记录ollama history model-name例如ollama history llama2模型状态检查模型状态检查指定模型的状态ollama status model-name例如ollama status llama2Ollama 模型交互Ollama 提供了多种方式与模型进行交互其中最常见的就是通过命令行进行推理操作。命令行交互通过命令行直接与模型进行交互是最简单的方式。运行模型使用 ollama run 命令启动模型并进入交互模式ollama run model-name例如我们下载 deepseek-coder 模型实例ollama run deepseek-coder启动后您可以直接输入问题或指令模型会实时生成响应。 你好你能帮我写一段代码吗 当然可以。但是首先我想知道您希望在哪种编程语言中实现这个功能例如Python、JavaScript等和要解决什么问题或者完成的任务是什么样的例子呢这样我们可以为您提供更准确的 内容同时也方便我帮助你写出最适合您的代码片段。 写一段 python hello world 当然可以这是一个简单的 Hello, World! 程序print(Hello, World!)这个脚本会输出Hello, World!并将其打印到控制台上。这只是最基本的 Python Hello world示例Python是一种解释型、通用型的编程语言以其简洁性和易读性而闻名。它还允许用户在代码中插入变量和表达式来创建复杂的行为。退出交互模式在交互模式下输入 /bye 或按下 Ctrld 退出。单次命令交互如果您只需要模型生成一次响应可以直接在命令行中传递输入。使用管道输入通过管道将输入传递给模型实例echo 你是谁 | ollama run deepseek-coder输出结果如下我是由中国的深度求索DeepSeek公司开发的编程智能助手名为DeepCoder。我专注于解答计算机科学相关的问题和任务。如果你有任何关于这个领域的话题或者需要帮助的地方请 随时提问使用命令行参数直接在命令行中传递输入ollama run deepseek-coder Python 的 hello world 代码输出结果如下在 Python 中“Hello World!” 通常是这段简单的脚本print(Hello World!)当你运行这个程序时它会输出Hello, World。这是因为 print() 函数将字符串 “Hello, World” 打印到标准输出设备 (stdout) - 也就是你的屏幕上显示的信息在这种情况下是命令行终端或类似的工具中运行 Python 脚本时它会直接写入控制台。多轮对话Ollama 支持多轮对话模型可以记住上下文。实例 你好你能帮我写一段 Python 代码吗 当然可以请告诉我你需要实现什么功能。 我想写一个计算斐波那契数列的函数。 好的以下是一个简单的 Python 函数 def fibonacci(n): if n 1: return n else: return fibonacci(n-1) fibonacci(n-2)文件输入可以将文件内容作为输入传递给模型。假设 input.txt 文件内容为Python 的 hello world 代码将 input.txt 文件内容作为输入ollama run deepseek-coder input.txt自定义提示词通过 Modelfile 定义自定义提示词或系统指令使模型在交互中遵循特定规则。创建自定义模型编写一个 ModelfileModelfile文件为以Modelfile命名无扩展名的文件实例FROM deepseek-coder SYSTEM 你是一个编程助手专门帮助用户编写代码。 然后创建自定义模型 ollama create runoob-coder -f ./Modelfile 运行自定义模型: ollama run runoob-coder交互日志Ollama 会记录交互日志方便调试和分析。查看日志:ollama logs创建模型准备Modelfile文件FROM deepseek-r1 SYSTEM 你是华星重工智能助理专门帮助华星重工及客户解决问题在ollama官网创建一个模型ollama配置本地秘钥找到本地的秘钥不同系统对应的地址如下macOS~/.ollama/id_ed25519.pubLinux/usr/share/ollama/.ollama/id_ed25519.pubWindowsC:\Users\username\.ollama\id_ed25519.pubNext, add it as a key in settings↗.点击settings将本地的秘钥添加进去推送本地模型到ollama使用命名行进行推送ollama push rckj/hxjx-AIOllama Open WebUIOpen WebUI 用户友好的 AI 界面支持 Ollama、OpenAI API 等。Open WebUI 支持多种语言模型运行器如 Ollama 和 OpenAI 兼容 API并内置了用于检索增强生成RAG的推理引擎使其成为强大的 AI 部署解决方案。Open WebUI 可自定义 OpenAI API URL连接 LMStudio、GroqCloud、Mistral、OpenRouter 等。Open WebUI 管理员可创建详细的用户角色和权限确保安全的用户环境同时提供定制化的用户体验。Open WebUI 支持桌面、笔记本电脑和移动设备并提供移动设备上的渐进式 Web 应用PWA支持离线访问。开源地址https://github.com/open-webui/open-webui官方文档https://docs.openwebui.com/安装Open WebUI 提供多种安装方式包括通过 Python pip 安装、Docker 安装、Docker Compose、Kustomize 和 Helm 等。使用 Docker 快速开始如果 Ollama 已安装在你的电脑上使用以下命令docker run -d -p 3000:8080 --add-hosthost.docker.internal:host-gateway -v open-webui:/app/backend/data --name open-webui --restart always ghcr.io/open-webui/open-webui:main使用 Nvidia GPU 支持运行 Open WebUIdocker run -d -p 3000:8080 --gpus all --add-hosthost.docker.internal:host-gateway -v open-webui:/app/backend/data --name open-webui --restart always ghcr.io/open-webui/open-webui:cudaOpen WebUI 与 Ollama 捆绑安装此安装方法使用一个单一的容器镜像将 Open WebUI 与 Ollama 捆绑在一起可以通过一个命令轻松设置。根据你的硬件配置选择合适的命令。启用 GPU 支持docker run -d -p 3000:8080 --gpusall -v ollama:/root/.ollama -v open-webui:/app/backend/data --name open-webui --restart always ghcr.io/open-webui/open-webui:ollama仅使用 CPUdocker run -d -p 3000:8080 -v ollama:/root/.ollama -v open-webui:/app/backend/data --name open-webui --restart always ghcr.io/open-webui/open-webui:ollama这两个命令都能帮助你简化安装过程让 Open WebUI 和 Ollama 无缝运行。安装完成后你可以通过访问 http://localhost:3000 使用 Open WebUI。更新 Open WebUI手动更新使用 Watchtower 手动更新 Docker 容器docker run --rm -v /var/run/docker.sock:/var/run/docker.sock containrrr/watchtower --run-once open-webui自动更新每 5 分钟自动更新容器docker run -d --name watchtower --restart unless-stopped -v /var/run/docker.sock:/var/run/docker.sock containrrr/watchtower --interval 300 open-webui注意如果你的容器名不同请将 open-webui 替换为你的容器名。手动安装Open WebUI 的安装有两种主要方法使用 uv runtime manager 或 Python 的 pip。推荐使用 uv因为它简化了环境管理减少了潜在的冲突。使用 uv 安装推荐macOS/Linuxcurl -LsSf https://astral.sh/uv/install.sh | shWindowspowershell -ExecutionPolicy ByPass -c irm https://astral.sh/uv/install.ps1 | iex运行 Open WebUI安装 UV 后运行 Open WebUI 就比较简单了。使用以下命令确保设置 DATA_DIR 环境变量以避免数据丢失。macOS/LinuxDATA_DIR~/.open-webui uvx --python 3.11 open-webuilatest serveWindows$env:DATA_DIRC:\open-webui\data; uvx --python 3.11 open-webuilatest serve通过 pip 安装Open WebUI 可以通过 Python 的包安装程序 pip 进行安装在开始安装之前请确保您使用的是 Python 3.11以避免可能出现的兼容性问题。打开您的终端运行以下命令以安装 Open WebUIpip install open-webui安装完成后您可以通过以下命令启动 Open WebUIopen-webui serve启动后Open WebUI 服务器将运行在 http://localhost:8080您可以通过浏览器访问该地址来使用 Open WebUI。

相关新闻

3分钟快速上手:foobar2000终极美化指南,打造专业级音乐播放体验

3分钟快速上手:foobar2000终极美化指南,打造专业级音乐播放体验

3分钟快速上手:foobar2000终极美化指南,打造专业级音乐播放体验 【免费下载链接】foobox-cn DUI 配置 for foobar2000 项目地址: https://gitcode.com/GitHub_Trending/fo/foobox-cn 还在为foobar2000单调的界面而烦恼吗?想要一个既美…

2026/8/5 18:16:14 阅读更多 →
Peeky测试环境配置:Node与浏览器模式的灵活切换技巧

Peeky测试环境配置:Node与浏览器模式的灵活切换技巧

Peeky测试环境配置:Node与浏览器模式的灵活切换技巧 【免费下载链接】peeky A fast and fun test runner for Vite & Node 🐈️ Powered by Vite ⚡️ 项目地址: https://gitcode.com/gh_mirrors/pe/peeky Peeky是一款由Vite驱动的快速且有趣…

2026/8/5 18:16:14 阅读更多 →
Video2X技术架构深度解析:现代C++视频超分辨率框架的设计哲学

Video2X技术架构深度解析:现代C++视频超分辨率框架的设计哲学

Video2X技术架构深度解析:现代C视频超分辨率框架的设计哲学 【免费下载链接】video2x A machine learning-based video super resolution and frame interpolation framework. Est. Hack the Valley II, 2018. 项目地址: https://gitcode.com/GitHub_Trending/vi/…

2026/8/5 18:16:14 阅读更多 →

最新新闻

明日方舟MAA助手完整指南:3步实现游戏自动化,每天节省2小时

明日方舟MAA助手完整指南:3步实现游戏自动化,每天节省2小时

明日方舟MAA助手完整指南:3步实现游戏自动化,每天节省2小时 【免费下载链接】MaaAssistantArknights 《明日方舟》小助手,全日常一键长草!| A one-click tool for the daily tasks of Arknights, supporting all clients. 项目地…

2026/8/5 18:54:28 阅读更多 →
FGO-py深度解析:全自动免配置的Fate/Grand Order智能助手实战指南

FGO-py深度解析:全自动免配置的Fate/Grand Order智能助手实战指南

FGO-py深度解析:全自动免配置的Fate/Grand Order智能助手实战指南 【免费下载链接】FGO-py 自动爬塔! 自动每周任务! 全自动免配置跨平台的Fate/Grand Order助手.启动脚本,上床睡觉,养肝护发,满加成圣诞了解一下? 项目地址: https://gitcode.com/GitHub_Trending…

2026/8/5 18:54:28 阅读更多 →
10分钟精通Obsidian-Git行作者功能:从基础配置到高级技巧全指南

10分钟精通Obsidian-Git行作者功能:从基础配置到高级技巧全指南

10分钟精通Obsidian-Git行作者功能:从基础配置到高级技巧全指南 【免费下载链接】obsidian-git Integrate Git version control with automatic commit-and-sync and other advanced features in Obsidian.md 项目地址: https://gitcode.com/gh_mirrors/ob/obsidi…

2026/8/5 18:54:28 阅读更多 →
Ruby on Rails 框架曝高危漏洞 CVE - 2026 - 66066,企业需紧急应对!

Ruby on Rails 框架曝高危漏洞 CVE - 2026 - 66066,企业需紧急应对!

漏洞概述Ruby on Rails(“Rails”)Web 应用程序框架近日曝出一个新的严重漏洞 CVE - 2026 - 66066,它能让看似无害的图片成为窥探秘密的入口。该漏洞于 7 月 30 日披露,严重程度评分高达 9.5 分(满分 10 分&#xff09…

2026/8/5 18:54:28 阅读更多 →
OneDark-Pro主题终极指南:从新手到高手的完整使用教程

OneDark-Pro主题终极指南:从新手到高手的完整使用教程

OneDark-Pro主题终极指南:从新手到高手的完整使用教程 【免费下载链接】OneDark-Pro Atoms iconic One Dark theme for Visual Studio Code 项目地址: https://gitcode.com/gh_mirrors/on/OneDark-Pro 您是否曾为VS Code编辑器单调的界面感到厌倦&#xff1f…

2026/8/5 18:54:28 阅读更多 →
纯真社区版IP库,免费授权

纯真社区版IP库,免费授权

纯真IP库:社区版免费授权,商业版精准服务 自2005年起,纯真(CZ88.NET)一直为广大社区用户提供免费的社区版IP地址库服务。这项服务已成为国内开发者、网络管理员和IT爱好者的重要资源。只要获得纯真的授权,用户就能免费使用这一IP库&#xff0…

2026/8/5 18:53:27 阅读更多 →

日新闻

Java缓存框架:JetCache

Java缓存框架:JetCache

TOC 一、简介 JetCache 是一个 Java 缓存抽象框架,为不同的缓存解决方案提供了统一的使用方式。 它提供的注解比 Spring Cache 更加强大。 JetCache 的注解支持原生 TTL、两级缓存以及在分布式环境中的自动刷新功能,同时你也可以通过代码直接操作 Cach…

2026/8/5 0:00:43 阅读更多 →
AD 铺铜设置十字连接,过孔全连接,新版AD的简单设置

AD 铺铜设置十字连接,过孔全连接,新版AD的简单设置

需求:通孔焊盘 十字花;过孔 Via 实心直连;贴片焊盘按需设置 AD 测试版本AD24 很多工程师踩坑:全部统一十字,导致接地过孔阻抗高、大电流发热! 一、快捷键打开规则 PCB 界面按下:D R 展开…

2026/8/5 0:00:43 阅读更多 →
AI素描转换技术深度拆解(2024最新论文+工业级落地代码):从Stable Diffusion ControlNet到LoRA微调全链路解析

AI素描转换技术深度拆解(2024最新论文+工业级落地代码):从Stable Diffusion ControlNet到LoRA微调全链路解析

更多请点击: https://kaifayun.com 第一章:AI生成素描效果 AI生成素描效果是计算机视觉与风格迁移技术融合的典型应用,其核心在于将彩色照片或RGB图像转换为具有手绘质感、明暗对比强烈、边缘清晰的单色素描图像。该过程通常依赖于深度学习模…

2026/8/5 0:00:43 阅读更多 →

周新闻

最大流算法详解:从水管网络到Ford-Fulkerson与Dinic实战

最大流算法详解:从水管网络到Ford-Fulkerson与Dinic实战

1. 从水管网络到最大流:一个核心问题的诞生想象一下,你是一个城市供水系统的总工程师。你的城市有多个水源(水库),需要通过一个复杂的地下管道网络,将水输送到各个居民区。每条管道都有其最大通水能力&…

2026/8/5 15:00:43 阅读更多 →
基于Springboot的企业门户网站(源码+LW+调试文档+讲解)

基于Springboot的企业门户网站(源码+LW+调试文档+讲解)

温馨提示:本人主页置顶文章(点我)开头有 CSDN 平台官方提供的学长联系方式的名片! 温馨提示:本人主页置顶文章(点我)开头有 CSDN 平台官方提供的学长联系方式的名片! 温馨提示:本人主页置顶文章(点我)开头有 CSDN 平台…

2026/8/5 13:13:56 阅读更多 →
MATLAB xcorr函数详解:从互相关原理到四大实战应用

MATLAB xcorr函数详解:从互相关原理到四大实战应用

1. 从一次信号“找茬”说起:为什么我们需要互相关几年前,我在处理一组声学传感器数据时遇到了一个棘手的问题。我有两个麦克风记录了一段相同的音频信号,理论上它们接收到的声音波形应该非常相似,只是由于麦克风位置不同&#xff…

2026/8/5 10:20:36 阅读更多 →

月新闻

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南 【免费下载链接】BaiduNetdiskPlugin-macOS For macOS.百度网盘 破解SVIP、下载速度限制~ 项目地址: https://gitcode.com/gh_mirrors/ba/BaiduNetdiskPlugin-macOS 还在为百度网盘macOS版的龟速下…

2026/8/4 13:38:24 阅读更多 →
终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换 【免费下载链接】ncmdump 项目地址: https://gitcode.com/gh_mirrors/ncmd/ncmdump 还在为网易云音乐下载的NCM格式文件无法在其他播放器播放而烦恼吗?ncmdump解密工具帮你轻松解决这个困…

2026/8/4 11:09:16 阅读更多 →
HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

AgentCard 智能体卡片:为英语学习 App 打造桌面级学习助手适用平台:HarmonyOS 7.0 (API 26 Beta)一、引言 HarmonyOS 7.0(API 26 Beta)新增了 AgentCard 智能体卡片能力,这是继 HMAF(鸿蒙智能体框架&#x…

2026/8/4 13:38:40 阅读更多 →