免费跑自己的 AI Agent:Hermes-CN-Desktop 接入 Ollama 与 LM Studio 本地模型完整指南
人工智能AI Agent桌面应用【免费下载链接】Hermes-CN-DesktopHermes Agent CN desktop app, Windows-First, built with Tauri, Typescript and Rust. Isolated Hermes Agent core insides.项目地址https://gitcode.com/gh_mirrors/he/Hermes-CN-Desktop点击查看免费下载Hermes-CN-Desktop 是 Hermes Agent 中文社区推出的 AI Agent 桌面客户端基于 Tauri Rust TypeScript 构建内置独立 Hermes Agent 内核。它原生支持 Ollama、LM Studio、vLLM、llama.cpp 等本地部署方案只需在「设置 → 模型」里填入本地端点就能免费、离线、不限量地跑自己的 AI Agent数据全部留在你自己的电脑上。为什么要在本地免费跑 AI Agent云端模型按 token 计费、对话内容会上传到第三方服务器。而使用Ollama 或 LM Studio 本地模型 Hermes-CN-Desktop的组合你可以获得零费用模型在本地推理不产生任何 API 调用费用数据隐私代码、聊天记录、文件内容全部留在本机⚡离线可用断网也能工作适合内网、涉密环境️Agent 能力完整聊天、流式输出、MCP 工具、Skills、Memory、定时任务一个不少桌面端对本地生态的支持见 README.md「亮点」章节覆盖 Ollama、vLLM、LM Studio、llama.cpp 等本地部署方案。开始前的准备清单准备项说明电脑硬件建议 16GB 内存起步模型越大对显存/内存要求越高本地运行时安装Ollama或LM Studio二选一本文两条路线都讲模型规格上下文窗口必须 ≥ 64,000 tokens推荐 65,536桌面客户端安装 Hermes-CN-Desktop Windows / macOS 安装包⚠️ 特别提醒Hermes Agent 会拒绝低于 64K 上下文的本地模型。这个限制定义在 local-provider-context.tsMINIMUM_LOCAL_CONTEXT_LENGTH 64_000RECOMMENDED_LOCAL_CONTEXT_LENGTH 65_536所以加载模型时上下文一定要拉满到 65,536 以上。首次启动桌面端时如果还没有配置模型会自动弹出「开始使用 Hermes」引导弹窗源码model-onboarding-dialog.tsx点击「配置模型」即可直达模型设置页。路线一使用 Ollama 接入本地模型Ollama 是命令行式的本地模型管理器拉取模型非常方便。第 1 步拉取并启动模型以 Qwen2.5-Coder 为例拉取模型并把上下文设为 65536ollama pull qwen2.5-coder:7b ollama run qwen2.5-coder:7b -c 65536也可以用 Modelfile 永久指定上下文。Ollama 的 OpenAI 兼容端点默认监听在http://127.0.0.1:11434/v1API Key 通常留空即可。第 2 步在桌面端一键应用 Ollama 预设进入「设置 → 模型」点击「添加自定义服务商」并选择「本地部署」弹窗中会列出 Ollama、LM Studio、vLLM、llama.cpp 四张预设卡片见 settings-models-section.tsx 中的LOCAL_PROVIDER_PRESETS。点击Ollama卡片Base URL 会自动填好http://127.0.0.1:11434/v1模型名默认为qwen2.5-coder:7b你可以直接保存。路线二使用 LM Studio 接入本地模型LM Studio 提供图形界面更适合新手。第 1 步启动本地服务在 LM Studio 中下载一个模型建议 7B 级别起步打开Developer / Local Server面板把Context Length 调到 ≥ 65536重新加载模型后点击Start ServerLM Studio 的 OpenAI 兼容端点为http://127.0.0.1:1234/v1同样不需要 API Key。第 2 步在桌面端应用 LM Studio 预设同样在「添加本地部署服务商」弹窗中点击LM Studio卡片Base URL 自动填为http://127.0.0.1:1234/v1填入你的模型名称点击「刷新模型列表」即可从本地服务拉取模型清单。关键一步手动设置上下文窗口本地模型的上下文长度经常探测不准桌面端允许你在主模型卡片里手动声明上下文窗口token 数该值拥有最高优先级。操作路径「设置 → 模型 → 主模型卡片 → 上下文窗口」填入65536并保存。留空或填0表示回退到自动探测。该功能的完整设计说明可参考 custom-model-context-window.md。配置完成后卡片上会显示「自动探测 / 用户覆盖 / 实际生效」三个值方便你确认最终生效的窗口大小。验证连接并开始使用保存后点击「设为当前模型」然后直接发一条消息测试。如果服务未启动或模型未加载界面会给出明确的超时提示告诉你确认本地服务已启动、模型已加载、上下文窗口足够大提示文案来源gateway-result.ts。一切正常后你就可以在聊天窗口中免费使用自己的 AI Agent 了还可以打开「健康状态」面板查看运行时信息。常见问题排查FAQ现象原因与解决请求超时本地服务没启动、模型没加载或上下文没设够。回 Ollama / LM Studio 检查后重试提示「上下文低于 64,000 tokens」在本地运行时和桌面端「上下文窗口」中都设为 65,536并重新加载模型刷新不到模型列表确认 Base URL 带/v1后缀LM Studio 未点击 Start ServerOllama 未ollama pull填了 API Key 报 401本地部署不需要 Key把 API Key清空响应很慢模型太大。换更小的量化模型或降低并发任务 进阶玩法本地跑 Hermes Agent 之外还可以配合定时任务、Skills 库和 Memory 记忆系统打造完全离线的个人智能助理。总结把 Hermes-CN-Desktop 和 Ollama / LM Studio 组合起来你花0 元就能拥有一个私有、离线、能力完整的 AI Agent本地运行时Ollama 或 LM Studio加载模型上下文设为65536桌面端「设置 → 模型」点击对应预设卡片填好 Base URL手动设置上下文窗口为 65,536设为当前模型发一条消息享受免费本地推理 想深入了解桌面端架构与本地生态支持可以阅读 README.md 与项目文档目录 docs/。赞分享人工智能AI Agent桌面应用【免费下载链接】Hermes-CN-DesktopHermes Agent CN desktop app, Windows-First, built with Tauri, Typescript and Rust. Isolated Hermes Agent core insides.项目地址https://gitcode.com/gh_mirrors/he/Hermes-CN-Desktop点击查看免费下载相关推荐Zed 本地模型接入实战llama.cpp、Ollama 与 LM Studio 的完整配置指南Zed 本地模型接入实战llama.cpp、Ollama 与 LM Studio 的完整配置指南 本文基于 Zed 官方文档 Use a Local Mode开发工具代码编辑器桌面应用VoltAgent 接入 LM Studio用本地模型驱动 AI Agent 的完整指南VoltAgent 接入 LM Studio用本地模型驱动 AI Agent 的完整指南 导读 本文讲解如何在 VoltAgent 的模型路由model r人工智能AI AgentAgent 框架后端多智能体RAG工具调用Agent 记忆Agent 工作流AI 评测MCP 服务MCP Clients语音OpenExecutive本地模型配置教程Ollama、vLLM与LM Studio免费运行AI高管的完整方案OpenExecutive本地模型配置教程Ollama、vLLM与LM Studio免费运行AI高管的完整方案 OpenExecutive 是一个 AI 虚拟人工智能AI 应用AI AgentAgent 记忆MCP 服务RAG后端前端创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

教务知识图谱实战:从数据库到可问答的语义网络

教务知识图谱实战:从数据库到可问答的语义网络

简介:本资源是一套基于知识图谱构建的教务领域智能问答系统Python实现,面向计算机及相关专业本科生,适用于毕业设计、期末大作业与项目实战训练。系统覆盖教务常见场景(如选课、毕业答辩、奖学金评定、暑期学校等)&…

2026/10/11 16:28:40 阅读更多 →
私域流量爆发后,自动回复机器人如何撑起标准化客服响应

私域流量爆发后,自动回复机器人如何撑起标准化客服响应

做私域的朋友应该都经历过这种时刻:优惠券一放,群里咨询量肉眼可见地往上涨,客服手指敲出了火星,依然有一大片消息标着未读。客户等久了会退群,会去群里问“还有人管吗”,更直接的可能转身就去别家下单。这…

2026/10/11 16:28:40 阅读更多 →
SpringBoot+Vue外卖系统实战:骑手接单配送全流程设计与部署

SpringBoot+Vue外卖系统实战:骑手接单配送全流程设计与部署

做Java SpringBoot Vue这套外卖管理系统,我前后带过不少人跑通整个骑手接单配送流程。说实话,这个项目放在简历上和毕业设计里都属于非常“扛打”的类型——业务链路完整、角色划分清晰、技术栈贴合企业主流。今天这篇不是抄官方文档,是我实…

2026/10/11 16:28:40 阅读更多 →

最新新闻

Spring Boot + Vue民宿预订网站全栈开发实战与部署指南

Spring Boot + Vue民宿预订网站全栈开发实战与部署指南

1. 项目概述手记做民宿房源预订网站,这几年算是个非常典型的全栈练手项目,同时也是很多毕业设计、个人作品集里的常客。市面上类似的系统不少,但大多数要么只停留在管理后台,要么前端拿模板硬套,真正能做到前后端分离、…

2026/10/11 18:06:40 阅读更多 →
输电线路分布式故障诊断系统合规设计指南

输电线路分布式故障诊断系统合规设计指南

简介:本资源为《国家标准 输电线路分布式故障诊断系统(征求意见稿)》正式文本,面向电力系统设计、运维、检测及标准研究领域的工程师、科研人员与高校师生,旨在支撑高电压等级输电线路故障快速定位与智能诊断技术的规范…

2026/10/11 18:06:40 阅读更多 →
SQL数据库课程设计宾馆房间管理系统:从ER图到窗口函数的完整落地

SQL数据库课程设计宾馆房间管理系统:从ER图到窗口函数的完整落地

简介:《SQL数据库课程设计宾馆房间管理系统.doc》是面向软件工程专业学生的课程设计参考文档,以宾馆客房管理为业务场景,完整演示从需求分析、概念结构设计、逻辑/物理设计到SQL Server 2000建库建表及C#.NET程序实现的全过程。文档包含数据流…

2026/10/11 18:06:40 阅读更多 →
编译原理实验:词法分析与语法分析器从零实现指南

编译原理实验:词法分析与语法分析器从零实现指南

简介:面向编译原理课程实验的词法分析与语法分析报告,系统讲解单词识别原理、状态图设计以及LL(1)语法分析表构造。资源围绕标识符、关键字、十进制整数、运算符和分隔符的识别展开,给出使用C语言实现的扫描函数完整代码,并以表达…

2026/10/11 18:06:40 阅读更多 →
Spring Boot+Vue前后端分离旅游订票系统实战:从库存防超卖到订单状态机

Spring Boot+Vue前后端分离旅游订票系统实战:从库存防超卖到订单状态机

上个季度我完整做了一个“旅游线路展示 在线订票”的前后端分离项目:Spring Boot 做后端接口,Vue 做前端页面,整个系统包含线路浏览、景点详情、日期团期选择、订单提交、支付状态回跳、后台线路维护这些核心环节。项目不大,但业…

2026/10/11 18:06:40 阅读更多 →
Linux线程同步指南:从互斥锁、条件变量到生产者消费者模型

Linux线程同步指南:从互斥锁、条件变量到生产者消费者模型

1. 一条计数器的崩溃现场:竞态条件到底怎么回事上一周我在调一个批量图片压缩工具,开了四个线程同时去处理任务队列,结果跑出来的图片里有好几张是花的,还有一次直接段错误。我排查了很久,最后定位到问题根源不在压缩算…

2026/10/11 18:05:40 阅读更多 →

日新闻

流感时间序列预测实战:ARIMA/LSTM全流程拆解与避坑指南

流感时间序列预测实战:ARIMA/LSTM全流程拆解与避坑指南

简介:基于 ARIMA、LSTM、Transformer 等模型的流感时间序列预测 Python 源码,面向计算机相关专业课程设计与期末大作业学生,以及项目实战学习者。内容覆盖预处理、平稳性检验、定阶、残差分析、多模型对比预测的完整时序建模流程,…

2026/10/11 0:00:27 阅读更多 →
影刀RPA新手教程:键盘模拟输入实战——输入文本与模拟按键的区别

影刀RPA新手教程:键盘模拟输入实战——输入文本与模拟按键的区别

影刀RPA新手教程:键盘模拟输入实战——输入文本与模拟按键的区别 做影刀RPA自动化,十个新手有八个栽在"往输入框里填东西"这件事上:要么填不进去,要么填了一半,要么直接把原来内容追加在后面。这背后的根因&…

2026/10/11 0:00:27 阅读更多 →
影刀RPA新手教程:阅文起点小说数据采集实战——书籍信息与章节内容

影刀RPA新手教程:阅文起点小说数据采集实战——书籍信息与章节内容

影刀RPA新手教程:阅文起点小说数据采集实战——书籍信息与章节内容 1. 认识影刀:什么场景该用RPA采小说数据 起点中文网的页面结构相对稳定——分类榜单、书籍详情、章节内容三块独立页面,跳转链路清晰。这种场景非常适合影刀自动化&#x…

2026/10/11 0:00:27 阅读更多 →

周新闻

流感时间序列预测实战:ARIMA/LSTM全流程拆解与避坑指南

流感时间序列预测实战:ARIMA/LSTM全流程拆解与避坑指南

简介:基于 ARIMA、LSTM、Transformer 等模型的流感时间序列预测 Python 源码,面向计算机相关专业课程设计与期末大作业学生,以及项目实战学习者。内容覆盖预处理、平稳性检验、定阶、残差分析、多模型对比预测的完整时序建模流程,…

2026/10/11 0:00:27 阅读更多 →
影刀RPA新手教程:键盘模拟输入实战——输入文本与模拟按键的区别

影刀RPA新手教程:键盘模拟输入实战——输入文本与模拟按键的区别

影刀RPA新手教程:键盘模拟输入实战——输入文本与模拟按键的区别 做影刀RPA自动化,十个新手有八个栽在"往输入框里填东西"这件事上:要么填不进去,要么填了一半,要么直接把原来内容追加在后面。这背后的根因&…

2026/10/11 0:00:27 阅读更多 →
影刀RPA新手教程:阅文起点小说数据采集实战——书籍信息与章节内容

影刀RPA新手教程:阅文起点小说数据采集实战——书籍信息与章节内容

影刀RPA新手教程:阅文起点小说数据采集实战——书籍信息与章节内容 1. 认识影刀:什么场景该用RPA采小说数据 起点中文网的页面结构相对稳定——分类榜单、书籍详情、章节内容三块独立页面,跳转链路清晰。这种场景非常适合影刀自动化&#x…

2026/10/11 0:00:27 阅读更多 →

月新闻

我发现了一个新思路:用 Remotion + Claude Code 像写代码一样自动化生成短视频

我发现了一个新思路:用 Remotion + Claude Code 像写代码一样自动化生成短视频

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/11 10:45:37 阅读更多 →
Windows下 Codex 中 Chrome 和 Computer Use 插件不可用问题排查及解决参考方式:TaoToken 统一 Key 配置与验证

Windows下 Codex 中 Chrome 和 Computer Use 插件不可用问题排查及解决参考方式:TaoToken 统一 Key 配置与验证

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/11 14:36:53 阅读更多 →
黑夜航拍船只数据集训练YOLOV5模型全流程解析

黑夜航拍船只数据集训练YOLOV5模型全流程解析

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/11 14:36:54 阅读更多 →