1. 理解Dify的模型供应商体系在开始配置之前我们需要先理解Dify平台与AI模型之间的关系。Dify本身是一个模型无关的平台它不内置任何AI模型而是通过模型供应商这一概念来连接各种AI服务。1.1 模型供应商的核心作用模型供应商在Dify架构中扮演着桥梁角色它负责提供API接口的标准化封装处理认证和授权流程转换不同供应商的API响应格式管理模型的生命周期和状态这种设计使得Dify可以灵活支持各种AI服务提供商从商业API到开源模型都能无缝集成。1.2 两种配置模式详解Dify支持两种主要的模型供应商配置方式预定义模型供应商这类供应商已经由Dify团队预先集成用户只需要提供API Key即可使用。典型代表包括OpenAI (GPT系列)Anthropic (Claude系列)Google (Gemini)特点开箱即用配置简单模型列表由供应商预先定义通常有完善的文档支持自定义模型供应商这类供应商需要用户手动指定模型参数适合本地部署的模型(Ollama)私有化部署的服务新兴的或小众的AI服务配置时需要提供模型名称(必须与后端完全一致)服务器地址必要的认证信息1.3 六种模型类型及其应用场景Dify将AI模型按功能划分为六种类型每种类型对应不同的应用场景模型类型主要用途典型应用场景代表模型LLM文本生成、对话推理聊天机器人、内容创作GPT-4, Claude 3Text Embedding文本向量化知识库检索、语义搜索text-embedding-3-smallRerank检索结果重排序提升RAG系统准确率Cohere RerankSpeech2Text语音转文字会议记录、语音助手WhisperTTS文字转语音语音播报、有声内容OpenAI TTSModeration内容审核社区管理、内容过滤OpenAI Moderation提示构建知识库应用时至少需要配置一个LLM和一个Text Embedding模型。Rerank模型虽非必需但能显著提升检索质量。2. 配置OpenAI供应商的完整指南OpenAI是目前最流行的模型供应商之一其GPT系列模型在各类NLP任务中表现优异。下面详细介绍配置流程。2.1 获取API Key的注意事项访问OpenAI平台(https://platform.openai.com)登录后进入API Keys页面点击Create new secret key按钮创建密钥时的最佳实践为密钥设置描述性名称(如dify-prod)根据使用场景设置适当的权限范围记录创建日期以便后续管理考虑创建多个密钥用于不同环境(开发/测试/生产)重要API Key只在创建时显示一次请立即妥善保存。如果丢失需要重新创建。2.2 Dify中的详细配置步骤登录Dify控制台点击右上角用户头像 → 选择设置在左侧菜单选择模型供应商找到OpenAI卡片 → 点击配置填写表单凭证名称建议使用有意义的命名(如生产环境OpenAI)API Key粘贴之前获取的密钥点击验证并保存配置完成后系统会自动验证API Key的有效性获取该密钥可用的模型列表加密存储凭证信息更新前端显示状态2.3 配置验证与问题排查成功配置后你应该能看到OpenAI卡片显示绿色激活状态模型列表中包含GPT-4o、GPT-4等模型每个模型旁边有启用/禁用开关常见问题及解决方法问题现象可能原因解决方案验证失败API Key错误检查密钥是否正确复制模型列表为空账号权限不足检查OpenAI账号的订阅状态请求超时网络问题检查网络连接特别是代理设置配额不足免费额度用完升级OpenAI账号或等待下月重置3. 国产模型供应商配置详解对于中文场景国产模型往往能提供更好的本地化支持和更低的延迟。以下是主流国产模型的配置方法。3.1 通义千问(Qwen)配置访问阿里云DashScope平台(https://dashscope.aliyun.com)获取API Key在Dify中添加通义千问供应商填写DashScope API Key可用模型qwen-max (最强能力)qwen-plus (平衡型)qwen-turbo (经济型)qwen-text-embedding (向量模型)3.2 智谱AI(ChatGLM)配置登录智谱AI开放平台(https://open.bigmodel.cn)获取API Key在Dify中添加ZHIPU AI供应商填写API Key可用模型GLM-4 (最新旗舰)GLM-4-Flash (轻量版)GLM-3-Turbo (上一代)3.3 深度求索(DeepSeek)配置访问DeepSeek官网(https://platform.deepseek.com)获取API Key在Dify中添加DeepSeek供应商填写API Key可用模型deepseek-chat (通用对话)deepseek-reasoner (复杂推理)3.4 百度文心一言(ERNIE)配置登录百度智能云千帆平台(https://cloud.baidu.com/product/wenxinworkshop)获取API Key和Secret Key在Dify中添加百度千帆供应商填写两个密钥字段可用模型ERNIE-4.0 (最新版)ERNIE-3.5 (稳定版)4. 本地模型部署与配置对于数据敏感或希望完全掌控模型的用户可以在本地部署开源模型并通过Ollama接入Dify。4.1 Ollama安装与配置安装步骤# Linux/macOS curl -fsSL https://ollama.ai/install.sh | sh # Windows (PowerShell) winget install ollama.ollama常用命令# 拉取模型 ollama pull qwen2.5:7b # 运行模型 ollama run qwen2.5:7b # 查看已安装模型 ollama list4.2 Dify中配置Ollama在模型供应商页面找到Ollama点击添加模型填写配置模型名称必须与ollama list显示的名称完全一致模型类型根据实际用途选择服务器地址本地运行http://localhost:11434Docker环境http://host.docker.internal:114344.3 推荐的开源模型模型名称适用场景内存需求特点qwen2.5:7b中文对话16GB优秀的中文理解能力llama3.1:8b通用任务16GB均衡的性能表现mistral:7b英文任务12GB高效的推理速度nomic-embed-text文本向量化8GB不错的embedding效果5. 高级配置技巧5.1 模型负载均衡配置当业务量较大时单个API Key可能遇到速率限制。Dify支持为同一模型配置多个Key实现负载均衡。配置步骤进入目标模型的配置页面启用负载均衡开关添加多个API Key设置每个Key的权重(可选)负载均衡策略轮询(Round Robin)分发请求自动跳过被限流的Key冷却期结束后自动恢复5.2 系统默认模型设置建议为每种模型类型设置默认选项进入设置 → 模型供应商点击顶部的系统模型设置为每种类型选择默认模型典型配置方案LLM: GPT-4o或qwen-maxText Embedding: text-embedding-3-smallRerank: bge-reranker-largeTTS: OpenAI TTS-15.3 模型配额监控Dify提供了模型使用情况的监控每个API Key的调用次数令牌消耗统计错误率监控可以通过以下路径查看 设置 → 模型供应商 → 点击具体供应商 → 使用情况统计6. 配置检查清单完成配置后请逐一核对以下事项至少一个LLM模型可用如使用知识库至少一个Text Embedding模型可用系统默认模型已设置API Key有足够的配额网络连接正常(特别是本地模型)各模型的状态显示为active常见问题快速排查问题检查点模型不可选检查供应商配置状态、模型启用状态请求超时检查网络连接、代理设置返回错误检查API Key配额、模型权限性能不佳尝试更换模型、检查负载均衡配置7. 最佳实践建议生产环境建议配置至少两个不同的供应商确保高可用性根据业务场景选择合适的模型规格不必一味追求最大模型定期轮换API Key特别是使用频率高的场景为不同环境(开发/测试/生产)使用不同的供应商配置关注各平台的费率变化优化成本结构通过以上步骤你应该已经成功配置了Dify的模型供应商可以开始构建各种AI应用了。如果在配置过程中遇到任何问题建议查阅Dify官方文档或社区论坛获取最新支持信息。