Dify 安装部署教程:5 分钟搭建可视化智能体平台
发表于|更新于|agents
|浏览量:
Dify 安装部署教程
Dify 是目前最流行的开源 LLMOps 平台之一:可视化编排 Agent、自带知识库(RAG)、支持 100+ 模型接入,一条命令即可本地部署。本教程带你从零跑通 Dify。

一、环境要求
系统:Linux / macOS / Windows(推荐 Linux 服务器)
Docker:20.10+,并启用 Docker Compose
配置:最低 4 核 8G 内存(生产建议 8 核 16G)
模型 API Key:OpenAI / DeepSeek / 通义千问 / 智谱 任选其一
二、安装步骤
1. 安装 Docker(如已安装可跳过)
1 | # Ubuntu / Debiancurl -fsSL https://get.docker.com | bashsudo systemctl enable --now docker# 验证docker --versiondocker compose version |
2. 克隆 Dify 仓库
1 | git clone https://github.com/langgenius/dify.gitcd dify/dockercp .env.example .env |
3. 启动服务
1 | docker compose up -d |
首次启动会拉取镜像(约 5~10 分钟),看到 Started 后访问:
1 | http://localhost (默认 80 端口) |
三、初始化配置
打开浏览器进入首页,设置管理员邮箱和密码
进入「设置 → 模型供应商」,添加你的模型 API Key(以 DeepSeek 为例):
1 | # 在 DeepSeek 开放平台申请 Key 后填入类型: 对话型 (LLM)模型: deepseek-chatAPI Key: sk-xxxxxxxx |
- 创建应用:工作室 → 创建空白应用 → 聊天助手

四、快速搭建一个 Agent
在应用编排页,左侧选择「Agent」模式
添加工具:搜索、网页读取、代码执行等
编写提示词(System Prompt),例如:
1 | 你是一位耐心的智能客服助手。- 优先使用【搜索】工具查询最新信息- 回答要简洁、分点- 不确定时如实说明 |
- 右上角「发布」→ 可嵌入网站、调用 API、发布到微信/飞书
五、常见问题
| 问题 | 解决 |
|---|---|
| 80 端口被占用 | 修改 docker/.env 中 EXPOSE_NGINX_PORT 后重启 |
| 模型调用失败 | 检查 API Key 是否填写、模型名是否正确 |
| 内存不足 | 关闭向量库组件:docker compose stop weaviate |
| 升级版本 | cd dify/docker && docker compose pull && docker compose up -d |
小结
Dify 的价值在于把模型、知识库、工具、工作流串成一条可视化流水线,无需编写胶水代码。本地部署后数据完全自控,适合企业内网与私有化场景。
延伸阅读:
文章作者: 智算工坊
版权声明: 本博客所有文章除特别声明外,均采用 CC BY-NC-SA 4.0 许可协议。转载请注明来源 智算工坊!
相关推荐

2026-08-08
AutoGPT 安装与使用:让 AI 自主完成任务
AutoGPT 安装与使用AutoGPT 是最早出圈的自主智能体项目:你只需给出一个目标,它会自动拆解任务、调用工具、自我反思,直到任务完成。本文介绍 AutoGPT 的安装与上手。 一、AutoGPT 是什么?AutoGPT 的核心循环: 1目标 → 思考(Thought) → 行动(Action) → 观察(Observation) → 再思考 → ... 它通过 LLM 的推理能力驱动,可调用: 文件读写:生成/修改文档、代码 网页浏览:搜索信息、抓取网页 代码执行:运行 Python 脚本 内存存储:长期记忆任务上下文 二、安装步骤方式一:Docker(推荐)1# 1. 克隆仓库git clone https://github.com/Significant-Gravitas/AutoGPT.gitcd AutoGPT# 2. 配置 API Keycp .env.template .env# 编辑 .env,填入 OPENAI_API_KEY 或兼容的第三方 Key# 3. 启动docker compose up --build 方式二:源码运...

2026-08-08
主流智能体框架盘点:从 AutoGPT 到 Dify
主流智能体框架盘点:从 AutoGPT 到 Dify2025 年被称为「智能体元年」,市面上涌现出大量 Agent 框架与平台。它们定位不同、形态各异:有开源的开发框架,也有开箱即用的云端平台。本文按开发框架、低代码平台、通用助手三条路线,盘点当前最流行的智能体产品。 一、开源开发框架(适合程序员)1. LangChain / LangGraph 定位:最成熟的 LLM 应用开发框架,LangGraph 是其图编排升级版 特点:组件丰富、生态庞大,支持链式调用、状态机、人机协作 适合:有编程基础、需要深度定制的开发者 安装:pip install langgraph 2. AutoGPT 定位:经典自主 Agent 项目,给定目标后自动拆解任务并执行 特点:目标驱动、自动循环,可调用浏览器、文件、API 适合:想体验「AI 自主干活」的极客 安装:git clone https://github.com/Significant-Gravitas/AutoGPT && cd AutoGPT && ./setup.sh ...

2026-08-15
Grok Bot 深度评测:xAI 的 AI 智能体能不能真的替你干活
Grok Bot 深度评测:xAI 的 AI 智能体能不能真的替你干活先把话说清楚Grok Bot 是 xAI 在 2026 年 8 月 11 日发布的 AI Agent(Early Beta)。它跟普通 Grok 聊天助手最大的区别是:每个 Bot 都有一台属于自己的云端电脑,能登录网站、操作浏览器、读文件、用工具,在后台自己干活,干完回来汇报,遇到要拿主意的节点再请你拍板。 所以它盯着的早就不是 ChatGPT、Claude 那条”聊天”赛道了,而是 AI Agent、Computer Use、自动化办公这一带。 先给你的判断,省得往下读半天: 你只是要聊天、写文章、总结资料——现在为它付几百美元一个月,不值。 你想把邮件、CRM、Bug 复现、内容生产这类多步骤的活整包丢给 AI——Grok Bot 值得盯着看,但到今天为止它还是”预售评估”,不是实测背书。 本文按它是什么、能干什么、跟同类怎么比、风险在哪、多少钱、适合谁这个顺序写。 Grok Bot 到底是什么一句话:xAI 推出的 AI Agent,特点不是”会聊天”,是自己有一台电脑。 按官方文档的说法,...

2026-08-04
多智能体协作:让两个 Agent 互相辩论优化答案
多智能体协作框架实践:生成者 + 评审者,让两个 Agent 互相辩论优化答案一、为什么需要「让 AI 与自己吵架」单个 LLM 有一个众所周知的毛病:顺着用户、缺乏批判、容易自信地编造(幻觉)。一个 Agent 直接吐出的答案往往是「第一稿」——没有经过审视和反驳。而人类高质量工作从来不是一气呵成:先写初稿,再找同行挑毛病,反复修改后才成型。 多智能体协作(Multi-Agent Debate / Reflection)就是把这个「审稿-修改」过程搬到 AI 身上:让一个 Agent 负责生成,另一个 Agent 负责挑刺,两个 Agent 来回多轮「辩论」,最终收敛出一个经过对抗检验的答案。这是目前最被证实的降低幻觉、提升逻辑严密性的工程手段之一。 二、本实验的架构:生成者 + 评审者采用最少但完整的双 Agent 结构: 1出题 → Agent A 生成 → Agent B 评审 → 分歧则回炉 → 收敛输出 Agent A(生成者 Generator):负责产出答案初稿,立场是「尽量全面、尽量自信」; Agent B(评审者 Critic):负责逐条指出初...

2026-08-08
vLLM 部署与性能调优:高并发推理的正确姿势
vLLM 部署与性能调优Ollama 适合个人使用,但当你要对外提供服务、支撑高并发时,vLLM 是业界主流选择。它通过 PagedAttention、Continuous Batching 等优化,吞吐量可达传统方案的 10~20 倍。 一、环境要求 GPU:NVIDIA 显卡(Ampere 架构以上最佳),显存 ≥ 16GB 系统:Linux(推荐 Ubuntu 22.04+),CUDA 12.x Python:3.10+ 二、安装 vLLM1# 方式一:pip 安装pip install vllm# 方式二:Docker(推荐生产环境)docker pull vllm/vllm-openai:latest 三、启动服务方式一:命令行1python -m vllm.entrypoints.openai.api_server \ --model Qwen/Qwen2.5-7B-Instruct \ --served-model-name qwen2.5 \ --port 8000 \ --max-model-len 8192 \ --gpu-memory-utili...

2026-08-14
RAG 切分与重排调优:把知识库问答准确率从 60% 提到 90%
RAG 切分与重排调优:把知识库问答准确率从 60% 提到 90%上一篇文章讲了怎么搭一套本地 RAG(检索增强生成),这次聊聊进阶:为什么同样的模型、同样的知识库,你的答案准确率只有六成?问题几乎都出在「切分(Chunking)」和「重排(Rerank)」这两个环节。这篇文章用实测数据告诉你怎么调。 一、先建立度量:没有评测集就别谈调优调优的第一步不是改参数,而是先有标尺。没有标准答案的对比,你根本不知道改完是好是坏。 建评测集三步走: 从知识库里挑 20~30 个真实问题(覆盖不同文档、不同难度); 对每个问题标注「应该命中哪几段」(期望检索结果); 跑一遍当前系统,记录命中率。 之后每次改切分/重排参数,都跑同一份评测集,看命中率变化。这一步的价值怎么强调都不为过——RAG 调优最大的坑就是「凭感觉调参」。 评测集怎么建才有代表性随便挑几个问题不算评测集。有代表性的评测集要注意: 难度分层:三分之一是「直接抄原文就能答」的简单题,三分之一是需要跨段拼接的中等题,三分之一是「原文里没写、需要推理」的难题。只挑简单题,命中率虚高,掩盖了系统真实水平; ...