在Ubuntu 20.04上安装Ollama并部署大型语言模型：含Open WebUI图形界面教程

优质文章学习记录

12 Apr 2026 — 8 min read

在Ubuntu 20.04上安装Ollama并部署大型语言模型：含Open WebUI图形界面教程

引言

在人工智能浪潮席卷全球的今天，大型语言模型（LLM）不再是遥不可及的云端技术。借助 Ollama，每一位开发者都能轻松地将强大的模型部署在自己的本地计算机上，实现无缝、私密且可定制的AI体验。本文将带领您一步步在 Ubuntu 20.04 系统上完成 Ollama 的安装与模型部署，并最终搭建美观易用的图形化界面（Open webui）。

Ollama 是什么？

Ollama 是一个开源项目，专为在本地运行、管理和部署大型语言模型（如 Llama 3、Mistral、Gemma 等）而设计。

它的核心概念与优势非常清晰：

简单易用：通过简单的命令行工具，即可完成模型的下载（pull）、运行（run）和管理。一条命令就能启动与模型的对话。
丰富的模型库：它提供了官方支持的模型库（Ollama Search），包含deep-seek、qwen等数十种经过优化的大型语言模型，满足从代码生成到创意写作的各种需求。
“开箱即用”：它自动处理了模型运行所需的大部分复杂配置和环境依赖，用户无需关心繁琐的底层细节。

展示 Ollama 使用效果

想象一下，在您的终端中，直接与一个几十亿参数的大模型进行流畅的对话和代码编写，是一种怎样的体验？以下是在 Ubuntu 终端中运行 ollama run deepseek-coder:6.7b 后的截图：

本地部署语言模型的好处与局限性

选择在本地运行 Ollama，意味着选择了一种新的 AI 交互方式，但它也并非完美无缺。

优势 (Benefits)

数据隐私与安全：您的所有对话提示（Prompts）和模型生成的内容完全在本地处理，不会离开您的计算机。这对于处理敏感代码、商业数据或个人信息的用户至关重要。
完全离线可用：一旦模型下载完成，您就无需依赖互联网连接或担心API服务宕机，可以在任何没有网络的环境中使用。
可定制性：您可以尝试各种不同规模和专长的模型，甚至可以根据需要加载自定义模型（Modelfiles），灵活性远超固定的云端API。
无使用成本：除了电费和硬件成本外，没有按次收费或订阅费用，您可以无限次地与模型交互。

局限性 (Limitations)

硬件要求高：本地部署对计算机硬件，尤其是内存（RAM）和显存（VRAM） 有较高要求。运行大型模型可能需要数十GB的资源。
性能差异：虽然本地推理延迟低，但模型的能力和响应速度通常无法与 OpenAI GPT-4 这类顶级付费API相提并论，尤其是在复杂推理任务上。
知识陈旧：本地部署的模型知识库是静态的，其知识截止日期取决于它被训练的时间点，无法像一些云端模型那样实时获取最新信息。

环境准备

设备信息

lsb_release -a

检查储存空间及显存大小

储存空间至少预留十几G，因为一个模型的大小都在几个G左右
检查显存大小，显存大小决定了能运行模型的参数量

nvidia-smi

Ollama 下载与安装

1. 下载链接：

官网: https://ollama.com/
GitHub: https://github.com/ollama/ollama

2. 运行安装脚本：

curl -fsSL https://ollama.com/install.sh |sh

3. 管理Ollama服务：

# 启动 Ollama 服务sudo systemctl start ollama # 停止 Ollama 服务sudo systemctl stop ollama # 重启 Ollama 服务sudo systemctl restart ollama # 设置开机自启sudo systemctl enable ollama # 查看服务日志sudo journalctl -u ollama -f

4. 常用Ollama命令：

# 查看所有命令帮助 ollama --help # 运行模型（如果不存在会自动下载） ollama run <model-name># 运行模型并直接提问 ollama run <model-name>"你的问题"# 拉取（下载）模型 ollama pull <model-name># 列出已下载的模型 ollama list # 删除模型 ollama rm<model-name># 查看已下载模型的详细信息 ollama show llama3 # 查看模型配置 ollama show llama3 --modelfile

Ollama 部署并运行模型

现在 Ollama 已经安装完成，接下来是下载和运行各种大型语言模型

查看可用模型

通过命令行查看

# 查看本地已下载的模型 ollama list

通过模型库查看
访问Ollama官方的模型库：模型库，选择自己感兴趣的模型，注意参数量大小，一般先选择参数少一些的模型进行试验

下载模型

下载并运行deepseek-r1:7b模型

ollama run deepseek-r1:7b

运行模型

如果已经下载了deepseek-r1:7b，就不会重复下载而是启动命令行交互对话

ollama run deepseek-r1:7b

对话控制命令

在交互模式下，可以使用一些特殊命令：

# 退出对话 /bye 或者按 Ctrl + D # 清空对话上下文（开始新对话） /clear

设置参数

可以调整模型生成参数以获得不同效果：

# 设置温度（控制随机性，0-1） ollama run deepseek-r1:7b --temperature 0.7# 限制输出token数量 ollama run deepseek-r1:7b --num-predict 100# 指定随机种子（确保可重复性） ollama run deepseek-r1:7b --seed 42

安装Open WebUI 图形化界面

虽然命令行交互已经很强大，但对于日常使用来说，一个美观的图形界面能极大提升体验。Open WebUI（原名 Ollama WebUI）提供了一个类似 ChatGPT 的现代化 Web 界面，让您可以通过浏览器与本地模型进行交互。

Open WebUI 是什么？

Open WebUI 是一个功能强大的开源 Web 界面，专为 Ollama 和其他本地语言模型设计。它具有以下特点：

类ChatGPT体验：熟悉的聊天界面，支持多轮对话、对话历史管理
多模型支持：轻松切换不同的语言模型
可视化操作：图形化的模型管理和设置界面
高级功能：支持 RAG（检索增强生成）、文档上传、角色预设等
多用户支持：可注册多个账户，每个用户有自己的对话历史
完全本地化：所有数据仍然保存在本地，保障隐私安全

先决条件：安装 Docker

Open WebUI 通过 Docker 容器部署，因此需要先安装 Docker。参考以下安装教程Ubuntu 20.04 安装Docker 全过程

启动Docker 服务

# 确保Docker服务已启动sudo systemctl start docker sudo systemctl enable docker # 检查Docker服务状态sudo systemctl status docker

使用 Docker 一键部署 Open WebUI

安装好 Docker 后，只需一条命令即可部署 Open WebUI：

docker run -d --network="host" -v open-webui:/app/backend/data --name open-webui --restart always ghcr.io/open-webui/open-webui:main

部署完成后，检查容器状态：

docker ps

访问并使用Open WebUI

容器正常运行后，即可通过浏览器访问：

打开浏览器，访问：http://localhost:8080
首次注册：

点击 “Sign Up” 注册新账户
输入邮箱和密码（无需真实邮箱，仅用于本地识别）
确认密码并完成注册

登录系统：

使用刚才注册的邮箱和密码登录
首次登录会自动检测本地的 Ollama 服务

开始使用：

在左侧模型选择器中选择要使用的模型（如 llama3）
在输入框中开始对话

右侧可以查看对话历史、切换模型、调整参数等

Vitis使用教程：从零实现AI模型FPGA部署

从零开始：用Vitis把AI模型部署到FPGA上，我走过的每一步都算数最近在做边缘AI推理项目时，被一个现实问题卡住了：GPU功耗太高，端侧跑不动；云端延迟又太大，实时性扛不住。于是我把目光转向了FPGA——这块曾经“难啃”的硬件，如今在 Vitis 的加持下，竟然也能像写软件一样开发AI加速器。今天我想和你分享的，不是一篇冷冰冰的技术文档，而是一次真实的、手把手带你从模型训练到板级验证的全过程实战记录。如果你也想让自己的PyTorch模型在KV260开发板上跑出上千FPS，同时保持极低功耗，那这篇文值得你完整读一遍。为什么是FPGA？为什么是Vitis？先说结论： FPGA + Vitis AI = 边缘智能场景下的“黄金组合” 传统印象里，FPGA开发等于Verilog、时序约束、逻辑综合……门槛高得吓人。但Xilinx（现AMD）推出的 Vitis统一平台彻底改变了这一点。它允许我们用C/C++甚至Python来描述算法，再通过高层次综合（HLS）自动生成硬件电路。更关键的是，

FPGA初学者必读：Vivado下载及烧录流程通俗解释

FPGA新手避坑指南：Vivado下载与烧录全流程实战解析你有没有遇到过这样的情况？写好了Verilog代码，综合实现一路绿灯，结果点下“Download”按钮时——Vivado卡住不动；或者好不容易下载成功，断电再上电，FPGA却像失忆了一样，什么都没运行。别急，这几乎是每个FPGA初学者都会踩的坑。问题不在你的代码，而在于你还没搞清楚一个关键区别： “临时下载”和“永久烧录”是两回事。今天我们就来彻底讲明白：从你在电脑上点开Vivado开始，到FPGA真正稳定运行你的设计为止，这一整套流程到底是怎么走的。不绕术语，不说空话，只讲你实际会用到的东西。一、先搞清一件事：为什么FPGA要“下载”两次？很多新人困惑的第一个问题是： “我都把.bit文件下进去了，为啥断电就没了？” 答案很简单： FPGA本质是一块超大规模的SRAM电路板。它内部没有存储能力，所有逻辑配置都是靠上电时加载的一串“开关指令”（也就是比特流）来决定的。一旦断电，这些开关状态全归零。所以，我们通常说的“下载”，其实分两个层次：

无人机 5.8G 模拟图传电路设计方案及性能分析

一、什么是 5.8G 模拟图传？简单说，5.8G 模拟图传就是无人机的 “千里眼”，能把天上拍的画面实时传到地面。你在遥控器上看到的无人机视角，全靠它来实现。为啥是 5.8G？因为这个频段干扰少，就像高速路上车少，信号跑起来更顺畅。而且模拟信号传输快，延迟低，特别适合 FPV 竞速这种需要快速反应的场景 —— 总不能无人机都撞墙了，你才在屏幕上看到障碍物吧？二、工作原理：信号的 “旅行记” 2.1 信号采集：无人机的 “眼睛” 无人机上的摄像头就像手机相机，能把看到的景象变成电信号。但这时候的信号很弱，还带着 “杂音”，就像说话含着口水，听不清。这时候会经过两步处理： * 过滤杂音：用低通滤波器 “过滤” 掉高频噪音，就像用滤网把水里的沙子去掉。 * 信号放大：放大器把信号变强，

手把手教你用 OpenClaw + 飞书，打造专属 AI 机器人

手把手教你用 OpenClaw + 飞书，打造专属 AI 机器人当前版本 OpenClaw（2026.2.22-2）已内置飞书插件，无需额外安装。你有没有想过，在飞书里直接跟 AI 对话，就像跟同事聊天一样自然？今天这篇文章，带你从零开始，用 OpenClaw 搭建一个飞书 AI 机器人。全程命令行操作，10 分钟搞定。一、准备工作 1.1 安装 Node.js（版本 ≥ 22） OpenClaw 依赖 Node.js 运行，首先确保你的 Node 版本不低于 22。推荐使用 nvm 管理 Node

在Ubuntu 20.04上安装Ollama并部署大型语言模型：含Open WebUI图形界面教程

引言

Ollama 是什么？

展示 Ollama 使用效果

本地部署语言模型的好处与局限性

优势 (Benefits)

局限性 (Limitations)

环境准备

设备信息

检查储存空间及显存大小

Ollama 下载与安装

1. 下载链接：

2. 运行安装脚本：

3. 管理Ollama服务：

4. 常用Ollama命令：

Ollama 部署并运行模型

查看可用模型

下载模型

运行模型

对话控制命令

设置参数

安装Open WebUI 图形化界面

Open WebUI 是什么？

先决条件：安装 Docker

启动Docker 服务

使用 Docker 一键部署 Open WebUI

访问并使用Open WebUI

Read more

Vitis使用教程：从零实现AI模型FPGA部署

FPGA初学者必读：Vivado下载及烧录流程通俗解释

无人机 5.8G 模拟图传电路设计方案及性能分析

手把手教你用 OpenClaw + 飞书，打造专属 AI 机器人