本地离线部署AI大模型：OpenClaw + Ollama + Qwen3.5:cloud/Qwen3:0.6b 超详细教程（无需GPU）

优质文章学习记录

07 Apr 2026 — 7 min read

前言

随着开源大模型越来越成熟，我们完全可以在自己电脑上本地运行AI，不联网、不上传数据、免费使用，隐私性极强。

今天这篇文章，我会一步步带你完成：Ollama + Qwen3.5:cloud（主力模型）+ Qwen3:0.6b（轻量备选）+ OpenClaw 的本地部署，实现一个属于自己的本地聊天AI，兼顾效果与低配置适配。

一、项目介绍

本项目实现本地离线运行阿里通义千问系列大模型（Qwen3.5:cloud 主力模型 + Qwen3:0.6b 轻量备选模型），全程不需要云端API，不需要高性能显卡，普通电脑就能跑，可根据自身电脑配置选择对应模型。

用到的工具：

Ollama：最简单的本地大模型管理工具，一键拉取、运行、管理模型

Qwen3.5:cloud：阿里云开源的轻量高性能大语言模型，对话效果强、适配本地部署，作为主力使用

Qwen3:0.6b：阿里云开源的超轻量大语言模型，占用内存极低（1GB左右），适合8GB内存低配电脑，作为备选模型

OpenClaw：美观好用的本地AI可视化交互界面

特点：免费、离线、隐私安全、低配置可运行

二、环境准备

操作系统：Windows 10 / Windows 11

内存：最低 8GB（推荐 16GB 更流畅）

无需独立显卡，CPU 即可运行

网络：仅在下载模型时需要，运行时可完全断网

三、详细安装步骤

安装 Ollama

Ollama 是运行模型的核心，安装非常简单。

打开官网：https://ollama.com/
点击 Download 下载 Windows 版本
双击安装，一路下一步
安装完成后，Ollama 会自动在后台运行

验证是否安装成功：

打开 CMD 或 PowerShell，输入：

ollama --version

出现版本号即成功。

使用 Ollama 下载并运行模型（Qwen3.5:cloud + Qwen3:0.6b）

我实际下载了两个模型，可根据自身电脑配置选择运行，优先推荐 Qwen3.5:cloud（效果更好），8GB内存低配电脑推荐 Qwen3:0.6b（更流畅）。

2.1 下载并运行 Qwen3.5:cloud（主力模型）

继续在命令行输入以下命令，
第一次运行会自动下载模型，下载完成后出现 >>> 即启动成功，可直接输入问题测试，适配低配电脑，运行流畅无压力。

ollama run qwen3.5:cloud

出现 >>> 表示模型已启动成功。

你可以直接在这里输入问题测试：

你好，介绍一下自己

模型能正常回答，说明 Qwen3.5:cloud 部署成功。

2.2 下载并运行 Qwen3:0.6b（轻量备选模型）

若电脑内存较低（8GB及以下），运行 Qwen3.5:cloud 卡顿，可下载 Qwen3:0.6b 超轻量模型，命令行输入：

ollama run qwen3:0.6b

出现 >>> 表示模型已启动成功。

你可以直接在这里输入问题测试：
你好，介绍一下自己

模型能正常回答，说明部署成功一半。

安装 OpenClaw 可视化界面

OpenClaw 让你不用敲命令，直接像 ChatGPT 一样聊天。

打开 OpenClaw 发布页：https://github.com/sqzw-x/OpenClaw
找到最新版本下载 Windows 安装包
解压或安装后打开软件
连接 OpenClaw 与本地 Ollama

打开 OpenClaw 后：

右上角进入设置
模型选择：根据自身需求选择，主力推荐 qwen3.5:cloud，低配电脑选择 qwen3:0.6b
Ollama 地址保持默认：

http://localhost:11434

保存设置

回到主界面，即可开始聊天。

四、效果展示

与AI对话的效果截图
任务管理器内存占用展示（打开任务管理器，切换到“性能-内存”页面，同步显示AI运行状态）

示例说明：

OpenClaw 连接成功界面（截图包含设置页面、模型选择（可分别展示 qwen3.5:cloud 和 qwen3:0.6b 选择界面）、地址配置）

模型启动速度：约 3～10 秒

回答速度：流畅，可日常使用

五、常见问题与解决方法（非常重要）

内存占用：Qwen3.5:cloud 约 2GB～4GB，Qwen3:0.6b 约 1GB～1.5GB

模型启动速度：Qwen3.5:cloud 约 3～10 秒，Qwen3:0.6b 约 1～3 秒

回答速度：均流畅可日常使用，Qwen3:0.6b 适配低配电脑，卡顿更少

模型下载特别慢

解决方法：

先暂停下载重新开始，进度不会变

或等待半夜下载（网络高峰期避开）

OpenClaw 连接失败 / 连不上 127.0.0.1:11434

解决方法：

确保 Ollama 正在后台运行（任务栏右下角查看 Ollama 图标）

重启 Ollama：任务栏右键 Ollama → Restart

检查地址是否为：http://localhost:11434（切勿多写/少写字符）

电脑卡顿、内存不足

解决方法：

关闭其他软件（尤其是浏览器、视频软件、后台下载工具）

关闭其他软件（尤其是浏览器、视频软件、后台下载工具），释放内存

解决方法：

切换/运行 Qwen3:0.6b 命令：

切换至超轻量模型：若运行 Qwen3.5:cloud 卡顿，可切换到 Qwen3:0.6b 模型，占用内存极低，适配8GB及以下低配电脑

ollama run qwen3:0.6b

命令：

使用更小参数模型（若 qwen3.5:cloud 卡顿）：qwen3.5:4b

OpenClaw 不显示模型（qwen3.5:cloud 或 qwen3:0.6b）

ollama run qwen3.5:4b

解决方法：

重启 OpenClaw 软件，重新加载模型列表

解决方法：

重新进入 OpenClaw 设置，根据自身需求选择 qwen3.5:cloud 或 qwen3:0.6b 模型并保存

重启 OpenClaw 软件

确认 Ollama 已成功拉取模型（命令行输入 ollama list 可查看已拉取的 qwen3.5:cloud 和 qwen3:0.6b 模型）

确认 Ollama 已成功拉取模型（命令行输入 ollama list 可查看已拉取模型）

六、项目总结

通过 Ollama + Qwen3.5:cloud + OpenClaw，我们轻松实现了：

通过 Ollama + Qwen3.5:cloud（主力）+ Qwen3:0.6b（备选）+ OpenClaw，我们轻松实现了：

本地离线运行大模型

完全免费、无流量限制

可视化界面，使用体验接近在线AI

数据不上传，隐私百分百安全

适合人群：

想学习AI本地部署的新手

想学习AI本地部署的新手

注重隐私、不想数据上传云端

学生、开发者、日常办公使用；8GB内存低配电脑也能轻松适配（选择 Qwen3:0.6b 模型）

注重隐私、不想数据上传云端

学生、开发者、日常办公使用

OpenClaw实操指南03｜OpenClaw vs Coze/Dify/n8n 帮你半小时内选对合适的AI

这是「OpenClaw 实操指南」的第 3 篇。踩过2个月的坑，终于敢说：选对AI Agent工具，能省80%的力；选错了，越折腾越心累。我花了2个月试遍4款主流AI Agent工具，踩过的坑能写满3页纸：用Coze做长期选题，每天要重新跟它说“我是做科技号的”；用n8n筛选优质文章，直接把广告文全选进来；直到摸透它们的底层逻辑，才发现：选工具不是选“最好的”，是选“适配你场景的”——选错了，越努力越白费。先问自己3个问题，比看100篇测评有用选工具前，先把这3个问题砸在脑门上，答案直接锁死方向： 1. 你要的是“机器流水线”，还是“有脑子的数字员工”？ 2. 数据敢上云吗？敏感信息碰不得的话，自托管是刚需吗？ 3. 你愿意花多少时间折腾？是“半小时上线”，还是“一周搭系统”

【收藏必看】从“能说“到“能做“：一文看懂文心一言与实在Agent的本质区别

人工智能的浪潮正以前所未有的速度重塑着各行各业。当大众还在惊叹于大型语言模型（LLM）生成文本、代码和图像的能力时，企业决策者们已经开始思考一个更深层次的问题：如何将这种强大的智能，从“对话框”中解放出来，真正嵌入到业务流程中，成为推动生产力变革的核心引擎？这不再是一个关于“能不能聊”的问题，而是关乎“能不能干”的现实挑战。正是在这一背景下，市场上涌现出两大主流路径的代表：以百度文心一言为首的通用大模型，和以实在智能旗下“实在Agent”为代表的AI Agent（智能体）。对于许多正在进行AI选型的企业而言，困惑是显而易见的：文心一言知识渊博、应答如流，似乎无所不能；而实在Agent则声称能像“数字员工”一样自主执行任务。它们之间究竟有何本质区别？谁更能解决企业面临的实际痛点？本文将通过一场全面、深入的对比测评，从核心定位、功能深度、应用场景、商业价值及未来趋势等多个维度，为您拨开迷雾，找到最适合您企业的AI解决方案。一、核心定位与技术分野：通用大模型与垂直领域Agent的本质差异要理解两者的区别，首先必须明确它们的根本定位。这并非简单的功能多寡之别，

7D-AI系列：AI 编程 Spec Coding 完整详细的典型标准化工作流

文章目录 * 前言 * 一、核心前提：什么是「Spec（规格）」？Spec的核心要求 * ✅ Spec的定义 * ✅ Spec的核心要求（重中之重，决定代码质量） * ✅ Spec的常见载体（按优先级排序，工业界高频使用） * 二、Spec Coding 标准完整工作流（6个核心阶段） * ✅ 核心原则 * 阶段1：需求拆解 & 范围界定（前置准备，耗时占比：10%） * 阶段2：编写精准的结构化Spec（核心核心，耗时占比：30%，最关键） * 阶段3：AI 代码生成（核心提效环节，耗时占比：5%） * 阶段4：人工评审 + 静态校验（第一道质检，耗时占比：15%，过滤80%的问题） * 阶段5：自动化测试

人工智能：自然语言处理在社交媒体分析领域的应用与实战

人工智能：自然语言处理在社交媒体分析领域的应用与实战学习目标 💡 理解自然语言处理（NLP）在社交媒体分析领域的应用场景和重要性 💡 掌握社交媒体分析的核心技术（如情感分析、话题检测、用户画像构建） 💡 学会使用前沿模型（如BERT、GPT-3）进行社交媒体文本分析 💡 理解社交媒体分析的特殊挑战（如数据量大、噪声多、实时性要求高） 💡 通过实战项目，开发一个社交媒体话题检测应用重点内容 * 社交媒体分析的主要应用场景 * 核心技术（情感分析、话题检测、用户画像构建） * 前沿模型（BERT、GPT-3）在社交媒体分析中的使用 * 社交媒体分析的特殊挑战 * 实战项目：社交媒体话题检测应用开发一、社交媒体分析的主要应用场景 1.1 情感分析 1.1.1 情感分析的基本概念情感分析是对社交媒体文本中情感倾向进行分析和判断的过程。在社交媒体分析领域，情感分析的主要应用场景包括： * 品牌声誉管理：分析用户对品牌的情感倾向（如“正面评价”、“负面评价”

2.1 下载并运行 Qwen3.5:cloud（主力模型）

2.2 下载并运行 Qwen3:0.6b（轻量备选模型）

Read more

OpenClaw实操指南03｜OpenClaw vs Coze/Dify/n8n 帮你半小时内选对合适的AI

【收藏必看】从“能说“到“能做“：一文看懂文心一言与实在Agent的本质区别

7D-AI系列：AI 编程 Spec Coding 完整详细的典型标准化工作流

人工智能：自然语言处理在社交媒体分析领域的应用与实战