旧电脑 Win7 复活计划：编译与运行 llama.cpp (Qwen3版)

优质文章学习记录

05 Apr 2026 — 4 min read

🦕 旧电脑 Win7 复活计划：编译与运行 llama.cpp (Qwen3版)

这份指南专为不支持新版软件的 Windows 7 设计，通过本地编译实现大模型运行。

手动编译可以获得最好的性能，不想自己手动编译可以直接使用下面编译好的bin文件，同时包含下面用到的相关软件和替换文件httplib.h
链接：https://pan.quark.cn/s/2c5f627c93d7
提取码：cSJh

📋 0. 软件版本清单

请务必确保使用以下特定版本，以保证在 Win7 下的兼容性：

软件名称	文件名 (根据截图)	作用	备注
编译环境	`w64devkit-x64-2.5.0.7z.exe`	提供 GCC 编译器	核心工具
构建工具	`cmake-3.31.10-windows-x86_64.msi`	生成编译配置	必须安装到默认路径
源码工具	`Git_for_Windows_(64bit)_v2.45.2.exe`	下载代码
浏览器	`Firefox Setup 115.30.0esr.exe`	唯一推荐	Win7 支持的最后版本，用于打开聊天界面
备用浏览器	`109.0.5414.120_chrome_installer.exe`	Chrome 109	Win7 支持的最后 Chrome 版本

📥 第一阶段：下载代码并替换httplib.h (使用 Git Bash)

操作环境：Windows 桌面/资源管理器

准备目录：建议在 C 盘根目录 下操作，路径短，不容易出错。
打开 Git：在 C 盘空白处右键 -> “Open Git Bash here”。
执行命令（请一行一行复制运行）：

# 1. 克隆 llama.cpp 仓库git clone https://github.com/ggerganov/llama.cpp.git # 2. 进入文件夹cd llama.cpp # 3. 【核心步骤】切换到支持 Qwen3 的特定版本 (Tag: b5092)git checkout b5092 # 4. 【核心步骤】替换 /examples/server/httplib.h 文件 夸克网盘自取

确认路径：确保代码文件夹就在 C:\llama.cpp。

🛠️ 第二阶段：准备编译环境

操作环境：w64devkit.exe 黑色终端

🛑 关闭杀毒软件 (Win7 必做)
- 请务必彻底退出 360、腾讯管家、金山毒霸等。
- 原因：Win7 下这些软件会拦截编译器生成的 conftest.exe 等临时文件，直接导致 Access Violation 报错。
启动编译终端
- 解压 w64devkit-x64-2.5.0.7z.exe。
- 双击运行文件夹内的 w64devkit.exe。
- 在黑框中输入以下命令（注意路径写法）：

进入代码目录

cd /c/llama.cpp

⚙️ 第三阶段：清理与配置 (CMake)

操作环境：w64devkit.exe 黑色终端

直接复制下面这行长命令运行：

成功标志：屏幕滚动后显示 Generating done。

生成配置文件 (Win7 专用修复版)

"C:\Program Files\CMake\bin\cmake.exe". -G "MinGW Makefiles" -DLLAMA_CURL=OFF -DLLAMA_BUILD_TESTS=OFF -DCMAKE_C_COMPILER=gcc -DCMAKE_CXX_COMPILER=g++

清理环境 (防止旧缓存报错)

rm -f CMakeCache.txt rm -rf CMakeFiles

🚀 第四阶段：执行编译

操作环境：w64devkit.exe 黑色终端

-j4 表示使用 4 线程加速，如果电脑配置极低可改为 -j2。

等待完成
- 耐心等待进度条走到 [100%]。
- 编译完成后，bin 文件夹下会出现 llama-server.exe。

开始编译

"C:\Program Files\CMake\bin\cmake.exe" --build . --config Release -j4

✅ 第五阶段：验证结果

在当前终端输入：

看到 commit d3bd719 字样即为成功。

检查版本

./bin/llama-server.exe --version

🤖 第六阶段：启动 Qwen3 模型 (Win7 专用方案)

Win7 的 CMD 窗口无法很好地显示聊天文字，必须使用浏览器模式。

准备工作

安装 Firefox 115 ESR (Firefox Setup 115.30.0esr.exe)。这是 Win7 下最稳定、兼容性最好的现代浏览器。

情况 A：加载 .gguf 文件

假设模型文件在 C:\models\qwen3.gguf。

-c 4096: 上下文长度。如果内存大于 16G，可以设为 8192 或更高。

启动命令：

./bin/llama-server.exe -m "/c/models/qwen3.gguf" -c 4096 --host 0.0.0.0 --port 8080

情况 B：加载 Ollama 缓存模型

如果你用 Ollama 下载过 Qwen3，可以直接利用它的缓存文件（无需转换）。

找到 Blob 文件：
- 路径：C:\Users\你的用户名\.ollama\models\blobs
- 找到最大的那个文件（例如 sha256-abc1234...）。

启动命令：

./bin/llama-server.exe -m "/c/Users/Administrator/.ollama/models/blobs/sha256-你的文件名..." -c 4096 --host 0.0.0.0 --port 8080

🌐 最后一步：开始对话

当黑框显示 HTTP server listening 时，保持黑框开启（不要关闭）。
打开 Firefox 115 浏览器。
地址栏输入：http://127.0.0.1:8080
界面加载后，即可在浏览器中与 Qwen3 流畅对话！

Web 聊天室消息加解密方案详解

目录编辑一、Web 聊天室消息加解密需求与技术约束 1.1 核心安全需求 1.2 技术约束二、主流消息加解密方案详解 2.1 方案 1：对称加密（AES-256-GCM） 2.1.1 方案概述 2.1.2 核心原理 2.1.3 实现步骤（分场景）场景 1：单聊加密场景 2：群聊加密 2.1.4 代码实现（前端 + 后端）前端（Vue3 + Web Crypto API）后端（

前端实现B站视频画中画功能 - 完整代码实现主页面和小窗同步视频控制功能

🌷 古之立大事者，不惟有超世之才，亦必有坚忍不拔之志 🎐 个人CSND主页——Micro麦可乐的博客 🐥《Docker实操教程》专栏以最新的Centos版本为基础进行Docker实操教程，入门到实战 🌺《RabbitMQ》专栏19年编写主要介绍使用JAVA开发RabbitMQ的系列教程，从基础知识到项目实战 🌸《设计模式》专栏以实际的生活场景为案例进行讲解，让大家对设计模式有一个更清晰的理解 🌛《开源项目》本专栏主要介绍目前热门的开源项目，带大家快速了解并轻松上手使用 🍎 《前端技术》专栏以实战为主介绍日常开发中前端应用的一些功能以及技巧，均附有完整的代码示例 ✨《开发技巧》本专栏包含了各种系统的设计原理以及注意事项，并分享一些日常开发的功能小技巧 💕《Jenkins实战》专栏主要介绍Jenkins+Docker的实战教程，让你快速掌握项目CI/CD，是2024年最新的实战教程 🌞《Spring Boot》专栏主要介绍我们日常工作项目中经常应用到的功能以及技巧，代码样例完整 👍《Spring Security》专栏中我们将逐步深入Spring Security的各个

Spring AI Alibaba百炼平台 - Java开发者首选

目录 1、介绍 2、官网地址 3、框架对比 4、工程搭建（1）版本依赖（2）接入阿里百炼平台的通义模型 1) 获得Api-key 编辑2）获取模型名称 3）获得baseUrl （3）创建父工程 1）创建SpringAIAlibabaProject父工程 2）修改pom文件（4）创建子模块 1）创建SAA-01HelloWord子模块 2）修改pom文件 3）添加配置文件 4）配置ApiKey 5）主启动 6）编写配置类 7）编写controller 8）测试 9）切换其他模型 5、Ollama私有化部署（1）介绍（2）

前端通用AI rules定义，适用于Cursor ，Trae，Qorder等AI开发工具

前端通用 AI Rules 定义（适用于 Cursor、Trae、Qoder、Windsurf、Zed + AI、Codeium、Copilot 等几乎所有主流 AI 代码助手）以下内容是 2025–2026 年在前端圈被大量验证、反复迭代后相对好用的“通用前端 Rules”模板。你可以直接复制粘贴到 Cursor 的 Rules / Custom Instructions / 项目 .cursor/rules.md 中，或者 Trae、Qoder 等工具的类似位置。推荐的通用前端 Rules 结构（2026 年主流写法） # 前端通用 Rules - 适用于 React / Vue

🦕 旧电脑 Win7 复活计划：编译与运行 llama.cpp (Qwen3版)

📋 0. 软件版本清单

📥 第一阶段：下载代码并替换httplib.h (使用 Git Bash)

🛠️ 第二阶段：准备编译环境

⚙️ 第三阶段：清理与配置 (CMake)

🚀 第四阶段：执行编译

✅ 第五阶段：验证结果

🤖 第六阶段：启动 Qwen3 模型 (Win7 专用方案)

准备工作

情况 A：加载 .gguf 文件

情况 B：加载 Ollama 缓存模型

🌐 最后一步：开始对话

Read more

Web 聊天室消息加解密方案详解

前端实现B站视频画中画功能 - 完整代码实现主页面和小窗同步视频控制功能

Spring AI Alibaba百炼平台 - Java开发者首选

前端通用AI rules定义，适用于Cursor ，Trae，Qorder等AI开发工具