主题
免翻墙极速部署 DeepSeek-R1 本地专属个人知识库教程 (Ollama+PageAssist)
在 AI 爆发的 2026 年,DeepSeek-R1 凭借强大的推理思维链和开源属性,彻底打破了大模型行业的版图。很多极客、独立开发者和企业用户在日常处理敏感文档、代码库或财务报表时,都面临着一个痛点:
- 数据安全焦虑:将包含商业机密、个人隐私的 PDF 或文档上传给国外的在线 AI API,随时有泄密和封号风险。
- 网络门槛高:直接使用 ChatGPT/Claude 的网页端,不仅要付昂贵的月费,还要时刻防范因为异地 IP 导致的账号被封。
最佳的终极解决方案是:将 DeepSeek-R1 部署在您的个人电脑本地运行。
本地运行大模型不仅 完全免费、100% 保护隐私,而且国内网络完全直连,无需任何科学上网工具。
本文为您送上 2026 最新、最省心的 DeepSeek-R1 本地部署与专属个人知识库构建保姆级教程。
一、 本地部署双王牌搭档:Ollama 与 PageAssist
为了让没有编程基础的普通人也能愉快玩转本地 AI,我们选用目前生态最成熟、安装最简单的工具链:
- Ollama (大模型运行引擎 ⭐⭐⭐⭐⭐): 一个开源的本地大模型管理工具。它能像软件一样把大模型下载并运行在您的电脑后台,支持 CPU 与 GPU (显卡) 硬件加速。
- PageAssist (本地交互 Web UI 插件 ⭐⭐⭐⭐⭐): 一个开源的浏览器侧边栏/独立网页交互插件(支持 Chrome、Edge)。它可以直接读取本地运行的 Ollama 模型,提供类似 ChatGPT 般优雅的对话界面,并原生支持本地文档知识库(RAG)功能。
二、 极速部署第一步:安装 Ollama 并拉取 DeepSeek-R1
Ollama 的安装非常傻瓜化:
- 下载安装包: 访问 Ollama 官网
https://ollama.com,下载对应您操作系统(Windows、macOS 或 Linux)的安装程序。 - 一键安装: 双击下载的安装文件,一路点击 “Next” 完成安装。安装完成后,您可以在任务栏右下角看到一只可爱的小章鱼图标。
- 拉取并运行 DeepSeek-R1 模型:
- Windows:按下快捷键
Win + R,输入cmd回车打开命令行。 - macOS:打开“终端 (Terminal)”。
- 在命令行中输入以下命令,直接拉取目前性价比最高的 8B (80亿参数) 蒸馏版模型:bash
ollama run deepseek-r1:8b 硬件配置选型指南
- 8G / 16G 内存电脑 (轻薄本、MacBook Air):推荐拉取
deepseek-r1:8b(模型包大小约 4.9GB)。 - 32G 内存及以上 / 拥有 12G 显存独立显卡电脑:推荐拉取
deepseek-r1:14b或deepseek-r1:32b。 - 极客高配服务器:可尝试满血版
deepseek-r1:671b。
- 8G / 16G 内存电脑 (轻薄本、MacBook Air):推荐拉取
- 输入命令后,Ollama 会自动以极快的国内速度下载模型。下载完成后,您直接在终端里打字,就可以开始体验 DeepSeek-R1 的推理对话了!
- Windows:按下快捷键
三、 极速部署第二步:构建本地专属私密文档知识库
在终端中对话不够直观,且无法上传本地文档。我们现在利用 PageAssist 组建您的私密 RAG 知识库:
- 安装浏览器插件: 在 Chrome 网上应用店或 Edge 扩展商店,搜索 “PageAssist” 并点击添加安装。
- 关联本地 Ollama 引擎: 安装后,点击浏览器右上角的 PageAssist 插件图标。它会自动检测到您在后台运行的 Ollama(默认监听本地
http://localhost:11434端口)。 - 选择 DeepSeek-R1 模型: 在 PageAssist 顶部的模型下拉菜单中,选择我们刚才拉取的
deepseek-r1:8b。 - 导入本地文档构建知识库:
- 在 PageAssist 对话框中,点击底部的 “Documents / 知识库” 图标。
- 创建一个新知识库,点击上传您的本地敏感文档(支持 PDF、Word、TXT、Markdown 等格式)。
- 插件会在您本地电脑的 CPU 上,对文档进行分块、嵌入 (Embedding) 和本地向量化存储。全程没有任何数据上传到云端!
- 本地推理对话:
- 勾选启用该知识库。
- 像使用 ChatGPT 一样提问。例如:“请根据我上传的合同,分析其中有哪些不利于我方的潜在法务风险?”
- DeepSeek-R1 会先在本地检索文档内容,随后展现其强大的
<think>推理思维链,结合合同条款给您出具专业的报告。
四、 硬件配置与运行速度调优建议
本地运行大模型的速度非常依赖硬件:
- 内存带宽是核心瓶颈:如果使用 CPU 运行,双通道高频 DDR5 内存的速度会明显快于 DDR4。
- 显卡加速:如果您的电脑拥有 NVIDIA 独立显卡(支持 CUDA)或 Apple Silicon (M1/M2/M3) 芯片,Ollama 会自动将模型加载到显存(Unified Memory)中,运行速度会从几字/秒瞬间提升至几十字/秒,体验极佳。
五、 结论与外网开发推荐
通过 Ollama 和 PageAssist,国内开发者可以彻底摆脱对海外代理网络和美元支付账户的依赖,零成本拥有 100% 隐私安全的专属本地大模型。
但如果您的电脑硬件配置不足以流畅运行 32B 以上的高阶推理模型,或者需要在 IDE 中进行云端高效编程(如使用 GitHub Copilot、Claude 3.5 API),您仍然需要稳定的网络环境与境外卡支持。欢迎延伸查阅:
国家利益和民族团结高于一切
使用网络时请严格遵守国家法律法规规定,请勿从事色情、暴恐、破坏国家安全等违反国家法律的活动,科学上网,不谈政治,不谈宗教,不碰黄赌毒。龙的传人需自律,有损国家利益和民族团结的事情,坚决不做!

