庫)
簡介面向AI初學(xué)者與本地部署愛好者的DeepSeek完整落地教程以保姆級(jí)方式講解從零開始在個(gè)人電腦上部署DeepSeek、配置WebUI可視化界面并借助nomic-embed-text與AnythingLLM完成數(shù)據(jù)投喂訓(xùn)練。資源為單一docx文檔共1個(gè)文件壓縮包大小2.76MB內(nèi)容按本地部署、WebUI可視化、數(shù)據(jù)投喂訓(xùn)練三大模塊展開包含Ollama安裝與模型選型、Page Assist插件配置、AnythingLLM工作區(qū)搭建及知識(shí)庫嵌入等關(guān)鍵環(huán)節(jié)步驟清晰且附有命令行示例與界面操作說明即使無AI基礎(chǔ)也能按圖索驥。目前已有1186人學(xué)習(xí)下載適合希望擺脫官方服務(wù)不穩(wěn)定、追求本地運(yùn)行與個(gè)性化知識(shí)庫的玩家收藏使用。1. DeepSeek 本地部署與其在網(wǎng)頁端排隊(duì)不如把它裝進(jìn)自己的機(jī)器最近 DeepSeek 的熱度不用我多說了網(wǎng)頁端動(dòng)不動(dòng)就是“服務(wù)器繁忙”高峰時(shí)段一個(gè)問句要轉(zhuǎn)半天才出結(jié)果。其實(shí) DeepSeek 是開源模型完全可以在本地部署大語言模型把對(duì)話、知識(shí)庫、訓(xùn)練數(shù)據(jù)全部攥在自己手里。這篇文章要把整條鏈路拆開講清楚用 Ollama 部署 DeepSeek-R1、用 Page Assist 做 WebUI 可視化再用 AnythingLLM 配合 nomic-embed-text 做數(shù)據(jù)投喂訓(xùn)練 AI。整個(gè)過程不涉及改代碼、不需要懂 Transformer 原理只要你有一臺(tái) Windows 電腦跟著步驟走就能拿到一個(gè)隨時(shí)能對(duì)話、還能查看并回答自己私有文檔內(nèi)容的專屬大模型。這也是近兩個(gè)月我?guī)团笥押屯麓盍似甙颂字笳沓鰜淼囊粭l最穩(wěn)的路徑。2. 從零裝好 Ollama 并拉取 DeepSeek-R1命令、選型與顯存邊界2.1 為什么先裝 Ollama本地大模型運(yùn)行時(shí)的角色拆解大模型不是一個(gè)安裝包雙擊就能跑的。它下載下來是幾十 GB 的權(quán)重文件運(yùn)行時(shí)要加載到顯存、做推理、管理上下文長度這些工作如果讓你手動(dòng)做得配置 Python 環(huán)境、下載 PyTorch、寫推理腳本新手基本勸退。Ollama 做的事就是把“下載模型、加載模型、運(yùn)行模型”這三件事封裝成一條命令它底層調(diào)用 llama.cpp 這類推理引擎對(duì)外只暴露一個(gè)簡潔的 CLI 和本地 HTTP API。你只要裝好 Ollama之后無論是用命令行直接對(duì)話還是讓 WebUI、知識(shí)庫工具通過接口調(diào)用模型都由它統(tǒng)一托管省掉大量環(huán)境折騰。我一般會(huì)把它理解為“本地大模型的 Docker”你不用關(guān)心權(quán)重文件放在哪個(gè)目錄、CUDA 版本對(duì)不對(duì)、模型量化格式是什么Ollama 全包了。說個(gè)選型理由目前本地部署大語言模型的方案不少有寫 Python 腳本直接調(diào) transformers 的有用 vLLM 做高性能推理的但新手最穩(wěn)的路徑就是 Ollama。它對(duì) Windows 支持好、顯存不足時(shí)會(huì)自動(dòng)退到 CPU 推理慢而已官方模型庫一行命令就能拉模型而且用戶基數(shù)大出問題隨便一搜就是別人的踩坑記錄不用你一個(gè)人對(duì)著黑匣子發(fā)愁。2.2 安裝與驗(yàn)證三步確認(rèn)環(huán)境沒問題到 Ollama 官網(wǎng) https://ollama.com 下載 Windows 安裝包安裝過程沒什么可選的一路下一步就行。安裝完成后打開 Windows 自帶的命令行工具cmd 或 PowerShell輸入# 驗(yàn)證 Ollama 是否安裝成功 ollama --version正常情況下會(huì)輸出類似ollama version 0.x.x的版本號(hào)。如果提示“不是內(nèi)部或外部命令”說明安裝路徑?jīng)]加進(jìn)系統(tǒng)環(huán)境變量 PATH重新開一個(gè)終端窗口再試還不行就找到 Ollama 的安裝目錄默認(rèn)在C:\Users\你的用戶名\AppData\Local\Programs\Ollama手動(dòng)把這個(gè)路徑加進(jìn)系統(tǒng)環(huán)境變量。Ollama 安裝好之后默認(rèn)在本機(jī)監(jiān)聽11434端口這個(gè)信息后面配置 Page Assist 和 AnythingLLM 都要用。想確認(rèn)服務(wù)真的在跑瀏覽器訪問http://localhost:11434能看到一行Ollama is running的提示就代表正常。提示Ollama 默認(rèn)監(jiān)聽 11434 端口后續(xù) WebUI 和知識(shí)庫工具都通過這個(gè)端口與模型通信如果哪一步連不上模型先回來看這個(gè)端口通不通。2.3 按顯存選 DeepSeek 版本1.5b 到 671b 的取舍Ollama 裝好后下一步是選模型版本。DeepSeek-R1 系列從 1.5b 一直到 671b參數(shù)量差了幾百倍顯存需求也天差地別。你可以在 Ollama 官網(wǎng)的 Models 頁面找到 DeepSeek-R1 模型詳情它會(huì)列出每個(gè) tag 對(duì)應(yīng)的參數(shù)量和推薦顯存。我的選型經(jīng)驗(yàn)是這樣4GB-6GB 顯存老老實(shí)實(shí)選 1.5b8GB 顯存可以試 7b16GB 以上再考慮 14b 或 32b至于 671b 滿血版那是多卡服務(wù)器的事普通 PC 不用想。這里的 bbillion指參數(shù)量參數(shù)量越大模型推理時(shí)占用顯存越高回答質(zhì)量也相對(duì)越好。本地部署的核心矛盾永遠(yuǎn)是“你的硬件能跑得起多大的模型”。我自己用的是 4GB 顯存的 Windows 筆記本所以全程以 1.5b 版本為基準(zhǔn)寫操作步驟。下面這張表是我常用的參考模型版本參數(shù)量建議顯存典型用途deepseek-r1:1.5b1.5B4GB 以上簡單對(duì)話、文本分類、文檔問答deepseek-r1:7b7B8GB - 12GB日常問答、代碼片段生成deepseek-r1:14b14B16GB 以上較復(fù)雜推理、長文本理解deepseek-r1:32b32B24GB 以上高質(zhì)量問答、知識(shí)庫分析deepseek-r1:671b671B多卡服務(wù)器滿血版本地幾乎不看注意表里的顯存建議是“模型全量加載到 GPU”的情況。如果顯存不夠Ollama 會(huì)自動(dòng)把部分層放到 CPU 上跑也能出結(jié)果但速度會(huì)明顯下降后面避坑章節(jié)我會(huì)詳細(xì)說這個(gè)現(xiàn)象的典型表現(xiàn)。2.4 拉取 DeepSeek-R1 模型并完成首次命令行對(duì)話決定好版本之后直接復(fù)制 Ollama 頁面上的模型名在命令行執(zhí)行拉取命令# 拉取 1.5b 版本對(duì)應(yīng)原文中 4GB 顯存的例子 ollama pull deepseek-r1:1.5b顯存更大就改成deepseek-r1:7b或deepseek-r1:14bpull命令不區(qū)分模型大小只是下載的數(shù)據(jù)量不同。下載過程中看不到百分比進(jìn)度條是正常的它只會(huì)顯示連接狀態(tài)耐心等即可。如果不小心關(guān)掉了窗口重新執(zhí)行一次ollama pull會(huì)從斷點(diǎn)繼續(xù)不用從頭拉。下載完成后直接執(zhí)行# 進(jìn)入交互式對(duì)話模式 ollama run deepseek-r1:1.5b這個(gè)命令會(huì)進(jìn)入一個(gè)命令行聊天界面你輸入一句它回一句行為和網(wǎng)頁端 DeepSeek 類似只是沒有圖形界面。第一次運(yùn)行需要加載模型4GB 顯存跑 1.5b 大概 5 到 10 秒出結(jié)果速度可以接受。確認(rèn)能對(duì)話之后命令行這一層就算跑通了接下來加 WebUI。3. WebUI 可視化用 Page Assist 給 DeepSeek 裝一個(gè)瀏覽器界面3.1 命令行交互的痛點(diǎn)與 WebUI 選型命令行能跑通但這離“好用”還差得遠(yuǎn)。ollama run這種交互方式有幾個(gè)明顯問題第一沒有對(duì)話歷史列表對(duì)話一長就翻不到前面的內(nèi)容第二不直觀想引用一張圖或一段網(wǎng)頁內(nèi)容都做不到第三日常用很別扭每句話都得在終端里敲。所以我建議加一層 WebUI。目前社區(qū)里最常見的兩個(gè)方案是 Open WebUI 和 Page Assist。Open WebUI 功能很強(qiáng)但需要 Docker 或 Python 環(huán)境安裝門檻略高Page Assist 是瀏覽器插件直接從 Chrome/Edge 擴(kuò)展商店裝代碼倉庫在 https://github.com/n4ze3m/page-assist面向的就是 Ollama 這類本地推理引擎。裝好后能在瀏覽器側(cè)邊欄里和本地模型對(duì)話還能讀取當(dāng)前網(wǎng)頁內(nèi)容、和 PDF 對(duì)話對(duì)大部分開發(fā)者來說功能密度足夠覆蓋日常需求了。我之所以推薦 Page Assist核心原因是它不需要額外起服務(wù)不用配端口、不用管 Docker 容器一個(gè)插件解決可視化訴求非常適合新手。3.2 安裝 Page Assist 并接入 Ollama操作路徑打開 Chrome 或 Edge 瀏覽器進(jìn)入擴(kuò)展管理頁面地址欄輸入edge://extensions或chrome://extensions搜索 Page Assist點(diǎn)擊獲取安裝。裝完擴(kuò)展列表里會(huì)出現(xiàn) Page Assist 的圖標(biāo)點(diǎn)擊圖標(biāo)打開側(cè)邊欄對(duì)話界面。打開之后頁面上有模型選擇下拉框。如果里面沒有 DeepSeek 模型檢查兩件事一是確認(rèn) Ollama 服務(wù)在運(yùn)行二是確認(rèn)模型已經(jīng)下載成功。Page Assist 通過 Ollama 的本地 API 自動(dòng)發(fā)現(xiàn)已安裝模型正常情況下列表里會(huì)直接出現(xiàn)deepseek-r1:1.5b。選擇模型后直接輸入問題即可對(duì)話。本質(zhì)上是 Page Assist 把瀏覽器里的對(duì)話請(qǐng)求轉(zhuǎn)發(fā)給 Ollama 的http://localhost:11434/api/chat接口模型推理完再把結(jié)果渲染到側(cè)邊欄。整個(gè)鏈路里沒有遠(yuǎn)程服務(wù)器參與所有對(duì)話都在本機(jī)完成。這里有個(gè)值得注意的細(xì)節(jié)如果 Page Assist 連不上本地服務(wù)去 Ollama 的環(huán)境變量里檢查一下OLLAMA_HOST是否被改過默認(rèn)應(yīng)該是127.0.0.1:11434。3.3 聯(lián)網(wǎng)開關(guān)與視覺支持的邊界Page Assist 的側(cè)邊欄下方有一個(gè)“聯(lián)網(wǎng)”開關(guān)打開后它會(huì)把當(dāng)前網(wǎng)頁的內(nèi)容作為上下文一并交給本地模型再讓模型結(jié)合網(wǎng)頁內(nèi)容回答。我建議這樣用搜索類任務(wù)打開聯(lián)網(wǎng)讓模型先讀當(dāng)前頁面再做總結(jié)純知識(shí)問答保持關(guān)閉即可這樣響應(yīng)更快也更穩(wěn)定。需要說清楚的一點(diǎn)聯(lián)網(wǎng)開關(guān)并沒有讓 DeepSeek 真正“上網(wǎng)”只是讓模型多了一個(gè)網(wǎng)頁內(nèi)容來源。DeepSeek-R1 的訓(xùn)練數(shù)據(jù)有截止時(shí)間點(diǎn)對(duì)于之后的新信息唯一能讓它“知道”的辦法就是把內(nèi)容喂給它——無論是開 Page Assist 的聯(lián)網(wǎng)開關(guān)還是后面 AnythingLLM 的數(shù)據(jù)投喂本質(zhì)都是給模型看它沒見過的資料。另外Page Assist 支持視覺模型但 DeepSeek-R1 文本版不支持圖片輸入。如果你想用截圖識(shí)別、圖片問答這類能力需要額外拉一個(gè)支持視覺的模型比如llava或qwen2-vl。這個(gè)屬于進(jìn)階玩法新手先把文本鏈路跑通后面有需求再補(bǔ)。4. 數(shù)據(jù)投喂訓(xùn)練 AIAnythingLLM 與 nomic-embed-text 搭建私有知識(shí)庫4.1 方案鏈路拆解為什么一定要嵌入模型“數(shù)據(jù)投喂訓(xùn)練 AI”這個(gè)詞其實(shí)容易讓人誤解。嚴(yán)格來說接下來做的不是改模型權(quán)重不是重新訓(xùn)練而是把文檔切塊、向量化、存進(jìn)向量數(shù)據(jù)庫在問答時(shí)檢索最相關(guān)的文本片段把片段作為上下文交給大模型讓它基于你的私有資料回答。這套方案的專業(yè)叫法是 RAG檢索增強(qiáng)生成對(duì)新手最友好因?yàn)樗恍枰~外訓(xùn)練、不需要改權(quán)重卻能實(shí)現(xiàn)“AI 能看懂我的文檔”的效果。在這條鏈路里nomic-embed-text 扮演的角色是“把文本變成向量”的嵌入模型。文檔投喂進(jìn)系統(tǒng)時(shí)每段文字都要統(tǒng)一編碼成一組數(shù)字向量這樣才能計(jì)算相似度、才能被檢索出來。AnythingLLM 本身不內(nèi)置嵌入模型它通過 Ollama 調(diào)用 nomic-embed-text 完成文檔向量化。這也是為什么在執(zhí)行數(shù)據(jù)投喂之前要先ollama pull nomic-embed-text。4.2 拉取嵌入模型并安裝 AnythingLLM先執(zhí)行命令拉取嵌入模型# 拉取 nomic-embed-text 嵌入模型 ollama pull nomic-embed-text這個(gè)模型很小幾百 MB下載很快。嵌入模型和對(duì)話模型是兩類角色對(duì)話模型負(fù)責(zé)“生成回答”嵌入模型負(fù)責(zé)“理解并向量化文本”兩者缺一不可。拉取完之后去 AnythingLLM 官網(wǎng)下載對(duì)應(yīng) Windows 版本的安裝包。安裝過程中有一個(gè)細(xì)節(jié)默認(rèn)安裝路徑在 C 盤可以在向?qū)Ю锇崖窂绞鬃帜父某善渌P符比如F:\AnythingLLM避免把模型數(shù)據(jù)和應(yīng)用全堆在系統(tǒng)盤。安裝完打開軟件首次啟動(dòng)有個(gè)引導(dǎo)界面點(diǎn)擊 Get started然后輸入工作區(qū)名稱。工作區(qū)相當(dāng)于一個(gè)獨(dú)立的項(xiàng)目空間每個(gè)工作區(qū)可以投喂不同數(shù)據(jù)集、指定不同模型互不干擾。之后進(jìn)入主界面如果顯示英文點(diǎn)左下角設(shè)置Settings在 Customization 里把語言切換成 Chinese重啟軟件生效。4.3 三處關(guān)鍵配置LLM、Embedder 與代理AnythingLLM 的主界面需要配置三層每一層都指向 Ollama 提供的本地服務(wù)。第一層是全局 LLM 設(shè)置進(jìn)入“設(shè)置” - “LLM 首選項(xiàng)”提供商選OllamaOllama Model 選擇下載好的deepseek-r1:1.5b保存更改。含義是所有對(duì)話默認(rèn)用這個(gè)模型推理。第二層是 Embedder 設(shè)置在“Embedder 首選項(xiàng)”里提供商選Ollama嵌入模型選nomic-embed-text保存。第三層是工作區(qū)級(jí)別的模型覆蓋在工作區(qū)設(shè)置里選“聊天設(shè)置”把工作區(qū) LLM 提供者、聊天模型都設(shè)為 Ollama 和 deepseek-r1點(diǎn) Update workspace agent代理配置同樣指向 Ollama 和 deepseek-r1。這層的意義是讓每個(gè)工作區(qū)可以獨(dú)立覆蓋全局設(shè)定多個(gè)項(xiàng)目的數(shù)據(jù)不會(huì)串味。不配置代理模型一般不影響基本對(duì)話但 AnythingLLM 的 Agent 功能也就是讓 AI 執(zhí)行多步操作、調(diào)用工具的能力依賴這個(gè)字段。建議新人一并配齊省得后面要用時(shí)再回來補(bǔ)。4.4 上傳文檔與向量化投喂完整操作步驟配置完成后回到工作區(qū)主界面點(diǎn)“上傳”按鈕選擇需要投喂的文檔。AnythingLLM 支持 PDF、TXT、Word、Excel、PPT 等常見格式文本類文件基本通吃。文件上傳后會(huì)出現(xiàn)在臨時(shí)文件列表里勾選要投喂的文件點(diǎn)擊 Move to Workspace 把文件移入當(dāng)前工作區(qū)然后再點(diǎn) Save and Embed 執(zhí)行向量化。所謂 Embed就是把文檔切塊并調(diào)用 nomic-embed-text 生成向量存入 AnythingLLM 自帶的向量數(shù)據(jù)庫。這一步就是“數(shù)據(jù)投喂訓(xùn)練 AI”的字面執(zhí)行。執(zhí)行完之后關(guān)掉文檔窗口直接在對(duì)話框提問。如果你問的問題在文檔里有明確答案AnythingLLM 會(huì)先檢索相關(guān)片段再把片段拼進(jìn) prompt 交給 deepseek-r1 生成回答。這套方案的邊界是它擅長回答文檔中有原文依據(jù)的問題文檔里沒提到的內(nèi)容模型會(huì)退化回自己的常識(shí)回答甚至明確告訴你不知道。這不算缺陷反而是 RAG 方案的安全邊界防止模型把知識(shí)庫之外的內(nèi)容編造出來。5. 避坑與排查從“拉不下來”到“答非所問”的五條實(shí)戰(zhàn)記錄5.1 現(xiàn)象ollama pull卡住不動(dòng)提示網(wǎng)絡(luò)錯(cuò)誤原因Ollama 拉取模型走的是官方模型倉庫國內(nèi)網(wǎng)絡(luò)訪問時(shí)鏈路不穩(wěn)定尤其在大模型下載過程中經(jīng)常中斷。解決我的習(xí)慣分三步。第一步重新執(zhí)行ollama pullOllama 支持?jǐn)帱c(diǎn)續(xù)傳多試幾次經(jīng)常能拉完第二步如果反復(fù)失敗檢查 Ollama 的環(huán)境變量看是否配置了OLLAMA_MODELS指向的模型存儲(chǔ)路徑有足夠磁盤空間同時(shí)可以在 Ollama 官方文檔里查詢鏡像倉庫配置方式換一個(gè)訪問更快的鏡像源第三步實(shí)在不行換個(gè)網(wǎng)絡(luò)環(huán)境比如手機(jī)熱點(diǎn)拉通之后再切回原網(wǎng)絡(luò)。這個(gè)坑基本每個(gè)新手都會(huì)遇到是網(wǎng)絡(luò)環(huán)境問題不是配置錯(cuò)誤不用反復(fù)懷疑自己。5.2 現(xiàn)象模型加載成功但回答速度極慢一個(gè)字一個(gè)字往外蹦原因顯存不夠Ollama 自動(dòng)把部分層放到了 CPU 上推理。4GB 顯存跑 7b 就是這種體驗(yàn)?zāi)艹鼋Y(jié)果但基本沒法用。解決回到選型環(huán)節(jié)把模型換成deepseek-r1:1.5b或者關(guān)掉其他占用顯存的軟件瀏覽器多開標(biāo)簽頁也會(huì)吃顯存再或者把 Ollama 的并行參數(shù)OLLAMA_NUM_PARALLEL設(shè)置為 1減少并發(fā)任務(wù)對(duì)顯存的占用。我自己的測試?yán)?GB 顯存跑 1.5b 流暢對(duì)話跑 7b 基本不可用所以在選版本這件事上寧小勿大先跑通再升級(jí)。5.3 現(xiàn)象文檔投喂完之后提問時(shí) AI 還是回答不上來原因常見有三種。第一種投喂后沒點(diǎn) Save and Embed文檔只是上傳了沒做向量化檢索不到內(nèi)容第二種提問的措辭和文檔原文差異太大嵌入檢索匹配不上第三種對(duì)話界面選錯(cuò)了工作區(qū)當(dāng)前工作區(qū)里根本沒有投喂數(shù)據(jù)。解決重新確認(rèn)上傳流程三步都執(zhí)行完畢特別是最后的 Save and Embed提問時(shí)盡量用文檔里的原詞比如文檔寫的是“正點(diǎn)原子”你問“這家公司是做什么的”能答出來但換一個(gè)完全不同的說法可能就匹配不上最后確認(rèn)對(duì)話界面對(duì)應(yīng)的就是投喂數(shù)據(jù)的工作區(qū)。5.4 現(xiàn)象Page Assist 打開聯(lián)網(wǎng)開關(guān)后回答質(zhì)量反而變差原因聯(lián)網(wǎng)后模型收到了當(dāng)前網(wǎng)頁的大段無關(guān)文本作為上下文這些干擾文本沖淡了模型對(duì)問題的理解回答自然跑偏。解決聯(lián)網(wǎng)開關(guān)保持關(guān)閉只在需要總結(jié)當(dāng)前網(wǎng)頁內(nèi)容時(shí)開啟。頁面內(nèi)容過長時(shí)手動(dòng)復(fù)制關(guān)鍵段落投喂給模型效果比讓模型讀全文好得多。這里有個(gè)經(jīng)驗(yàn)RAG 的關(guān)鍵不是給更多內(nèi)容而是給更相關(guān)的內(nèi)容。5.5 現(xiàn)象AnythingLLM 界面全英文找不到中文選項(xiàng)原因語言選項(xiàng)藏在 Customization 外觀定制菜單里而不是 Settings 首頁新用戶容易忽略。解決進(jìn)入 Settings - Customization找到 Language 或語言下拉框選擇 Chinese保存后重啟 AnythingLLM。如果你的版本里連這個(gè)選項(xiàng)都沒有確認(rèn)安裝的是最新版舊版本對(duì)中文界面支持不完整。6. 驗(yàn)證投喂成果與兩條進(jìn)階玩法把 AI 變成團(tuán)隊(duì)的文檔庫驗(yàn)證整套本地部署值不值得關(guān)鍵看你能不能從“能對(duì)話”走到“能用”。我自己驗(yàn)證投喂效果的方式很簡單問一個(gè)只有文檔里才有的答案。比如投喂的是公司介紹文檔里面有句“正點(diǎn)原子成立于某年某地”我就問“正點(diǎn)原子公司成立于哪一年、在哪個(gè)城市”。如果 AI 能準(zhǔn)確回復(fù)出來說明嵌入、檢索、生成這條鏈路全通了如果回得不對(duì)回到上一章的 5.3 逐項(xiàng)排查。進(jìn)階玩法第一個(gè)是多工作區(qū)隔離。AnythingLLM 支持每個(gè)工作區(qū)獨(dú)立投喂數(shù)據(jù)、獨(dú)立選模型我一般每個(gè)項(xiàng)目開一個(gè)工作區(qū)項(xiàng)目 A 的合同文本放工作區(qū) A項(xiàng)目 B 的技術(shù)手冊(cè)放工作區(qū) B兩邊提問互不干擾。這個(gè)做法對(duì)團(tuán)隊(duì)協(xié)作特別實(shí)用相當(dāng)于給每個(gè)項(xiàng)目建了一個(gè)獨(dú)立的私有知識(shí)庫。第二個(gè)進(jìn)階玩法是把 Ollama 的能力接進(jìn)自己的腳本。Ollama 在 11434 端口提供 OpenAI 兼容 APIAnythingLLM 之外的代碼也能直接調(diào)用。比如用 Python 的ollama庫或 Node 的ollama/ollama-js在腳本里封裝對(duì)話請(qǐng)求把本地模型嵌入到業(yè)務(wù)流程中。我做一個(gè)日?qǐng)?bào)自動(dòng)生成工具時(shí)就是這么干的腳本讀取項(xiàng)目文檔調(diào)用本地deepseek-r1:1.5b生成摘要再寫入 Excel全程不出本機(jī)不產(chǎn)生任何 API 費(fèi)用。從那以后我每次幫人部署本地大模型都強(qiáng)制走一遍“裝 Ollama - 拉模型 - 接 WebUI - 建工作區(qū) - 投喂測試文檔”的完整流程。這套流程看著長跑熟了一次不到二十分鐘但能確保每一層環(huán)境都是通的而不是只在命令行里能回話。希望這篇教程里的鏈路和坑位記錄能幫到你特別是第一次碰本地大模型的朋友按著文檔一步步來大概率不會(huì)再翻車。本文還有配套的精品資源點(diǎn)擊獲取