在本地部署大模型ollama的保姆級(jí)教程
一、部署方式選擇
| 部署方式 | 上手難度 | 核心特點(diǎn) | 適用場(chǎng)景 |
|---|---|---|---|
| Ollama | ? | 命令極簡(jiǎn),自動(dòng)適配環(huán)境,自帶 API 接口 | 新手日常本地調(diào)用、快速測(cè)試 |
| LM Studio | ? | 圖形化操作,無(wú)需敲代碼,兼容 OpenAI 接口 | 不想使用命令行、純可視化使用 |
| Text Generation WebUI | ??? | 功能齊全,支持模型微調(diào)、多種量化格式 | 深度調(diào)試模型、個(gè)性化參數(shù)配置 |
| vLLM | ???? | 推理速度快,高并發(fā)性能強(qiáng) | 搭建對(duì)外服務(wù)、生產(chǎn)環(huán)境部署 |
大家可以按需自我選擇,我的推薦是本地自己玩使用ollama,在企業(yè)使用最好用vLLM
二、ollama下載(windows電腦為例)
如果官網(wǎng)能下載就用官網(wǎng),不能就鏡像地址,懂得都懂
- 官網(wǎng)地址:https://ollama.com/download
- 鏡像地址:https://cnb.cool/hex/ollama/-/releases/latest/download/OllamaSetup.exe
注意:后續(xù)下載模型一般都好幾個(gè)G,可以在setting中設(shè)置模型下載地址
三、免費(fèi)開(kāi)源大模型選擇
| 模型名稱 | 推薦版本 | 中文友好 | 商用權(quán)限 | Ollama 下載命令 | 最低顯存 | 推薦顯存 | 最低內(nèi)存 | 推薦內(nèi)存 | 硬件適配選型 |
|---|---|---|---|---|---|---|---|---|---|
| 通義千問(wèn) Qwen | Qwen2:7b/14b | ★★★★★ | 免費(fèi)可商用 | ollama run qwen2:7b ollama run qwen2:14b | 6G 10G | 8-16G 16G+ | 16G 32G | 32G 64G | 16G 內(nèi)存選 7b,32G 及以上內(nèi)存選 14b |
| 智譜 ChatGLM | chatglm3:6b | ★★★★★ | 免費(fèi)可商用 | ollama run chatglm3:6b | 5G | 6-8G | 16G | 32G | 常規(guī)家用內(nèi)存均可流暢運(yùn)行 |
| Llama3 | llama3:8b | ★★★☆☆ | 個(gè)人免費(fèi)商用受限 | ollama run llama3:8b | 6G | 8-16G | 16G | 32G | 16G 標(biāo)準(zhǔn)內(nèi)存適配日常使用 |
| DeepSeek | deepseek:7b | ★★★★☆ | 個(gè)人免費(fèi)商用受限 | ollama run deepseek:7b | 6G | 8-16G | 16G | 32G | 代碼推理場(chǎng)景,16G 內(nèi)存夠用 |
| Mixtral | mixtral:8x7b | ★★★☆☆ | 免費(fèi)可商用 | ollama run mixtral | 10G | 16G+ | 32G | 64G | 大內(nèi)存機(jī)型專屬,長(zhǎng)文本處理優(yōu)選 |
| Gemma | gemma2:9b | ★★★☆☆ | 個(gè)人免費(fèi)商用受限 | ollama run gemma2:9b | 8G | 12-16G | 16G | 32G | 主流內(nèi)存配置均可穩(wěn)定運(yùn)行 |
| Phi-3 | phi3:mini | ★★★☆☆ | 免費(fèi)可商用 | ollama run phi3:mini | 3G | 4-6G | 8G | 16G | 低配小內(nèi)存筆記本首選 |
我是16G內(nèi)存,下載的是Qwen2:7b,直接在powershell上運(yùn)行ollama run qwen2:7b
四、使用

選中模型直接對(duì)話即可,就可以使用了?。?!
地址驗(yàn)證:http://localhost:11434/

五、項(xiàng)目集成(Spring AI框架為例)
- pom依賴
<dependencies>
<dependency>
<groupId>org.springframework.boot</groupId>
<artifactId>spring-boot-starter-web</artifactId>
</dependency>
<!-- Spring AI Ollama 依賴 -->
<dependency>
<groupId>org.springframework.ai</groupId>
<artifactId>spring-ai-starter-model-ollama</artifactId>
<version>1.0.0</version>
</dependency>
</dependencies>- yaml配置
spring:
application:
name: spring-ai-demo
ai:
ollama:
base-url: http://localhost:11434
chat:
model: qwen2:7b- 測(cè)試運(yùn)行
package com.example.springaidemo.controller;
import org.springframework.ai.chat.client.ChatClient;
import org.springframework.web.bind.annotation.GetMapping;
import org.springframework.web.bind.annotation.RestController;
@RestController
public class AiController {
private final ChatClient chatClient;
// 自動(dòng)注入 Ollama
public AiController(ChatClient.Builder chatClientBuilder) {
this.chatClient = chatClientBuilder.build();
}
// 測(cè)試接口
@GetMapping("/ai")
public String ask(String question) {
return chatClient.prompt()
.user(question)
.call()
.content();
}
}
到此這篇關(guān)于在本地部署大模型ollama的保姆級(jí)教程的文章就介紹到這了,更多相關(guān)本地部署大模型ollama內(nèi)容請(qǐng)搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章,希望大家以后多多支持腳本之家!
相關(guān)文章

2026最新Linux本地部署Ollama安裝全流程(含離線/開(kāi)機(jī)自啟/遠(yuǎn)程訪問(wèn))
本文記錄在 CentOS 7+ / Ubuntu 20.04+ 上部署 Ollama 的實(shí)操筆記,覆蓋 一鍵在線安裝 與 離線 tar 包安裝 兩種方式,并補(bǔ)充 systemd 開(kāi)機(jī)自啟、qwen2 / deepseek-r1 等模2026-05-19
Windows系統(tǒng)使用Ollama部署本地大模型的實(shí)現(xiàn)步驟
本文主要介紹了在Ollama平臺(tái)下載和安裝AI模型的方法,包括點(diǎn)擊按鈕安裝和使用指令下載兩種方式,文中通過(guò)示例代碼介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)2026-04-29
Ollama本地部署與遠(yuǎn)程訪問(wèn)的全流程實(shí)戰(zhàn)指南
本文詳細(xì)介紹了Ollama本地大模型運(yùn)行框架的安裝配置方法,特別是如何實(shí)現(xiàn)遠(yuǎn)程訪問(wèn),文章從基礎(chǔ)安裝、配置優(yōu)化、網(wǎng)絡(luò)設(shè)置、遠(yuǎn)程訪問(wèn)、服務(wù)驗(yàn)證到常見(jiàn)問(wèn)題解決,逐層深入,為開(kāi)發(fā)2026-04-12
本地快速部署Ollama運(yùn)行大語(yǔ)言模型詳細(xì)流程(最新推薦)
本文主要介紹如何在 Windows 系統(tǒng)快速部署 Ollama 開(kāi)源大語(yǔ)言模型運(yùn)行工具,并安裝 Open WebUI 結(jié)合 cpolar 內(nèi)網(wǎng)穿透軟件,實(shí)現(xiàn)在公網(wǎng)環(huán)境也能訪問(wèn)你在本地內(nèi)網(wǎng)搭建的 llam2026-04-07
ollama本地部署DeepSeek教程的實(shí)現(xiàn)
本文主要介紹如何使用ollama本地部署deepseek大模型,以及使用WebUI工具界面進(jìn)行交互,文中通過(guò)示例代碼介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需2026-03-31
Docker部署Ollama搭建本地AI開(kāi)發(fā)環(huán)境
本文介紹如何通過(guò)Docker+Ollama搭建本地AI開(kāi)發(fā)環(huán)境,解決云端API調(diào)用成本高、延遲大的問(wèn)題,幫助開(kāi)發(fā)者快速實(shí)現(xiàn)本地AI應(yīng)用開(kāi)發(fā),無(wú)需擔(dān)心API調(diào)用限制和費(fèi)用問(wèn)題,感興趣的可2026-03-30







