2026最新Linux本地部署Ollama安裝全流程(含離線/開機自啟/遠程訪問)
前言:本文記錄在 CentOS 7+ / Ubuntu 20.04+ 上部署 Ollama 的實操筆記,覆蓋 一鍵在線安裝 與 離線 tar 包安裝 兩種方式,并補充 systemd 開機自啟、qwen2 / deepseek-r1 等模型拉取與對話、局域網(wǎng)遠程 API 訪問 及常見排錯要點。適合在 Linux 服務(wù)器或虛擬機上本地跑大模型、為 Python/AI 應(yīng)用提供推理服務(wù)、或內(nèi)網(wǎng)/弱網(wǎng)環(huán)境需要離線部署的讀者。按文操作即可完成安裝、啟服、拉模型,并按需開放 11434 端口供其他機器調(diào)用。
一、環(huán)境準備
- 系統(tǒng):CentOS7+ / Ubuntu20.04+(64 位)
- 權(quán)限:root 或 sudo 權(quán)限
- 硬件:內(nèi)存 ≥8GB(7B 模型推薦 16GB),磁盤 ≥20GB(存模型)
- 網(wǎng)絡(luò):聯(lián)網(wǎng)(在線安裝);離線需提前下載安裝包
二、兩種安裝方式
方式 1:一鍵在線安裝
# 官方腳本(自動下載+解壓+配置服務(wù)) curl -fsSL https://ollama.com/install.sh | sh # 驗證安裝(輸出版本即成功) ollama --version # 示例:ollama version is 0.5.12
方式 2:手動離線安裝(網(wǎng)絡(luò)差時用)
下載離線包(官網(wǎng) / 網(wǎng)盤):https://ollama.com/download/ollama-linux-amd64.tgz
上傳到 Linux(如 /root/install_package),執(zhí)行:
# 解壓到 /usr(系統(tǒng)目錄,全局可用) tar -zxvf ollama-linux-amd64.tgz -C /usr/ # 驗證 ollama -v
三、配置開機自啟(必做)
創(chuàng)建系統(tǒng)服務(wù)文件 /etc/systemd/system/ollama.service:
vi /etc/systemd/system/ollama.service
寫入內(nèi)容:
[Unit] Description=Ollama Service After=network-online.target [Service] ExecStart=/usr/bin/ollama serve User=root Group=root Restart=always RestartSec=3 [Install] WantedBy=default.target
生效并設(shè)置開機自啟:
# 重載服務(wù)配置 systemctl daemon-reload # 開機自啟 systemctl enable ollama # 啟動服務(wù) systemctl start ollama # 查看狀態(tài)(顯示 active 即正常) systemctl status ollama
四、拉取并運行模型(以 qwen2、deepseek-r1 為例)
1. 拉取模型(自動下載,約 300MB–1GB)
# 通義千問 qwen2:0.5b(輕量) ollama pull qwen2:0.5b # DeepSeek 推理模型 deepseek-r1:1.5b ollama pull deepseek-r1:1.5b
2. 運行模型(對話交互)
# 運行 qwen2 ollama run qwen2:0.5b # 運行 deepseek-r1 ollama run deepseek-r1:1.5b
輸入問題直接對話,輸入 /bye 退出。
五、開通遠程訪問(可選,局域網(wǎng) / 外部調(diào)用)
1. 配置環(huán)境變量(允許所有 IP 訪問)
編輯 /etc/profile:
vi /etc/profile
添加:
export OLLAMA_HOST=0.0.0.0:11434 export OLLAMA_ORIGINS=*
生效:
source /etc/profile
2. 修改服務(wù)文件(添加環(huán)境變量)
vi /etc/systemd/system/ollama.service
在 [Service] 下添加 2 行:
Environment="OLLAMA_HOST=0.0.0.0:11434" Environment="OLLAMA_ORIGINS=*"
3. 重啟服務(wù) + 放行端口
# 重載+重啟 systemctl daemon-reload systemctl restart ollama # 放行11434端口(防火墻) firewall-cmd --zone=public --add-port=11434/tcp --permanent firewall-cmd --reload # 或直接關(guān)閉防火墻(測試環(huán)境) systemctl stop firewalld systemctl disable firewalld
4. 測試遠程訪問
在另一臺機器(Windows/macOS)終端執(zhí)行:
curl http://Linux虛擬機IP:11434/api/generate -d '{"model":"qwen2:0.5b","prompt":"你好"}'
返回結(jié)果即成功。
六、Ollama 避坑指南(Linux + Windows)
一、安裝類問題
1)Linux:ollama: command not found
原因:解壓沒放到 /usr/bin,或沒刷新環(huán)境
解決:
# 確認文件存在 ls /usr/bin/ollama # 重新解壓(離線包) tar -zxvf ollama-linux-amd64.tgz -C /usr/ # 重載環(huán)境 source /etc/profile
2)Linux:一鍵安裝卡住、很慢
原因:國外源,網(wǎng)絡(luò)差
解決:改用離線安裝(文檔里那個 tgz 包),速度穩(wěn)定。
3)Windows:安裝后命令不存在
原因:沒加到 PATH
解決:重啟終端;或把 C:\Program Files\Ollama 手動加到系統(tǒng) PATH。
二、服務(wù)啟動類問題
4)Linux:systemctl start ollama 失敗
常見:配置文件寫錯、端口占用、權(quán)限不對
排查:
# 看報錯 journalctl -u ollama # 端口是否被占 netstat -tuln | grep 11434
注意:ollama.service 里路徑必須是 /usr/bin/ollama,別寫錯。
5)Windows:托盤沒羊駝圖標(biāo)、服務(wù)沒起來
解決:管理員運行一次 ollama run qwen2:0.5b,看具體報錯;必要時重裝。
三、模型下載 / 運行坑
6)pull 模型很慢、一直卡
原因:國外服務(wù)器
解決:
- 耐心等;
- 或者先在網(wǎng)絡(luò)好的機器下好,把
.ollama/models目錄直接拷過去。
7)運行模型報錯:out of memory / 卡死
原因:內(nèi)存不夠(qwen2:0.5b≈350MB,7B 模型至少 10G+)
避坑:虛擬機至少 8G 內(nèi)存、2–4 核;新手先用 0.5b/1.5b 小模型。
8)運行模型時:一直拉 manifest、沒反應(yīng)
解決:網(wǎng)絡(luò)不穩(wěn),換網(wǎng)絡(luò)或離線導(dǎo)入模型。
四、遠程訪問坑(最常見)
9)虛擬機里開了 0.0.0.0,外部還是連不上
90% 原因:防火墻沒關(guān) / 沒放行端口
Linux 快速解決(二選一):
# 放行端口 firewall-cmd --add-port=11434/tcp --permanent firewall-cmd --reload # 或直接關(guān)防火墻(測試環(huán)境) systemctl stop firewalld systemctl disable firewalld
10)改了 OLLAMA_HOST 還是不能遠程
必做:改兩處
1)/etc/profile:
export OLLAMA_HOST=0.0.0.0:11434 export OLLAMA_ORIGINS=*
2)ollama.service 的 [Service] 里:
Environment="OLLAMA_HOST=0.0.0.0:11434" Environment="OLLAMA_ORIGINS=*"
然后:
source /etc/profile systemctl daemon-reload systemctl restart ollama
11)Windows 訪問虛擬機 11434 超時
檢查:
- 虛擬機 IP 是否能 ping 通;
- 虛擬機防火墻是否放行;
curl http://虛擬機IP:11434是否返回。
到此這篇關(guān)于2026最新Linux本地部署Ollama安裝全流程(含離線/開機自啟/遠程訪問)的文章就介紹到這了,更多相關(guān)Linux本地部署Ollama內(nèi)容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章,希望大家以后多多支持腳本之家!
相關(guān)文章

一篇帶你搞定Ollama模型的安裝到生產(chǎn)級調(diào)優(yōu)
Ollama 是一個輕量級、可擴展的本地大語言模型運行框架,旨在簡化 LLM 的部署、管理和使用流程,本文主要為大家詳細介紹了Ollama模型的部署、管理和使用,有需要的小伙伴可以2026-05-13
Ollama是一個輕量級、易于使用的大模型管理和部署工具,主要用于簡化大模型的運行和交互,并且為開發(fā)者和用戶提供了快速加載,管理和調(diào)用多種主流大模型的能力,下面我們就2026-04-12
三種快速安裝下載OLLAMA的方法小結(jié)(任何版本都適用)
本文主要介紹了三種快速下載OLLAMA的方法小結(jié),文中通過圖文步驟介紹的非常詳細,對大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價值,需要的朋友們下面隨著小編來一起學(xué)習(xí)學(xué)習(xí)吧2026-03-31
Ollama 簡單安裝(windows/mac/linux/docker)
Ollama 支持多種操作系統(tǒng),包括 macOS、Windows、Linux 以及通過 Docker 容器運行,Ollama 對硬件要求不高,旨在讓用戶能夠輕松地在本地運行、管理和與大型語言模型進行交互2026-03-07
Ollama最新版安裝包下載和安裝步驟(開源,簡單,小白5分鐘學(xué)會)
本文詳細介紹了Ollama的安裝流程,包括Windows和Linux兩個平臺的安裝步驟,以及如何修改模型存儲路徑和使用示例,本文給大家介紹的非常詳細,感興趣的朋友跟隨小編一起看看吧2026-03-06






