使用Docker部署ollama和MaxKB全過(guò)程
步驟1:配置Ollama網(wǎng)絡(luò)環(huán)境
確保Ollama監(jiān)聽外部請(qǐng)求
默認(rèn)情況下,Ollama僅監(jiān)聽 127.0.0.1:11434。需修改環(huán)境變量使其監(jiān)聽所有IP:
# 啟動(dòng)Ollama容器時(shí)添加環(huán)境變量 docker run -d --name ollama \ -p 11434:11434 \ -e OLLAMA_HOST=0.0.0.0 \ # 允許外部訪問(wèn) ollama/ollama
驗(yàn)證Ollama服務(wù)狀態(tài)
在宿主機(jī)執(zhí)行以下命令,確認(rèn)API可訪問(wèn):
curl http://localhost:11434
若返回 Ollama is running 則正常。
步驟2:配置MaxKB連接Ollama
啟動(dòng)MaxKB容器并加入Ollama網(wǎng)絡(luò)
使用 --network 參數(shù)讓兩個(gè)容器共享網(wǎng)絡(luò):
docker run -d --name maxkb \ --network container:ollama \ # 共享Ollama的網(wǎng)絡(luò)命名空間 -p 8080:8080 \ -v ~/.maxkb:/var/lib/postgresql/data \ cr2.fit2cloud.com/1panel/maxkb
或通過(guò)Docker內(nèi)部DNS通信
若未共享網(wǎng)絡(luò),在MaxKB容器內(nèi)使用 Ollama容器名稱 作為域名:
# 啟動(dòng)MaxKB時(shí)指定Ollama容器網(wǎng)絡(luò) docker run -d --name maxkb \ --network my_network \ # 創(chuàng)建自定義網(wǎng)絡(luò)后加入 -p 8080:8080 \ -v ~/.maxkb:/var/lib/postgresql/data \ cr2.fit2cloud.com/1panel/maxkb
步驟3:在MaxKB中添加Ollama模型
登錄MaxKB界面
訪問(wèn) http://localhost:8080,使用初始賬號(hào) admin/maxkb@123… 登錄。
添加Ollama模型
- 模型類型:選擇
Ollama - API域名:填寫
http://ollama:11434(若共享網(wǎng)絡(luò))或http://宿主機(jī)IP:11434 - 模型名稱:與
ollama list中的模型名完全一致(如llama3:8b) - API Key:任意非空字符(如
dummy)
驗(yàn)證連接
點(diǎn)擊 測(cè)試連接,若顯示成功即可保存。
步驟4:創(chuàng)建知識(shí)庫(kù)并關(guān)聯(lián)模型
創(chuàng)建知識(shí)庫(kù)
上傳文檔(支持PDF/TXT/Markdown等),選擇智能分段并導(dǎo)入。
創(chuàng)建應(yīng)用
在應(yīng)用中關(guān)聯(lián)知識(shí)庫(kù)和Ollama模型,調(diào)整參數(shù)(如溫度、重復(fù)懲罰等)。
測(cè)試問(wèn)答
在應(yīng)用界面提問(wèn),觀察是否基于知識(shí)庫(kù)生成答案。
常見問(wèn)題解決
API域名無(wú)效
- 確認(rèn)Ollama容器IP和端口可訪問(wèn):
curl http://ollama:11434 - 檢查防火墻是否開放
11434端口。
模型無(wú)法加載
- 確保模型名稱與
ollama list完全一致(區(qū)分大小寫)。 - 若模型未下載,在Ollama容器內(nèi)執(zhí)行
ollama pull 模型名。
跨容器網(wǎng)絡(luò)不通
創(chuàng)建自定義Docker網(wǎng)絡(luò)并加入:
docker network create my_network docker network connect my_network ollama docker network connect my_network maxkb
性能優(yōu)化建議
GPU加速
啟動(dòng)Ollama時(shí)添加 --gpus all 參數(shù)(需宿主機(jī)安裝NVIDIA驅(qū)動(dòng)):
docker run -d --gpus all -p 11434:11434 ollama/ollama
模型量化
使用低精度模型(如 llama3:8b-q4_K_M)減少資源占用:
ollama pull llama3:8b-q4_K_M
通過(guò)以上步驟,即可在Docker環(huán)境中實(shí)現(xiàn)MaxKB與Ollama的集成。若需進(jìn)一步優(yōu)化響應(yīng)速度,可考慮部署更高性能的模型或升級(jí)硬件配置。
總結(jié)
以上為個(gè)人經(jīng)驗(yàn),希望能給大家一個(gè)參考,也希望大家多多支持腳本之家。
相關(guān)文章
Docker構(gòu)建kubectl鏡像的實(shí)現(xiàn)步驟
這篇文章主要介紹了Docker構(gòu)建kubectl鏡像的實(shí)現(xiàn)步驟,文中通過(guò)示例代碼介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友們下面隨著小編來(lái)一起學(xué)習(xí)學(xué)習(xí)吧2021-01-01
Docker?Compose+Nestjs構(gòu)建Dapr?Redis發(fā)布訂閱分布式應(yīng)用
這篇文章主要為大家介紹了Docker?Compose+Nestjs構(gòu)建Dapr?Redis發(fā)布訂閱分布式應(yīng)用步驟詳解,有需要的朋友可以借鑒參考下,希望能夠有所幫助,祝大家多多進(jìn)步,早日升職加薪2022-08-08
docker掛載NVIDIA顯卡運(yùn)行pytorch的方法
這篇文章主要介紹了docker掛載NVIDIA顯卡運(yùn)行pytorch的方法,非常不錯(cuò),具有參考借鑒價(jià)值,需要的朋友可以參考下2018-02-02
Jenkins整合Docker實(shí)現(xiàn)CICD自動(dòng)化部署的詳細(xì)過(guò)程(若依項(xiàng)目)
本文介紹了如何使用Jenkins和Docker實(shí)現(xiàn)CI/CD自動(dòng)化部署,文章介紹了環(huán)境準(zhǔn)備,包括Jenkins、Docker、JDK、Node和Maven,然后討論了如何配置GitLab環(huán)境并利用Webhooks實(shí)現(xiàn)代碼的自動(dòng)拉取和部署,最后,展示了如何部署前后端分離的項(xiàng)目,并通過(guò)實(shí)際操作驗(yàn)證了整個(gè)流程的有效性2024-10-10
本地Docker部署Navidrome音樂(lè)服務(wù)器與遠(yuǎn)程訪問(wèn)聽歌詳細(xì)教程(圖文詳解)
本文和大家分享一款目前在G站有11K+Star的開源跨平臺(tái)音樂(lè)服務(wù)器?Navidrome,如何在?Linux?環(huán)境本地使用?Docker?部署,并結(jié)合cpolar?內(nèi)網(wǎng)穿透工具配置公網(wǎng)地址,實(shí)現(xiàn)隨時(shí)隨地遠(yuǎn)程訪問(wèn)本地存儲(chǔ)音樂(lè)的詳細(xì)流程,感興趣的朋友跟隨小編一起看看吧2024-08-08
在Docker構(gòu)建的容器中實(shí)現(xiàn)安裝ping工具
這篇文章主要介紹了在Docker構(gòu)建的容器中實(shí)現(xiàn)安裝ping工具,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。一起跟隨小編過(guò)來(lái)看看吧2020-11-11
CentOS7.6系統(tǒng)下Docker安裝部署教程
這篇文章主要為大家介紹了CentOS7.6系統(tǒng)下Docker的安裝部署教程,有需要的朋友可以借鑒參考下,希望能夠有所幫助,祝大家多多進(jìn)步早日升職加薪2022-04-04

