Ollama 命令行工具(CLI)
Ollama 提供了多種命令行工具(CLI)供用戶與本地運(yùn)行的模型進(jìn)行交互。
基本格式:
ollama <command> [args]
我們可以用 ollama --help 查看包含有哪些命令:
Large language model runner Usage: ollama [flags] ollama [command] Available Commands: serve Start ollama create Create a model from a Modelfile show Show information for a model run Run a model stop Stop a running model pull Pull a model from a registry push Push a model to a registry list List models ps List running models cp Copy a model rm Remove a model help Help about any command Flags: -h, --help help for ollama -v, --version Show version information
1、使用方法
ollama [flags]:使用標(biāo)志(flags)運(yùn)行 ollama。
ollama [command]:運(yùn)行 ollama 的某個(gè)具體命令。
2、可用命令
serve:?jiǎn)?dòng) ollama 服務(wù)。
create:根據(jù)一個(gè) Modelfile 創(chuàng)建一個(gè)模型。
show:顯示某個(gè)模型的詳細(xì)信息。
run:運(yùn)行一個(gè)模型。
stop:停止一個(gè)正在運(yùn)行的模型。
pull:從一個(gè)模型倉庫(registry)拉取一個(gè)模型。
push:將一個(gè)模型推送到一個(gè)模型倉庫。
list:列出所有模型。
ps:列出所有正在運(yùn)行的模型。
cp:復(fù)制一個(gè)模型。
rm:刪除一個(gè)模型。
help:獲取關(guān)于任何命令的幫助信息。
3、標(biāo)志(Flags)
- -h, --help:顯示 ollama 的幫助信息。
- -v, --version:顯示版本信息。
完整示例:
| 命令 (Command) | 說明 (Description) | 示例 (Example) |
|---|---|---|
ollama run | 運(yùn)行模型。如果不存在則自動(dòng)拉取。 | ollama run llama3 |
ollama pull | 拉取模型。從庫中下載模型但不運(yùn)行。 | ollama pull mistral |
ollama list | 列出模型。顯示本地所有已下載的模型。 | ollama list |
ollama rm | 刪除模型。移除本地模型釋放空間。 | ollama rm llama3 |
ollama cp | 復(fù)制模型。將現(xiàn)有模型復(fù)制為新名稱(用于測(cè)試)。 | ollama cp llama3 my-model |
ollama create | 創(chuàng)建模型。根據(jù) Modelfile 創(chuàng)建自定義模型(高級(jí))。 | ollama create my-bot -f ./Modelfile |
ollama show | 顯示信息。查看模型的元數(shù)據(jù)、參數(shù)或 Modelfile。 | ollama show --modelfile llama3 |
ollama ps | 查看進(jìn)程。顯示當(dāng)前正在運(yùn)行的模型及顯存占用。 | ollama ps |
ollama push | 推送模型。將你自定義的模型上傳到 ollama.com。 | ollama push my-username/my-model |
ollama serve | 啟動(dòng)服務(wù)。啟動(dòng) Ollama 的 API 服務(wù)(通常后臺(tái)自動(dòng)運(yùn)行)。 | ollama serve |
ollama help | 幫助。查看任何命令的幫助信息。 | ollama help run |
1. 拉取與刪除模型
pull拉取遠(yuǎn)端模型到本地。
ollama pull <model>
rm / remove刪除本地模型。
ollama rm <model>
list / ls列出所有本地模型。
ollama list
2. 運(yùn)行模型
run交互模式運(yùn)行模型,不退出。
ollama run <model>
可帶系統(tǒng)信息與 prompt:
ollama run <model> -s "<system>" -p "<prompt>"
run + script從文件讀取 prompt:
ollama run <model> < input.txt
當(dāng)你輸入 ollama run 進(jìn)入聊天界面后,你不再是在操作命令行,而是在和 AI 對(duì)話。這時(shí)你可以使用以 / 開頭的快捷指令來控制對(duì)話:
/bye或/exit:最重要! 退出聊天界面,返回命令行。/clear:清空當(dāng)前的上下文記憶(開啟一段新的對(duì)話)。/show info:查看當(dāng)前模型的詳細(xì)參數(shù)信息。/set parameter seed 123:設(shè)置隨機(jī)種子(高級(jí)玩法,用于復(fù)現(xiàn)結(jié)果)。/help:在聊天中查看所有可用的快捷鍵。
3. 推理接口(一次性執(zhí)行)
generate執(zhí)行單次推理,輸出文本。
ollama generate <model> -p "<prompt>"
4. 創(chuàng)建與修改模型
create用 Modelfile 創(chuàng)建本地模型。
ollama create <model-name> -f Modelfile
cp復(fù)制一個(gè)模型為新名字。
ollama cp <src> <dst>
5. 服務(wù)器相關(guān)
serve啟動(dòng) Ollama 本地服務(wù)(默認(rèn) 11434)。
ollama serve
run serverless當(dāng) ollama run 時(shí)會(huì)自動(dòng)拉起后臺(tái)服務(wù),不需單獨(dú)執(zhí)行。
6. 模型信息
show查看模型元數(shù)據(jù)、參數(shù)、模板。
ollama show <model>
7. 專用參數(shù)
這些參數(shù)多數(shù)可用于 run/generate:
--num-predict <number> 限制輸出 token 數(shù) --temperature <float> 控制隨機(jī)性 --top-k <int> 采樣范圍 --top-p <float> 核采樣 --seed <int> 固定隨機(jī)性 --format json 輸出 JSON --keepalive <seconds> 會(huì)話保持時(shí)間
8. Modelfile 指令
構(gòu)建模型時(shí)使用:
- FROM <model>:基礎(chǔ)模型
- SYSTEM "xxx":設(shè)定系統(tǒng)提示
- PARAMETER key=value:設(shè)定默認(rèn)參數(shù)
- TEMPLATE "xxx":自定義 Chat 模板
- LICENSE "xxx":設(shè)置 License
- ADAPTER <file> / WEIGHTS <file>:加載 LoRA 或額外權(quán)重
9. API(當(dāng) serve 運(yùn)行時(shí))
REST 端點(diǎn)(默認(rèn) http://localhost:11434/api):
/api/generate:文本生成/api/chat:對(duì)話流式接口/api/pull:遠(yuǎn)程拉取/api/tags:本地模型列表
調(diào)用示例(curl):
curl http://localhost:11434/api/generate \
-d '{"model":"qwen2.5","prompt":"hello"}'10. 進(jìn)階
自定義參數(shù)運(yùn)行:
ollama run <model> --temperature 0.2 --top-p 0.9
持久會(huì)話(保留上下文):會(huì)話由模型內(nèi)部緩存自動(dòng)管理,無需額外命令。
相關(guān)文章

Ollama中本地大模型部署與運(yùn)行深度評(píng)測(cè)詳解
本文對(duì)開源本地大模型運(yùn)行工具Ollama進(jìn)行了全面深度評(píng)測(cè),涵蓋硬件兼容性、性能表現(xiàn)、功能特性、安全性等10個(gè)核心維度,基于2026年最新版本(v0.19.0)的實(shí)測(cè)數(shù)據(jù),結(jié)合客觀2026-06-01
這段文章詳細(xì)介紹了Ollama、LMStudio、TextGenerationWebUI和vLLM四種部署方式,適合不同模型的本地和企業(yè)環(huán)境部署,文章還提供了Ollama的下載指南和免費(fèi)開源大模型的推薦版2026-05-25
Windows版Ollama強(qiáng)制安裝到C盤的五種方案
Ollama 官方 Windows 安裝程序沒有提供路徑選擇,直接雙擊就只有“Install”按鈕,但我們可以通過以下方法實(shí)現(xiàn)自定義安裝路徑,需要的朋友可以參考下2026-05-20
2026最新Linux本地部署Ollama安裝全流程(含離線/開機(jī)自啟/遠(yuǎn)程訪問)
本文記錄在 CentOS 7+ / Ubuntu 20.04+ 上部署 Ollama 的實(shí)操筆記,覆蓋 一鍵在線安裝 與 離線 tar 包安裝 兩種方式,并補(bǔ)充 systemd 開機(jī)自啟、qwen2 / deepseek-r1 等模2026-05-19
一篇帶你搞定Ollama模型的安裝到生產(chǎn)級(jí)調(diào)優(yōu)
Ollama 是一個(gè)輕量級(jí)、可擴(kuò)展的本地大語言模型運(yùn)行框架,旨在簡(jiǎn)化 LLM 的部署、管理和使用流程,本文主要為大家詳細(xì)介紹了Ollama模型的部署、管理和使用,有需要的小伙伴可以2026-05-13
在嘗試將 Ollama 的 localhost 地址替換為本地 IP 地址(如 192.168.*.*)時(shí),遇到了網(wǎng)絡(luò)錯(cuò)誤,提示無法連接到服務(wù),本文給大家介紹了可能的原因和解決方案,需要的朋友可以2026-05-12
Ollama下載的模型如何導(dǎo)入LLama-Factory進(jìn)行二次微調(diào)
本文介紹如何將Ollama下載的GGUF格式模型轉(zhuǎn)換為Hugging Face格式,并通過LLama-Factory進(jìn)行LoRA微調(diào),涵蓋模型提取、格式轉(zhuǎn)換、訓(xùn)練配置及合并導(dǎo)出全流程,幫助開發(fā)者在本地2026-05-12
本文介紹了在Windows系統(tǒng)上配置Ollama使用GPU加速的步驟,文中通過示例代碼介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友們下面隨著小編來一起2026-04-30
本文介紹了如何利用Ollama和LangChain構(gòu)建基礎(chǔ)AIAgent,文中通過示例代碼介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友們下面隨著小編來一起學(xué)2026-04-29
Windows系統(tǒng)使用Ollama部署本地大模型的實(shí)現(xiàn)步驟
本文主要介紹了在Ollama平臺(tái)下載和安裝AI模型的方法,包括點(diǎn)擊按鈕安裝和使用指令下載兩種方式,文中通過示例代碼介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)2026-04-29











