OpenClaw imageModel 配置指南
一、什么是 imageModel
imageModel 是 OpenClaw 中專門用于視覺理解的模型配置,獨立于主對話模型(model)。當對話涉及圖片或視覺內容時,OpenClaw 會自動切換到 imageModel 指定的模型來處理。
二、為什么需要單獨配置
主模型(model.primary)不一定支持視覺輸入。例如:
- MiniMax-M2.5-highspeed 是純文本模型,無法處理圖片
- moonshot/kimi-k2.5 支持多模態(tài)(文本+圖片)
單獨配置 imageModel 可以做到:文本走快模型,圖片走多模態(tài)模型,兼顧速度和能力。
三、配置方式
在 OpenClaw 配置文件中(openclaw config edit):
{
"agents": {
"defaults": {
"model": {
"primary": "minimax-portal/MiniMax-M2.5-highspeed",
"fallbacks": ["moonshot/kimi-k2.5", "anthropic/claude-opus-4-6"]
},
"imageModel": {
"primary": "moonshot/kimi-k2.5",
"fallbacks": ["openrouter/qwen/qwen-2.5-vl-72b-instruct:free"]
}
}
}
}兩種寫法都支持:
// 簡寫(只設主模型,無回退)
"imageModel": "moonshot/kimi-k2.5"
// 完整寫法(主模型 + 回退鏈)
"imageModel": {
"primary": "moonshot/kimi-k2.5",
"fallbacks": ["openrouter/google/gemini-2.0-flash-vision:free"]
}四、CLI 管理命令
# 查看當前 imageModel 狀態(tài) openclaw models status # 設置 imageModel 主模型 openclaw models set-image moonshot/kimi-k2.5 # 管理 imageModel 回退鏈 openclaw models image-fallbacks list openclaw models image-fallbacks add openrouter/qwen/qwen-2.5-vl-72b-instruct:free openclaw models image-fallbacks remove openrouter/qwen/qwen-2.5-vl-72b-instruct:free openclaw models image-fallbacks clear
五、觸發(fā)場景
| 場景 | 說明 |
|---|---|
| 用戶發(fā)送圖片 | 照片、截圖等圖片附件,agent 需要"看圖說話"時 |
| 用戶發(fā)送 PDF | PDF 含掃描頁/圖片,需視覺分析時(先查 pdfModel,未配則回退到 imageModel) |
| 媒體理解管線 | 收到的圖片/視頻截幀經(jīng)過自動媒體理解流程時 |
| agent 工具調用 | agent 使用內置的 image 工具分析圖片時 |
六、回退邏輯
imageModel.primary → imageModel.fallbacks[0] → fallbacks[1] → ...
逐個嘗試,第一個成功即返回。全部失敗則報錯:
“No image model configured. Set agents.defaults.imageModel.primary or agents.defaults.imageModel.fallbacks.”
七、與 pdfModel 的關系
PDF 處理優(yōu)先級:pdfModel → imageModel → 內置 provider 默認值
如果沒有配置 pdfModel,PDF 工具會自動回退到 imageModel 的配置。
八、內置默認圖像模型(無配置時)
當未配置 imageModel 且系統(tǒng)檢測到對應 provider 的 API key 時,會使用內置默認:
| Provider | 默認模型 |
|---|---|
| OpenAI | gpt-5-mini |
| Anthropic | claude-opus-4-6 |
| gemini-3-flash-preview | |
| MiniMax | MiniMax-VL-01 |
| ZAI | glm-4.6v |
九、完整配置示例
{
"agents": {
"defaults": {
"model": {
"primary": "minimax-portal/MiniMax-M2.5-highspeed",
"fallbacks": ["moonshot/kimi-k2.5", "anthropic/claude-opus-4-6"]
},
"imageModel": {
"primary": "moonshot/kimi-k2.5",
"fallbacks": ["openrouter/google/gemini-2.0-flash-vision:free"]
},
"pdfModel": {
"primary": "anthropic/claude-opus-4-6"
},
"models": {
"moonshot/kimi-k2.5": { "alias": "kimi" },
"minimax-portal/MiniMax-M2.5-highspeed": { "alias": "mm" }
}
}
}
}效果:
- 純文本對話 → MiniMax-M2.5-highspeed
- 發(fā)圖片 → moonshot/kimi-k2.5,失敗則 → gemini-2.0-flash-vision
- 發(fā) PDF → claude-opus-4-6,未配則回退到 imageModel 鏈
到此這篇關于OpenClaw imageModel 配置指南的文章就介紹到這了,更多相關OpenClaw imageModel 配置內容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關文章,希望大家以后多多支持腳本之家!
相關文章
這篇文章主要介紹了OpenClaw CLI 和配置文件參考完整指南,本指南全面涵蓋了這兩方面,首先介紹配置文件:格式、結構以及每個主要部分的示例,需要的朋友可以參考下2026-03-23
本文介紹如何在 OpenClaw 中配置 DeepSeek API,通過 OpenAI 兼容接口使用 deepseek-reasoner(R1 推理模型),配置完成后,OpenClaw 的 Agent 將默認調用 DeepSeek 進行推2026-03-20
OpenClaw配置Tavily 搜索 Skill 完整指南教程
本文記錄為 OpenClaw 2026.3.8 + 飛書 Agent 添加 Tavily 搜索能力的完整過程,包括安裝方式、安全配置、搜索優(yōu)先級調整,以及踩過的所有坑和最終結論,本文給大家介紹的2026-03-19
本文檔詳細介紹了在Mac本地環(huán)境配置OpenClaw與QQ機器人對接的完整流程,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友們下面隨2026-03-18
文章講述了作者在配置環(huán)境變量時遇到的問題,以及如何通過在shell配置文件和systemd服務配置中雙重設置環(huán)境變量來解決這個問題,作者還分享了常見的錯誤及解決方法,并提出了2026-03-17
本文主要介紹了OpenClaw多Agent配置實戰(zhàn)及踩坑指南,包括創(chuàng)建Agent、設置模型、定義角色、測試Agent以及Telegram多賬號配置等,具有一定的參考價值,感興趣的可以了解一下2026-03-17
本文詳細介紹了配置項"tools"的各個部分,包括profile、allow、deny和exec,以及approval配置,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的2026-03-13
OpenClaw 從零配置指南并接入飛書 + 常用命令 + 原理全解析
本文介紹了如何從零配置OpenClaw并接入飛書,包括安裝、配置、權限設置、模型切換、技能管理等步驟,以及常用命令和配置文件說明,感興趣的朋友跟隨小編一起看看吧2026-03-12









