惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Apple Machine Learning Research
Apple Machine Learning Research
Jina AI
Jina AI
博客园_首页
WordPress大学
WordPress大学
罗磊的独立博客
小众软件
小众软件
Last Week in AI
Last Week in AI
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Hugging Face - Blog
Hugging Face - Blog
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
爱范儿
爱范儿
The Cloudflare Blog
GbyAI
GbyAI
C
Check Point Blog
腾讯CDC
MyScale Blog
MyScale Blog
有赞技术团队
有赞技术团队
博客园 - 聂微东
IT之家
IT之家
雷峰网
雷峰网
H
Help Net Security
博客园 - 叶小钗
美团技术团队
D
DataBreaches.Net

博客园 - 见路非道

Lumera 深度解读(2026):从一张图片到 Blender 可编辑 3D 场景——image to 3d 与 image to blender 全解析 Qwen3.8-Flash-Next(2026):Qwen Qwen4 预览版架构模型完整指南 Qwen3.8-27B(2026):Qwen 新 27B 视觉语言模型完整指南 DeepSeek Harness Agent Loop 2026:驱动每一轮对话的可替换插件内部解析 DeepSeek Harness 2026:一切皆插件 — 开发者预览版完全指南 awesome design md(2026):Google DESIGN.md 精选集完整指南 DeepSeek V4 Pro 0813 完全指南(2026):价格、基准测试与 Fable 5 对比 2026 完整指南:生命路径计算器(Life Path Calculator)的每个数字到底意味着什么 Qwen 3.8 Max vs GLM 5.2 vs Kimi K3 vs DeepSeek V4 Flash(2026年):国产大模型四强全面对比 Love Meter 2026 完全指南:Lovemeter.xyz 的免费与付费功能,以及 Love Oracle 的神奇之处 Unlimited OCR(百度无限制 OCR)2026 完整指南:单次前向传播解析数十页文档的开源模型 Kimi K3 vs GLM 5.2 (2026年):中国两大开源旗舰大模型终极对比 PDF 转 Markdown 工具如何把复杂 PDF 变成干净的 Markdown:2026 年完整指南 如何使用 Garden Letters:2026 年 AI、音乐与私密分享的花信创作完整指南 Flag Tone:如何匹配旗子条纹颜色(2026完整指南) Mog Omegle 2026 完全指南:如何运行一场 AI PSL 颜值对比 Toon Tone:用更简洁、更易分享的色彩匹配游戏练习色彩记忆 CurateClick 2026年4月每周精选:发现、访问与创意AI Hy-MT1.5-1.8B-2bit:腾讯开源 574MB 能打败 72B 巨人的移动端翻译模型 Qwen3.6-35B-A3B 全面评测:阿里开源模型如何超越前沿级水平 SBTI 和 SBTI Skill 完全指南:Claude 驱动的超大型人格测试 Happy Horse:重新定义2026年AI视频生成的最强模型 OpenClaw Dreaming 完全指南 2026:AI 代理的后台记忆整合 Qwen3.6-Plus:阿里低调憋大招,百万Token上下文企业级AI旗舰发布 CurateClick 应用推荐(2026年3月22日版) 2026年完全指南:OpenClaw LCM 插件 — 再也不会丢失任何对话 ACE-Step 1.5:2026年开源AI音乐生成完全指南 用 OpenClaw 构建 CBT 疗法 Agent — 2026 年完整指南 Claude Code Telegram 官方插件:完整配置指南 2026 小米 MiMo-V2 系列完全指南 2026:Pro/Omni/TTS 三大模型全面解读
OpenClaw imageModel 配置指南
见路非道 · 2026-03-08 · via 博客园 - 见路非道

OpenClaw imageModel 配置指南

一、什么是 imageModel

imageModel 是 OpenClaw 中专门用于视觉理解的模型配置,独立于主对话模型(model)。当对话涉及图片或视觉内容时,OpenClaw 会自动切换到 imageModel 指定的模型来处理。

二、为什么需要单独配置

主模型(model.primary)不一定支持视觉输入。例如:

  • MiniMax-M2.5-highspeed 是纯文本模型,无法处理图片
  • moonshot/kimi-k2.5 支持多模态(文本+图片)

单独配置 imageModel 可以做到:文本走快模型,图片走多模态模型,兼顾速度和能力。

三、配置方式

在 OpenClaw 配置文件中(openclaw config edit):

{
  "agents": {
    "defaults": {
      "model": {
        "primary": "minimax-portal/MiniMax-M2.5-highspeed",
        "fallbacks": ["moonshot/kimi-k2.5", "anthropic/claude-opus-4-6"]
      },
      "imageModel": {
        "primary": "moonshot/kimi-k2.5",
        "fallbacks": ["openrouter/qwen/qwen-2.5-vl-72b-instruct:free"]
      }
    }
  }
}

两种写法都支持:

// 简写(只设主模型,无回退)
"imageModel": "moonshot/kimi-k2.5"

// 完整写法(主模型 + 回退链)
"imageModel": {
  "primary": "moonshot/kimi-k2.5",
  "fallbacks": ["openrouter/google/gemini-2.0-flash-vision:free"]
}

四、CLI 管理命令

# 查看当前 imageModel 状态
openclaw models status

# 设置 imageModel 主模型
openclaw models set-image moonshot/kimi-k2.5

# 管理 imageModel 回退链
openclaw models image-fallbacks list
openclaw models image-fallbacks add openrouter/qwen/qwen-2.5-vl-72b-instruct:free
openclaw models image-fallbacks remove openrouter/qwen/qwen-2.5-vl-72b-instruct:free
openclaw models image-fallbacks clear

五、触发场景

用户发送图片 照片、截图等图片附件,agent 需要"看图说话"时 用户发送 PDF PDF 含扫描页/图片,需视觉分析时(先查 pdfModel,未配则回退到 imageModel媒体理解管线 收到的图片/视频截帧经过自动媒体理解流程时 agent 工具调用 agent 使用内置的 image 工具分析图片时
场景 说明

六、回退逻辑

imageModel.primary  →  imageModel.fallbacks[0]  →  fallbacks[1]  →  ...

逐个尝试,第一个成功即返回。全部失败则报错:

"No image model configured. Set agents.defaults.imageModel.primary or agents.defaults.imageModel.fallbacks."

七、与 pdfModel 的关系

PDF 处理优先级:pdfModel → imageModel → 内置 provider 默认值

如果没有配置 pdfModel,PDF 工具会自动回退到 imageModel 的配置。

八、内置默认图像模型(无配置时)

当未配置 imageModel 且系统检测到对应 provider 的 API key 时,会使用内置默认:

OpenAI gpt-5-mini Anthropic claude-opus-4-6 Google gemini-3-flash-preview MiniMax MiniMax-VL-01 ZAI glm-4.6v
Provider 默认模型

九、完整配置示例

{
  "agents": {
    "defaults": {
      "model": {
        "primary": "minimax-portal/MiniMax-M2.5-highspeed",
        "fallbacks": ["moonshot/kimi-k2.5", "anthropic/claude-opus-4-6"]
      },
      "imageModel": {
        "primary": "moonshot/kimi-k2.5",
        "fallbacks": ["openrouter/google/gemini-2.0-flash-vision:free"]
      },
      "pdfModel": {
        "primary": "anthropic/claude-opus-4-6"
      },
      "models": {
        "moonshot/kimi-k2.5": { "alias": "kimi" },
        "minimax-portal/MiniMax-M2.5-highspeed": { "alias": "mm" }
      }
    }
  }
}

效果:

  • 纯文本对话 → MiniMax-M2.5-highspeed
  • 发图片 → moonshot/kimi-k2.5,失败则 → gemini-2.0-flash-vision
  • 发 PDF → claude-opus-4-6,未配则回退到 imageModel 链