背景

在claude code cli使用国产模型(DeepSeek或者GLM),它们都是纯文本模型,不能直接识别图片,经常做的方式就是去别的视觉识别模型聊天页面识图完,将结果反馈给DeepSeek或者GLM;或者是通过修改配置文件直接切换模型进行使用。本文提供一种方式通过全局配置claude-vision-skill实现在同一个client端不用切换模型支持图片识别并使用

配置方法

下载Skill

claude-vision-skill

配置windows环境变量

  • 键:DASHSCOPE_BASE_URL 值:你的服务提供商URL
  • 键:DASHSCOPE_API_KEY 值:你的API Key
  • 键:VISION_MODEL 值:你想使用的视觉模型如minimax-m3、kimi-k3
    环境变量

引入脚本vision.js

将附件vision.js添加到用户目录下的.claude文件夹下的scripts文件夹下

~/.claude/CLAUDE.md~/.claude/scripts/vision.js

脚本

修改识图的全局规则

将附件CLAUDE.md追加到用户目录下的.claude文件夹下的CLAUDE.md

~/.claude/CLAUDE.md

全局CLAUDE

Logo

小龙虾开发者社区是 CSDN 旗下专注 OpenClaw 生态的官方阵地,聚焦技能开发、插件实践与部署教程,为开发者提供可直接落地的方案、工具与交流平台,助力高效构建与落地 AI 应用

更多推荐