claude code cli支持纯文本模型识别图片方案
·
背景
在claude code cli使用国产模型(DeepSeek或者GLM),它们都是纯文本模型,不能直接识别图片,经常做的方式就是去别的视觉识别模型聊天页面识图完,将结果反馈给DeepSeek或者GLM;或者是通过修改配置文件直接切换模型进行使用。本文提供一种方式通过全局配置claude-vision-skill实现在同一个client端不用切换模型支持图片识别并使用
配置方法
下载Skill
配置windows环境变量
- 键:DASHSCOPE_BASE_URL 值:你的服务提供商URL
- 键:DASHSCOPE_API_KEY 值:你的API Key
- 键:VISION_MODEL 值:你想使用的视觉模型如minimax-m3、kimi-k3

引入脚本vision.js
将附件vision.js添加到用户目录下的.claude文件夹下的scripts文件夹下
~/.claude/CLAUDE.md~/.claude/scripts/vision.js

修改识图的全局规则
将附件CLAUDE.md追加到用户目录下的.claude文件夹下的CLAUDE.md
~/.claude/CLAUDE.md

更多推荐



所有评论(0)