一 下载

       ollama:官网下载https://ollama.com/
可供选择多种模型,根据自己电脑配置去选择对应的模型(本次使用qwen3-8b,该模型后台占运存大约6G,大参数模型都是在15-20G)


二 常见模型
Qwen3-30B-A3B 
GPT-OSS-20B  
Llama 3.1 70B   
Qwen 2.5 72B  
Mistral Large 123B 
o3-mini (闭源)   

三 具体配置步骤如下(qwen3-8b):

1 安装ollama
macOS:brew install ollama
Linux:curl -fsSL https://ollama.ai/install.sh | sh
Windows:从 ollama.com 下载安装。
验证:运行 ollama --version。

启动服务:ollama serve(后台运行),检查 curl http://localhost:11434(返回 “Ollama is running”)。


2 拉取小模型
在cmd/powershell下执行 ollama pull qwen3:8b 拉取小模型
ollama list 查看列表
执行ollama run qwen3:8b进行测试,输入hello,看是否有回应,然后让它生成一段简单代码试试


3 配置 config.yaml
将vscode中ctrl+l 打开continue,找到config文件或者Ctrl + Shift + P > “Continue: Open Config” > 编辑 ~/.continue/config.yaml:
name: Qwen3-8B Local Config
version: 0.0.1
schema: v1
models:
  - name: Qwen3-8B
    provider: ollama
    model: qwen3:8b  
    roles: [chat, autocomplete, edit]
    apiBase: http://localhost:11434
4 保存退出,重新打开
5  选中部分代码,按ctrl+l 分析代码 ctrl+i自动编辑代码

更多推荐