Windows环境下Claude Code与VSCode集成开发环境搭建全指南:从Ollama部署到DeepSeek-7B模型调用

1次阅读
没有评论

共计 1508 个字符,预计需要花费 4 分钟才能阅读完成。

image.webp

环境准备:Ollama 与 DeepSeek-7B 部署

  1. Ollama 服务安装
    官方推荐使用管理员权限运行 PowerShell 执行:

    winget install Ollama.Ollama

    安装后需手动启动服务:

    Start-Service ollama

    Windows 环境下 Claude Code 与 VSCode 集成开发环境搭建全指南:从 Ollama 部署到 DeepSeek-7B 模型调用

  2. 代理配置(如遇下载失败):

    $env:HTTP_PROXY="http://127.0.0.1:7890"
    $env:HTTPS_PROXY="http://127.0.0.1:7890"

  3. 模型下载与验证
    下载 DeepSeek-7B 模型(约 13GB):

    ollama pull deepseek-ai/deepseek-llm:7b

    验证模型加载:

    ollama run deepseek-ai/deepseek-llm:7b "你好"

    正常应返回中文响应,若出现 CUDA 错误需检查显卡驱动版本。

核心配置:Claude Code 参数解析

配置文件通常位于 %APPDATA%\ClaudeCode\config.json,关键字段说明:

{
  "hascompletedonboarding": true,  // 跳过首次引导,直接启用高级功能
  "model_endpoint": "http://localhost:11434",  // Ollama 默认端口
  "max_tokens": 2048,  // 限制单次请求 token 数量
  "stream": true  // 启用 SSE 流式响应
}

  • 重点参数
    hascompletedonboarding 实际控制是否显示新手引导界面,设为 true 可避免初次使用时多余的配置步骤。

VSCode 集成实战

  1. 插件安装
    在 VSCode 扩展市场搜索 ”ClaudeCode” 安装,注意认准官方出品标识。

  2. 端点配置
    Ctrl+, 打开设置,搜索 ”ClaudeCode” 填写:

  3. Model Endpoint: http://localhost:11434
  4. Default Model: deepseek-ai/deepseek-llm:7b

  5. 流式响应测试
    新建空白文件,输入问题后按 Ctrl+Enter,观察右下角逐步输出的回答。

验证方案:Python 测试脚本

import aiohttp
import asyncio

async def test_model():
    async with aiohttp.ClientSession() as session:
        payload = {
            "model": "deepseek-ai/deepseek-llm:7b",
            "prompt": "解释量子纠缠现象",
            "stream": False
        }
        async with session.post(
            "http://localhost:11434/api/generate",
            json=payload
        ) as resp:
            print(await resp.json())

asyncio.run(test_model())

正常响应应包含 "response":"..." 字段,若超时需检查防火墙设置。

避坑指南

  1. 路径问题
    Windows 路径需转义反斜杠:C:\\Users\\name\\AppData

  2. 防火墙配置
    允许 Ollama 入站规则:

    New-NetFirewallRule -DisplayName "Ollama" -Direction Inbound -Action Allow -Protocol TCP -LocalPort 11434

  3. CUDA 版本冲突
    使用 nvidia-smi 确认驱动版本,需 CUDA 11.7+ 支持。

延伸建议

  • 性能优化:在 config.json 中调整 num_gpu_layers 参数提升推理速度
  • 多模型切换:通过修改 default_model 字段快速切换不同模型
  • 高级调试:使用 Wireshark 抓包分析 SSE 流数据格式
正文完
 0
评论(没有评论)