🤗
HF-Mirror Engineering Guide
代码助理 🕒 阅读时间:约 14 分钟 📅 2026-03 深度精选

Qwen2.5-Coder 编程大模型:Continue / Cline 插件与私有代码助理实战

Qwen2.5-Coder 在多项代码基准测试中拔得头筹。本文展示如何通过镜像极速下载并在本地搭建企业专属的智能编程助手,无缝对接 Continue 与 Cline 插件。

💻 一、为什么选择 Qwen2.5-Coder 作为本地主力代码模型?

Qwen2.5-Coder 是通义实验室专门针对程序设计微调的代码大模型,涵盖 0.5B 到 32B 全尺寸。32B 版本在 EvalPlus、Aider、HumanEval 等核心榜单上得分超越了众多千亿级通用模型。其核心优势在于:

  • 128K 超长上下文窗口: 能够将整个项目的代码仓库目录、多文件依赖与 API 规范一次性喂入模型。
  • Fill-in-the-Middle (FIM) 支持: 完美匹配 IDE 行内代码补全(Tab Autocomplete)场景。

⚡ 二、镜像拉取 32B 权重与 vLLM 本地化部署

下载与启动命令
# 设置镜像
export HF_ENDPOINT="https://hf-mirror.net"

# 拉取 32B 指令微调版本
huggingface-cli download Qwen/Qwen2.5-Coder-32B-Instruct \
  --local-dir /data/models/Qwen2.5-Coder-32B-Instruct \
  --local-dir-use-symlinks False

# 启动 vLLM OpenAI 兼容接口 (单卡或双卡 24G 运行 AWQ 量化版)
vllm serve /data/models/Qwen2.5-Coder-32B-Instruct \
  --tensor-parallel-size 2 \
  --max-model-len 32768 \
  --port 8000

🔌 三、配置 Continue 与 Cline 插件

在 VS Code 插件 Continue 的 ~/.continue/config.json 中追加本地接口:

Continue 配置示例
{
  "models": [
    {
      "title": "Qwen2.5-Coder-32B (Local)",
      "provider": "openai",
      "model": "Qwen2.5-Coder-32B-Instruct",
      "apiBase": "http://localhost:8000/v1",
      "apiKey": "EMPTY"
    }
  ],
  "tabAutocompleteModel": {
    "title": "Qwen2.5-Coder-1.5B (FIM)",
    "provider": "ollama",
    "model": "qwen2.5-coder:1.5b-base"
  }
}
← 专栏目录 查看全部 32 篇开源大模型工程实录 动手配置 → 5分钟零门槛配置与高速拉取教程