返回目录
开源模型文本与推理进阶

DeepSeek-R1-Distill-Qwen-7B

适合纯文本推理、数学和代码学习的 7B 蒸馏开放权重模型。

1 次阅读2026/08/09 发布

参数规模

7B

权重体积

约 14GB(BF16);约 4.5GB(常见 4-bit 量化)

最低运行配置

4-bit 建议 8GB 内存或 6GB 显存;BF16 建议 16GB 以上可用显存/统一内存

它解决什么问题

该模型基于 Qwen2.5-7B,并使用 DeepSeek-R1 生成的数据进行蒸馏。它更适合个人设备验证推理工作流,但输出仍需核对事实、计算和引用。

安装 / 开始使用

使用 Ollama、llama.cpp、Transformers、vLLM 或 SGLang;先从 4-bit 量化和 8K 上下文开始。

适用场景

纯文本推理
数学题
代码解释
研究草稿