开源模型文本与推理进阶
DeepSeek-R1-Distill-Qwen-7B
适合纯文本推理、数学和代码学习的 7B 蒸馏开放权重模型。
1 次阅读2026/08/09 发布
参数规模
7B
权重体积
约 14GB(BF16);约 4.5GB(常见 4-bit 量化)
最低运行配置
4-bit 建议 8GB 内存或 6GB 显存;BF16 建议 16GB 以上可用显存/统一内存
它解决什么问题
该模型基于 Qwen2.5-7B,并使用 DeepSeek-R1 生成的数据进行蒸馏。它更适合个人设备验证推理工作流,但输出仍需核对事实、计算和引用。
安装 / 开始使用
使用 Ollama、llama.cpp、Transformers、vLLM 或 SGLang;先从 4-bit 量化和 8K 上下文开始。
适用场景
纯文本推理
数学题
代码解释
研究草稿