开源模型文本与推理进阶
Qwen3-8B
兼顾中文、推理、代码与工具调用的 8B 开放权重文本模型。
0 次阅读2026/08/09 发布
参数规模
8B
权重体积
约 16GB(BF16);约 5GB(常见 4-bit 量化)
最低运行配置
4-bit 建议 8GB 内存或显存;BF16 建议 20GB 以上可用显存/统一内存
它解决什么问题
Qwen3-8B 支持思考与非思考模式,适合中文问答、结构化写作、代码辅助和本地 Agent 原型。长上下文会显著增加 KV Cache,占用应按实际长度评估。
安装 / 开始使用
可使用 Ollama、llama.cpp、Transformers 或 vLLM;个人电脑优先选择 4-bit 量化并缩短上下文。
适用场景
中文写作
代码辅助
工具调用
本地知识库