Qwen 2.5 14B Instruct 显存需求测算器
中端本地部署标杆模型,知识储备丰富,广泛用于个人工作流及私有 Agent 搭建。
大语言模型开发方: Alibaba
推荐显卡: RTX 3060 12GB / RTX 4070 12GB
12 GB
16,384 tokens
预估所需总显存
12.98GB
显存负载比例100% (12.98 / 12 GB)
显存组成明细
模型权重8.68 GB
KV Cache3 GB
CUDA 运行时1.3 GB
⚠️ 显存不足 (CUDA OOM 警告)
+1.0 GB 超出显存上限,加载或推理时将直接报错中断。