开发入门已解决
本地部署大模型需要什么硬件?
从 7B 到 70B,不同规模模型的显存需求和可行的低配方案。
问题正文
显存是硬门槛
7B 模型 4bit 量化约需 4~6GB 显存;14B 约 10GB;32B 约 20GB;70B 至少 40GB 起。显存不足就只能退而求其次选小模型,或用 CPU 加内存慢速推理。
低配可行方案
没有独显也能玩:Ollama、llama.cpp 支持 CPU 推理,7B 量化模型在现代 CPU 上能达到可用的速度。Mac 的统一内存架构是天然优势,M 系列芯片可以跑 32B 甚至 70B。
先想清楚用途
日常问答 7~14B 足够;代码补全 7B 专用模型即可;复杂推理才需要 32B 以上。先定场景再买卡,别为了跑分买单。
