免费 · 无需注册 · 在浏览器中运行
你的模型需要多少显存?
根据 Hugging Face 上的真实配置和权重文件,估算任意模型的显存占用、每秒生成 token 数和 MoE 专家卸载方案。
- 个模型有独立页面
- 55
- 种 GPU 与 Mac 配置
- 73
- 种权重精度
- 13
让浏览器识别你的 GPU,看看电脑能跑什么。也可以看看 8–96 GB 显存能跑哪些本地大模型、大模型显存统计,或下载开放的显存数据集(CSV 与 JSON)。估算与实测差多少,见估算准确度。
计算器
几个专注的小工具,共用同一套公式和模型数据。
- LLM 显存计算器 任意量化精度和上下文长度下的权重、KV cache 与运行开销,以及能装下的 GPU。 打开 →
- LLM 速度计算器 根据显存带宽和激活参数,估算模型在你的 GPU 或 Mac 上每秒生成多少 token。 打开 →
- 微调显存计算器 Transformers 或 Unsloth 中全参数微调、LoRA、QLoRA 需要的显存,并与公开实测对比。 打开 →
- Qwen-Image-2.1 显存计算器 DiT、文本编码器和 VAE 各种组合的峰值显存,附真实显卡实测数据。 打开 →
- MiniMax H3 显存计算器
(ComfyUI) MiniMax H3 视频在 ComfyUI 中的显存与系统内存:剪枝版、INT8、NVFP4 和 GGUF 文件在 8–96 GB 显卡上的表现。 打开 → - 投机解码显存计算器
(MTP 与草稿模型) llama.cpp 中 MTP 头、DFlash 草稿模型和小草稿模型额外占用的显存,适用于 Qwen3.8 27B 和 Gemma 4 31B。 打开 → - MoE 卸载计算器
(--n-cpu-moe) 根据 GGUF 真实张量大小,找出能装进你显卡的最小 llama.cpp --n-cpu-moe。 打开 → - Qwen3.8 27B 新 GGUF 量化:Bonsai 2、GSQ-RCO 与 UD 对比 Qwen3.8 27B 的 Ternary Bonsai 2、GSQ-RCO 与 Unsloth UD 文件:显存、质量、速度,以及各自需要的推理引擎。 打开 →
- vLLM KV cache 与并发计算器 vLLM 分配的 KV cache 池有多少 token、能同时处理多少请求,并给出 vllm serve 命令。 打开 →
- 我的电脑能跑什么? 在浏览器里识别你的 GPU,列出它能跑的本地大模型,以及最佳量化和速度。 打开 →
以下模型页和 GPU 页目前只有英文版。
各模型显存需求
- Spark-X2.5 4B
- Ling 3.0 Tiny 7.9B-A1.3B
- LFM2.5 8B-A1B
- Step 3.7 Flash 196B-A11B
- Hy4 Preview 770B-A49B
- Limite 1B Violetto
- ZDTaichu 5.0 9B
- Hemmingway-1 27B
- MiMo V2.6 Distill Qwen 9B
- K2-Horizon MoVA 36B-A4B
- IQuest-Q1 320B-A15B
- LLM-jp-4.1 32B-A3B Thinking
- Ornith 1.5 35B-A3B
- Ornith 1.5 9B
- AliceAI Foundation 80B-A3B
- DeepSeek V4 Flash 0731
- Qwen3.6 35B-A3B
- Qwen3.6 27B
- Qwen3.8 27B
- Qwen3.8 Flash Next
- Qwen3.8 2.4T-A95B
- Qwen3.5 9B
- Qwen3.5 122B-A10B
- Qwen3-Coder-Next
- DeepSeek V4.1 Flash
- DeepSeek V4 Flash
- DeepSeek V4 Pro
- DeepSeek V3.2
- GLM-5.3
- GLM-5.3 Flash
- GLM-5.2
- GLM-4.7 Flash
- Gemma 4 31B
- Gemma 4 26B-A4B
- Gemma 4 12B
- Gemma 4 E4B
- Kimi K3
- MiniMax M3
- MiniMax M2.7
- MiMo V2.6 Flash
- MiMo V2.6 Pro
- Mistral Medium 3.5 128B
- Nemotron 3 Nano 4B
- Nemotron 3 Nano 30B-A3B
- Nemotron 3 Super 120B-A12B
- Xing 4.0 29B-A4B
- Muse Glimmer 30B
- MiniCPM5 2B
- Llama 3.1 8B
- Llama 3.1 70B
- Qwen3 8B
- Qwen3 30B-A3B
- gpt-oss-20b
- gpt-oss-120b
- DeepSeek V3 / R1
指南
你的 GPU 能跑什么?
- RTX 4060 8GB
- RTX 3060 12GB
- Arc B580 12GB
- RTX 4070 12GB
- RTX 5070 12GB
- RTX 4060 Ti 16GB
- RTX 5060 Ti 16GB
- RX 9070 XT 16GB
- RTX 4070 Ti Super 16GB
- RTX 4080 Super 16GB
- RTX 5070 Ti 16GB
- RTX 5080 16GB
- RTX 3090
- RTX 4090
- RX 7900 XTX
- RTX 5090
- M4 Pro Mac (64 GB)
- M4 Max Mac (128 GB)
- M3 Ultra Mac Studio (512 GB)
- Ryzen AI Max+ 395 (128 GB)
- DGX Spark (128 GB)
- L40S
- RTX PRO 6000 Blackwell
- A100 80GB
- H100 SXM
- H200
- B200
- M1 Mac (8 GB)
- M1 Mac (16 GB)
- M2 or M3 Mac (8 GB)
- M2 or M3 Mac (16 GB)
- M2 or M3 Mac (24 GB)
- M4 Mac (16 GB)
- M4 Mac (24 GB)
- M4 Mac (32 GB)
- M5 Mac (16 GB)
- M5 Mac (24 GB)
- M5 Mac (32 GB)
- M1 Pro or M2 Pro Mac (16 GB)
- M1 Pro or M2 Pro Mac (32 GB)
- M3 Pro Mac (18 GB)
- M3 Pro Mac (36 GB)
- M4 Pro Mac (24 GB)
- M4 Pro Mac (48 GB)
- M5 Pro Mac (24 GB)
- M5 Pro Mac (48 GB)
- M5 Pro Mac (64 GB)
- M1 Max or M2 Max Mac (32 GB)
- M1–M3 Max Mac (64 GB)
- M3 Max Mac (36 GB)
- M3 Max Mac (128 GB)
- M4 Max Mac (36 GB)
- M4 Max Mac (48 GB)
- M4 Max Mac (64 GB)
- M5 Max Mac (36 GB)
- M5 Max Mac (48 GB)
- M5 Max Mac (64 GB)
- M5 Max Mac (128 GB)
- CPU only, DDR4-3200 dual channel (16 GB)
- CPU only, DDR4-3200 dual channel (32 GB)
- CPU only, DDR4-3200 dual channel (64 GB)
- CPU only, DDR5-5600 dual channel (32 GB)
- CPU only, DDR5-5600 dual channel (64 GB)
- CPU only, DDR5-5600 dual channel (128 GB)
- CPU only, DDR4-3200 quad channel (128 GB)
- CPU only, DDR4-3200 quad channel (256 GB)
- 2× RTX 3060 12GB
- 2× RTX 3090
- 4× RTX 3090
- 2× RTX 4090
- 2× RTX 5090
- 8× H100 SXM
- 8× H200