你的电脑能跑哪些本地模型?

浏览器本地检测 GPU 配置,估算显存和推理速度,帮你判断 DeepSeek、Qwen、Llama 等模型能不能跑得动。

GPU检测中…
VRAM
Bandwidth
RAM
CUDA Cores
12 GB
32 GB

模型兼容性一览

基于当前显存配置,估算各模型在本地运行的表现

等级 模型名称 参数量 所需显存 预估速度 状态
S绰绰有余
A流畅运行
B正常运行
C勉强可跑
D非常吃力
F无法运行
提示:以上为估算值,实际速度受推理引擎(llama.cpp / vLLM / exllamav2)、上下文长度、驱动版本等因素影响。MoE 模型(如 DeepSeek-R1、Mixtral)可通过专家卸载在较低显存上运行,但速度会明显下降。Mac 用户建议将统一内存的 70%~80% 作为可用显存。

关于检测结果的说明

检测原理:通过浏览器 WebGL API 读取显卡渲染器字符串,与内置 GPU 数据库匹配,获取已知的显存和带宽规格。系统内存通过浏览器 API 估算。所有检测在本地完成,不会上传任何硬件信息。

局限性:浏览器无法直接读取显卡的精确显存大小,部分显卡(尤其是笔记本独显、Apple Silicon、Intel Arc 新型号)的显存规格可能不准确。建议对照手动调整区的参数进行修正。Firefox / Safari 对 WebGL 扩展支持有限,推荐使用 Chrome / Edge 获得最佳检测效果。

推理速度说明:预估速度基于显存带宽计算(llama.cpp 场景),实际 tok/s 受推理框架、prompt 长度、batch size 等因素影响。表中速度仅供横向对比参考,不代表精确数值。

需要帮助?如果你不确定该选什么硬件来跑本地模型,可以联系我们获取硬件选型和部署建议。