浏览器本地检测 GPU 配置,估算显存和推理速度,帮你判断 DeepSeek、Qwen、Llama 等模型能不能跑得动。
基于当前显存配置,估算各模型在本地运行的表现
| 等级 | 模型名称 | 参数量 | 所需显存 | 预估速度 | 状态 |
|---|
检测原理:通过浏览器 WebGL API 读取显卡渲染器字符串,与内置 GPU 数据库匹配,获取已知的显存和带宽规格。系统内存通过浏览器 API 估算。所有检测在本地完成,不会上传任何硬件信息。
局限性:浏览器无法直接读取显卡的精确显存大小,部分显卡(尤其是笔记本独显、Apple Silicon、Intel Arc 新型号)的显存规格可能不准确。建议对照手动调整区的参数进行修正。Firefox / Safari 对 WebGL 扩展支持有限,推荐使用 Chrome / Edge 获得最佳检测效果。
推理速度说明:预估速度基于显存带宽计算(llama.cpp 场景),实际 tok/s 受推理框架、prompt 长度、batch size 等因素影响。表中速度仅供横向对比参考,不代表精确数值。
需要帮助?如果你不确定该选什么硬件来跑本地模型,可以联系我们获取硬件选型和部署建议。