348 个开源模型,覆盖主流厂商。按参数规模、架构类型、VRAM 需求筛选, 找到最适合你硬件条件的开源模型。
选择你的显卡和量化级别,查看可运行的开源模型列表
VRAM 需求为估算值(含 ~20% KV Cache 开销),实际值因推理框架(vLLM / llama.cpp / TGI)而异。 MoE 模型需全量加载权重,推理时仅激活部分参数。
用实际硬件成交价、运营成本和目标模型实测吞吐,对比 API 月费。缺少吞吐或容量不足时不会给出回本结论。