DeepSeek V4 Flash 0420 (Non-reasoning)
厂商当前主推同系列的其他型号。这一页保留下来,方便对照这个版本的历史价格与指标。
价格 / 每 1M tokens
输入
$0.094
输出
$0.195
缓存读取
$0.070
加权价
$0.114输入×0.8 + 输出×0.2,全站统一口径
站内性价比
智能指数18.9
Arena Elo1436
厂商当前主推同系列的其他型号。这一页保留下来,方便对照这个版本的历史价格与指标。
这个模型能做什么、做得多好、答得多快
Artificial Analysis 综合指数 · 指数分,非百分比
一次装得下多少上下文,自己跑要多少显存
本地部署显存需求(含约 20% KV Cache 开销)
按 FP16 / Q8 / Q4 三档给出,含约 20% KV Cache 开销,可以对着手上的显卡直接估。
每厂商取一个,按站内性价比排序。加权价的口径是输入×0.8 + 输出×0.2,当前模型为 $0.114。绿色表示这一项比 DeepSeek V4 Flash 0420 (Non-reasoning) 便宜。