同题实测 · SHORT ANSWER
让模型用两句话解释一个概念,哪个最省钱?
答案是 deepseek-v4-flash,每次 $0.000152。
同一道题,最贵的 claude-fable-5 是它的 26.6 倍 —— 跑一万次,差 $38.96。
典型场景:agent 在流程中间需要一句解释、一个判断、一段简短说明。调用量大、单次很短,单价差异会被放大成账单差异。
| # | 模型 | 每次实付 | 倍数 | tokens 入/出 | 耗时 |
|---|---|---|---|---|---|
| 1 | deepseek-v4-flash | $0.000152 | 基准 | 26 / 201 | 4554 ms |
| 2 | GLM5.2 | $0.000742 | ×4.9 | 34 / 200 | 19610 ms |
| 3 | claude-sonnet-5 | $0.000994 | ×6.5 | 21 / 116 | 4088 ms |
| 4 | gemini-3.5-flash | $0.001351 | ×8.9 | 688 / 73 | 6797 ms |
| 5 | claude-opus-4-8 | $0.002124 | ×14.0 | 21 / 102 | 7095 ms |
| 6 | Kimi-K3 | $0.002239 | ×14.7 | 28 / 181 | 6438 ms |
| 7 | claude-fable-5 | $0.004048 | ×26.6 | 21 / 97 | 3477 ms |
怎么测的:同一段提示词发给每个模型,temperature 0,限定 max_tokens,每晚各跑一次。 成本按上游返回的 token 用量乘以我们实际支付的单价计算 —— 没有返回用量的调用直接丢弃,不做估算。 因为是同一道题,差异只来自模型本身(它愿意吐多少 token、单价多少),不含任务难度。 窗口 30 天,更新于 2026-08-06T11:59。
其他任务
拿这份数据
curl "https://ainetcafe.com/api/model-costs"
curl "https://ainetcafe.com/t/model_costs?days=30"
CC BY 4.0,引用请注明 "AI NetCafe real model cost dataset, https://ainetcafe.com/costs"。
完整方法论与全部任务:/costs ·
想直接按这些价格调用:给 Agent 的接入文档。