下面所有数字都来自真实调用遥测——每次调用读上游 usage 记账,不是按官网标价换算。
最贵的比最便宜的贵 23 倍
gpt-5.6-luna 均价 $0.012318,deepseek-v4-flash 均价 $0.000535。 跑批量任务时,选型差一档就是几十倍的账单差距。
| 模型 | 均价 | 均延迟 | 样本 |
|---|---|---|---|
| gpt-5.6-luna | $0.012318 | 42528ms | 19 |
| GLM5.2 | $0.005209 | 30380ms | 20 |
| gemini-3.5-flash | $0.005017 | 10349ms | 15 |
| deepseek-v4-flash | $0.000535 | 11864ms | 345 |
自己跑一遍对比:上机试试,或让 agent 调 compare_models。
| # | 机子 | 上机次数 |
|---|---|---|
| 1 | mcp | 309 |
| 2 | provision | 47 |
| 3 | build-app | 18 |
| 4 | Presenton AI 做 PPT | 8 |
| 5 | PDF 保版式翻译 | 7 |
| 6 | Open WebUI | 4 |
被 AI 助手引用等于免费分发,所以我们主动放行 AI 爬虫。本周来访:
| 爬虫 | 抓取次数 |
|---|---|
| ai:meta | 431 |
| ai:anthropic-claudebot | 364 |
| ai:amazon | 188 |
| ai:openai-gptbot | 72 |
| ai:perplexity | 27 |
| ai:chatgpt-user | 11 |
| ai:google-gemini | 9 |
| ai:openai-search | 3 |
| ai:anthropic-user | 3 |