做 AI 应用,第一笔账永远是 API 账单。我整理了一份主流模型的参考价格(每百万 tokens),帮你建立基本盘。注意:价格会随时间和活动变动,下文只是帮你判断量级,下单前以各官方定价页为准。
先理解计费单位
API 按 token 计费,1 个汉字大约 1.5~2 个 token。厂商一般给三个价格:输入(缓存命中)、输入(未命中)、输出。输出通常比输入贵 3~5 倍,因为生成更费算力。
主流模型参考价(每百万 tokens)
| 厂商/模型 | 输入 | 输出 |
|---|---|---|
| OpenAI GPT-4o | $2.5 | $10 |
| OpenAI GPT-4o mini | $0.15 | $0.6 |
| Anthropic Claude Sonnet | $3 | $15 |
| DeepSeek-V3(人民币) | ¥0.5~2 | ¥8 |
| DeepSeek-R1(人民币) | ¥1~4 | ¥16 |
| 通义千问 qwen-plus | 约 ¥0.8 | 约 ¥2 |
| 智谱 GLM-4 | 约 ¥0.2~1 | 约 ¥2 |
换算一下人民币大致能感受到:GPT-4o 输出 $10 ≈ ¥70,DeepSeek-R1 输出 ¥16——同样是输出一百万 tokens,差 4 倍多;如果是 GPT-4o mini($0.6),则比 DeepSeek 贵约 2.8 倍。
省钱三板斧(真实有效)
- 缓存:重复前缀自动打 5~8 折(OpenAI 缓存输入 $1.25)
- 批处理:非实时的任务用 Batch API,OpenAI 五折
- 按任务选模型:简单分类/改写用 mini 或国产便宜模型,复杂推理才上贵模型
为什么国产模型这两年火
DeepSeek 把"大模型也能便宜训练"这件事摆上台面(V3 训练成本约 557.6 万美元,是 GPT-4 估值的约 1/20),价格战就此开打。对创业团队来说,一个月省几万块 API 费是常态。
一句话建议
先算清楚你的场景:高频、长文、简单任务 → 便宜模型;低频率、高难度推理 → 贵模型。按 token 单价盲目选"最强模型",账单大概率撑不了多久。
(价格整理自各官方定价页与公开资料,为 2025-2026 参考值,以官方为准。)
暂无评论