价格为各厂商官方 API 报价,单位:美元 / 每百万 token。缓存命中、批量接口、错峰时段通常另有折扣。
数据截至 2026-09-08填上你一次典型调用的用量,右边「单次成本」列会实时算出各模型的价格并排序。 比任何评分都实在 —— 便宜一个数量级的模型,很多任务上并不差。
| 厂商 | 模型 | 上下文 | 输入 $/M | 输出 $/M | 单次成本 | 适合做什么 |
|---|---|---|---|---|---|---|
| Anthropic | Claude Fable 5.1 claude-fable-5-1 | 1M | $10.0 | $50.0 | — | 最难的推理与长程 agent 任务 思考始终开启,不接受 budget_tokens |
| Anthropic | Claude Opus 5 claude-opus-5 | 1M | $5.0 | $25.0 | — | 复杂编码、重构、agent 主力 |
| Anthropic | Claude Sonnet 5 claude-sonnet-5 | 1M | $2.0 | $10.0 | — | 日常主力,能力与成本平衡 |
| Anthropic | Claude Haiku 4.5 claude-haiku-4-5 | 200K | $1.0 | $5.0 | — | 高并发轻任务、子 agent 唯一非 1M 上下文的当代型号 |
| OpenAI | GPT-6 Astra gpt-6-astra | 1.05M | $10.0 | $50.0 | — | 旗舰级综合能力 2026-09-03 发布,取代 Sol 成为旗舰 |
| OpenAI | GPT-5.6 Sol gpt-5.6-sol | 1.05M | $5.0 | $30.0 | — | 上一代旗舰,仍在服务 超过 272K 上下文约按 10 / 45 计费;促销价有波动 |
| OpenAI | GPT-5.6 Terra gpt-5.6-terra | 1.05M | $2.0 | $12.0 | — | 均衡主力 |
| OpenAI | GPT-5.6 Luna gpt-5.6-luna | 1.05M | $0.2 | $1.2 | — | 大批量分类、抽取、清洗 当前最便宜的 1M 级上下文 |
| Gemini 3.1 Pro gemini-3.1-pro | 1M | $2.0 | $12.0 | — | 多模态与长文档理解 此价对应 ≤200K;超出后输入 ×2、输出 ×1.5 | |
| Gemini 3.8 Flash gemini-3.8-flash | 1M | $0.75 | $3.75 | — | 低延迟多模态 2026-09-02 发布,尝鲜价;2027-01-01 起调至 1.50 / 7.50 | |
| Gemini 3.6 Flash gemini-3.6-flash | 1M | $1.5 | $7.5 | — | 稳定版 Flash | |
| Gemini 3.5 Flash-Lite gemini-3.5-flash-lite | 1M | $0.3 | $2.5 | — | 便宜且要长上下文 | |
| DeepSeek | DeepSeek V4 Flash deepseek-v4-flash | — | $0.44 | $1.32 | — | 可自部署、数据不出内网 MIT 许可,权重开放;错峰时段价格减半 |
| 阿里云 | Qwen3.8 Max qwen3.8-max | — | $2.0 | $6.0 | — | 国内可直连的闭源旗舰 同代另有 Apache-2.0 开源权重版本 |
| 月之暗面 | Kimi K3 kimi-k3 | 1M | $3.0 | $15.0 | — | 原生多模态、长上下文 |
按场景给的建议,不是排名。榜单分数和你的实际任务往往对不上。
Claude Opus 5
编码与 agent 档位的主力,1M 上下文能整仓库塞进去。预算紧就降到 Sonnet 5。
Claude Sonnet 5 或 GPT-5.6 Terra
都是 $2 输入档,能力够用。差别更多在生态和调用便利性,不在价格。
GPT-5.6 Luna 或 Gemini 3.5 Flash-Lite
$0.20 和 $0.30 的输入价,比主力档便宜一个数量级,且都是 1M 上下文。别忘了批量接口再打五折。
Claude Fable 5.1 或 GPT-6 Astra
两家的顶格型号,巧合地同为 $10 / $50。差距要看你自己的评测集,别信榜单。
DeepSeek V4(MIT)或 Qwen3.8 开源权重
权重开放,可本地部署。上面的价格是官方托管 API 价,自部署的成本是你自己的显卡。