模型选型表

价格为各厂商官方 API 报价,单位:美元 / 每百万 token。缓存命中、批量接口、错峰时段通常另有折扣。

数据截至 2026-09-08

填上你一次典型调用的用量,右边「单次成本」列会实时算出各模型的价格并排序。 比任何评分都实在 —— 便宜一个数量级的模型,很多任务上并不差。

厂商 模型 上下文 输入 $/M 输出 $/M 单次成本 适合做什么
Anthropic Claude Fable 5.1 claude-fable-5-1 1M $10.0 $50.0
最难的推理与长程 agent 任务 思考始终开启,不接受 budget_tokens
Anthropic Claude Opus 5 claude-opus-5 1M $5.0 $25.0
复杂编码、重构、agent 主力
Anthropic Claude Sonnet 5 claude-sonnet-5 1M $2.0 $10.0
日常主力,能力与成本平衡
Anthropic Claude Haiku 4.5 claude-haiku-4-5 200K $1.0 $5.0
高并发轻任务、子 agent 唯一非 1M 上下文的当代型号
OpenAI GPT-6 Astra gpt-6-astra 1.05M $10.0 $50.0
旗舰级综合能力 2026-09-03 发布,取代 Sol 成为旗舰
OpenAI GPT-5.6 Sol gpt-5.6-sol 1.05M $5.0 $30.0
上一代旗舰,仍在服务 超过 272K 上下文约按 10 / 45 计费;促销价有波动
OpenAI GPT-5.6 Terra gpt-5.6-terra 1.05M $2.0 $12.0
均衡主力
OpenAI GPT-5.6 Luna gpt-5.6-luna 1.05M $0.2 $1.2
大批量分类、抽取、清洗 当前最便宜的 1M 级上下文
Google Gemini 3.1 Pro gemini-3.1-pro 1M $2.0 $12.0
多模态与长文档理解 此价对应 ≤200K;超出后输入 ×2、输出 ×1.5
Google Gemini 3.8 Flash gemini-3.8-flash 1M $0.75 $3.75
低延迟多模态 2026-09-02 发布,尝鲜价;2027-01-01 起调至 1.50 / 7.50
Google Gemini 3.6 Flash gemini-3.6-flash 1M $1.5 $7.5
稳定版 Flash
Google Gemini 3.5 Flash-Lite gemini-3.5-flash-lite 1M $0.3 $2.5
便宜且要长上下文
DeepSeek DeepSeek V4 Flash deepseek-v4-flash $0.44 $1.32
可自部署、数据不出内网 MIT 许可,权重开放;错峰时段价格减半
阿里云 Qwen3.8 Max qwen3.8-max $2.0 $6.0
国内可直连的闭源旗舰 同代另有 Apache-2.0 开源权重版本
月之暗面 Kimi K3 kimi-k3 1M $3.0 $15.0
原生多模态、长上下文

该挑哪个

按场景给的建议,不是排名。榜单分数和你的实际任务往往对不上。

写代码 / 大规模重构

Claude Opus 5

编码与 agent 档位的主力,1M 上下文能整仓库塞进去。预算紧就降到 Sonnet 5。

日常问答 / 内容生成

Claude Sonnet 5 或 GPT-5.6 Terra

都是 $2 输入档,能力够用。差别更多在生态和调用便利性,不在价格。

大批量处理(分类、抽取、清洗)

GPT-5.6 Luna 或 Gemini 3.5 Flash-Lite

$0.20 和 $0.30 的输入价,比主力档便宜一个数量级,且都是 1M 上下文。别忘了批量接口再打五折。

最难的题目,成本不是问题

Claude Fable 5.1 或 GPT-6 Astra

两家的顶格型号,巧合地同为 $10 / $50。差距要看你自己的评测集,别信榜单。

数据不能出内网

DeepSeek V4(MIT)或 Qwen3.8 开源权重

权重开放,可本地部署。上面的价格是官方托管 API 价,自部署的成本是你自己的显卡。

价格随时会变,本页数据为人工整理,仅供比价参考,下单前请以官方页面为准。