大模型对照表

当前在售的 11 个主力档位:输入 / 缓存 / 输出单价、上下文与最大输出、推理模式、 工具调用、结构化输出、图像输入,以及按你的 token 组合算出的每千次请求成本。 每列都能点表头排序。数据核对于 2026-08-15,每周自动同步。

模型 输入 $/M 缓存 $/M 输出 $/M 上下文 最大输出 能力 发布 每千次请求
Claude Opus 5 Anthropic · 2026-05 $5 $0.5 $25 1000k 128k
RTSV
2026-07-24
Claude Sonnet 5 Anthropic · 2026-01-31 $2 $0.2 $10 1000k 128k
RTSV
2026-06-29
Claude Haiku 4.5 Anthropic · 2025-02-28 $1 $0.1 $5 200k 64k
RTSV
2025-10-15
DeepSeek V4 Pro DeepSeek $0.435 $0.003625 $0.87 1000k 384k
RTSV
2026-08-12
DeepSeek V4 Flash DeepSeek · 2025-05 $0.14 $0.0028 $0.28 1000k 384k
RTSVO
2026-07-31
Gemini 3.7 Flash Google · 2026-03 $0.75 $0.075 $3.75 1049k 66k
RTSV
2026-08-13
Gemini 3.5 Flash Lite Google · 2026-03 $0.3 $0.03 $2.5 1049k 66k
RTSV
2026-07-21
GPT-5.6 Sol OpenAI · 2026-02-16 $5 $0.5 $30 1050k 128k
RTSV
2026-07-09
GPT-5.6 Terra OpenAI · 2026-02-16 $2 $0.2 $12 1050k 128k
RTSV
2026-07-09
GPT-5.3 Codex OpenAI · 2025-08-31 $1.75 $0.175 $14 400k 128k
RTSV
2026-02-05
GPT-5.6 Luna OpenAI · 2026-02-16 $0.2 $0.02 $1.2 1050k 128k
RTSV
2026-07-09

点表头排序;「每千次请求」按左侧的 token 组合实时算。

R 推理模式 · T 工具调用 · S 结构化输出 · V 图像输入 · O 开放权重 · 2026-05 知识截止

价格是列表价,每周从 models.dev 同步并与 LiteLLM 交叉校验。折扣、批处理与长上下文档位不在表内。

要算月度账单请用成本计算器 →

为什么单看价格对不出结论

「$5 / $25」和「$2 / $12」哪个便宜,取决于你的流量长什么样。 RAG 场景输入远大于输出(几千 token 上下文换几百 token 答案),这时输入单价主导; 代码生成和长文写作反过来,输出能到输入的一半甚至更多,而输出单价通常是输入的 5–6 倍。 所以这张表最右边一列不是照抄的价格,而是拿你左上角填的 token 组合把两个价格混合后 按每千次请求算出来的 —— 改一下输入输出比例,排名会当场变。

能力标记只留了四个真会影响架构决策的:R 推理模式、 T 工具调用、S 结构化输出(schema 约束)、 V 图像输入。不支持工具调用的模型做不了 agent; 不支持结构化输出就得自己写 JSON 修复逻辑,那是另一笔工程账。

这张表和网上大多数对照表的差别在维护方式:它不是手工维护的 —— 数据由每周运行的脚本从 models.dev 同步、并与 LiteLLM 的价格文件交叉校验, 价格变动超过 60% 或两个源分歧超过 25% 时脚本会拒绝写入并要求人工确认。 新模型按「家族 + 档位」自动进来,旧档位自动退场。所以你看到的是当周的数据,而不是某个人半年前录的。

不在表内的:批处理与低优先级折扣(通常再打五折)、长上下文档位(超过阈值后单价翻倍)、 缓存写入价、以及你自己谈下来的合约价。要把这些算进去,用 成本计算器,那里的每个价格都可以改。

配套工具