大模型 API 价格对比:Claude、GPT、Gemini、DeepSeek 怎么选
先说结论:选模型先看任务,再看价格。难题和长链路 Agent 用 Claude Opus 或 GPT-6 Sol;日常写代码、写文档用 Claude Sonnet;量大、对延迟敏感的用 Gemini Flash 或 DeepSeek。下面每张价格表都直接读取 Lazu 的线上目录,价格一变这里就跟着变,不用担心是旧数据。
怎么看下面的价格表
- 价格单位是美元 / 每百万 token,输入和输出分开计。
- 第一行是模型厂商的官方价,下面是 Lazu 的稳定线路(走官方 API)和优惠线路(如果有)。
- 优惠线路是逆向渠道,不是官方 API,只建议在对应的 Agent 工具里用:Claude 配 Claude Code,GPT 配 Codex,Gemini 配 Antigravity。自己写的程序请看稳定线路的价格。
旗舰:处理难题和长任务
claude-opus-5-5Anthropic · 1M · 稳定 $4.00 / $20.00 · 优惠 $1.72 / $8.60查看模型页 →美元 / 百万 token
— 表示未记录该项价格,不代表免费;实际费用以请求回执为准。
gpt-6-solOpenAI · 1.05M · 稳定 $2.00 / $10.00 · 优惠 $0.36 / $1.80查看模型页 →美元 / 百万 token
输入(含缓存)超过阈值的请求,整单按长上下文价计费。
— 表示未记录该项价格,不代表免费;实际费用以请求回执为准。
旗舰模型贵在输出。Agent 场景一次任务动辄几十万 token,其中大部分是重复发送的上下文,所以要把缓存读取价一起算进去:缓存命中的输入通常只收原价的一小部分。
主力:日常写代码和文档
claude-sonnet-5-5Anthropic · 1M · 稳定 $2.00 / $10.00 · 优惠 $0.86 / $4.30查看模型页 →美元 / 百万 token
— 表示未记录该项价格,不代表免费;实际费用以请求回执为准。
claude-opus-5-5(上一代)
claude-opus-5-5Anthropic · 1M · 稳定 $4.00 / $20.00 · 优惠 $1.72 / $8.60查看模型页 →美元 / 百万 token
— 表示未记录该项价格,不代表免费;实际费用以请求回执为准。
很多日常编码任务用 Sonnet 就够了,价格比 Opus 低不少。上表同时列出了 Opus,方便直接对比。
高性价比:量大、要快
gemini-3.8-flashGoogle · 1M · 稳定 $0.75 / $3.75 · 优惠 $0.1875 / $0.9375查看模型页 →美元 / 百万 token
— 表示未记录该项价格,不代表免费;实际费用以请求回执为准。
deepseek-v4-proDeepSeek · 1M · 稳定 $0.825 / $2.48查看模型页 →美元 / 百万 token
— 表示未记录该项价格,不代表免费;实际费用以请求回执为准。
deepseek-v4-flashDeepSeek · 1M · 稳定 $0.1875 / $0.75查看模型页 →美元 / 百万 token
— 表示未记录该项价格,不代表免费;实际费用以请求回执为准。
DeepSeek 有分时价格:高峰时段价格翻倍,模型页上会标出具体时段。批量任务尽量放到非高峰时段跑。
算一笔账
假设每天 2000 次请求,每次输入 3000 token、输出 500 token:
- 每天输入 600 万 token,输出 100 万 token;
- 每天费用 = 6 × 输入单价 + 1 × 输出单价;
- 把上面表格里的单价代进去,就能得到每个模型的日成本。输出单价往往是输入的 4–8 倍,所以输出长的任务差距会被放大。
省钱的几个办法
- 开缓存:系统提示和长文档放在前面、保持不变,命中缓存的部分按缓存价计费。
- 按任务分模型:同一个 Key 可以调所有模型,简单的分类、摘要交给 Flash 级模型。
- Agent 工具走优惠线路:在 Claude Code、Codex 里可以把对应模型切到优惠线路,自己的程序继续用稳定线路。
- 看账单调:控制台「用量与日志」按模型拆开了费用,先找出最贵的那一类请求再优化。
完整的模型和价格见 模型目录,价格实时更新。