跳到主要内容
可追溯来源参考

LLM API 价格与成本估算

一组规模有限的公开 token 价格参考。筛选当前可见渠道后,按输入与输出量估算一个场景;这里不宣称存在通用的“最划算”方案。

成本情境

支持 0 到 1,000,000 的小数。

9 条公开价格记录 · 美元/百万 token;估算不含税费、缓存、存储、工具、批处理、最低消费和折扣。这不是账单,请在付费前确认当前价格。

Alibaba Cloud Model Studio

Qwen3.8 Flash

qwen3.8-flash · 新加坡国际站

估算$6.20
输入 / 1M
$0.150
输出 / 1M
$0.470
套餐与可用范围
国际站 API 价格 · 新加坡国际站区域
限制与假设
地区与套餐的价格可能不同。
Z.AI

GLM-5.3-Flash

glm-5.3-flash · 公布的标准价格

估算$6.50
输入 / 1M
$0.150
输出 / 1M
$0.500
套餐与可用范围
全球 USD API 定价 · Z.AI API
限制与假设
不包含 Coding Plan 的定价。
DeepSeek

DeepSeek V4.1 Flash

deepseek-flash · 非高峰时段

估算$7.50
输入 / 1M
$0.150
输出 / 1M
$0.600
套餐与可用范围
标准 API 价格;未命中缓存的输入 · DeepSeek API 路由
限制与假设
其他时段列为非高峰;中国节假日的适用方式以发布方时段表为准。
DeepSeek

DeepSeek V4.1 Flash

deepseek-flash · 高峰时段

估算$15.00
输入 / 1M
$0.300
输出 / 1M
$1.20
套餐与可用范围
标准 API 价格;未命中缓存的输入 · DeepSeek API 路由
限制与假设
高峰时段为 UTC 工作日 01:00–04:00 与 06:00–10:00,中国节假日除外。
DeepSeek

DeepSeek V4 Pro

deepseek-v4-pro · 非高峰时段

估算$26.40
输入 / 1M
$0.660
输出 / 1M
$1.98
套餐与可用范围
标准 API 价格;未命中缓存的输入 · DeepSeek API 路由
限制与假设
其他时段列为非高峰;中国节假日的适用方式以发布方时段表为准。
DeepInfra

GLM-5.2

zai-org/GLM-5.2 · 标准目录价

估算$31.50
输入 / 1M
$0.750
输出 / 1M
$2.40
套餐与可用范围
基础目录价;不使用临时促销报价 · DeepInfra 托管推理路由
限制与假设
页面还显示了 25% 促销报价(每百万输入 $0.563/输出 $1.80),未公布结束日期,因此计算器不采用它。此标准档位为 fp4;本页未测试其与其他 GLM-5.2 路由在质量或版本上的等价性。
DeepSeek

DeepSeek V4 Pro

deepseek-v4-pro · 高峰时段

估算$52.80
输入 / 1M
$1.32
输出 / 1M
$3.96
套餐与可用范围
标准 API 价格;未命中缓存的输入 · DeepSeek API 路由
限制与假设
高峰时段为 UTC 工作日 01:00–04:00 与 06:00–10:00,中国节假日除外。
Z.AI

GLM-5.2

glm-5.2 · 公布的标准价格

估算$58.00
输入 / 1M
$1.40
输出 / 1M
$4.40
套餐与可用范围
全球 USD API 定价 · Z.AI API
限制与假设
不包含 Coding Plan 的定价。
Alibaba Cloud Model Studio

Qwen3.8 Max

qwen3.8-max · 新加坡国际站 · 输入不超过 1M token

估算$80.00
输入 / 1M
$2.00
输出 / 1M
$6.00
套餐与可用范围
国际站 API 价格 · 新加坡国际站区域
限制与假设
此记录仅覆盖公布的输入不超过 1M token 档位;地区与套餐的价格可能不同。
计算方法

只计算你能核查的记录。

估算成本 = 输入百万 token × 输入单价 + 输出百万 token × 输出单价。不包含税费、缓存 token 价格、存储、工具、批处理、最低消费、赠金或折扣。

时段和地区也是价格条件。

DeepSeek 记录将高峰与非高峰拆开;公布的时段按 UTC 工作日计算,并有中国节假日例外。Alibaba 记录仅限页面标示的新加坡国际场景。本页不做货币换算。

范围与常见问题

这是完整的市场比较吗?

不是。它是一个规模有限、有复核日期、且每条都可回查发布方链接的参考表;不对质量、速度或可用性排序。

为什么同一个模型有两行?

它们可能对应不同的时段或计费情境,是可替代的场景,不是不同供应商,也不是推荐。

计算器会上传估算用量或要求 API Key 吗?

不会。这里没有 Key 输入框或估算提交接口;计算仅保存在当前页面的浏览器状态中。可选的页面统计仍遵循你的已有同意设置。