计费说明

AI 服务平台(AISP)采用按量计费模式,根据模型实际消耗进行结算。 平台支持四种计费模式,覆盖 Chat 对话、图片生成、视频生成、语音合成四大能力。 无需包年包月,无最低消费要求,按实际使用量付费。

计费概览
  • ✔ 按用量计费,不使用不扣费
  • ✔ 实时扣费,每次请求完成后自动结算
  • ✔ 明细透明,控制台可查询每笔消费记录
  • ✔ 余额不足时提前拦截,不会调用模型

四种计费模式

计费模式适用能力计费单位计算公式
tokenChat 对话Token(百万)费用 = tokens / 1,000,000 × 单价
image图片生成张数费用 = 生成数量 × 单价
second视频生成秒数费用 = 视频时长(秒) × 单价
tts语音合成字符数费用 = 字符数 / 10,000 × 单价

Token 计费(Chat 对话)

Chat 接口按实际消耗的 Token 数计费,区分输入 Token 和输出 Token,分别乘以对应单价后求和。

计费公式
总费用 = prompt_tokens / 1,000,000 × input_price + completion_tokens / 1,000,000 × output_price

计算示例(以 deepseek-v4-pro 为例,输入 ¥12/百万,输出 ¥24/百万):

prompt_tokens = 150
completion_tokens = 300

输入费用 = 150 / 1,000,000 × 12 = 0.0018 元
输出费用 = 300 / 1,000,000 × 24 = 0.0072 元
总费用 = 0.0018 + 0.0072 = 0.0090 元

Image 计费(图片生成)

图片生成按生成张数计费,单价由所选模型决定。

计费公式
费用 = 生成数量 × 模型单价

计算示例(以 wanx2.1-t2i-turbo 为例,¥0.4/张):

生成数量 n = 4
费用 = 4 × 0.4 = 1.6 元

Second 计费(视频生成)

视频生成按视频时长(秒)计费,单价由所选模型决定。

计费公式
费用 = 视频时长(秒) × 模型单价

计算示例(以 wanx2.1-t2v-plus 为例,¥0.6/秒):

视频时长 = 5 秒
费用 = 5 × 0.6 = 3.0 元

TTS 计费(语音合成)

语音合成按实际转换的字符数计费。

计费公式
费用 = 字符数 / 10,000 × 模型单价

计算示例(以 cosyvoice-v1 为例,¥0.05/千字符):

字符数 = 500
费用 = 500 / 10,000 × 0.05 = 0.0025 元

各模型单价表

Chat 对话模型(按 Token 百万计费)

模型输入价格输出价格
deepseek-v4-pro¥12 / 百万¥24 / 百万
deepseek-r1¥4 / 百万¥16 / 百万
qwen-max¥2.4 / 百万¥9.6 / 百万
qwen-plus¥0.8 / 百万¥2 / 百万
qwen-turbo¥0.3 / 百万¥0.6 / 百万
qwen3-235b-a22b¥2 / 百万¥8 / 百万
qwen3-32b¥1 / 百万¥4 / 百万
qwen3-14b¥0.5 / 百万¥2 / 百万
qwen3-8b¥0.2 / 百万¥0.8 / 百万
qwen3-coder-plus¥3 / 百万¥12 / 百万
glm-4.5¥1 / 百万¥4 / 百万
kimi/kimi-k2.5¥1 / 百万¥4 / 百万
baichuan4¥1 / 百万¥4 / 百万
minimax-text-01¥1 / 百万¥4 / 百万

图片生成模型(按张数计费)

模型单价
wanx2.1-t2i-turbo¥0.4 / 张
wanx2.1-t2i-plus¥0.6 / 张
wanx2.2-t2i-plus¥0.8 / 张
wanx2.2-t2i-flash¥0.3 / 张
flux-dev¥0.5 / 张
flux-schnell¥0.2 / 张

视频生成模型 — 通义万相(按秒数计费)

模型单价
wanx2.1-t2v-turbo¥0.3 / 秒
wanx2.1-t2v-plus¥0.6 / 秒
wan2.2-t2v-plus¥0.8 / 秒

视频生成模型 — 豆包 Seedance(按 Token 计费)

模型单价
Doubao-Seedance-2.0¥46 / 百万 Token
Doubao-Seedance-2.0-fast¥37 / 百万 Token
Doubao-Seedance-2.0-mini¥23 / 百万 Token
豆包视频计费说明
  • 计费方式:按 Token 计费
  • 费用 = total_tokens / 1,000,000 × 单价
  • 分辨率限定 720p

语音合成模型(按字符计费)

模型单价
cosyvoice-v1¥0.05 / 千字符
qwen3-tts-flash¥0.08 / 千字符

计费流程

一次完整的 API 调用包含以下计费流程:

① 用户发起请求
      │
      ▼
② 网关鉴权 & 余额预检查
      │  ├─ 余额充足 → 继续
      │  └─ 余额不足 → 返回 403 错误
      │
      ▼
③ 请求路由至对应模型服务
      │
      ▼
④ 模型处理并返回结果(含 usage 数据)
      │
      ▼
⑤ BillingService 计算费用
      │  ├─ Token 模式:tokens × 单价
      │  ├─ Image 模式:数量 × 单价
      │  ├─ Second 模式:时长 × 单价
      │  └─ TTS 模式:字符数 / 10,000 × 单价
      │
      ▼
⑥ 记录调用日志(含 Request ID)
      │
      ▼
⑦ 扣减账户余额
      │
      ▼
⑧ 返回结果给用户

余额扣减逻辑

  • 预检查:请求发起前检查余额是否充足,不足则直接返回 403,不会调用模型
  • 实时扣费:请求完成后立即从账户余额中扣减对应费用
  • 原子操作:扣费操作具有原子性,避免并发导致的超扣
  • 费用精度:所有费用保留 6 位小数
  • 失败不扣费:请求失败(模型返回错误)不收取任何费用
  • 余额保护:账户余额为 0 时自动拒绝请求,需充值后恢复

消费记录

平台记录每一次 API 调用的完整信息,可在控制台查询:

字段说明
Request ID请求唯一标识,用于日志追踪
模型名称本次调用的模型
计费模式token / image / second / tts
用量Token 数 / 张数 / 秒数 / 字符数
单价模型对应的计费单价
本次消费本次调用的实际费用
请求时间调用发起时间
状态成功 / 失败

余额查询

登录控制台后可实时查看:

  • 账户当前余额
  • 今日消费金额
  • 累计消费金额
  • 本月消费金额
  • 调用次数统计
  • Token / 张数 / 秒数 / 字符 使用量

常见问题

什么时候扣费?

模型返回结果后立即结算并扣减余额。流式输出在整个流结束后统一结算。

请求失败是否收费?

不会。请求失败(如模型超时、参数错误等)不收取任何费用。但如果是在模型处理成功后因网络问题导致客户端未收到响应,仍会正常计费。

流式输出如何计费?

流式输出与普通输出采用相同计费规则,按实际消耗的 Token 数量收费,不额外增加费用。

费用精度是多少?

所有费用均保留 6 位小数。当单次费用不足 0.000001 元时按 0 计。

不同模型的费用如何比较?

Chat 模型按 Token 百万单价比较,Image 模型按每张单价比较,Video 按每秒单价比较,TTS 按每千字符单价比较。具体价格请参考 模型列表