计费说明
AI 服务平台(AISP)采用按量计费模式,根据模型实际消耗进行结算。 平台支持四种计费模式,覆盖 Chat 对话、图片生成、视频生成、语音合成四大能力。 无需包年包月,无最低消费要求,按实际使用量付费。
计费概览
- ✔ 按用量计费,不使用不扣费
- ✔ 实时扣费,每次请求完成后自动结算
- ✔ 明细透明,控制台可查询每笔消费记录
- ✔ 余额不足时提前拦截,不会调用模型
四种计费模式
| 计费模式 | 适用能力 | 计费单位 | 计算公式 |
|---|---|---|---|
| token | Chat 对话 | Token(百万) | 费用 = tokens / 1,000,000 × 单价 |
| image | 图片生成 | 张数 | 费用 = 生成数量 × 单价 |
| second | 视频生成 | 秒数 | 费用 = 视频时长(秒) × 单价 |
| tts | 语音合成 | 字符数 | 费用 = 字符数 / 10,000 × 单价 |
Token 计费(Chat 对话)
Chat 接口按实际消耗的 Token 数计费,区分输入 Token 和输出 Token,分别乘以对应单价后求和。
计费公式
总费用 = prompt_tokens / 1,000,000 × input_price + completion_tokens / 1,000,000 × output_price
总费用 = prompt_tokens / 1,000,000 × input_price + completion_tokens / 1,000,000 × output_price
计算示例(以 deepseek-v4-pro 为例,输入 ¥12/百万,输出 ¥24/百万):
prompt_tokens = 150
completion_tokens = 300
输入费用 = 150 / 1,000,000 × 12 = 0.0018 元
输出费用 = 300 / 1,000,000 × 24 = 0.0072 元
总费用 = 0.0018 + 0.0072 = 0.0090 元Image 计费(图片生成)
图片生成按生成张数计费,单价由所选模型决定。
计费公式
费用 = 生成数量 × 模型单价
费用 = 生成数量 × 模型单价
计算示例(以 wanx2.1-t2i-turbo 为例,¥0.4/张):
生成数量 n = 4
费用 = 4 × 0.4 = 1.6 元Second 计费(视频生成)
视频生成按视频时长(秒)计费,单价由所选模型决定。
计费公式
费用 = 视频时长(秒) × 模型单价
费用 = 视频时长(秒) × 模型单价
计算示例(以 wanx2.1-t2v-plus 为例,¥0.6/秒):
视频时长 = 5 秒
费用 = 5 × 0.6 = 3.0 元TTS 计费(语音合成)
语音合成按实际转换的字符数计费。
计费公式
费用 = 字符数 / 10,000 × 模型单价
费用 = 字符数 / 10,000 × 模型单价
计算示例(以 cosyvoice-v1 为例,¥0.05/千字符):
字符数 = 500
费用 = 500 / 10,000 × 0.05 = 0.0025 元各模型单价表
Chat 对话模型(按 Token 百万计费)
| 模型 | 输入价格 | 输出价格 |
|---|---|---|
| deepseek-v4-pro | ¥12 / 百万 | ¥24 / 百万 |
| deepseek-r1 | ¥4 / 百万 | ¥16 / 百万 |
| qwen-max | ¥2.4 / 百万 | ¥9.6 / 百万 |
| qwen-plus | ¥0.8 / 百万 | ¥2 / 百万 |
| qwen-turbo | ¥0.3 / 百万 | ¥0.6 / 百万 |
| qwen3-235b-a22b | ¥2 / 百万 | ¥8 / 百万 |
| qwen3-32b | ¥1 / 百万 | ¥4 / 百万 |
| qwen3-14b | ¥0.5 / 百万 | ¥2 / 百万 |
| qwen3-8b | ¥0.2 / 百万 | ¥0.8 / 百万 |
| qwen3-coder-plus | ¥3 / 百万 | ¥12 / 百万 |
| glm-4.5 | ¥1 / 百万 | ¥4 / 百万 |
| kimi/kimi-k2.5 | ¥1 / 百万 | ¥4 / 百万 |
| baichuan4 | ¥1 / 百万 | ¥4 / 百万 |
| minimax-text-01 | ¥1 / 百万 | ¥4 / 百万 |
图片生成模型(按张数计费)
| 模型 | 单价 |
|---|---|
| wanx2.1-t2i-turbo | ¥0.4 / 张 |
| wanx2.1-t2i-plus | ¥0.6 / 张 |
| wanx2.2-t2i-plus | ¥0.8 / 张 |
| wanx2.2-t2i-flash | ¥0.3 / 张 |
| flux-dev | ¥0.5 / 张 |
| flux-schnell | ¥0.2 / 张 |
视频生成模型 — 通义万相(按秒数计费)
| 模型 | 单价 |
|---|---|
| wanx2.1-t2v-turbo | ¥0.3 / 秒 |
| wanx2.1-t2v-plus | ¥0.6 / 秒 |
| wan2.2-t2v-plus | ¥0.8 / 秒 |
视频生成模型 — 豆包 Seedance(按 Token 计费)
| 模型 | 单价 |
|---|---|
| Doubao-Seedance-2.0 | ¥46 / 百万 Token |
| Doubao-Seedance-2.0-fast | ¥37 / 百万 Token |
| Doubao-Seedance-2.0-mini | ¥23 / 百万 Token |
豆包视频计费说明
- 计费方式:按 Token 计费
- 费用 = total_tokens / 1,000,000 × 单价
- 分辨率限定 720p
语音合成模型(按字符计费)
| 模型 | 单价 |
|---|---|
| cosyvoice-v1 | ¥0.05 / 千字符 |
| qwen3-tts-flash | ¥0.08 / 千字符 |
计费流程
一次完整的 API 调用包含以下计费流程:
① 用户发起请求
│
▼
② 网关鉴权 & 余额预检查
│ ├─ 余额充足 → 继续
│ └─ 余额不足 → 返回 403 错误
│
▼
③ 请求路由至对应模型服务
│
▼
④ 模型处理并返回结果(含 usage 数据)
│
▼
⑤ BillingService 计算费用
│ ├─ Token 模式:tokens × 单价
│ ├─ Image 模式:数量 × 单价
│ ├─ Second 模式:时长 × 单价
│ └─ TTS 模式:字符数 / 10,000 × 单价
│
▼
⑥ 记录调用日志(含 Request ID)
│
▼
⑦ 扣减账户余额
│
▼
⑧ 返回结果给用户余额扣减逻辑
- 预检查:请求发起前检查余额是否充足,不足则直接返回 403,不会调用模型
- 实时扣费:请求完成后立即从账户余额中扣减对应费用
- 原子操作:扣费操作具有原子性,避免并发导致的超扣
- 费用精度:所有费用保留 6 位小数
- 失败不扣费:请求失败(模型返回错误)不收取任何费用
- 余额保护:账户余额为 0 时自动拒绝请求,需充值后恢复
消费记录
平台记录每一次 API 调用的完整信息,可在控制台查询:
| 字段 | 说明 |
|---|---|
| Request ID | 请求唯一标识,用于日志追踪 |
| 模型名称 | 本次调用的模型 |
| 计费模式 | token / image / second / tts |
| 用量 | Token 数 / 张数 / 秒数 / 字符数 |
| 单价 | 模型对应的计费单价 |
| 本次消费 | 本次调用的实际费用 |
| 请求时间 | 调用发起时间 |
| 状态 | 成功 / 失败 |
余额查询
登录控制台后可实时查看:
- 账户当前余额
- 今日消费金额
- 累计消费金额
- 本月消费金额
- 调用次数统计
- Token / 张数 / 秒数 / 字符 使用量
常见问题
什么时候扣费?
模型返回结果后立即结算并扣减余额。流式输出在整个流结束后统一结算。
请求失败是否收费?
不会。请求失败(如模型超时、参数错误等)不收取任何费用。但如果是在模型处理成功后因网络问题导致客户端未收到响应,仍会正常计费。
流式输出如何计费?
流式输出与普通输出采用相同计费规则,按实际消耗的 Token 数量收费,不额外增加费用。
费用精度是多少?
所有费用均保留 6 位小数。当单次费用不足 0.000001 元时按 0 计。
不同模型的费用如何比较?
Chat 模型按 Token 百万单价比较,Image 模型按每张单价比较,Video 按每秒单价比较,TTS 按每千字符单价比较。具体价格请参考 模型列表。
