模型列表

AI 服务平台(AISP)聚合了国内外多个主流 AI 模型,涵盖 Chat 对话、Image 图片生成、Video 视频生成、Audio 语音合成四大能力。 所有模型均使用统一的 REST 接口,您只需修改 model 参数即可切换模型,无需更换接口地址或修改 SDK。

使用说明
  • 所有模型通过统一的 model 参数指定
  • 不同模型的价格、上下文长度、能力各不相同
  • 平台会根据模型类型自动路由到对应的接口服务
  • 建议根据业务场景选择合适的模型

如何切换模型

调用接口时,只需在请求体中将 model 字段设置为目标模型名称即可。以 Chat 接口为例:

// 使用 deepseek-v4-pro(旗舰推荐)
POST /api/openai/chatCompletions
{
  "model": "deepseek-v4-pro",
  "messages": [
    { "role": "user", "content": "你好" }
  ]
}

// 切换为 qwen-plus(通义千问)
{
  "model": "qwen-plus",
  "messages": [
    { "role": "user", "content": "你好" }
  ]
}

// 切换为 glm-4.5(智谱)
{
  "model": "glm-4.5",
  "messages": [
    { "role": "user", "content": "你好" }
  ]
}

Chat 对话模型

模型名厂商说明上下文计费类型输入价格输出价格能力
deepseek-v4-proDeepSeek旗舰·推荐128Ktoken¥12 / 百万¥24 / 百万流式 / 多模态 / 函数调用
deepseek-r1DeepSeek推理模型32Ktoken¥4 / 百万¥16 / 百万流式 / 推理
qwen-max阿里百炼旗舰32Ktoken¥2.4 / 百万¥9.6 / 百万流式 / 多模态
qwen-plus阿里百炼推荐32Ktoken¥0.8 / 百万¥2 / 百万流式 / 多模态
qwen-turbo阿里百炼高速低价32Ktoken¥0.3 / 百万¥0.6 / 百万流式 / 多模态
qwen3-235b-a22b阿里百炼多模态旗舰128Ktoken¥2 / 百万¥8 / 百万流式 / 多模态 / 函数调用
qwen3-32b阿里百炼多模态128Ktoken¥1 / 百万¥4 / 百万流式 / 多模态 / 函数调用
qwen3-14b阿里百炼多模态128Ktoken¥0.5 / 百万¥2 / 百万流式 / 多模态 / 函数调用
qwen3-8b阿里百炼多模态轻量128Ktoken¥0.2 / 百万¥0.8 / 百万流式 / 多模态
qwen3-coder-plus阿里百炼代码模型128Ktoken¥3 / 百万¥12 / 百万流式 / 代码专用
glm-4.5智谱 AI国产旗舰·推理128Ktoken¥1 / 百万¥4 / 百万流式 / 推理 / 多模态
kimi/kimi-k2.5Moonshot长文本·推理128Ktoken¥1 / 百万¥4 / 百万流式 / 长文本 / 推理
baichuan4百川国产通用32Ktoken¥1 / 百万¥4 / 百万流式 / 多模态
minimax-text-01MiniMax国产通用32Ktoken¥1 / 百万¥4 / 百万流式

Image 图片生成模型

模型名厂商说明计费类型单价能力
wanx2.1-t2i-turbo阿里百炼通义万相 Turbo · 高速image¥0.4 / 张文生图 / 图生图 / 多种尺寸
wanx2.1-t2i-plus阿里百炼通义万相 Plus · 高质量image¥0.6 / 张文生图 / 图生图 / 多种尺寸
wanx2.2-t2i-plus阿里百炼通义万相 2.2 Plusimage¥0.8 / 张文生图 / 图生图 / 高清
wanx2.2-t2i-flash阿里百炼通义万相 2.2 Flash · 极速image¥0.3 / 张文生图 / 极速生成
flux-devFLUXFLUX 开发版image¥0.5 / 张文生图 / 高质量
flux-schnellFLUXFLUX 快速版image¥0.2 / 张文生图 / 极速生成

Video 视频生成模型

模型名厂商说明计费类型单价能力
wanx2.1-t2v-turbo阿里百炼通义万相视频 Turbosecond¥0.3 / 秒文生视频 / 图生视频
wanx2.1-t2v-plus阿里百炼通义万相视频 Plussecond¥0.6 / 秒文生视频 / 图生视频 / 高清
wan2.2-t2v-plus阿里百炼通义万相视频 2.2 Plussecond¥0.8 / 秒文生视频 / 图生视频 / 4K
Doubao-Seedance-2.0火山引擎豆包 Seedance 2.0 标准版token¥46 / 百万 Token文生视频 / 图生视频 / 视频生视频 / 音频
Doubao-Seedance-2.0-fast火山引擎豆包 Seedance 2.0 快速版token¥37 / 百万 Token文生视频 / 图生视频 / 视频生视频 / 音频
Doubao-Seedance-2.0-mini火山引擎豆包 Seedance 2.0 精简版token¥23 / 百万 Token文生视频 / 图生视频 / 视频生视频 / 音频
豆包视频模型说明

豆包 Seedance 系列视频模型按 Token 计费,支持图生视频、视频生视频等高级功能,详见 豆包视频生成文档

TTS 语音合成模型

模型名厂商说明计费类型单价能力
cosyvoice-v1阿里百炼CosyVoice 语音合成tts¥0.05 / 千字符多音色 / 多语言 / 情感合成
qwen3-tts-flash阿里百炼通义千问 TTS 快速版tts¥0.08 / 千字符多音色 / 多语言 / 极速合成

计费类型说明

计费类型适用能力计费方式计算公式
tokenChat 对话按 Token 数(百万)计费费用 = tokens / 1,000,000 × 单价
image图片生成按张数计费费用 = 生成数量 × 单价
second视频生成按秒数计费费用 = 视频时长(秒) × 单价
tts语音合成按字符数计费费用 = 字符数 / 10,000 × 单价

能力标签说明

  • 流式:支持 SSE 流式输出,可实现打字机效果
  • 多模态:支持图片输入(Vision),可进行图文理解
  • 函数调用:支持 Function Calling,可对接外部工具
  • 推理:支持深度推理,适用于复杂逻辑思考场景
  • 长文本:支持超长上下文窗口(128K+)
  • 代码专用:针对代码生成优化的模型

最佳实践

  • 日常对话推荐使用 deepseek-v4-proqwen-plus
  • 需要深度推理时推荐使用 deepseek-r1glm-4.5
  • 对速度要求高的场景推荐使用 qwen-turboflux-schnell
  • 代码生成场景推荐使用 qwen3-coder-plus
  • 所有模型均使用统一接口,切换模型仅需修改 model 参数