/v1/chat/completions
待官方通道联调
开放接口能力
仅展示已经实现的公开接口;模型须通过官方目录校验和最小真实调用后才会开放。
/v1/messages
待官方通道联调
模型目录
96 个国内官方模型已进入接入目录,逐款验证后开放调用。
deepseek-v4-pro
深度推理、代码生成与复杂分析
deepseek-v4-flash
低延迟对话、批量处理与智能助手
deepseek-v3.2
通用对话、推理与代码任务
glm-5.3
文本对话(轻量思考模式)
glm-5.2
企业问答、Agent 与长文本处理
glm-4.7
通用对话、代码与知识问答
glm-4.7-flash
高频对话、分类提取与轻量生成
glm-4.5-air
成本敏感的内容生成与智能助手
kimi-k3
文本对话(轻量思考模式)
kimi-k2.6
文本对话(非思考模式)
kimi-k2-thinking
复杂推理、研究分析与代码任务
moonshot-v1-128k
长文档解析、摘要与知识问答
qwen3.8-max
旗舰推理、代码与企业智能体
qwen3.8-plus
高质量通用对话与工具调用
qwen3.8-flash
低延迟、高并发文本任务
qwen3.7-max
复杂指令、推理与代码生成
qwen3.7-plus
通用生成、企业问答与 Agent
qwen3.5-plus
稳定通用文本生成与知识问答
doubao-seed-2-1-pro-260628
旗舰通用模型、推理与多轮对话
doubao-seed-2-1-pro-260915
文本对话(非思考模式)
doubao-seed-2-1-lite-260915
文本对话(非思考模式)
doubao-seed-2-1-turbo-260628
文本对话(非思考模式)
doubao-seed-2-0-pro-260428
复杂指令、企业问答与内容生成
doubao-seed-2-0-lite-260428
高频轻量对话与批量文本处理
doubao-seed-1-6-250615
深度思考、多模态理解与通用生成
doubao-seed-1-6-flash-250615
低延迟对话与视觉理解
ernie-5.0
原生全模态理解、推理与智能体规划
ernie-5.0-thinking-preview
深度推理、视觉理解与复杂规划
ernie-x1.1-preview
深度推理、工具调用与数学代码
ernie-4.5-turbo-128k
长文本生成、总结与企业问答
ernie-4.5-turbo-vl
图片理解、创作辅助与多模态问答
hy3-preview
复杂推理、代码与通用智能体
hunyuan-role-latest
角色对话、互动内容与人设保持
hy-mt2-pro
多语言文本翻译与本地化
hunyuan-a13b
高效推理与企业级文本任务
generalv3.5
中文问答、知识推理与内容生成
spark-x
深度推理、代码与复杂问题求解
MiniMax-M2.5
Agent、代码、工具调用与复杂任务
MiniMax-M2.1
通用对话、编程与办公场景
MiniMax-M2
文本生成、推理与智能助手
step-3.7-flash
高效推理、Agent 与代码任务
step-3.5-flash
高并发对话与内容生成
step-2-16k
通用文本生成与企业问答
Baichuan2-Turbo
通用对话、知识问答与内容创作
Baichuan2-Turbo-192k
超长文档阅读、总结与信息抽取
wan2.6-t2i
中文海报、商品图与视觉内容生成
wan2.6-t2v
文本生成短视频与分镜动态预览
doubao-seedance-2-0-260128
文生视频、参考图生视频与带声音视频生成
MiniMax-Hailuo-2.3
文本与首帧参考图生成视频
deepseek-flash
文本对话(非思考模式)
glm-5.3-flash
文本对话(轻量思考模式)
glm-5.3-flashx
对话、代码与图文问答
glm-5.1
代码与智能体任务
glm-5
代码与智能体任务
glm-5-turbo
代码与智能体任务
glm-4.7-flashx
文本对话(非思考模式)
glm-4.6
推理、代码与工具协作
glm-4.5-airx
对话与工具协作
glm-4-long
长文档问答与摘要
glm-4-flashx-250414
对话与批量文本处理
glm-4.5-flash
对话与内容生成
glm-4-flash-250414
对话与内容生成
glm-5v-turbo
图文问答与代码任务
glm-4.6v
图文问答与工具协作
glm-4.6v-flash
图文问答
glm-4.1v-thinking-flashx
图文推理
glm-4.1v-thinking-flash
图文推理
glm-4v-flash
图文问答
qwen-turbo
高性价比通用对话与批量文本处理
qwen3.7-flash
对话与批量文本处理
qwen3.6-max-preview
推理与代码任务
qwen3.6-plus
对话与工具协作
qwen3.6-flash
对话与批量文本处理
qwen3.5-flash
对话与批量文本处理
qwen3.5-397b-a17b
推理与代码任务
qwen3.5-122b-a10b
对话与工具协作
qwen3.5-27b
对话与工具协作
qwen3.5-35b-a3b
对话与工具协作
qwen3-max
推理与代码任务
qwen3-235b-a22b
对话与工具协作
qwen3-235b-a22b-thinking-2507
推理与代码任务
qwen3-235b-a22b-instruct-2507
对话与内容生成
qwen3-next-80b-a3b-thinking
推理与代码任务
qwen3-next-80b-a3b-instruct
对话与内容生成
qwen3-32b
对话与工具协作
qwen3-30b-a3b
对话与工具协作
qwen3-30b-a3b-thinking-2507
推理与代码任务
qwen3-30b-a3b-instruct-2507
对话与内容生成
qwen3-14b
对话与工具协作
qwen3-8b
对话与工具协作
qwen3-coder-plus
代码生成与工程任务
qwen3-coder-flash
代码生成与工程任务
qwen3-coder-next
代码生成与工程任务
qwen3-coder-480b-a35b-instruct
代码生成与工程任务
qwen3-coder-30b-a3b-instruct
代码生成与工程任务
qwen-long
长文档问答与摘要
透明的人民币计费
调用前预留服务余额,成功后按实际用量结算;失败、取消或确认超时后自动释放预留额度。充值申请到账后才增加余额。
按量使用
按公开模型与请求参数计费,控制台展示预计费用和最终流水。
失败释放
失败请求保留记录,同时在失败退款记录中显示退回金额。
企业审计
按月份查询用量、调用明细与账单,并可导出 CSV。
| 模型 | 计费方式 | 预计费用(人民币) |
|---|---|---|
deepseek-v4-pro | 按 Token 用量 | 联调后公布 |
glm-5.3 | 按 Token 用量 | 联调后公布 |
kimi-k3 | 按 Token 用量 | 联调后公布 |
正式价格发布前不会开放生产调用;失败或取消的请求不扣除服务余额。
从第一把 API Key 开始
注册后可在在线调试中验证模型,再把同一套请求接入业务系统。