Integrated model providers
从文本推理到视频生成,一个平台统一选择
按模型能力、调用成本、稳定性和使用场景选择线路。热门模型会持续维护,不稳定线路会被降级。
OpenAI
gpt-5.6-sol
$5 / 1M 输入 tokens
Anthropic
claude-opus-5
$5 / 1M 输入 tokens
Moonshot AI
kimi-k3
$20 / 1M 输入 tokens
gemini-3.6-flash
$1.5 / 1M 输入 tokens
视频生成
doubao-seedance-2.0 / veo3.1
$0.508 / 次
图像生成
gpt-image-2 / nano-banana-pro
$0.12 / 次
让 AI 编程工具一次读懂你的 API 接入方式
为 Claude Code、Codex、Cursor、ChatGPT、Windsurf 和自建 Agent 准备标准化上下文。复制提示词即可让模型按 WanAPIs 的 endpoint、模型名和任务接口生成代码;也兼容 ccswitch / cc-switch 一键切换接入。
# WanAPIs API 使用约定 Base URL: https://api.wanapis.com/v1 兼容 OpenAI SDK: - chat.completions.create - responses.create - embeddings.create 推荐模型: - 代码 / Agent: gpt-5.5, claude-sonnet-4.7 - 中文推理: deepseek-v4-pro, kimi-k2 - 高速低价: gemini-3.5-flash 要求: 1. 不要硬编码 API Key 2. 对长任务使用异步任务接口 3. 记录 request id 方便排查
三步把现有应用迁移到 WanAPIs
保留你熟悉的 OpenAI SDK 和请求格式,把模型选择、路由和成本控制交给网关。
创建 API Key
注册后进入控制台生成密钥,可按项目设置分组、额度和可用模型。
替换 base_url
保留现有 OpenAI SDK,只把 baseURL 指向 https://api.wanapis.com/v1。
上线并观察
在日志面板查看 token、费用、渠道、耗时和失败原因,随时调路由策略。
01import OpenAI from 'openai';0203const client = new OpenAI({04 apiKey: process.env.WANAPIS_API_KEY,05 baseURL: 'https://api.wanapis.com/v1',06});0708const response = await client.chat.completions.create({09 model: 'deepseek-v4-pro',10 messages: [{ role: 'user', content: '解释一下 RAG 的核心流程' }],11});不仅是转发,而是面向生产环境的 AI API 网关
从开发调试到生产监控,把多模型接入中最容易出问题的部分收敛在一个控制台里。
全球模型统一入口
一个 endpoint 覆盖文本、推理、代码、图片、视频和语音模型,不再维护多套鉴权和 SDK。
生产级失败转移
多渠道健康检查、自动降级、分组路由和重试策略,让上游抖动不直接暴露给业务。
透明计费与额度
按模型、分组、输入、输出、缓存命中分别记录,方便你对账、控成本和分发额度。
国内链路优化
Cloudflare Tunnel 与后端路由组合,减少不可达、超时和跨境线路波动带来的调用失败。
OpenAI 兼容
支持 OpenAI Chat Completions、Responses 以及常用客户端,现有项目改 base_url 即可迁移。
异步任务托管
视频、图像、Midjourney 等长任务由 WanAPIs facade 承接,避免公网入口的 100 秒超时限制。
不只是一个 endpoint,还有一整个控制台
调模型、看账单、领优惠都在同一个后台完成,不用先写代码才能开始。
常见问题
这里覆盖接入前最常见的问题。更细的模型参数、任务接口和错误码请看文档。
是否兼容 OpenAI SDK?
兼容常用的 OpenAI Chat Completions、Responses 和 Embeddings 调用方式。大多数项目只需要替换 base_url 和 API Key。
模型列表会更新吗?
会。我们会根据上游稳定性、成本和用户需求持续加入 GPT、Claude、Gemini、DeepSeek、Kimi、Qwen、图像和视频模型。
如何避免上游不稳定?
WanAPIs 后台可以为同一模型配置多条渠道,通过优先级、分组和自动重试做失败转移。
计费是否透明?
控制台会记录每次请求的 prompt tokens、completion tokens、缓存命中、模型倍率、分组倍率和最终扣费。
能用于 Claude Code、Codex、Cursor 或自建 Agent 吗?
可以。只要工具支持 OpenAI 兼容 endpoint 就能接入 WanAPIs:Claude Code、Codex、Cursor、Windsurf、Cline,以及 ccswitch / cc-switch 这类切换工具都能把 base_url 指向 WanAPIs。长上下文和推理模型建议单独配置限额。
你们会用我的请求数据训练模型吗?
不会。WanAPIs 只做转发,不以训练为目的留存您的 prompt 或 completion。同步调用的请求内容在转发后即从内存释放;调用日志只记录用量元数据(模型、token 数、耗时、扣费),不记录对话正文。例外是异步生图/生视频:任务需要跨轮询跟踪,请求(含提示词)会在进行中临时落盘,任务结束即清除、最长保留 7 天。另请注意上游厂商主要位于境外,调用时 prompt 会发送至境外服务器处理。完整说明见隐私政策与《数据与安全》页。
支持哪些支付方式?可以开发票吗?
支付宝(人民币充值)与信用卡(经 Creem,美元结算)。所有充值记录可在控制台账单页查询。如需发票或对公汇款,请联系 [email protected] 说明需求。
有速率限制吗?稳定性怎么保障?
目前不对 API 调用设固定的 RPM / TPM 上限,实际并发主要受上游渠道容量约束。稳定性上,同一模型会配置多条来自不同上游的渠道,遇到 503、超时或上游长时间无响应会自动切换;流式请求另有「等响应头」超时保护,避免上游黑洞让请求长时间挂起。每次请求实际走了哪条渠道、是否发生过转移,都能在控制台日志里查到。
API Key 安全吗?万一泄露怎么办?
任何 Key 都可以在控制台随时重置或删除,立即失效。更重要的是可以提前把风险面收窄:每个 Key 都能单独设置额度上限、可调用模型白名单、IP 白名单和有效期。建议按项目分别创建 Key,这样即使某个 Key 泄露,损失也被额度和白名单框住。